Generador de prompts de video Veo: cómo escribir prompts efectivos para Veo
Esta guía te ofrece un sistema completo para usar un veo-video-prompt-generator, de modo que salgas con plantillas de prompts, desgloses escenario por escenario y una lista de comprobación de errores que produzca resultados consistentes y de alta calidad en Veo 3 y Veo 3.1.
Ya sea que estés generando un reel de viajes cinematográfico, un anuncio de producto o un cortometraje con personajes, la misma arquitectura central de prompts se aplica. Al final, sabrás exactamente cómo estructurar cada prompt que introduzcas en Veo.
Antes de escribir una sola palabra, comprende qué interpreta Veo en realidad. Veo es un modelo de difusión de video semántico, lo que significa que interpreta los prompts como una descripción holística de la escena en lugar de una lista de etiquetas. Esa distinción cambia la forma en que escribes.
Los seis pilares del prompt
Cada prompt efectivo de Veo contiene alguna combinación de estos seis elementos:
| Pilar | Qué controla | Valor de ejemplo |
|---|---|---|
| Sujeto | Quién o qué es el foco visual | "Una botánica plateada de unos 50 años" |
| Acción / Movimiento | Qué ocurre, cómo se mueve | "gira lentamente un terrario de vidrio entre sus manos" |
| Entorno | Ubicación, hora del día, clima | "dentro de un invernadero soleado a la hora dorada" |
| Cámara | Tipo de plano, movimiento, sensación de lente | "primer plano, poca profundidad de campo, deriva con cámara al hombro" |
| Ambiente / Atmósfera | Tono emocional, paleta de color | "tonos ámbar cálidos, tranquilo y contemplativo" |
| Pista de audio (Veo 3+) | Sonido ambiental, diálogos, música | "lluvia suave sobre el vidrio, zumbido ambiental bajo" |
Veo 3 y Veo 3.1 introdujeron generación de audio nativo: el pilar de Pista de audio es exclusivo de estas versiones y no debe dejarse en blanco si quieres un diseño de sonido coherente.
Parámetros clave de generación
| Parámetro | Rango recomendado | Notas |
|---|---|---|
| Longitud del prompt | 40–120 palabras | Muy corto = vago; muy largo = instrucciones contradictorias |
| Duración del plano | 5–16 segundos | Los clips más largos necesitan indicaciones explícitas de ritmo en el prompt |
| Relación de aspecto | 16:9 / 9:16 / 1:1 | Adáptala a tu plataforma de distribución |
| Movimiento de cámara | Preferible un movimiento nombrado | "dolly in", "arc left", "static locked-off" |
| Espacio negativo | Úsalo con moderación | Veo maneja los negativos de forma menos fiable que los modelos de imagen |
Puedes explorar plantillas listas para usar y ejemplos de la comunidad directamente en la biblioteca de prompts de Veo de PixMind, una referencia útil antes de empezar a construir los tuyos propios.
El objetivo
Producir un plano de naturaleza al estilo BBC, con una fuerte sensación de escala y atmósfera.
✅ Plantilla de prompt de ejemplo
A lone Arctic fox trots across a vast frozen tundra at blue hour,
its white coat catching the faint violet light of the horizon.
Camera: wide establishing shot slowly pulling back via drone,
revealing endless ice plains stretching to the edge of frame.
Mood: silent, vast, awe-inspiring.
Audio: distant wind howl, soft crunch of snow underfoot.
Cinematic color grade, 24fps film look.
Caso práctico
Una creadora de contenido de viajes usó esta estructura para generar una apertura de 10 segundos para una serie documental. El ajuste clave fue añadir "slowly pulling back via drone": sin un movimiento de cámara explícito, Veo recurría por defecto a un plano abierto estático que resultaba plano. Añadir la instrucción de movimiento creó de inmediato la sensación de escala que la escena necesitaba.
⚠️ Advertencia de error
No escribas "hermoso paisaje" como descriptor independiente. Es demasiado abstracto para que Veo pueda actuar sobre ello. Sustituye los adjetivos vagos por datos visuales concretos: dirección de la luz, temperatura de color y un movimiento de cámara nombrado. "Hermoso" no significa nada; "luz violeta atrapando cristales de escarcha con profundidad a f/2.8" lo significa todo.
El objetivo
Generar un plano hero de producto pulido de 8–12 segundos, adecuado para anuncios sociales o e-commerce.
✅ Plantilla de prompt de ejemplo
A matte black ceramic coffee mug sits on a weathered oak table
in a minimalist Scandinavian kitchen.
Steam rises slowly from the surface.
Camera: tight macro shot, slow push-in, rack focus from table grain
to the mug's rim.
Lighting: soft diffused morning light from a large window camera-left.
Mood: calm, premium, unhurried.
Audio: quiet ambient kitchen sounds, faint birdsong outside.
Color palette: warm neutrals, deep blacks, cream whites.
Caso práctico
Una marca de e-commerce probó esta plantilla para un servicio de suscripción de café. El detalle crítico fue "rack focus from table grain to the mug's rim": esta única instrucción de cámara le indicó a Veo que animara el enfoque en lugar de generar un clip con sensación estática. El resultado fue un clip de 9 segundos con apariencia apta para emisión sin postproducción.
Para casos de uso más profundos de video de e-commerce, la página de casos de uso de Veo de PixMind tiene ejemplos específicos por escenario que vale la pena guardar.
⚠️ Advertencia de error
Evita colocar dos sujetos competidores en un plano de producto. Si escribes "una taza, un libro y una vela sobre una mesa", Veo intentará destacar los tres y la composición se volverá desordenada. Elige un objeto principal y trata todo lo demás como entorno de apoyo.
El objetivo
Generar una escena corta con dos personajes intercambiando líneas habladas, aprovechando la generación de audio nativo de Veo 3.
✅ Plantilla de prompt de ejemplo
Two young women sit across from each other at a small Paris café table,
afternoon light filtering through lace curtains.
Character A (brunette, 20s, wearing a yellow dress) leans forward and says:
"Do you ever feel like we're living someone else's story?"
Character B (redhead, 20s, green jacket) smiles softly and replies:
"Every single day."
Camera: over-the-shoulder two-shot, then cuts to close-up reaction.
Audio: ambient café noise, soft French accordion in background.
Mood: melancholic but warm, indie film aesthetic.
Caso práctico
Un creador de cortometrajes usó esta estructura para prototipar una escena de diálogo antes de la producción en vivo. El descubrimiento más importante: las líneas de diálogo deben escribirse entre comillas con atribución de speakers. Sin atribución, Veo a veces fusionaba ambas voces en una sola o generaba movimientos de labios desincronizados. El etiquetado explícito "Character A says:" resolvió esto.
⚠️ Advertencia de error
Mantén el diálogo en 1–2 líneas cortas por personaje y por clip. La sincronización de audio de Veo 3 es sólida en intercambios breves, pero se degrada notablemente en monólogos más largos. Para escenas de diálogo extendidas, genera varios clips cortos y únelos en postproducción.
Sección V: Escenario: secuencia de acción y deportes
El objetivo
Crear un clip dinámico y de alta energía: un skater, atleta o intérprete en movimiento.
✅ Plantilla de prompt de ejemplo
A young skateboarder in a red hoodie executes a kickflip
on a sun-drenched Los Angeles street court, mid-afternoon.
Camera: low-angle tracking shot following the board,
then a slow-motion freeze-frame at peak trick height.
Motion: fast approach, explosive jump, brief 120fps slow-motion at apex.
Mood: energetic, free, urban summer.
Audio: skateboard wheels on concrete, crowd cheer, hip-hop beat drop.
Color grade: high contrast, saturated warm tones.
Caso práctico
Una marca de ropa deportiva usó esta plantilla para una campaña en Instagram Reels. El avance fue la instrucción "brief 120fps slow-motion at apex": le indicó a Veo que cambiara el ritmo temporal a mitad del clip, creando una pausa dramática que destacaba el producto (la sudadera) en el momento de máximo impacto visual. Sin esta indicación de ritmo, el clip se reproducía a velocidad uniforme y resultaba poco destacable.
⚠️ Advertencia de error
No pidas múltiples trucos en un solo clip. "Un skater hace un kickflip, luego un heelflip, luego un grind en una baranda" producirá una secuencia de movimiento confusa. Una acción por clip, ejecutada de forma limpia, siempre supera a un prompt con múltiples trucos.
Sección VI: Escenario: bucle de arte abstracto o generativo
El objetivo
Generar un visual abstracto en bucle continuo, ideal para fondos, visualizadores de música o pantallas ambientales.
✅ Plantilla de prompt de ejemplo
An infinite fluid simulation of deep indigo and gold ink
slowly blooming and dissolving in water.
No identifiable objects or figures.
Camera: static overhead macro view, perfectly centered.
Motion: slow, continuous, organic expansion and contraction — loop-ready.
Mood: meditative, hypnotic, timeless.
Audio: low drone, 40Hz binaural hum, no music.
Duration cue: designed to loop seamlessly at 8 seconds.
Caso práctico
Un productor musical usó esto para un canal ambiental de YouTube. Las adiciones esenciales fueron "No identifiable objects or figures" y "loop-ready": sin ellas, Veo introducía una mano humana o un recipiente reconocible en el plano del fluido, y el clip tenía un corte visual brusco al final que rompía el bucle. Tanto la guía negativa como la instrucción de bucle resultaron necesarias.
⚠️ Advertencia de error
En los prompts abstractos, el lenguaje vago en realidad importa más, no menos. "Algo hermoso y fluido" producirá resultados inconsistentes entre generaciones. Ancla tu prompt abstracto con nombres de color específicos, un tipo de movimiento nombrado (simulación de fluidos, deriva de partículas, crecimiento de cristales) y una posición de cámara definida.
Sección VII: Escenario: atmósfera de drama histórico o de época
El objetivo
Evocar una era histórica específica con textura y ambiente visuales auténticos, sin necesidad de diálogo.
✅ Plantilla de prompt de ejemplo
A Victorian-era London street at dusk, 1880s.
Gas lamps flicker to life along a cobblestone lane
as a horse-drawn carriage passes through light fog.
Camera: medium wide shot, static, slightly elevated angle as if from a second-floor window.
Mood: atmospheric, melancholic, Dickensian.
Lighting: warm amber gas lamp glow against cold blue dusk sky.
Audio: horse hooves on cobblestones, distant church bell, light rain.
Film grain texture, desaturated with amber highlights.
Caso práctico
Un autor de ficción histórica usó esto para crear un reel atmosférico de tráiler de libro. La frase "as if from a second-floor window" fue la instrucción de cámara clave: le dio a Veo una posición de observador específica que ancló el plano e impidió que la cámara descendiera al nivel de la calle, lo cual habría eliminado la sensación de distancia cinematográfica que la escena requería.
⚠️ Advertencia de error
No mezcles referencias de épocas. Escribir "Londres victoriano con letreros de neón" o "calle de los años 80 del siglo XIX con coches modernos de fondo" produce resultados anacrónicos difíciles de corregir en un único prompt. Si quieres una anacronía intencional, hazla explícita: "Londres alternativo steampunk donde la arquitectura victoriana coexiste con vallas publicitarias eléctricas brillantes."
Sección VIII: Marco general de prompts y lista de comprobación de errores
La fórmula universal de prompts de Veo
Usa esta estructura como punto de partida predeterminado para cualquier generación con Veo:
[SUBJECT + DEFINING DETAIL]
[ACTION / MOTION DESCRIPTION]
[ENVIRONMENT: location, time of day, weather]
[CAMERA: shot type + movement]
[LIGHTING: source, direction, color temperature]
[MOOD / COLOR PALETTE]
[AUDIO: ambient sound + music + dialogue if any]
[TECHNICAL NOTE: fps, grain, aspect ratio if needed]
No todos los campos son obligatorios para cada clip, pero cuantos más campos completes, más control mantendrás sobre el resultado.
Guía de longitud del prompt
| Tipo de clip | Longitud ideal del prompt | Pilares prioritarios |
|---|---|---|
| Bucle abstracto | 40–60 palabras | Movimiento, cámara, ambiente |
| Plano hero de producto | 60–80 palabras | Sujeto, iluminación, cámara |
| Naturaleza / paisaje | 60–90 palabras | Entorno, cámara, audio |
| Escena con personajes | 80–120 palabras | Sujeto, acción, audio |
| Acción / deportes | 70–100 palabras | Acción, cámara, ambiente |
| Drama de época | 70–100 palabras | Entorno, iluminación, audio |
Lista maestra de comprobación de errores
Pasa cada prompt por esta lista antes de generar:
- [ ] Sin adjetivos vagos en solitario: sustituye "hermoso", "asombroso", "impresionante" por datos visuales concretos
- [ ] Un sujeto principal por clip: evita protagonistas competidores en el encuadre
- [ ] El movimiento de cámara está nombrado: "dolly in", "arc right", "static", no solo "cámara en movimiento"
- [ ] Pista de audio incluida (Veo 3 / 3.1): incluso "silencio ambiental" es una instrucción válida
- [ ] No más de un momento de acción por clip: los prompts con múltiples acciones producen movimiento confuso
- [ ] Las referencias de época o estilo son internamente coherentes: sin anacronismos accidentales
- [ ] El diálogo está atribuido y entre comillas: "Character A says: 'línea aquí'"
- [ ] La intención de bucle es explícita: si necesitas un bucle continuo, di "loop-ready" o "designed to loop"
- [ ] La longitud del prompt está dentro del rango: menos de 40 palabras suele ser demasiado escaso; más de 130 arriesga contradicción
Cuándo usar una herramienta generadora de prompts
Escribir prompts desde cero cada vez es lento. Un veo-video-prompt-generator dedicado, como el disponible en PixMind, te permite introducir un concepto de escena en lenguaje natural y recibir un prompt estructurado y completo en todos sus pilares, listo para pegar directamente en Veo.
Esto es especialmente útil cuando:
- Eres nuevo en Veo y no estás seguro de a qué términos de cámara responde
- Necesitas generar por lotes múltiples variaciones de escena rápidamente
- Estás adaptando un prompt de imagen a un prompt de video y necesitas añadir capas de movimiento, cámara y audio
La biblioteca de prompts de Veo de PixMind incluye prompts curados de la comunidad organizados por caso de uso: una forma rápida de calibrar tu propio estilo de prompt contra ejemplos probados.
Para un recorrido completo por las capacidades y los ajustes de generación de Veo 3.1, la guía completa de Veo 3.1 cubre los matices específicos del modelo que afectan cómo se interpretan los prompts. Y si quieres comparar Veo con otros modelos de video líderes antes de comprometerte con un flujo de trabajo, la guía del generador de video Veo 3 es una referencia técnica sólida.
Sección IX: Conclusión
Escribir prompts efectivos para Veo no se trata de escribir más, sino de escribir con precisión en los pilares correctos. Sujeto, acción, entorno, cámara, ambiente y audio: completa estos seis campos de forma deliberada, mantén tu prompt internamente coherente y evita los errores comunes anteriores.
La diferencia entre un video con IA genérico y un clip con calidad de emisión suele reducirse a dos o tres palabras específicas: el nombre del movimiento de cámara, la dirección de la luz, la textura del audio. Esos detalles no cuestan nada añadir y lo cambian todo en el resultado.
Empieza con la fórmula universal, prueba un escenario a la vez y usa los casos de uso de Veo de PixMind como biblioteca de referencia a medida que crece tu vocabulario de prompts. Cuanto más precisamente describas el mundo que quieres ver, con más fiabilidad lo construirá Veo.



