¿Qué son los prompts para video con AI?
Un prompt para video con AI es un brief corto de toma que le indica al modelo qué aparece, qué se mueve y cómo se comporta la cámara.
Los modelos de texto a video crean una secuencia de cuadros a partir de tus palabras. Por eso, el prompt debe describir tanto la escena visual como el cambio que ocurre desde el primer cuadro hasta el último.
Los prompts de imagen se enfocan en un solo resultado: sujeto, entorno, composición, iluminación y estilo. Los prompts para video con AI suman momentos de acción, movimiento de cámara, ritmo, duración y, a veces, diálogo o sonido.
Un buen prompt de video no tiene que ser largo. Tiene que estar bien ordenado para que el modelo entienda una toma limpia a la vez.
| Dimensión | Prompt de imagen | Prompt de video |
|---|---|---|
| Función principal | Describir un cuadro fijo | Describir una escena y cómo cambia con el tiempo |
| Ingredientes clave | Sujeto, entorno, estilo, composición, iluminación | Sujeto, acción, escena, ángulo de cámara, movimiento de cámara, tiempo |
| La parte difícil | Precisión visual y composición | Claridad del movimiento y consistencia temporal |
| Ajustes | Relación de aspecto, tamaño, semilla, calidad | Duración, FPS, relación de aspecto, resolución, semilla, material de referencia |
| Mejor forma del prompt | Descripción visual | Brief de toma |
La gramática de prompt para video con AI que sí funciona
La estructura más confiable es: sujeto, momentos de acción, escena, ángulo de cámara, movimiento de cámara, iluminación, tiempo, sonido y, al final, ajustes.
Este orden funciona porque separa lo que el espectador ve de lo que cambia. También mantiene los controles técnicos fuera del texto narrativo, donde algunas herramientas podrían pasarlos por alto.
En la mayoría de las herramientas de texto a video, escribe de forma natural. Usa sustantivos y verbos claros. Cambia “video cool de producto” por un plan real de toma: qué producto es, dónde está, qué se mueve, qué hace la cámara y cómo termina el clip.
| Atributo | Qué especificar | Ejemplo |
|---|---|---|
| Sujeto | La persona, objeto, animal o escena principal | Un tenis para correr negro mate sobre un pedestal oscuro |
| Momentos de acción | Una o dos acciones con tiempo definido | El polvo flota, el tenis gira ligeramente |
| Escena o contexto | Lugar, hora, clima, fondo | Estudio minimalista con un haz de luz estrecho |
| Ángulo de cámara | Encuadre y punto de vista | Primer plano en ángulo bajo, plano medio a la altura de los ojos, plano general de apertura |
| Movimiento de cámara | Un solo movimiento claro | Acercamiento lento, toma fija, seguimiento en mano, desplazamiento suave a la izquierda |
| Iluminación y paleta | Fuente de luz, color, contraste, atmósfera | Contraluz frío, brillo cálido de lámpara, luz suave de ventana por la mañana |
| Tiempo del movimiento | Ritmo y momento final | Revelación en el último segundo, cuatro pasos lentos, solo movimiento sutil |
| Diálogo o sonido | Solo si la herramienta lo permite | Murmullo de ciudad al fondo, piano suave, diálogo entre comillas |
| Ajustes | Controles fuera del prompt | 6 segundos, 24 FPS, 16:9, 1080p, semilla 4812 |
¿Cuál es la regla #1 para escribir mejores prompts de video con AI?
Usa una acción clara del sujeto y un movimiento claro de cámara por toma.
Los modelos de video pueden manejar detalle, pero demasiadas partes en movimiento generan confusión. Si el sujeto corre, saluda, gira, habla y además la cámara sube, hace zoom, rota y corta, el clip puede desviarse o verse caótico.
Trata cada generación como una toma, no como una película completa. Si necesitas una secuencia, escribe prompts separados para cada toma y conserva las mismas palabras para el sujeto, el estilo y la iluminación.
Esta regla es especialmente útil en clips cortos de menos de 10 segundos. Una acción simple con un movimiento de cámara simple suele verse más pulida que una escena saturada con cinco ideas compitiendo.
- Bien: “El chef coloca una tarta sobre la barra mientras la cámara se acerca lentamente.”
- Riesgoso: “El chef cocina, habla, emplata el postre, se da vuelta y la cámara gira por toda la cocina.”
- Bien: “Un zorro da cuatro pasos sobre la nieve mientras la cámara lo acompaña de lado.”
- Riesgoso: “El zorro corre, salta, rueda, aúlla y la cámara corta entre tres ángulos.”
Cómo escribir un prompt de texto a video paso a paso
Empieza por el objetivo de la toma y luego construye el prompt por capas. Cada capa debe responder una pregunta práctica de producción.
Mantén simple la primera versión. Genera algunos resultados, elige el más cercano y después ajusta una sola variable a la vez: acción, cámara, iluminación, duración o semilla.
Si un clip falla, no agregues un párrafo entero de correcciones de golpe. Simplifica la toma, deja la cámara fija si hace falta y reconstruye desde una base limpia.
- 1. Nombra el sujeto: “Una botella de agua de acero inoxidable.”
- 2. Agrega una acción: “Se forma condensación y una gota baja por el costado.”
- 3. Ubícalo en una escena: “Sobre piedra negra mojada en un estudio oscuro.”
- 4. Define el encuadre: “Primer plano cerrado de producto, centrado y con espacio para texto a la izquierda.”
- 5. Elige un movimiento de cámara: “Solo acercamiento lento.”
- 6. Añade iluminación, paleta y ajustes: “Contraluz frío, reflejo cálido, 5 segundos, 16:9, 24 FPS.”
¿Qué motor de video con AI conviene usar?
Elige según tu flujo de trabajo: APIs alojadas para calidad, herramientas gestionadas para rapidez, modelos de pesos abiertos para control y Vynzo si quieres un estudio simple todo en uno.
No todos los modelos se comportan igual. Algunos responden mejor al lenguaje cinematográfico de tomas, otros ofrecen campos de prompt negativo, otros se enfocan en videos de negocio y otros requieren configuración técnica.
Si quieres calidad sin instalar modelos, rentar GPUs ni saltar entre seis apps, Vynzo es la ruta práctica. Empieza en Vynzo Studio en /studio, o explora herramientas creativas enfocadas en /tools.
| Herramienta | Acceso | Mejor uso | Control y calidad | Notas de velocidad y costo |
|---|---|---|---|---|
| Google Veo | API alojada | Texto a video cinematográfico de alto nivel, con buena guía de cámara, lente, acción e iluminación | Alta calidad y controles estructurados; los ajustes incluyen duración del clip, relación de aspecto, FPS y opciones de resolución | Fácil de usar mediante acceso alojado; se paga por uso y aplican los términos de la plataforma |
| Adobe Firefly Video | API alojada | Flujos de video para marca y ecosistema Adobe | Funciona bien con tipo de toma, personaje, acción, ubicación y estética; ofrece ajustes de relación de aspecto y resolución | Buena opción para equipos que ya trabajan en Adobe; aplican precios alojados y reglas de uso |
| Synthesia | API alojada | Capacitación, onboarding, explicativos y comunicación empresarial | Ideal para guion, audiencia, objetivo, plantilla, voz y entrega con avatar, más que para generar tomas cinematográficas | Rápido para video corporativo; menos adecuado para tomas abiertas con estilo de cine |
| Runway | Herramienta gestionada para creadores | Trabajo creativo de texto a video e imagen a video | Prompts claros en lenguaje natural; fuerte enfoque en visuales y movimiento, además de prompts solo de movimiento para imagen a video | Buen equilibrio entre calidad y facilidad; no requiere alojamiento propio |
| Pika | Herramienta gestionada para creadores | Clips cortos rápidos, ideas para redes, transformaciones y movimiento de primer a último cuadro | Texto del prompt más campos como prompt negativo, semilla, resolución, duración y relación de aspecto | Rápida y amigable para creadores; buena para iterar |
| Luma | Herramienta gestionada para creadores | Clips cinematográficos cortos y animación basada en referencias | Los mejores prompts describen sujeto, acción, cámara, movimiento, atmósfera, entorno y estilo | Útil para idear rápido sin configurar modelos |
| Wan | Pesos abiertos | Equipos que quieren ejecutar, modificar o ajustar modelos de video por su cuenta | Máxima personalización con pipelines autoalojados; la calidad depende del tamaño del modelo, el flujo y el hardware | Tú te encargas de GPUs, instalaciones, actualizaciones, almacenamiento y solución de problemas |
| Vynzo | Estudio todo en uno | Creadores que quieren generar imágenes y video en un solo espacio limpio | Ejecuta motores potentes por ti, para que puedas escribir prompts, generar, revisar y refinar sin configurar nada | Creado para velocidad y foco: sin instalaciones, sin GPUs, sin saltar entre herramientas |
¿Cómo mantener consistentes personajes, estilo y movimiento?
La consistencia nace de reutilizar los mismos descriptores, mantener estable la iluminación y cambiar una sola cosa a la vez.
Usa las mismas palabras para el mismo sujeto en todas las tomas. Si tu primer prompt dice “un fundador con saco azul marino y lentes redondos”, no lo cambies a “un empresario con chaqueta azul” en la siguiente toma, a menos que busques variación.
La iluminación y la paleta también funcionan como anclas. Si quieres que la escena se sienta conectada, una “luz suave de ventana con relleno cálido de lámpara” debería mantenerse igual en los clips relacionados.
Cuando una plataforma permite imágenes de referencia, recursos de personaje, semillas o cuadros iniciales y finales, úsalos. Esos controles ayudan al modelo a recordar la apariencia mientras tu prompt se enfoca en la acción y la cámara.
- Reutiliza exactamente las mismas palabras para el sujeto en todas las tomas.
- Mantén estables la ropa, la paleta de color y las frases de iluminación.
- Usa imágenes de referencia cuando importen la identidad o la forma del producto.
- Evita cambiar el estilo de cámara y la acción del sujeto en la misma revisión.
- Registra prompt, semilla, duración, relación de aspecto y versión del modelo para trabajos repetibles.
Los ajustes van fuera del texto del prompt
Duración, FPS, relación de aspecto, resolución, semilla y material de referencia suelen ser ajustes, no palabras mágicas.
Muchas herramientas de video muestran estos controles en la interfaz o en la API. Si escribes “hazlo de 10 segundos” dentro del prompt, pero dejas la duración en 4 segundos, normalmente gana el ajuste.
Usa el prompt para la dirección creativa y los ajustes para el control de producción. Así es más fácil comparar pruebas y detectar si el problema viene de la redacción o de la configuración.
Los prompts negativos dependen de cada herramienta. Pika ofrece un campo de prompt negativo, mientras que varias herramientas de video funcionan mejor cuando describes el resultado deseado en términos positivos.
| Control | Mejor lugar | Por qué importa |
|---|---|---|
| Duración | Ajustes | Controla la duración del clip y el ritmo |
| FPS | Ajustes | Afecta la sensación de reproducción y las especificaciones de exportación |
| Relación de aspecto | Ajustes | Coincide con formatos de plataforma como 16:9, 9:16 o 1:1 |
| Resolución | Ajustes | Controla el tamaño y el detalle del resultado |
| Semilla | Ajustes | Ayuda a reproducir o variar resultados |
| Imagen de referencia o cuadro clave | Carga o ajustes | Ancla el sujeto, el estilo o el primer cuadro |
| Diálogo o sonido | Prompt, si se admite | Indica a las herramientas con audio qué decir o reproducir |
| Movimiento de cámara | Prompt | Define cómo se mueve el espectador dentro de la toma |
Ejemplos de prompts para video con AI que puedes adaptar
Los mejores ejemplos suenan como pequeñas notas de producción. Cada uno tiene una acción del sujeto, un movimiento de cámara, un entorno claro y una atmósfera definida.
Úsalos como punto de partida y luego cambia una sola variable a la vez. Por ejemplo, prueba la misma toma de producto con un acercamiento lento y después con cámara fija, manteniendo todo lo demás igual.
En Vynzo puedes redactar estos prompts, generar clips, comparar versiones y mantener tu trabajo de imagen y video dentro de un mismo estudio.
| Caso de uso | Prompt | Ajustes sugeridos |
|---|---|---|
| Hero de producto | Un tenis para correr negro mate descansa sobre un pedestal oscuro en un estudio minimalista. Polvo fino flota dentro de un haz de luz estrecho. La cámara hace un acercamiento lento mientras el tenis gira ligeramente y un contraluz frío revela la textura del tejido. Estética de comercial deportivo premium. | 5 segundos, 16:9, 24 FPS, 720p o 1080p |
| Clip de comida para redes | Una chef pastelera coloca una tarta brillante de fresa sobre una barra de mármol. Primer plano a la altura de los ojos. La cámara se acerca lentamente mientras sube vapor de un espresso desenfocado al fondo. Luz natural de ventana por la mañana, paleta cálida crema y rojo fresa. | 4 segundos, 9:16, 24 FPS, 1080p |
| Teaser de viaje | Plano general de apertura de un pueblo sobre acantilados frente al mar al amanecer. Barcos pesqueros se deslizan abajo. La cámara avanza suavemente desde arriba mientras la luz cálida se extiende sobre muros en tonos pastel. Cinematográfico y esperanzador. | 6 segundos, 16:9, 24 FPS, 1080p |
| Bumper animado de marca | Primer plano de un logotipo circular luminoso formado por partículas finas de oro. Las partículas giran hacia el centro, se fijan en un emblema limpio y luego emiten un pulso suave sobre un fondo negro mate. Estilo de motion design premium. | 5 segundos, 1:1 o 16:9, 24 FPS, 1080p |
Problemas comunes y soluciones rápidas
La mayoría de los clips fallidos vienen de prompts vagos, movimiento saturado, descriptores inestables o ajustes que no coinciden.
Cuando el resultado se ve “bonito, pero no es”, agrega detalles concretos de la escena en lugar de palabras amplias de atmósfera. Cuando el movimiento se ve desordenado, elimina acciones y movimientos de cámara hasta que la toma sea fácil de leer.
Para trabajo de producción, revisa también derechos y privacidad antes de subir material de referencia. Usa recursos que tengas permiso de usar, pide consentimiento a personas identificables y no incluyas información confidencial en flujos de consumo salvo que los términos de tu proveedor lo permitan.
| Problema | Causa probable | Solución |
|---|---|---|
| Clip genérico | Al prompt le faltan sujeto, escena y acción concretos | Agrega sujeto exacto, entorno, ángulo de cámara, iluminación y momento final |
| Movimiento caótico | Demasiadas acciones o movimientos de cámara | Reduce a una acción y un movimiento de cámara |
| El personaje cambia entre clips | Los descriptores varían de una toma a otra | Reutiliza las mismas palabras y usa referencias cuando la herramienta lo permita |
| El texto o las etiquetas se ven mal | El copy no se indicó con suficiente claridad | Pon el texto exacto entre comillas y mantén un diseño simple |
| La duración del clip es incorrecta | El ajuste de duración no coincide con el prompt | Configura la duración en la herramienta, no solo en el texto |
| El resultado varía demasiado | La semilla o los ajustes cambiaron durante las pruebas | Bloquea la semilla y cambia una variable a la vez |
