¿Qué es crear prompts de AI?
Crear prompts de AI es darle instrucciones claras a un modelo para que pueda generar, editar o transformar un resultado.
En herramientas de imagen y video, el prompt funciona como el brief creativo: le dice al modelo qué debe aparecer, cómo debe verse, qué debe mantenerse intacto y qué ajustes técnicos son importantes.
Un buen prompt no consiste en meter más palabras. Consiste en usar las palabras correctas en el orden correcto: sujeto, entorno, composición, iluminación, estilo, movimiento cuando aplique y restricciones.
- Un prompt débil pide “una imagen cool de producto”.
- Un prompt más sólido define el producto, el entorno, el ángulo, la iluminación, la paleta, el estilo y el encuadre.
- Un gran prompt también separa la dirección creativa de ajustes como relación de aspecto, duración, seed y resolución.
¿En qué se diferencian los prompts para imagen y para video?
Un prompt de imagen describe un solo cuadro; un prompt de video describe ese cuadro y lo que cambia con el tiempo.
Un prompt de imagen se concentra en el resultado estático: sujeto, fondo, composición, iluminación, color, estilo visual, detalles y restricciones. El modelo intenta crear un momento visual terminado.
Un prompt de video agrega tiempo. Debes explicar la acción, el ritmo, el movimiento de cámara, la duración del plano, la continuidad y, a veces, sonido o diálogo si la herramienta lo permite.
Por eso, un prompt de video debería leerse más como un brief breve de toma que como una lista de etiquetas. Un buen prompt de video suele tener una acción principal clara y un movimiento de cámara claro, sobre todo en clips cortos.
| Dimensión | Generación de imágenes | Generación de video |
|---|---|---|
| Objetivo principal | Describir un resultado visual único | Describir un resultado visual y una secuencia en el tiempo |
| Ingredientes clave | Sujeto, contexto, composición, iluminación, color, estilo, restricciones | Sujeto, acción, escena, ángulo de cámara, movimiento de cámara, ritmo, iluminación, sonido opcional |
| Riesgo principal | Estilo genérico, encuadre incorrecto, texto mal renderizado, cambios no deseados | Parpadeos, deriva, acción confusa, cambios de identidad, tiempos poco claros |
| Mejor estructura de prompt | Escena → sujeto → detalles → composición → iluminación → estilo → restricciones | Sujeto → momentos de acción → entorno → encuadre → movimiento de cámara → iluminación → cierre |
| Lo que suelen controlar los ajustes | Relación de aspecto, tamaño, calidad, seed, referencia de estilo | Duración, FPS, relación de aspecto, resolución, seed, primer cuadro, medios de referencia |
La gramática básica de prompts que funciona en distintas herramientas
La mayoría de los modelos responde mejor a una estructura estable que a detalles puestos al azar. Usa una gramática repetible para que cada parte del brief de imagen o video cumpla una función.
Para imágenes, empieza por la escena visible. Para video, empieza por la toma: quién aparece, qué sucede, dónde sucede, cómo lo ve la cámara y cómo termina el plano.
Los parámetros no son lo mismo que la redacción del prompt. Si una herramienta tiene ajustes de tamaño, duración, fotogramas por segundo, relación de aspecto, seed o calidad, configúralos en la herramienta en lugar de esperar que la frase los imponga.
| Atributo | Úsalo para imágenes | Úsalo para video |
|---|---|---|
| Sujeto | Objeto, persona, lugar o producto principal | Entidad principal de la toma |
| Contexto | Fondo, ubicación, superficie, clima, hora del día | Entorno, atmósfera, hora del día |
| Composición | Vista cenital, primer plano, plano abierto, centrado, espacio para texto | Tipo de plano, encuadre, ángulo de cámara |
| Iluminación y color | Luz de ventana, softbox de estudio, tonos tierra apagados | Luz y paleta estables durante todo el clip |
| Estilo | Foto, vector, editorial, render 3D, acuarela | Cinematográfico, documental, motion graphic, animación |
| Movimiento | Normalmente no hace falta, salvo que sugiera acción en una imagen fija | Acción del sujeto, movimiento de cámara, ritmo, momento final |
| Restricciones | Conservar el diseño, reemplazar solo un objeto, renderizar exactamente el texto entre comillas | Mantener la acción simple, conservar la descripción del sujeto, evitar movimientos extra |
| Ajustes | Relación de aspecto, resolución, calidad, seed | Duración, FPS, resolución, relación de aspecto, seed, referencias |
¿Qué motores de AI deberían conocer los creadores?
El mejor motor depende del acceso, la calidad, la velocidad, el control y el costo, no solo del estilo del resultado.
Las APIs y apps alojadas son fáciles de usar y ofrecen alta calidad, pero rentas el acceso y trabajas bajo los términos de cada proveedor. Los modelos de pesos abiertos dan más control, pero tú te encargas de la configuración, GPUs, actualizaciones y resolución de problemas.
Las herramientas gestionadas para creadores quedan en un punto medio: son rápidas de usar y muy útiles para el trabajo creativo diario. Vynzo está hecho para creadores que quieren calidad sin configuraciones: un estudio limpio para imágenes y video, sin conectar APIs ni alojar modelos por cuenta propia.
| Motor o categoría | Acceso | Fortalezas | Velocidad y configuración | Control | Modelo de costo | Ideal para |
|---|---|---|---|---|---|---|
| OpenAI GPT Image | Cerrado, API alojada | Generación de imágenes para producción, ediciones, fotorrealismo, piezas con mucho texto | Configuración sencilla; rápido mediante acceso alojado | Alto control de prompt y edición, pero el usuario no ejecuta el modelo | Pago por uso o plan de plataforma | Creadores y equipos que necesitan gran calidad de imagen sin administrar infraestructura |
| Google Imagen + Veo | Cerrado, API alojada | Imágenes fotorrealistas, tipografía, video de alta gama, muy buena guía de cámara | Sencillo dentro de flujos de Google; los ajustes controlan relación de aspecto, resolución y duración | Controles amplios, pero limitados por las capacidades de la plataforma | Pago por uso o consumo en la nube | Equipos que ya trabajan con Google o Vertex |
| Adobe Firefly image + video | Cerrado, app/API alojada | Imagen y video aptos para entornos empresariales, mejora de prompts, flujos de Adobe | Fácil para usuarios de Adobe | Buenos controles creativos; la elección de modelo depende del acceso de Adobe | Suscripción y créditos generativos | Equipos de marca y diseño que usan herramientas de Adobe |
| Midjourney | Cerrado, servicio alojado | Arte conceptual rápido, moodboards, dirección de arte estilizada | Muy rápido para empezar | Prompt más parámetros como relación de aspecto, stylize, seed y exclusiones negativas | Suscripción | Exploración visual y dirección de arte |
| Stable Diffusion / Stable Image | Pesos abiertos y opciones alojadas | Pipelines personalizados, prompts negativos, prompts ponderados, fine-tuning | La configuración va desde una API alojada sencilla hasta autoalojamiento complejo | Muy alto si se autoaloja | Costo de GPU, hosting o API | Builders que quieren personalización y automatización |
| Wan | Open source, autoalojable | Flujos de imagen y video, investigación multimodal, control fino en pipelines locales | Requiere configuración y cómputo cuando se autoaloja | Alto para usuarios técnicos | Costo de GPU y mantenimiento | Equipos que quieren control de video con pesos abiertos |
| Runway, Pika, Luma | Herramientas gestionadas de video para creadores | Video corto, imagen a video, movimiento cinematográfico, controles simples | Flujo creativo rápido | Buenos controles prácticos, con menos control de infraestructura | Suscripción o créditos | Creadores que quieren buen video sin trabajo de ingeniería |
| Seedance, Seedream, Kling | Modelos cerrados y alojados con disponibilidad distinta según la región | Generación potente de imagen y video, entrada multimodal, movimiento sólido y casos de diseño avanzados | Fácil donde está disponible, aunque el acceso puede variar | Buenos controles de plataforma, no autoalojables | Costo por uso en la plataforma | Creadores con acceso a esos ecosistemas que necesitan visuales avanzados |
| Synthesia | Cerrado, plataforma alojada | Capacitación guiada por guion, onboarding, explicativos, videos de negocio con estilo avatar | Muy fácil para video corporativo | El control viene del guion, la plantilla, el kit de marca, la voz y el estilo de entrega | Suscripción | Comunicación empresarial más que generación de tomas cinematográficas |
| Vynzo | Estudio creativo todo en uno alojado | Flujo de prompt a imagen y de prompt a video en un solo espacio | Inicio rápido; sin configuración local | Controles pensados para creadores, sin administrar modelos | Plan de uso del estudio | Creadores que quieren resultados de calidad sin saltar entre herramientas |
¿API alojada, pesos abiertos o estudio todo en uno?
Elige herramientas alojadas si buscas facilidad, modelos de pesos abiertos si necesitas personalización y Vynzo cuando quieres un flujo listo para crear sin configurar nada.
Las APIs alojadas de OpenAI, Google, Adobe, Midjourney y Synthesia funcionan muy bien cuando quieres calidad, confiabilidad y menos trabajo técnico. El intercambio es que no controlas el modelo en sí, y tu flujo depende de precios, disponibilidad y términos de la plataforma.
Los modelos de pesos abiertos como Stable Diffusion y Wan convienen más cuando necesitas personalización profunda, fine-tuning, infraestructura privada o automatización. El costo práctico está en las GPUs, la configuración del entorno, las actualizaciones del modelo, el almacenamiento y el tiempo de ingeniería.
Para la mayoría de los creadores, el camino más rápido es un espacio gestionado. Vynzo se encarga de la capa de motores para que pases de prompt a imagen o video en un solo lugar. Empieza en /studio para crear, o compara opciones específicas en /tools.
- Elige APIs alojadas cuando la confiabilidad importe más que tener infraestructura a la medida.
- Elige modelos de pesos abiertos cuando necesites control total del pipeline y cuentes con soporte técnico.
- Elige herramientas gestionadas para creadores cuando la velocidad y la simplicidad sean prioridad.
- Elige Vynzo cuando quieras trabajar imagen y video juntos sin cambiar entre seis flujos distintos.
¿Cuál es el mejor flujo de trabajo para prompts de AI?
El mejor flujo es: base → generar → evaluar → cambiar una variable → repetir.
Empieza con un prompt base limpio que incluya solo la dirección creativa esencial. Luego define los parámetros técnicos fuera del prompt: relación de aspecto, resolución, duración, FPS, seed y referencias si están disponibles.
Genera algunos candidatos, compáralos contra el objetivo y después ajusta solo una cosa a la vez. Si cambias sujeto, cámara, iluminación, estilo y seed al mismo tiempo, no sabrás qué mejora realmente ayudó.
Este enfoque disciplinado importa todavía más en video. Muchas fallas vienen de pedir demasiadas acciones, movimientos de cámara o cambios de escena en un clip corto.
- 1. Define el resultado: imagen, texto a video, imagen a video, edición o explicativo.
- 2. Elige el motor según calidad, velocidad, control y costo.
- 3. Redacta un prompt base con la gramática anterior.
- 4. Configura los parámetros en la herramienta, no solo dentro de la frase.
- 5. Genera variantes y evalúalas contra el brief.
- 6. Cambia una variable, vuelve a generar y conserva lo que funciona.
Errores comunes al crear prompts de AI y cómo corregirlos
La mayoría de los problemas de prompt vienen de briefs vagos, tomas sobrecargadas o ajustes puestos en el lugar equivocado.
Si una imagen se ve atractiva pero no es correcta, normalmente le faltan sustantivos concretos al prompt: el sujeto, el material, el entorno, el ángulo de cámara o la iluminación. Cambia palabras generales por detalles visibles.
Si un video se siente caótico, simplifícalo. Usa una acción principal, un movimiento de cámara y un cierre claro. Agrega movimiento extra solo cuando la versión simple ya funcione.
Si una edición cambia demasiado, usa lenguaje de bloqueo. Dile al modelo qué debe conservar, qué debe reemplazar y qué debe permanecer sin cambios.
| Problema | Causa probable | Mejor solución |
|---|---|---|
| Resultado genérico | El prompt es demasiado amplio | Agrega detalles del sujeto, entorno, composición, luz, paleta y estilo |
| Recorte incorrecto | Falta composición | Indica el tipo de plano, ángulo, posición del sujeto y espacio para texto |
| Texto mal generado en la imagen | El texto exacto y su ubicación no están claros | Pon el texto entre comillas y especifica dónde debe ir |
| La edición cambia toda la imagen | Las reglas de conservación son débiles | Di qué debe preservarse y qué único elemento debe reemplazarse |
| El video se desvía con el tiempo | Hay demasiados cambios en un solo clip | Usa una descripción estable del sujeto, una acción, un movimiento de cámara y medios de referencia si la herramienta los admite |
| El prompt negativo se comporta raro | La herramienta no prioriza ese campo | Describe el resultado deseado en positivo y usa campos negativos solo donde estén admitidos |
| Los costos suben rápido | Demasiadas repeticiones en calidad final | Prueba primero con clips cortos o ajustes más bajos y luego renderiza en calidad final |
Derechos, consentimiento y procedencia también son parte del flujo
Saber crear prompts no elimina tu responsabilidad legal sobre los recursos que subes o publicas.
Sube solo imágenes, audio, video, logotipos, archivos de producto o materiales de marca que tengas permiso de usar. Si aparece una persona real, una voz o una apariencia reconocible, obtén el consentimiento adecuado antes de generar o editar contenido.
Los términos de salida de una plataforma y la ley de derechos de autor no son lo mismo. Una herramienta puede darte derechos contractuales para usar un resultado, mientras que las reglas locales de copyright pueden exigir una autoría humana significativa para protegerlo.
Piensa en la procedencia desde el inicio. Algunos proveedores usan credenciales de contenido, metadatos o sistemas tipo marca de agua para ayudar a identificar medios generados con AI. Para trabajos de producción, guarda registros de prompts, ajustes, referencias, seeds, ediciones y aprobaciones finales.
- Revisa los términos de cada herramienta antes de usar resultados con fines comerciales.
- Evita datos confidenciales o regulados en flujos de consumo, salvo que los términos del proveedor lo permitan.
- Guarda registros de prompts para repetir y revisar el proceso.
- Usa prácticas de divulgación y credenciales de contenido acordes con tu contexto de publicación.
¿A dónde seguir?
Usa este hub como mapa y profundiza según el resultado que necesites.
Si todavía estás aprendiendo lo básico, sigue con Cómo escribir prompts de AI efectivos. Cubre claridad, estructura, ejemplos, restricciones y el hábito de revisar una variable a la vez.
Si quieres visuales estáticos, lee Prompts de AI para imágenes. Profundiza en composición, iluminación, estilo, renderizado de texto, ediciones, parámetros y tips por modelo.
Si quieres movimiento, lee Prompts de AI para video y Prompts de imagen a video. El primero cubre briefs de toma, movimiento de cámara, timing y continuidad. El segundo explica cómo animar una imagen fija enfocando el prompt en el movimiento, en lugar de volver a describir toda la escena.
- Para crear de forma práctica, abre Vynzo Studio en /studio.
- Para comparar herramientas creativas específicas, visita /tools.
- Para trabajar con imágenes, empieza por sujeto, escena, composición, iluminación, estilo y restricciones.
- Para trabajar con video, empieza por sujeto, acción, cámara, timing y momento final.
