¿Qué es hacer prompting con AI?
Hacer prompting con AI es dar instrucciones claras a un modelo para que cree, edite o transforme un resultado.
En las herramientas de imagen y vídeo, el prompt funciona como un briefing creativo. Le dice al modelo qué debe aparecer, cómo debe verse, qué tiene que mantenerse igual y qué ajustes técnicos son importantes.
Un buen prompt no consiste en acumular palabras. Consiste en usar las palabras adecuadas en el orden correcto: sujeto, entorno, composición, iluminación, estilo, movimiento cuando haga falta y restricciones.
- Un prompt flojo pide “una imagen de producto chula”.
- Un prompt más sólido concreta el producto, el escenario, el ángulo, la iluminación, la paleta, el estilo y el encuadre.
- Un gran prompt, además, separa la dirección creativa de ajustes como relación de aspecto, duración, seed y resolución.
¿En qué se diferencian los prompts de imagen y de vídeo?
Un prompt de imagen describe un único fotograma; un prompt de vídeo describe un fotograma y lo que cambia con el paso del tiempo.
En imagen, el prompt se centra en el resultado estático: sujeto, fondo, composición, iluminación, color, estilo visual, detalles y límites. El modelo intenta crear un momento visual terminado.
En vídeo entra la dimensión temporal. Hay que explicar la acción, el ritmo, el movimiento de cámara, la duración del plano, la continuidad y, si la herramienta lo permite, sonido o diálogo.
Por eso un prompt de vídeo debería leerse más como una breve indicación de plano que como una lista de etiquetas. En clips cortos, lo normal es que un buen prompt tenga una acción principal clara y un movimiento de cámara claro.
| Dimensión | Generación de imagen | Generación de vídeo |
|---|---|---|
| Función principal | Describir un único resultado visual | Describir un resultado visual y una secuencia en el tiempo |
| Ingredientes clave | Sujeto, contexto, composición, iluminación, color, estilo y restricciones | Sujeto, acción, escena, ángulo de cámara, movimiento de cámara, tiempo, iluminación y sonido opcional |
| Riesgo principal | Estilo genérico, mal encuadre, texto mal renderizado o cambios no deseados | Parpadeos, deriva visual, acción confusa, cambios de identidad o tiempos poco claros |
| Estructura ideal | Escena → sujeto → detalles → composición → iluminación → estilo → restricciones | Sujeto → momentos de acción → entorno → encuadre → movimiento de cámara → iluminación → cierre |
| Ajustes habituales | Relación de aspecto, tamaño, calidad, seed y referencia de estilo | Duración, FPS, relación de aspecto, resolución, seed, primer fotograma y medios de referencia |
La gramática básica de prompts que funciona en distintas herramientas
La mayoría de modelos responde mejor a una estructura estable que a detalles puestos al azar. Usa una gramática repetible para que cada parte del briefing de imagen o vídeo cumpla una función.
Para imágenes, empieza por lo que se ve en la escena. Para vídeo, empieza por el plano: quién aparece, qué ocurre, dónde pasa, cómo lo ve la cámara y cómo termina.
Los parámetros no son prosa. Si una herramienta tiene ajustes de tamaño, duración, frecuencia de fotogramas, relación de aspecto, seed o calidad, configúralos en la herramienta en vez de esperar que una frase los sustituya.
| Atributo | Úsalo en imágenes para | Úsalo en vídeo para |
|---|---|---|
| Sujeto | Objeto, persona, lugar o producto principal | Elemento principal del plano |
| Contexto | Fondo, ubicación, superficie, clima o momento del día | Entorno, atmósfera y momento del día |
| Composición | Cenital, primer plano, plano general, centrado, espacio para texto | Tipo de plano, encuadre y ángulo de cámara |
| Iluminación y color | Luz de ventana, softbox de estudio, tonos tierra apagados | Luz y paleta constantes durante todo el clip |
| Estilo | Fotografía, vector, editorial, render 3D, acuarela | Cinematográfico, documental, motion graphic, animación |
| Movimiento | Normalmente no hace falta, salvo que sugiera acción en una imagen fija | Acción del sujeto, movimiento de cámara, ritmo y cierre |
| Restricciones | Mantener el diseño, sustituir solo un objeto, renderizar exactamente el texto entre comillas | Simplificar la acción, mantener la descripción del sujeto y evitar movimientos extra |
| Ajustes | Relación de aspecto, resolución, calidad y seed | Duración, FPS, resolución, relación de aspecto, seed y referencias |
¿Qué motores de AI conviene conocer?
El mejor motor depende del acceso, la calidad, la velocidad, el control y el coste; no solo del estilo del resultado.
Las apps y APIs alojadas son fáciles de usar y ofrecen mucha calidad, pero alquilas el acceso y trabajas bajo las condiciones de cada proveedor. Los modelos de pesos abiertos dan más control, pero también te obligan a gestionar instalación, GPUs, actualizaciones y problemas técnicos.
Las herramientas gestionadas para creadores se quedan en un punto intermedio: son rápidas y funcionan muy bien para el trabajo creativo diario. Vynzo está pensado para creadores que quieren calidad sin configuración: un estudio claro para imágenes y vídeo, sin montar APIs ni alojar modelos por su cuenta.
| Motor o categoría | Acceso | Puntos fuertes | Velocidad y configuración | Control | Modelo de coste | Mejor para |
|---|---|---|---|---|---|---|
| OpenAI GPT Image | API alojada y cerrada | Generación de imágenes de producción, ediciones, fotorrealismo y piezas con mucho texto | Configuración sencilla; rápido mediante acceso alojado | Alto control del prompt y la edición, aunque el modelo no lo ejecuta el usuario | Pago por uso o plan de plataforma | Creadores y equipos que necesitan gran calidad de imagen sin gestionar infraestructura |
| Google Imagen + Veo | API alojada y cerrada | Imágenes fotorrealistas, tipografía, vídeo de alta gama y buena dirección de cámara | Fácil dentro de flujos de Google; los ajustes controlan relación de aspecto, resolución y duración | Controles amplios, limitados por las capacidades de la plataforma | Pago por uso o consumo en la nube | Equipos que ya trabajan con Google o Vertex |
| Adobe Firefly image + video | App/API alojada y cerrada | Imagen y vídeo orientados a empresa, mejora de prompts y flujos de Adobe | Muy fácil para usuarios de Adobe | Buenos controles creativos; la elección del modelo depende del acceso a Adobe | Suscripción y créditos generativos | Equipos de marca y diseño que trabajan con herramientas Adobe |
| Midjourney | Servicio alojado y cerrado | Concept art rápido, moodboards y dirección artística estilizada | Se empieza muy rápido | Prompt más parámetros como relación de aspecto, stylize, seed y exclusiones negativas | Suscripción | Exploración visual y dirección de arte |
| Stable Diffusion / Stable Image | Pesos abiertos y opciones alojadas | Pipelines personalizados, prompts negativos, prompts ponderados y fine-tuning | La configuración va de una API alojada sencilla al autohospedaje complejo | Muy alto si se autohospeda | Coste de GPU, alojamiento o API | Builders que buscan personalización y automatización |
| Wan | Código abierto, autohospedable | Flujos de imagen y vídeo, investigación multimodal y control fino en pipelines locales | Requiere configuración y cómputo si se autohospeda | Alto para usuarios técnicos | Coste de GPU y mantenimiento | Equipos que quieren control de vídeo con pesos abiertos |
| Runway, Pika, Luma | Herramientas de vídeo gestionadas para creadores | Vídeo corto, imagen a vídeo, movimiento cinematográfico y controles simples | Flujo creativo rápido | Buenos controles prácticos, con menos control de infraestructura | Suscripción o créditos | Creadores que quieren buen vídeo sin trabajo de ingeniería |
| Seedance, Seedream, Kling | Modelos alojados y cerrados con disponibilidad variable por región | Generación potente de imagen y vídeo, entrada multimodal, buen movimiento y casos de diseño avanzados | Fáciles donde están disponibles, aunque el acceso puede variar | Buenos controles de plataforma, no autohospedables | Coste de uso de la plataforma | Creadores con acceso a esos ecosistemas que necesitan visuales avanzados |
| Synthesia | Plataforma alojada y cerrada | Formación guiada por guion, onboarding, explicativos y vídeos de negocio con avatares | Muy sencilla para vídeo corporativo | El control viene del guion, la plantilla, el kit de marca, la voz y el estilo de entrega | Suscripción | Comunicación empresarial más que generación cinematográfica de planos |
| Vynzo | Estudio creativo todo en uno alojado | Flujo de prompt a imagen y de prompt a vídeo en un mismo espacio | Inicio rápido; sin configuración local | Controles pensados para creadores sin gestionar modelos | Plan de uso del estudio | Creadores que quieren resultados de calidad sin saltar entre herramientas |
¿API alojada, pesos abiertos o estudio todo en uno?
Elige herramientas alojadas si priorizas la facilidad, pesos abiertos si necesitas personalización y Vynzo si quieres un flujo listo para crear sin configuración.
Las APIs alojadas de OpenAI, Google, Adobe, Midjourney y Synthesia son buenas cuando buscas calidad, fiabilidad y menos trabajo técnico. La contrapartida es que no controlas el modelo en sí, y tu flujo depende de precios, disponibilidad y condiciones de la plataforma.
Los modelos de pesos abiertos como Stable Diffusion y Wan encajan mejor cuando necesitas personalización profunda, fine-tuning, infraestructura privada o automatización. La contrapartida es práctica: GPUs, configuración del entorno, actualizaciones de modelos, almacenamiento y tiempo de ingeniería.
Para la mayoría de creadores, el camino más rápido es un espacio de trabajo gestionado. Vynzo se encarga de la capa de motores para que puedas pasar de prompt a imagen o vídeo en un solo lugar. Empieza a crear en /studio o compara opciones específicas en /tools.
- Elige APIs alojadas cuando la fiabilidad importe más que tener infraestructura propia.
- Elige modelos de pesos abiertos si necesitas controlar todo el pipeline y cuentas con soporte técnico.
- Elige herramientas gestionadas para creadores cuando la velocidad y la sencillez sean lo principal.
- Elige Vynzo si quieres crear imágenes y vídeo juntos sin cambiar entre seis flujos distintos.
¿Cuál es el mejor flujo de trabajo para prompts con AI?
El mejor flujo es: base → generar → evaluar → cambiar una variable → repetir.
Empieza con un prompt base limpio que incluya solo la dirección creativa esencial. Después configura los parámetros técnicos fuera del prompt: relación de aspecto, resolución, duración, FPS, seed y referencias si están disponibles.
Genera varias opciones, compáralas con el objetivo y modifica una sola cosa cada vez. Si cambias a la vez el sujeto, la cámara, la iluminación, el estilo y el seed, no sabrás qué mejora el resultado.
Este enfoque disciplinado es aún más importante en vídeo. Muchos fallos aparecen por pedir demasiadas acciones, movimientos de cámara o cambios de escena en un clip corto.
- 1. Define el resultado: imagen, texto a vídeo, imagen a vídeo, edición o vídeo explicativo.
- 2. Elige el motor según calidad, velocidad, control y coste.
- 3. Redacta un prompt base con la gramática anterior.
- 4. Configura los parámetros en la herramienta, no solo dentro de la frase.
- 5. Genera variantes y valora cada una frente al briefing.
- 6. Cambia una variable, vuelve a generar y fija lo que funciona.
Errores habituales al escribir prompts con AI y cómo corregirlos
La mayoría de problemas con prompts vienen de briefings vagos, planos demasiado cargados o ajustes puestos en el lugar equivocado.
Si una imagen es atractiva pero no correcta, normalmente al prompt le faltan sustantivos concretos: sujeto, material, entorno, ángulo de cámara o iluminación. Sustituye palabras amplias por detalles visibles.
Si un vídeo se siente caótico, simplifícalo. Usa una acción principal, un movimiento de cámara y un cierre claro. Añade más movimiento solo cuando la versión simple funcione.
Si una edición cambia demasiado, usa instrucciones de bloqueo. Indica al modelo qué debe conservar, qué debe sustituir y qué debe permanecer igual.
| Problema | Causa probable | Mejor solución |
|---|---|---|
| Resultado genérico | El prompt es demasiado amplio | Añade detalles del sujeto, entorno, composición, luz, paleta y estilo |
| Recorte incorrecto | Falta información de composición | Indica el tipo de plano, ángulo, posición del sujeto y espacio para texto |
| Texto mal generado en la imagen | El texto exacto y su ubicación no están claros | Pon el texto entre comillas y especifica dónde debe ir |
| La edición cambia toda la imagen | Las reglas de conservación son débiles | Di qué debe mantenerse y qué único elemento debe sustituirse |
| El vídeo deriva con el tiempo | Hay demasiados cambios en un solo clip | Usa una descripción estable del sujeto, una acción, un movimiento de cámara y medios de referencia si la herramienta lo permite |
| El prompt negativo se comporta raro | La herramienta no prioriza ese campo | Describe en positivo el resultado deseado y usa campos negativos solo cuando estén soportados |
| El coste sube rápido | Demasiadas repeticiones en calidad final | Prueba primero clips cortos o ajustes más bajos y renderiza al final en calidad definitiva |
Derechos, consentimiento y procedencia también forman parte del flujo de prompts
Saber escribir prompts no elimina la responsabilidad legal sobre los materiales que subes o publicas.
Sube únicamente imágenes, audio, vídeo, logotipos, archivos de producto o materiales de marca que tengas permiso para usar. Si interviene una persona real, una voz o una apariencia reconocible, obtén el consentimiento adecuado antes de generar o editar contenido.
Las condiciones de salida de una plataforma y la ley de derechos de autor no son lo mismo. Una herramienta puede concederte derechos contractuales para usar un resultado, mientras que las normas locales de copyright pueden exigir una aportación humana significativa para protegerlo.
Piensa en la procedencia desde el principio. Algunos proveedores utilizan credenciales de contenido, metadatos o sistemas similares a marcas de agua para identificar medios generados con AI. En trabajos de producción, guarda registros de prompts, ajustes, referencias, seeds, ediciones y aprobaciones finales.
- Revisa las condiciones de cada herramienta antes de usar resultados con fines comerciales.
- Evita datos confidenciales o regulados en flujos de consumo salvo que las condiciones del proveedor lo permitan.
- Guarda historiales de prompts para repetir resultados y revisarlos.
- Aplica prácticas de divulgación y credenciales de contenido acordes al contexto de publicación.
¿Cuál es el siguiente paso?
Usa este hub como mapa y profundiza según el resultado que quieras conseguir.
Si aún estás aprendiendo lo básico, sigue con Cómo escribir prompts efectivos para AI. Ahí verás claridad, estructura, ejemplos, restricciones y el hábito de revisar una sola variable cada vez.
Si quieres imágenes estáticas, lee Prompts de imagen con AI. Profundiza en composición, iluminación, estilo, renderizado de texto, ediciones, parámetros y consejos según el modelo.
Si buscas movimiento, lee Prompts de vídeo con AI y Prompts de imagen a vídeo. El primero cubre briefings de plano, movimiento de cámara, tiempos y continuidad. El segundo explica cómo animar una imagen fija centrando el prompt en el movimiento, no repitiendo toda la escena.
- Para crear directamente, abre Vynzo Studio en /studio.
- Para comparar herramientas creativas específicas, visita /tools.
- En imagen, empieza por sujeto, escena, composición, iluminación, estilo y restricciones.
- En vídeo, empieza por sujeto, acción, cámara, tiempo y cierre del plano.
