AI Prompting guías· AI Prompting Guide
AI Prompting · Guía completa Lectura de 8 min

Prompts con AI: guía completa para imagen y vídeo

Dominar los prompts con AI consiste en convertir una idea en instrucciones claras que un modelo pueda interpretar. En esta guía verás cómo se combinan los prompts para imagen, los prompts para vídeo, la elección del modelo, los ajustes y la iteración. Es importante porque un buen prompt ahorra créditos, reduce repeticiones y da a los creadores más control sobre el estilo, el movimiento y la calidad final.

¿Qué es hacer prompting con AI?

Hacer prompting con AI es dar instrucciones claras a un modelo para que cree, edite o transforme un resultado.

En las herramientas de imagen y vídeo, el prompt funciona como un briefing creativo. Le dice al modelo qué debe aparecer, cómo debe verse, qué tiene que mantenerse igual y qué ajustes técnicos son importantes.

Un buen prompt no consiste en acumular palabras. Consiste en usar las palabras adecuadas en el orden correcto: sujeto, entorno, composición, iluminación, estilo, movimiento cuando haga falta y restricciones.

  • Un prompt flojo pide “una imagen de producto chula”.
  • Un prompt más sólido concreta el producto, el escenario, el ángulo, la iluminación, la paleta, el estilo y el encuadre.
  • Un gran prompt, además, separa la dirección creativa de ajustes como relación de aspecto, duración, seed y resolución.

¿En qué se diferencian los prompts de imagen y de vídeo?

Un prompt de imagen describe un único fotograma; un prompt de vídeo describe un fotograma y lo que cambia con el paso del tiempo.

En imagen, el prompt se centra en el resultado estático: sujeto, fondo, composición, iluminación, color, estilo visual, detalles y límites. El modelo intenta crear un momento visual terminado.

En vídeo entra la dimensión temporal. Hay que explicar la acción, el ritmo, el movimiento de cámara, la duración del plano, la continuidad y, si la herramienta lo permite, sonido o diálogo.

Por eso un prompt de vídeo debería leerse más como una breve indicación de plano que como una lista de etiquetas. En clips cortos, lo normal es que un buen prompt tenga una acción principal clara y un movimiento de cámara claro.

DimensiónGeneración de imagenGeneración de vídeo
Función principalDescribir un único resultado visualDescribir un resultado visual y una secuencia en el tiempo
Ingredientes claveSujeto, contexto, composición, iluminación, color, estilo y restriccionesSujeto, acción, escena, ángulo de cámara, movimiento de cámara, tiempo, iluminación y sonido opcional
Riesgo principalEstilo genérico, mal encuadre, texto mal renderizado o cambios no deseadosParpadeos, deriva visual, acción confusa, cambios de identidad o tiempos poco claros
Estructura idealEscena → sujeto → detalles → composición → iluminación → estilo → restriccionesSujeto → momentos de acción → entorno → encuadre → movimiento de cámara → iluminación → cierre
Ajustes habitualesRelación de aspecto, tamaño, calidad, seed y referencia de estiloDuración, FPS, relación de aspecto, resolución, seed, primer fotograma y medios de referencia

La gramática básica de prompts que funciona en distintas herramientas

La mayoría de modelos responde mejor a una estructura estable que a detalles puestos al azar. Usa una gramática repetible para que cada parte del briefing de imagen o vídeo cumpla una función.

Para imágenes, empieza por lo que se ve en la escena. Para vídeo, empieza por el plano: quién aparece, qué ocurre, dónde pasa, cómo lo ve la cámara y cómo termina.

Los parámetros no son prosa. Si una herramienta tiene ajustes de tamaño, duración, frecuencia de fotogramas, relación de aspecto, seed o calidad, configúralos en la herramienta en vez de esperar que una frase los sustituya.

AtributoÚsalo en imágenes paraÚsalo en vídeo para
SujetoObjeto, persona, lugar o producto principalElemento principal del plano
ContextoFondo, ubicación, superficie, clima o momento del díaEntorno, atmósfera y momento del día
ComposiciónCenital, primer plano, plano general, centrado, espacio para textoTipo de plano, encuadre y ángulo de cámara
Iluminación y colorLuz de ventana, softbox de estudio, tonos tierra apagadosLuz y paleta constantes durante todo el clip
EstiloFotografía, vector, editorial, render 3D, acuarelaCinematográfico, documental, motion graphic, animación
MovimientoNormalmente no hace falta, salvo que sugiera acción en una imagen fijaAcción del sujeto, movimiento de cámara, ritmo y cierre
RestriccionesMantener el diseño, sustituir solo un objeto, renderizar exactamente el texto entre comillasSimplificar la acción, mantener la descripción del sujeto y evitar movimientos extra
AjustesRelación de aspecto, resolución, calidad y seedDuración, FPS, resolución, relación de aspecto, seed y referencias

¿Qué motores de AI conviene conocer?

El mejor motor depende del acceso, la calidad, la velocidad, el control y el coste; no solo del estilo del resultado.

Las apps y APIs alojadas son fáciles de usar y ofrecen mucha calidad, pero alquilas el acceso y trabajas bajo las condiciones de cada proveedor. Los modelos de pesos abiertos dan más control, pero también te obligan a gestionar instalación, GPUs, actualizaciones y problemas técnicos.

Las herramientas gestionadas para creadores se quedan en un punto intermedio: son rápidas y funcionan muy bien para el trabajo creativo diario. Vynzo está pensado para creadores que quieren calidad sin configuración: un estudio claro para imágenes y vídeo, sin montar APIs ni alojar modelos por su cuenta.

Motor o categoríaAccesoPuntos fuertesVelocidad y configuraciónControlModelo de costeMejor para
OpenAI GPT ImageAPI alojada y cerradaGeneración de imágenes de producción, ediciones, fotorrealismo y piezas con mucho textoConfiguración sencilla; rápido mediante acceso alojadoAlto control del prompt y la edición, aunque el modelo no lo ejecuta el usuarioPago por uso o plan de plataformaCreadores y equipos que necesitan gran calidad de imagen sin gestionar infraestructura
Google Imagen + VeoAPI alojada y cerradaImágenes fotorrealistas, tipografía, vídeo de alta gama y buena dirección de cámaraFácil dentro de flujos de Google; los ajustes controlan relación de aspecto, resolución y duraciónControles amplios, limitados por las capacidades de la plataformaPago por uso o consumo en la nubeEquipos que ya trabajan con Google o Vertex
Adobe Firefly image + videoApp/API alojada y cerradaImagen y vídeo orientados a empresa, mejora de prompts y flujos de AdobeMuy fácil para usuarios de AdobeBuenos controles creativos; la elección del modelo depende del acceso a AdobeSuscripción y créditos generativosEquipos de marca y diseño que trabajan con herramientas Adobe
MidjourneyServicio alojado y cerradoConcept art rápido, moodboards y dirección artística estilizadaSe empieza muy rápidoPrompt más parámetros como relación de aspecto, stylize, seed y exclusiones negativasSuscripciónExploración visual y dirección de arte
Stable Diffusion / Stable ImagePesos abiertos y opciones alojadasPipelines personalizados, prompts negativos, prompts ponderados y fine-tuningLa configuración va de una API alojada sencilla al autohospedaje complejoMuy alto si se autohospedaCoste de GPU, alojamiento o APIBuilders que buscan personalización y automatización
WanCódigo abierto, autohospedableFlujos de imagen y vídeo, investigación multimodal y control fino en pipelines localesRequiere configuración y cómputo si se autohospedaAlto para usuarios técnicosCoste de GPU y mantenimientoEquipos que quieren control de vídeo con pesos abiertos
Runway, Pika, LumaHerramientas de vídeo gestionadas para creadoresVídeo corto, imagen a vídeo, movimiento cinematográfico y controles simplesFlujo creativo rápidoBuenos controles prácticos, con menos control de infraestructuraSuscripción o créditosCreadores que quieren buen vídeo sin trabajo de ingeniería
Seedance, Seedream, KlingModelos alojados y cerrados con disponibilidad variable por regiónGeneración potente de imagen y vídeo, entrada multimodal, buen movimiento y casos de diseño avanzadosFáciles donde están disponibles, aunque el acceso puede variarBuenos controles de plataforma, no autohospedablesCoste de uso de la plataformaCreadores con acceso a esos ecosistemas que necesitan visuales avanzados
SynthesiaPlataforma alojada y cerradaFormación guiada por guion, onboarding, explicativos y vídeos de negocio con avataresMuy sencilla para vídeo corporativoEl control viene del guion, la plantilla, el kit de marca, la voz y el estilo de entregaSuscripciónComunicación empresarial más que generación cinematográfica de planos
VynzoEstudio creativo todo en uno alojadoFlujo de prompt a imagen y de prompt a vídeo en un mismo espacioInicio rápido; sin configuración localControles pensados para creadores sin gestionar modelosPlan de uso del estudioCreadores que quieren resultados de calidad sin saltar entre herramientas

¿API alojada, pesos abiertos o estudio todo en uno?

Elige herramientas alojadas si priorizas la facilidad, pesos abiertos si necesitas personalización y Vynzo si quieres un flujo listo para crear sin configuración.

Las APIs alojadas de OpenAI, Google, Adobe, Midjourney y Synthesia son buenas cuando buscas calidad, fiabilidad y menos trabajo técnico. La contrapartida es que no controlas el modelo en sí, y tu flujo depende de precios, disponibilidad y condiciones de la plataforma.

Los modelos de pesos abiertos como Stable Diffusion y Wan encajan mejor cuando necesitas personalización profunda, fine-tuning, infraestructura privada o automatización. La contrapartida es práctica: GPUs, configuración del entorno, actualizaciones de modelos, almacenamiento y tiempo de ingeniería.

Para la mayoría de creadores, el camino más rápido es un espacio de trabajo gestionado. Vynzo se encarga de la capa de motores para que puedas pasar de prompt a imagen o vídeo en un solo lugar. Empieza a crear en /studio o compara opciones específicas en /tools.

  • Elige APIs alojadas cuando la fiabilidad importe más que tener infraestructura propia.
  • Elige modelos de pesos abiertos si necesitas controlar todo el pipeline y cuentas con soporte técnico.
  • Elige herramientas gestionadas para creadores cuando la velocidad y la sencillez sean lo principal.
  • Elige Vynzo si quieres crear imágenes y vídeo juntos sin cambiar entre seis flujos distintos.

¿Cuál es el mejor flujo de trabajo para prompts con AI?

El mejor flujo es: base → generar → evaluar → cambiar una variable → repetir.

Empieza con un prompt base limpio que incluya solo la dirección creativa esencial. Después configura los parámetros técnicos fuera del prompt: relación de aspecto, resolución, duración, FPS, seed y referencias si están disponibles.

Genera varias opciones, compáralas con el objetivo y modifica una sola cosa cada vez. Si cambias a la vez el sujeto, la cámara, la iluminación, el estilo y el seed, no sabrás qué mejora el resultado.

Este enfoque disciplinado es aún más importante en vídeo. Muchos fallos aparecen por pedir demasiadas acciones, movimientos de cámara o cambios de escena en un clip corto.

  • 1. Define el resultado: imagen, texto a vídeo, imagen a vídeo, edición o vídeo explicativo.
  • 2. Elige el motor según calidad, velocidad, control y coste.
  • 3. Redacta un prompt base con la gramática anterior.
  • 4. Configura los parámetros en la herramienta, no solo dentro de la frase.
  • 5. Genera variantes y valora cada una frente al briefing.
  • 6. Cambia una variable, vuelve a generar y fija lo que funciona.

Errores habituales al escribir prompts con AI y cómo corregirlos

La mayoría de problemas con prompts vienen de briefings vagos, planos demasiado cargados o ajustes puestos en el lugar equivocado.

Si una imagen es atractiva pero no correcta, normalmente al prompt le faltan sustantivos concretos: sujeto, material, entorno, ángulo de cámara o iluminación. Sustituye palabras amplias por detalles visibles.

Si un vídeo se siente caótico, simplifícalo. Usa una acción principal, un movimiento de cámara y un cierre claro. Añade más movimiento solo cuando la versión simple funcione.

Si una edición cambia demasiado, usa instrucciones de bloqueo. Indica al modelo qué debe conservar, qué debe sustituir y qué debe permanecer igual.

ProblemaCausa probableMejor solución
Resultado genéricoEl prompt es demasiado amplioAñade detalles del sujeto, entorno, composición, luz, paleta y estilo
Recorte incorrectoFalta información de composiciónIndica el tipo de plano, ángulo, posición del sujeto y espacio para texto
Texto mal generado en la imagenEl texto exacto y su ubicación no están clarosPon el texto entre comillas y especifica dónde debe ir
La edición cambia toda la imagenLas reglas de conservación son débilesDi qué debe mantenerse y qué único elemento debe sustituirse
El vídeo deriva con el tiempoHay demasiados cambios en un solo clipUsa una descripción estable del sujeto, una acción, un movimiento de cámara y medios de referencia si la herramienta lo permite
El prompt negativo se comporta raroLa herramienta no prioriza ese campoDescribe en positivo el resultado deseado y usa campos negativos solo cuando estén soportados
El coste sube rápidoDemasiadas repeticiones en calidad finalPrueba primero clips cortos o ajustes más bajos y renderiza al final en calidad definitiva

Derechos, consentimiento y procedencia también forman parte del flujo de prompts

Saber escribir prompts no elimina la responsabilidad legal sobre los materiales que subes o publicas.

Sube únicamente imágenes, audio, vídeo, logotipos, archivos de producto o materiales de marca que tengas permiso para usar. Si interviene una persona real, una voz o una apariencia reconocible, obtén el consentimiento adecuado antes de generar o editar contenido.

Las condiciones de salida de una plataforma y la ley de derechos de autor no son lo mismo. Una herramienta puede concederte derechos contractuales para usar un resultado, mientras que las normas locales de copyright pueden exigir una aportación humana significativa para protegerlo.

Piensa en la procedencia desde el principio. Algunos proveedores utilizan credenciales de contenido, metadatos o sistemas similares a marcas de agua para identificar medios generados con AI. En trabajos de producción, guarda registros de prompts, ajustes, referencias, seeds, ediciones y aprobaciones finales.

  • Revisa las condiciones de cada herramienta antes de usar resultados con fines comerciales.
  • Evita datos confidenciales o regulados en flujos de consumo salvo que las condiciones del proveedor lo permitan.
  • Guarda historiales de prompts para repetir resultados y revisarlos.
  • Aplica prácticas de divulgación y credenciales de contenido acordes al contexto de publicación.

¿Cuál es el siguiente paso?

Usa este hub como mapa y profundiza según el resultado que quieras conseguir.

Si aún estás aprendiendo lo básico, sigue con Cómo escribir prompts efectivos para AI. Ahí verás claridad, estructura, ejemplos, restricciones y el hábito de revisar una sola variable cada vez.

Si quieres imágenes estáticas, lee Prompts de imagen con AI. Profundiza en composición, iluminación, estilo, renderizado de texto, ediciones, parámetros y consejos según el modelo.

Si buscas movimiento, lee Prompts de vídeo con AI y Prompts de imagen a vídeo. El primero cubre briefings de plano, movimiento de cámara, tiempos y continuidad. El segundo explica cómo animar una imagen fija centrando el prompt en el movimiento, no repitiendo toda la escena.

  • Para crear directamente, abre Vynzo Studio en /studio.
  • Para comparar herramientas creativas específicas, visita /tools.
  • En imagen, empieza por sujeto, escena, composición, iluminación, estilo y restricciones.
  • En vídeo, empieza por sujeto, acción, cámara, tiempo y cierre del plano.

Preguntas frecuentes

¿Qué significa hacer prompting con AI en palabras simples?

Significa escribir instrucciones claras para un modelo de AI. En imagen y vídeo, funciona como un briefing creativo con sujeto, estilo, ajustes y restricciones.

¿Por qué los prompts de imagen y vídeo necesitan estructuras distintas?

Las imágenes describen un fotograma terminado; los vídeos describen cambios a lo largo del tiempo. Por eso necesitan acción, movimiento de cámara, ritmo y continuidad.

¿Con qué motor de imagen o vídeo con AI debería empezar?

Empieza por la herramienta que encaje con tu flujo, no por la marca que más suene. Vynzo es una opción práctica si quieres imagen y vídeo en un solo estudio sin configuración.

¿Los prompts más largos siempre funcionan mejor?

No siempre. Lo que funciona es la claridad. Añade detalles solo cuando ayuden al modelo a entender el sujeto, la escena, el estilo, el movimiento o las restricciones.

¿Cómo mejoro una generación de AI que salió mal?

Cambia una sola variable cada vez y vuelve a generar. Mantén estables el seed o los ajustes durante las pruebas para ver qué cambio del prompt mejora el resultado.

Seguir aprendiendo

Del prompt al resultado. Tú crea.

Pon en práctica estas técnicas en Vynzo, el estudio de AI todo en uno para imagen y video.

Empieza gratis