¿Qué hace que un prompt de AI funcione?
Un prompt de AI funciona cuando le indica al modelo qué mostrar, cómo mostrarlo y qué ajustes debe usar.
Los mejores prompts no siempre son los más largos. Son claros, específicos y relevantes para el resultado que buscas. En imagen, eso incluye sujeto, entorno, composición, iluminación, color, estilo y restricciones. En video, suma acción, tiempos, movimiento de cámara y ritmo.
Piensa en el prompt como un brief creativo, no como una frase mágica. El modelo necesita suficiente detalle para tomar buenas decisiones, pero demasiadas instrucciones compitiendo entre sí pueden producir resultados confusos, sobre todo en video.
- Nombra primero al sujeto principal.
- Ubica al sujeto en un contexto claro.
- Define encuadre, iluminación, color y estilo.
- Agrega movimiento y tiempos cuando sea video.
- Pon los controles técnicos en los ajustes cuando la herramienta lo permita.
Usa esta estructura de prompt para imagen y video
Una estructura de prompt te da un orden repetible. Eso importa porque la mayoría de los sistemas de imagen y video responden mejor a instrucciones organizadas que a una lista suelta de adjetivos.
Usa la misma estructura para tu primer borrador y luego recorta o amplía según el motor. Midjourney suele responder bien a textos breves con parámetros. OpenAI GPT Image, Google Imagen, Runway, Firefly, Luma, Pika y Veo funcionan muy bien con lenguaje natural claro. Stable Diffusion y Wan permiten más control mediante ajustes, seeds, guidance y herramientas de flujo de trabajo.
Para image-to-video, no vuelvas a describir toda la imagen. La imagen de referencia ya fija el sujeto, la composición, el estilo y la luz; tu texto debe concentrarse en lo que cambia con el tiempo.
| Atributo | Qué especificar | Ejemplo en imagen | Ejemplo en video |
|---|---|---|---|
| Sujeto | La persona, objeto, lugar o idea principal | Una botella de agua de acero inoxidable | Un corredor con rompevientos rojo |
| Contexto | Dónde existe | sobre basalto negro mojado al amanecer | en un puente con neblina al amanecer |
| Composición | Encuadre y punto de vista | toma de producto en tres cuartos desde ángulo bajo | plano medio de seguimiento a la altura de los ojos |
| Iluminación | Fuente, contraste y atmósfera | luz suave de amanecer con contraluz frío en el borde | contraluz cálido atravesando la neblina |
| Color y estilo | Paleta, medio o lenguaje visual | grafito y plata apagados, foto comercial | estética documental cinematográfica, color natural |
| Acción | Qué cambia con el tiempo | no hace falta en una imagen fija | da cuatro pasos, se detiene y mira hacia arriba |
| Movimiento de cámara | Cómo se mueve la mirada del espectador | normalmente no hace falta | acercamiento lento, cámara fija o paneo suave |
| Restricciones | Qué debe mantenerse fijo | conservar exactamente el texto de la etiqueta | mantener al sujeto centrado durante todo el clip |
| Ajustes | Controles fuera del texto creativo | relación de aspecto, tamaño, seed, calidad | duración, FPS, resolución, relación de aspecto, seed |
La especificidad relevante supera a los adjetivos vagos
Los prompts específicos usan sustantivos concretos, detalles visibles y lenguaje de producción. Los prompts vagos se apoyan en palabras como bonito, cool, lindo o cinematográfico sin decir qué debería ver realmente la persona.
Cambia los juicios amplios por decisiones visuales. En lugar de “una oficina bonita”, escribe “una oficina de esquina iluminada por el sol, con repisas de roble, sillas de lino, sombras suaves y espacio libre a la derecha para el titular”. Eso le da al modelo objetos, distribución, luz y un caso de uso.
La relevancia es el filtro. Agrega detalles que sí cambien el resultado: material, pose, ángulo de cámara, hora del día, paleta de color, textura, momento de movimiento o restricción de edición. Quita lo que no afecte el encuadre o lo que se contradiga con otras instrucciones.
- Débil: “una foto de producto cool”.
- Mejor: “una bocina negro mate sobre un pedestal de concreto, foto de estudio desde ángulo bajo, contraluz frío en el borde, sombra suave, espacio vacío arriba”.
- Débil: “haz un video dramático”.
- Mejor: “plano abierto de nubes de tormenta avanzando sobre un campo de trigo, cámara estática, relámpago en el último segundo, gradación azul grisácea oscura”.
Separa el texto creativo de los ajustes técnicos
Los ajustes son controles como relación de aspecto, resolución, seed, steps, guidance, FPS y duración. Muchas veces deben ir fuera de la frase del prompt.
Esta diferencia importa porque algunas plataformas ignoran palabras técnicas dentro del texto si esos valores se controlan en otro lugar. Las herramientas de imagen de OpenAI usan ajustes de tamaño y estilo. Midjourney usa parámetros al final del prompt, como relación de aspecto, stylization, seed y versión. Pika ofrece campos como duración, resolución, relación de aspecto, seed y negative prompt. Veo, Runway y Firefly también documentan duración, FPS, relación de aspecto y resolución como ajustes de generación.
Si estás haciendo pruebas, bloquea el seed cuando sea posible. Después cambia solo un detalle del prompt o un ajuste a la vez. Así es más fácil ver qué causó cada mejora.
| Ajuste | Qué controla | Por qué importa |
|---|---|---|
| Relación de aspecto | Forma del encuadre, como 1:1, 16:9, 9:16 o 4:5 | Se adapta a web, redes sociales, miniaturas, anuncios o formato de video |
| Resolución o tamaño | Nivel de detalle y dimensiones en píxeles del resultado | Los valores más altos ayudan al detalle y al texto, pero pueden costar más o tardar más |
| Seed | Punto de partida aleatorio | Sirve para pruebas repetibles y variaciones controladas |
| Steps | Cuánto tiempo refinan el resultado algunos modelos de difusión | Más steps pueden mejorar el detalle, pero aumentan el tiempo de render |
| Guidance o CFG | Qué tanto sigue el modelo el prompt | Valores más altos pueden mejorar la adherencia, pero reducir la variación natural |
| Duración y FPS | Largo del clip y velocidad de fotogramas | El timing del video debe coincidir con los ajustes que admite el motor |
| Imagen de referencia | Ancla visual para identidad, estilo, composición o primer fotograma | Mejora la consistencia cuando la plataforma lo admite |
¿En qué se diferencian los prompts de imagen y video?
Un prompt de imagen describe un solo cuadro. Un prompt de video describe un cuadro y, además, lo que cambia con el tiempo.
Para imágenes fijas, concéntrate en lo que aparece: sujeto, entorno, composición, iluminación, color, estilo, texto y restricciones de edición. El prompt funciona casi como una especificación visual.
Para video, agrega lógica de toma. Indica la acción del sujeto, el ángulo de cámara, el movimiento de cámara, el ritmo y cómo termina la toma. Un clip de cinco segundos suele funcionar mejor con una sola acción principal y un solo movimiento de cámara.
Cuando una plataforma admite audio o diálogo, escríbelo por separado y con claridad. Para herramientas de avatares empresariales como Synthesia, pide tema, audiencia, objetivo, tono y estructura, en lugar de una toma cinematográfica.
- Objetivo en imagen: “¿Cómo debe verse este único cuadro?”
- Objetivo en video: “¿Qué pasa primero, después y al final?”
- Objetivo en image-to-video: “¿Qué movimiento debe ocurrir en este cuadro existente?”
- Objetivo en video con avatar: “¿Quién es la audiencia, cuál es el objetivo del guion y qué debe aprender quien lo vea?”
¿Qué motor de AI conviene usar?
Elige el motor según tu flujo de trabajo: calidad alojada, control en infraestructura propia, velocidad para creadores o un estudio todo en uno.
Las herramientas alojadas y cerradas como OpenAI GPT Image, Google Imagen y Veo, Adobe Firefly, Midjourney y Synthesia son buenas opciones cuando quieres alta calidad y acceso simple. Pagas por uso o suscripción, sigues los términos de cada proveedor y no controlas el modelo base.
Las opciones open-weight como Stable Diffusion y Wan te dan el mayor control. Puedes ejecutarlas, ajustarlas, automatizarlas o afinarlas, pero también te encargas de la configuración, las GPUs, las actualizaciones y el mantenimiento.
Las herramientas de video administradas para creadores, como Runway, Pika y Luma, están pensadas para trabajar rápido con controles más simples. Seedance, Seedream y Kling son sistemas cerrados potentes, aunque el acceso puede depender de la región y la disponibilidad de cada plataforma. Si quieres calidad sin conectar APIs ni montar infraestructura propia, Vynzo es la ruta práctica: empieza en /studio o explora flujos por motor desde /tools.
| Ruta de motor | Ejemplos | Ideal para | Punto a considerar |
|---|---|---|---|
| APIs y apps alojadas cerradas | OpenAI GPT Image, Google Imagen, Veo, Adobe Firefly, Midjourney, Synthesia | Alta calidad, acceso fácil y flujos listos para producción | Rentas acceso, sigues términos y pagas según plan o uso |
| Open-weight y autoalojables | Stable Diffusion, Wan | Máxima personalización, automatización, fine-tuning y pipelines privados | Tú administras hardware, configuración, versiones y mantenimiento |
| Herramientas de video administradas para creadores | Runway, Pika, Luma | Video corto rápido, image-to-video, pruebas de estilo y clips para redes | Menos control a nivel de modelo que con infraestructura propia |
| Modelos regionales cerrados para creadores | Seedance, Seedream, Kling | Alta calidad en imagen y video, entradas multimodales y controles cinematográficos | La disponibilidad y el flujo de trabajo pueden variar por región y proveedor |
| Estudio todo en uno para creadores | Vynzo | Prompt-to-image y prompt-to-video en un espacio de trabajo limpio | Ideal cuando quieres motores potentes sin instalar nada, usar GPUs ni cambiar de herramienta |
Itera una variable a la vez
Escribir prompts es hacer pruebas. Genera una base, revisa el resultado, cambia una cosa y vuelve a correrlo.
Este hábito es especialmente importante en video. Si cambias el sujeto, el movimiento de cámara, la iluminación, la duración y el seed al mismo tiempo, no sabrás qué ayudó o qué empeoró el resultado. Los modelos de video también pueden perder coherencia cuando un prompt pide demasiadas acciones, locaciones o movimientos de cámara en un clip corto.
Usa una guía simple de revisión: coincidencia con el brief, composición, movimiento, iluminación, defectos, ajuste a la marca y derechos. Cuando un resultado funcione, guarda el prompt, el seed, las referencias, los ajustes y la versión del motor.
- 1. Escribe un prompt base usando la estructura anterior.
- 2. Define controles técnicos como relación de aspecto, resolución, duración y seed.
- 3. Genera de 2 a 4 opciones si la herramienta lo permite.
- 4. Elige el resultado más cercano e identifica el problema principal.
- 5. Cambia solo una frase del prompt o un ajuste.
- 6. Repite hasta que el resultado coincida con el brief y luego guarda la receta.
¿Los negative prompts siempre funcionan?
Los negative prompts pueden ayudar en algunos motores, pero no son universales. Las restricciones positivas suelen ser más confiables entre herramientas.
Los flujos de Stable Diffusion y las APIs de Stability suelen admitir negative prompts y prompts con pesos. Midjourney permite excluir elementos con su propio estilo de parámetros. Pika ofrece un campo de negative prompt. Pero algunas herramientas recomiendan escribir en positivo, y los flujos de Wan pueden correr con CFG en 1 para ganar velocidad, lo que puede debilitar los negative prompts clásicos.
Usa negative prompts cuando el motor esté hecho para eso. Si no, describe directamente el resultado que quieres: “fondo blanco limpio”, “un solo sujeto centrado”, “enfoque nítido” o “conservar la composición original”. Para ediciones, sé muy preciso sobre lo que no debe cambiar.
| Problema | Causa probable | Solución |
|---|---|---|
| El resultado se ve genérico | Al prompt le faltan sujeto, contexto o anclas de estilo | Agrega detalles concretos del sujeto, entorno, composición, iluminación y medio |
| La edición de imagen cambia demasiado | No se indicaron claramente las áreas que debían quedar fijas | Escribe “reemplazar solo el fondo” o “conservar rostro, pose, composición y texto” |
| El texto dentro de la imagen está mal | No se especificó el copy como texto exacto | Pon el texto requerido entre comillas y define ubicación y estilo de fuente |
| El video se siente caótico | Hay demasiadas acciones o movimientos de cámara en un solo clip | Usa una acción clara del sujeto y un solo movimiento de cámara |
| La identidad cambia entre clips | Cambian los descriptores, las referencias o la iluminación entre tomas | Reutiliza la misma redacción y los mismos recursos de referencia cuando sea posible |
| El negative prompt casi no influye | El motor no lo soporta bien o el guidance está bajo | Usa redacción positiva, herramientas de edición o sube el guidance si el flujo lo permite |
| Los resultados son difíciles de reproducir | Cambió el seed, los ajustes o la versión del modelo | Registra prompt, seed, relación de aspecto, resolución, duración y versión del motor |
Respeta derechos, políticas y cuotas
Saber escribir buenos prompts no elimina la responsabilidad de producción. Sube solo imágenes, video, audio, logotipos o documentos que tengas derecho a usar, y pide consentimiento antes de usar personas identificables o referencias de voz.
Los motores alojados tienen sus propios términos, reglas de contenido, precios y cuotas. Los derechos de uso que otorga una plataforma tampoco son lo mismo que la protección de copyright bajo la ley local, que puede depender de la autoría humana y de la jurisdicción.
Planea la divulgación y la procedencia cuando publiques medios asistidos por AI. Los principales proveedores cada vez integran más credenciales de contenido o sistemas de marca de agua, y los equipos de producción deben conservar registros de prompts, archivos fuente, ediciones y aprobaciones finales.
- Revisa los términos del proveedor antes de usar resultados con fines comerciales.
- Evita datos confidenciales o regulados en flujos de consumo.
- Guarda archivos fuente, prompts y ajustes junto con el proyecto.
- Usa referencias de personas, voces e imagen personal solo con consentimiento.
- Revisa que los resultados encajen con la marca antes de publicarlos.
