AI Prompting guías· Effective AI Prompts
AI Prompting · Parte 1 de 4 8 min de lectura

Prompts de AI efectivos: estructura, ajustes e iteración

Un prompt de AI efectivo le dice con claridad a un modelo de imagen o video qué debe crear, cómo debe verse y qué controles importan. En esta guía aprenderás una estructura reutilizable para escribir prompts, cómo separar la idea creativa de los ajustes técnicos, cómo se comportan los principales motores y cómo corregir resultados flojos sin estar adivinando.

¿Qué hace que un prompt de AI funcione?

Un prompt de AI funciona cuando le indica al modelo qué mostrar, cómo mostrarlo y qué ajustes debe usar.

Los mejores prompts no siempre son los más largos. Son claros, específicos y relevantes para el resultado que buscas. En imagen, eso incluye sujeto, entorno, composición, iluminación, color, estilo y restricciones. En video, suma acción, tiempos, movimiento de cámara y ritmo.

Piensa en el prompt como un brief creativo, no como una frase mágica. El modelo necesita suficiente detalle para tomar buenas decisiones, pero demasiadas instrucciones compitiendo entre sí pueden producir resultados confusos, sobre todo en video.

  • Nombra primero al sujeto principal.
  • Ubica al sujeto en un contexto claro.
  • Define encuadre, iluminación, color y estilo.
  • Agrega movimiento y tiempos cuando sea video.
  • Pon los controles técnicos en los ajustes cuando la herramienta lo permita.

Usa esta estructura de prompt para imagen y video

Una estructura de prompt te da un orden repetible. Eso importa porque la mayoría de los sistemas de imagen y video responden mejor a instrucciones organizadas que a una lista suelta de adjetivos.

Usa la misma estructura para tu primer borrador y luego recorta o amplía según el motor. Midjourney suele responder bien a textos breves con parámetros. OpenAI GPT Image, Google Imagen, Runway, Firefly, Luma, Pika y Veo funcionan muy bien con lenguaje natural claro. Stable Diffusion y Wan permiten más control mediante ajustes, seeds, guidance y herramientas de flujo de trabajo.

Para image-to-video, no vuelvas a describir toda la imagen. La imagen de referencia ya fija el sujeto, la composición, el estilo y la luz; tu texto debe concentrarse en lo que cambia con el tiempo.

AtributoQué especificarEjemplo en imagenEjemplo en video
SujetoLa persona, objeto, lugar o idea principalUna botella de agua de acero inoxidableUn corredor con rompevientos rojo
ContextoDónde existesobre basalto negro mojado al amaneceren un puente con neblina al amanecer
ComposiciónEncuadre y punto de vistatoma de producto en tres cuartos desde ángulo bajoplano medio de seguimiento a la altura de los ojos
IluminaciónFuente, contraste y atmósferaluz suave de amanecer con contraluz frío en el bordecontraluz cálido atravesando la neblina
Color y estiloPaleta, medio o lenguaje visualgrafito y plata apagados, foto comercialestética documental cinematográfica, color natural
AcciónQué cambia con el tiempono hace falta en una imagen fijada cuatro pasos, se detiene y mira hacia arriba
Movimiento de cámaraCómo se mueve la mirada del espectadornormalmente no hace faltaacercamiento lento, cámara fija o paneo suave
RestriccionesQué debe mantenerse fijoconservar exactamente el texto de la etiquetamantener al sujeto centrado durante todo el clip
AjustesControles fuera del texto creativorelación de aspecto, tamaño, seed, calidadduración, FPS, resolución, relación de aspecto, seed

La especificidad relevante supera a los adjetivos vagos

Los prompts específicos usan sustantivos concretos, detalles visibles y lenguaje de producción. Los prompts vagos se apoyan en palabras como bonito, cool, lindo o cinematográfico sin decir qué debería ver realmente la persona.

Cambia los juicios amplios por decisiones visuales. En lugar de “una oficina bonita”, escribe “una oficina de esquina iluminada por el sol, con repisas de roble, sillas de lino, sombras suaves y espacio libre a la derecha para el titular”. Eso le da al modelo objetos, distribución, luz y un caso de uso.

La relevancia es el filtro. Agrega detalles que sí cambien el resultado: material, pose, ángulo de cámara, hora del día, paleta de color, textura, momento de movimiento o restricción de edición. Quita lo que no afecte el encuadre o lo que se contradiga con otras instrucciones.

  • Débil: “una foto de producto cool”.
  • Mejor: “una bocina negro mate sobre un pedestal de concreto, foto de estudio desde ángulo bajo, contraluz frío en el borde, sombra suave, espacio vacío arriba”.
  • Débil: “haz un video dramático”.
  • Mejor: “plano abierto de nubes de tormenta avanzando sobre un campo de trigo, cámara estática, relámpago en el último segundo, gradación azul grisácea oscura”.

Separa el texto creativo de los ajustes técnicos

Los ajustes son controles como relación de aspecto, resolución, seed, steps, guidance, FPS y duración. Muchas veces deben ir fuera de la frase del prompt.

Esta diferencia importa porque algunas plataformas ignoran palabras técnicas dentro del texto si esos valores se controlan en otro lugar. Las herramientas de imagen de OpenAI usan ajustes de tamaño y estilo. Midjourney usa parámetros al final del prompt, como relación de aspecto, stylization, seed y versión. Pika ofrece campos como duración, resolución, relación de aspecto, seed y negative prompt. Veo, Runway y Firefly también documentan duración, FPS, relación de aspecto y resolución como ajustes de generación.

Si estás haciendo pruebas, bloquea el seed cuando sea posible. Después cambia solo un detalle del prompt o un ajuste a la vez. Así es más fácil ver qué causó cada mejora.

AjusteQué controlaPor qué importa
Relación de aspectoForma del encuadre, como 1:1, 16:9, 9:16 o 4:5Se adapta a web, redes sociales, miniaturas, anuncios o formato de video
Resolución o tamañoNivel de detalle y dimensiones en píxeles del resultadoLos valores más altos ayudan al detalle y al texto, pero pueden costar más o tardar más
SeedPunto de partida aleatorioSirve para pruebas repetibles y variaciones controladas
StepsCuánto tiempo refinan el resultado algunos modelos de difusiónMás steps pueden mejorar el detalle, pero aumentan el tiempo de render
Guidance o CFGQué tanto sigue el modelo el promptValores más altos pueden mejorar la adherencia, pero reducir la variación natural
Duración y FPSLargo del clip y velocidad de fotogramasEl timing del video debe coincidir con los ajustes que admite el motor
Imagen de referenciaAncla visual para identidad, estilo, composición o primer fotogramaMejora la consistencia cuando la plataforma lo admite

¿En qué se diferencian los prompts de imagen y video?

Un prompt de imagen describe un solo cuadro. Un prompt de video describe un cuadro y, además, lo que cambia con el tiempo.

Para imágenes fijas, concéntrate en lo que aparece: sujeto, entorno, composición, iluminación, color, estilo, texto y restricciones de edición. El prompt funciona casi como una especificación visual.

Para video, agrega lógica de toma. Indica la acción del sujeto, el ángulo de cámara, el movimiento de cámara, el ritmo y cómo termina la toma. Un clip de cinco segundos suele funcionar mejor con una sola acción principal y un solo movimiento de cámara.

Cuando una plataforma admite audio o diálogo, escríbelo por separado y con claridad. Para herramientas de avatares empresariales como Synthesia, pide tema, audiencia, objetivo, tono y estructura, en lugar de una toma cinematográfica.

  • Objetivo en imagen: “¿Cómo debe verse este único cuadro?”
  • Objetivo en video: “¿Qué pasa primero, después y al final?”
  • Objetivo en image-to-video: “¿Qué movimiento debe ocurrir en este cuadro existente?”
  • Objetivo en video con avatar: “¿Quién es la audiencia, cuál es el objetivo del guion y qué debe aprender quien lo vea?”

¿Qué motor de AI conviene usar?

Elige el motor según tu flujo de trabajo: calidad alojada, control en infraestructura propia, velocidad para creadores o un estudio todo en uno.

Las herramientas alojadas y cerradas como OpenAI GPT Image, Google Imagen y Veo, Adobe Firefly, Midjourney y Synthesia son buenas opciones cuando quieres alta calidad y acceso simple. Pagas por uso o suscripción, sigues los términos de cada proveedor y no controlas el modelo base.

Las opciones open-weight como Stable Diffusion y Wan te dan el mayor control. Puedes ejecutarlas, ajustarlas, automatizarlas o afinarlas, pero también te encargas de la configuración, las GPUs, las actualizaciones y el mantenimiento.

Las herramientas de video administradas para creadores, como Runway, Pika y Luma, están pensadas para trabajar rápido con controles más simples. Seedance, Seedream y Kling son sistemas cerrados potentes, aunque el acceso puede depender de la región y la disponibilidad de cada plataforma. Si quieres calidad sin conectar APIs ni montar infraestructura propia, Vynzo es la ruta práctica: empieza en /studio o explora flujos por motor desde /tools.

Ruta de motorEjemplosIdeal paraPunto a considerar
APIs y apps alojadas cerradasOpenAI GPT Image, Google Imagen, Veo, Adobe Firefly, Midjourney, SynthesiaAlta calidad, acceso fácil y flujos listos para producciónRentas acceso, sigues términos y pagas según plan o uso
Open-weight y autoalojablesStable Diffusion, WanMáxima personalización, automatización, fine-tuning y pipelines privadosTú administras hardware, configuración, versiones y mantenimiento
Herramientas de video administradas para creadoresRunway, Pika, LumaVideo corto rápido, image-to-video, pruebas de estilo y clips para redesMenos control a nivel de modelo que con infraestructura propia
Modelos regionales cerrados para creadoresSeedance, Seedream, KlingAlta calidad en imagen y video, entradas multimodales y controles cinematográficosLa disponibilidad y el flujo de trabajo pueden variar por región y proveedor
Estudio todo en uno para creadoresVynzoPrompt-to-image y prompt-to-video en un espacio de trabajo limpioIdeal cuando quieres motores potentes sin instalar nada, usar GPUs ni cambiar de herramienta

Itera una variable a la vez

Escribir prompts es hacer pruebas. Genera una base, revisa el resultado, cambia una cosa y vuelve a correrlo.

Este hábito es especialmente importante en video. Si cambias el sujeto, el movimiento de cámara, la iluminación, la duración y el seed al mismo tiempo, no sabrás qué ayudó o qué empeoró el resultado. Los modelos de video también pueden perder coherencia cuando un prompt pide demasiadas acciones, locaciones o movimientos de cámara en un clip corto.

Usa una guía simple de revisión: coincidencia con el brief, composición, movimiento, iluminación, defectos, ajuste a la marca y derechos. Cuando un resultado funcione, guarda el prompt, el seed, las referencias, los ajustes y la versión del motor.

  • 1. Escribe un prompt base usando la estructura anterior.
  • 2. Define controles técnicos como relación de aspecto, resolución, duración y seed.
  • 3. Genera de 2 a 4 opciones si la herramienta lo permite.
  • 4. Elige el resultado más cercano e identifica el problema principal.
  • 5. Cambia solo una frase del prompt o un ajuste.
  • 6. Repite hasta que el resultado coincida con el brief y luego guarda la receta.

¿Los negative prompts siempre funcionan?

Los negative prompts pueden ayudar en algunos motores, pero no son universales. Las restricciones positivas suelen ser más confiables entre herramientas.

Los flujos de Stable Diffusion y las APIs de Stability suelen admitir negative prompts y prompts con pesos. Midjourney permite excluir elementos con su propio estilo de parámetros. Pika ofrece un campo de negative prompt. Pero algunas herramientas recomiendan escribir en positivo, y los flujos de Wan pueden correr con CFG en 1 para ganar velocidad, lo que puede debilitar los negative prompts clásicos.

Usa negative prompts cuando el motor esté hecho para eso. Si no, describe directamente el resultado que quieres: “fondo blanco limpio”, “un solo sujeto centrado”, “enfoque nítido” o “conservar la composición original”. Para ediciones, sé muy preciso sobre lo que no debe cambiar.

ProblemaCausa probableSolución
El resultado se ve genéricoAl prompt le faltan sujeto, contexto o anclas de estiloAgrega detalles concretos del sujeto, entorno, composición, iluminación y medio
La edición de imagen cambia demasiadoNo se indicaron claramente las áreas que debían quedar fijasEscribe “reemplazar solo el fondo” o “conservar rostro, pose, composición y texto”
El texto dentro de la imagen está malNo se especificó el copy como texto exactoPon el texto requerido entre comillas y define ubicación y estilo de fuente
El video se siente caóticoHay demasiadas acciones o movimientos de cámara en un solo clipUsa una acción clara del sujeto y un solo movimiento de cámara
La identidad cambia entre clipsCambian los descriptores, las referencias o la iluminación entre tomasReutiliza la misma redacción y los mismos recursos de referencia cuando sea posible
El negative prompt casi no influyeEl motor no lo soporta bien o el guidance está bajoUsa redacción positiva, herramientas de edición o sube el guidance si el flujo lo permite
Los resultados son difíciles de reproducirCambió el seed, los ajustes o la versión del modeloRegistra prompt, seed, relación de aspecto, resolución, duración y versión del motor

Respeta derechos, políticas y cuotas

Saber escribir buenos prompts no elimina la responsabilidad de producción. Sube solo imágenes, video, audio, logotipos o documentos que tengas derecho a usar, y pide consentimiento antes de usar personas identificables o referencias de voz.

Los motores alojados tienen sus propios términos, reglas de contenido, precios y cuotas. Los derechos de uso que otorga una plataforma tampoco son lo mismo que la protección de copyright bajo la ley local, que puede depender de la autoría humana y de la jurisdicción.

Planea la divulgación y la procedencia cuando publiques medios asistidos por AI. Los principales proveedores cada vez integran más credenciales de contenido o sistemas de marca de agua, y los equipos de producción deben conservar registros de prompts, archivos fuente, ediciones y aprobaciones finales.

  • Revisa los términos del proveedor antes de usar resultados con fines comerciales.
  • Evita datos confidenciales o regulados en flujos de consumo.
  • Guarda archivos fuente, prompts y ajustes junto con el proyecto.
  • Usa referencias de personas, voces e imagen personal solo con consentimiento.
  • Revisa que los resultados encajen con la marca antes de publicarlos.

Preguntas frecuentes

¿Cuál es la mejor estructura para prompts de AI efectivos?

Usa sujeto, contexto, composición, iluminación, color, estilo, restricciones y ajustes. Para video, suma acción, movimiento de cámara, timing y duración.

¿Qué tan largo debe ser un prompt de AI?

Lo suficiente para ser específico y lo bastante breve para mantenerse enfocado. Un buen prompt suele tener de 1 a 4 frases claras más los ajustes.

¿Conviene usar negative prompts?

Úsalos solo cuando el motor los soporte bien. Si no, escribe restricciones positivas que describan el resultado que quieres.

¿Por qué mis prompts de video dan resultados desordenados?

La mayoría de los videos desordenados salen de pedir demasiadas acciones o movimientos de cámara. Mantén cada clip corto en una acción principal y un movimiento de cámara.

¿Necesito autoalojar modelos para obtener buenos resultados?

No. Las herramientas alojadas y administradas pueden producir resultados sólidos sin configuración. Vynzo ejecuta motores potentes de imagen y video por ti en /studio.

Sigue aprendiendo

Del prompt al resultado. Solo crea.

Aplica estas técnicas en Vynzo, el estudio de AI todo en uno para imágenes y video.

Empieza gratis