¿Qué son los prompts para imágenes con AI?
Los prompts para imágenes con AI son instrucciones escritas que describen la imagen fija que quieres que un modelo genere o edite.
Un buen prompt le indica al modelo qué aparece en el encuadre, dónde está, cómo se compone la imagen, qué tipo de iluminación tiene y qué estilo visual debe seguir. A diferencia de los prompts para video, no necesitan una línea de tiempo, movimientos de cámara ni acciones que evolucionen con los segundos.
La mayoría de las herramientas modernas separan el prompt de los ajustes técnicos. Según el motor, la relación de aspecto, el tamaño, la semilla, la calidad, las imágenes de referencia y los prompts negativos pueden configurarse fuera del texto principal.
- Usa el prompt para dar dirección visual.
- Usa los ajustes para definir tamaño, relación de aspecto, semilla y opciones de salida.
- Usa referencias cuando importen el estilo, la composición o la consistencia de identidad.
- Usa instrucciones de edición cuando quieras modificar una imagen existente.
La estructura de prompt que funciona en distintos modelos
Los mejores prompts para imágenes con AI suelen seguir este orden: sujeto, contexto, composición, iluminación, color, estilo, detalles, restricciones y ajustes.
Este orden funciona porque va de la idea visual más importante a los controles finales de producción. También facilita corregir errores. Si el sujeto está mal, ajusta la primera parte. Si la atmósfera no funciona, revisa iluminación, color y estilo. Si el recorte no es el correcto, cambia la composición o la relación de aspecto.
No tienes que usar todos los campos cada vez. Una imagen hero de producto puede necesitar materiales exactos y espacio para texto. Un boceto conceptual quizá solo necesite sujeto, ambiente y estilo.
| Atributo | Qué especificar | Ejemplos |
|---|---|---|
| Sujeto | Quién o qué es el foco principal | Una botella de agua de acero inoxidable; una casa de cedro junto a un lago; un zorro con impermeable amarillo |
| Contexto | Dónde existe el sujeto | Sobre basalto negro mojado; dentro de un estudio blanco; en un bosque iluminado por la luna |
| Composición y ángulo | Cómo está organizado el encuadre | Flat lay cenital; toma amplia en contrapicado; centrado con espacio negativo a la izquierda |
| Iluminación | Fuente, calidad y contraste | Luz suave del amanecer; luz difusa de día nublado; luz cálida de ventana con contraluz frío |
| Color y gradación | Paleta y atmósfera | Tonos tierra apagados; paleta pastel en clave alta; gradación teal y ámbar |
| Estilo o medio | El lenguaje visual | Foto de producto fotorrealista; ilustración vectorial plana; portada de cuento en acuarela |
| Pistas de detalle | Texturas y notas de acabado | Trama visible de la tela; grano de película sutil; bordes vectoriales limpios; reflejos realistas |
| Restricciones | Qué debe mantenerse igual o evitarse | Texto exacto entre comillas; conservar la geometría de la etiqueta; no cambiar el fondo |
| Parámetros | Ajustes de la herramienta fuera del texto | Relación de aspecto; tamaño; calidad; semilla; referencia de estilo; prompt negativo cuando esté disponible |
Cómo escribir un prompt de imagen con AI paso a paso
Empieza por el uso final de la imagen y construye el prompt desde el sujeto hacia afuera.
Una imagen hero para una landing, un mockup de producto, una portada de álbum y una infografía requieren decisiones de prompt distintas. El uso final define la relación de aspecto, el nivel de realismo, el espacio para texto y cuántos detalles conviene incluir en el encuadre.
Cuando tengas un primer borrador, genera algunas opciones, compáralas con tu objetivo y cambia una sola cosa a la vez. Ese hábito importa más que simplemente agregar más palabras.
- 1. Nombra el uso final: imagen hero, mockup de anuncio, póster, arte conceptual, diagrama o post para redes.
- 2. Describe el sujeto con datos concretos: material, forma, edad, color, cantidad de objetos o rol.
- 3. Ubícalo en un contexto claro: estudio, calle, habitación, paisaje, fondo u hora del día.
- 4. Define el encuadre: close-up, toma abierta, flat lay, centrado, descentrado o espacio para texto.
- 5. Agrega iluminación, color y estilo según la marca o la atmósfera que buscas.
- 6. Cierra con restricciones y ajustes: texto exacto, áreas bloqueadas, relación de aspecto, tamaño, semilla o referencias.
Texto en imagen y bloqueo de edición: dos habilidades que muchos creadores pasan por alto
Para que el texto sea legible, escribe las palabras exactas entre comillas y describe ubicación, estilo tipográfico y espaciado.
Los modelos de imagen mejoraron mucho en tipografía, pero el texto todavía necesita prompts cuidadosos. En vez de pedir “un póster de oferta”, escribe el titular exacto, por ejemplo “SPRING LAUNCH”, e indica dónde debe aparecer. En diagramas o infografías complejas, lo normal es afinar el texto por pasadas.
Editar una imagen existente requiere lenguaje de bloqueo. Si solo quieres cambiar una parte, di qué se reemplaza y qué debe permanecer igual. Los buenos prompts de edición usan frases como “reemplazar solo el fondo”, “conservar exactamente el rostro y la pose”, “mantener la geometría de la etiqueta” y “no cambiar el diseño”.
Esto importa en assets de marca, fotos de producto, retratos, empaques y mockups de UI. El modelo necesita un límite claro, no solo un deseo.
- Para texto: escribe el copy exacto entre comillas.
- Para layout: indica la posición del texto y su relación de tamaño.
- Para ediciones: especifica qué cambia y qué se mantiene fijo.
- Para productos: conserva etiquetas, forma, reflejo y perspectiva cuando sea necesario.
- Para personas: conserva parecido, pose, iluminación y fondo cuando haga falta.
¿Cómo se comparan los motores de imagen en prompts, acceso y control?
Elige motores alojados si quieres velocidad y buen acabado; elige motores de pesos abiertos si necesitas control avanzado y estás dispuesto a configurarlos.
La elección del modelo cambia la forma en que responde el prompt. OpenAI GPT Image funciona bien con lenguaje natural y restricciones de edición precisas. Midjourney suele responder mejor a prompts más breves acompañados de parámetros. Google Imagen destaca con prompts detallados en lenguaje natural y trabajos centrados en tipografía. Adobe Firefly está pensado para flujos creativos simples y directos, con mejoras de prompt integradas.
Stable Diffusion y Wan juegan en otra categoría: son opciones de pesos abiertos o código abierto que puedes ejecutar, ajustar o automatizar por tu cuenta si tienes la infraestructura. Eso puede ser muy potente, pero también implica GPUs, gestión de modelos, actualizaciones y mantenimiento del flujo de trabajo.
Si quieres calidad sin esa configuración, Vynzo es el camino práctico. En Vynzo Studio, en /studio, los creadores pueden convertir prompts en imágenes y video dentro de un solo espacio de trabajo, sin instalar modelos ni saltar entre herramientas separadas. También puedes explorar herramientas específicas por modelo en /tools.
| Motor | Acceso | Ideal para | Enfoque de prompting | Notas de control, velocidad y costo |
|---|---|---|---|---|
| Vynzo | Estudio alojado todo en uno, sin self-hosting | Creadores que quieren generar imágenes y video en un espacio de trabajo limpio | Prompts en lenguaje natural con apoyo de flujo guiado | Inicio rápido, sin mantenimiento de GPU; canaliza el trabajo con motores capaces para resultados prácticos |
| OpenAI GPT Image | API alojada | Imágenes de producción, ediciones, texto en imagen y assets estructurados | Lenguaje natural con restricciones claras y bloqueo de edición | Alta calidad y uso sencillo; pagas por uso y sigues los términos del servicio |
| Midjourney | API alojada | Arte conceptual, moodboards, visuales estilizados y dirección de arte | Prompts concisos más parámetros como relación de aspecto, stylize, semilla y controles negativos | Exploración creativa rápida; menos control directo del modelo que con self-hosting |
| Google Imagen | API alojada | Fotorrealismo, tipografía y flujos de Google o Vertex | Lenguaje natural detallado: estilo, sujeto, entorno, acción y composición | Salida de alta calidad; los ajustes gestionan tamaños y relaciones compatibles |
| Adobe Firefly | API alojada | Visuales de marketing seguros para marca, flujos dentro de Adobe y ediciones rápidas | Lenguaje simple y directo, a menudo con mejora automática del prompt | Buena opción para equipos que ya usan Adobe; aplican precios y términos de servicio alojado |
| Stable Diffusion | Pesos abiertos | Pipelines personalizados, fine-tuning, automatización y control local | Prompts detallados, prompts negativos, pesos, referencias y nodos de flujo | Máxima personalización; requiere configuración, hardware y mantenimiento |
| Wan | Pesos abiertos | Flujos de imagen y video con self-hosting, investigación y pipelines personalizados | Prompts estructurados con sujeto, acción, entorno, estilo y especificaciones | Mucho control para equipos técnicos; la configuración y el cómputo corren por tu cuenta |
Parámetros, referencias y prompts negativos: ¿qué va fuera de la frase?
Algunos controles de imagen funcionan mejor como ajustes, no como más palabras dentro del prompt.
La relación de aspecto, el tamaño de salida, la semilla, la calidad, la referencia de estilo y los campos de prompt negativo suelen manejarse desde la interfaz del motor. Midjourney usa parámetros al final del prompt. OpenAI GPT Image usa campos de tamaño y calidad. Google Imagen expone tamaños y relaciones de aspecto compatibles. Los flujos de Stable Diffusion suelen mostrar muchos controles, como sampler, pasos, semilla y guidance.
Los prompts negativos sirven solo cuando el motor está diseñado para usarlos bien. Stable Diffusion permite prompts negativos y control de pesos. Midjourney ofrece parámetros de estilo negativo. Algunas herramientas prefieren redacción positiva, así que “fondo blanco limpio, un solo producto, etiqueta nítida” puede funcionar mejor que una lista larga de cosas para eliminar.
El flujo más repetible consiste en bloquear la semilla mientras pruebas cambios de redacción. Cuando el prompt ya funciona, cambia la semilla para explorar variaciones.
- Usa la relación de aspecto para definir el recorte, no una frase vaga como “imagen amplia”.
- Usa la semilla cuando compares cambios en el prompt.
- Usa referencias para estilo de marca, consistencia de personajes o forma de producto.
- Usa prompts negativos principalmente en sistemas diseñados para eso.
- Usa descripciones positivas cuando los prompts negativos generen resultados extraños.
Ejemplos resueltos: 4 prompts para imágenes con AI listos para adaptar
Los buenos ejemplos muestran la estructura en acción. Cada prompt de abajo incluye sujeto, contexto, encuadre, luz, estilo y restricciones.
Adapta la redacción según tu modelo. En Vynzo, puedes pegar el prompt en el estudio y ajustar el estilo o formato de salida desde el espacio de trabajo. En Midjourney, mueve la relación de aspecto y los controles de estilo a los parámetros. En flujos de OpenAI o Google, configura tamaño y calidad en los campos de la herramienta cuando estén disponibles.
- Hero de producto: Crea una imagen hero fotorrealista de una botella de agua premium de acero inoxidable, de pie sobre basalto negro mojado, luz suave del amanecer, condensación sutil, poca profundidad de campo, reflejos realistas, espacio negativo limpio a la izquierda para el titular, fotografía comercial premium, 16:9.
- Ilustración para landing SaaS: Ilustración 3D isométrica de un panel de operaciones de ciberseguridad flotando sobre una retícula oscura, tarjetas modulares, formas geométricas limpias, acentos cian y violeta, alta claridad, estilo de sitio web empresarial premium, amplio espacio para texto a la derecha, 16:9.
- Póster con texto: Diseña un póster moderno para una conferencia de diseño. Escultura abstracta de papel centrada sobre fondo crema, sombras suaves de estudio, acentos en cobalto y coral. Agrega el titular exacto “DESIGN SYSTEMS DAY” en la parte superior central con tipografía sans-serif limpia y en negrita, y una fecha más pequeña debajo, 4:5.
- Prompt de edición: Reemplaza solo el fondo por una cocina minimalista luminosa, conserva exactamente a la persona, el rostro, la pose, la ropa, el cabello, la dirección de la luz y la perspectiva de cámara, no cambies el sujeto en primer plano, fotografía editorial realista.
¿Qué hacer cuando la imagen casi funciona, pero algo falla?
Depura una variable visual a la vez: sujeto, composición, iluminación, estilo, texto o ajustes.
Si la imagen se ve bonita pero no sirve, normalmente al prompt le falta un trabajo específico. Agrega el uso final y el encuadre: “hero para landing con espacio para texto”, “portada cuadrada de álbum” o “foto de producto ecommerce sobre blanco”. Si el sujeto sale mal, suma cantidad de objetos, material y forma. Si el estilo se desvía, repite un medio claro como “fotografía editorial de producto” o “ilustración vectorial plana”.
Para errores de texto, acorta el copy, ponlo entre comillas y pide una ubicación clara. Si una edición cambia demasiado, refuerza el lenguaje de bloqueo. Si el resultado se siente genérico, agrega contexto, iluminación, color y detalles en lugar de palabras amplias como “bonito” o “cool”.
Para proyectos importantes, lleva un registro de prompts. Guarda el prompt, modelo, ajustes, semilla, referencias y notas sobre lo que cambió. Así el prompting deja de ser adivinanza y se vuelve un proceso creativo repetible.
| Problema | Causa probable | Mejor ajuste |
|---|---|---|
| Resultado genérico | Al prompt le faltan detalles concretos | Agrega atributos del sujeto, entorno, composición, iluminación y estilo |
| Recorte incorrecto | La relación de aspecto o el encuadre no están claros | Define la relación y describe el tipo de toma |
| Texto defectuoso | El copy o la ubicación son demasiado vagos | Pon las palabras exactas entre comillas y simplifica el diseño |
| La edición cambia demasiado | No se nombraron las áreas bloqueadas | Indica qué conservar y qué reemplazar únicamente |
| El estilo se desvía | La indicación de estilo es débil o inconsistente | Usa un solo medio claro y repite la misma redacción |
| Resultados difíciles de repetir | Cambió la semilla o la configuración | Bloquea la semilla y cambia una variable a la vez |
Derechos, privacidad y procedencia al crear prompts de imagen
Sube únicamente assets que tengas derecho a usar y revisa tanto los términos de la herramienta como la ley local.
Saber escribir prompts no elimina la responsabilidad legal. Si subes fotos de producto, marcas, retratos o materiales de clientes, confirma que tienes los derechos y permisos necesarios para ese flujo de trabajo. Los términos de salida de una plataforma pueden diferir de la protección de derechos de autor bajo la ley local.
La privacidad también importa. Los prompts y las imágenes de referencia pueden contener información sensible, personal o de negocio. Para trabajos de clientes o empresas, revisa cómo el proveedor maneja los datos, cuánto los conserva y qué dice sobre entrenamiento antes de usar flujos orientados al consumidor.
Cuando el proyecto lo requiera, planifica la divulgación y la trazabilidad desde el inicio. Algunos proveedores admiten sistemas de procedencia como C2PA, SynthID o Content Credentials. Trata esas señales como parte de la producción, no como algo de último momento.
