Generador de imágenes
Crea imágenes con IA a partir de texto o fotos de referencia. En segundos obtendrás fotos de producto, ilustraciones de personajes, carteles con texto legible y retratos fotorrealistas en alta resolución.
Funciona con
-
OpenAI
-
Google
-
xAI
Ejemplos
Marea de cobalto en un taller de Paraty
Nano Banana 2. Una escena de taller de cerámica creada solo con un prompt, donde el esmalte de cobalto se eleva de un cuenco artesanal como una ola translúcida en miniatura.
Cómo usar Generador de imágenes
Una guía de decisión concisa para ubicar este pipeline en un flujo de trabajo.
Ideal para
- Temas concretos o de nicho sin vídeos de stock, como recreaciones históricas, conceptos de ciencia ficción o escenas fantásticas
- Imágenes conceptuales, como ideas abstractas, tecnologías futuras o escenas imposibles
- Una identidad visual coherente en varias imágenes, con la misma iluminación y paleta de color
- Visualizaciones y maquetas de producto
- Carteles con texto legible en alfabetos latinos y no latinos
Consejos
- Sé muy concreto: «Vehículo eléctrico futurista y fotorrealista en una carretera de montaña, ángulo bajo dramático, hora dorada e iluminación cinematográfica», no «coche en carretera»
- Si el resultado parece una ilustración y buscas una foto, añade expresamente «fotorrealista»
- Algunas indicaciones de estilo útiles son «cinematográfico», «iluminación dramática», «niebla volumétrica» y «poca profundidad de campo»
- Usa imágenes de referencia para mantener el sujeto, la pose o la forma del producto entre varias generaciones
API de Generador de imágenes
Llama a este pipeline desde tu propio código. Una petición lanza una ejecución; el modelo es un campo de entrada, no un endpoint aparte.
Obtener un token de API- entradas
- 7
- Precios
- 0.2 to 6.4 créditos
| Entrada | Tipo | por defecto | Descripción |
|---|---|---|---|
prompt | string | por defecto— | Describe la imagen que quieres. La IA enriquecerá la composición, la iluminación y el estilo. |
reference_images | array | por defecto— | Referencias de imagen opcionales. Auto y los modelos Gemini admiten hasta 14; GPT Image 2 admite hasta 5. El límite del modelo seleccionado se aplica automáticamente. |
aspect_ratio | enum | por defecto1:1 | Relación de aspecto de la imagen generada.1:1 · 16:9 · 9:16 +21:116:99:164:33:4 |
enhance_prompt | boolean | por defectotrue | Mejora el prompt para el modelo seleccionado antes de generar. Desactívalo para enviar el prompt sin cambios. |
model | enum | por defectoauto | Modelo de generación de imágenes que se utilizará. Deja Auto para que Pipe2.ai elija el más adecuado para tu prompt.auto · gemini-3-1-flash-image · gemini-3-pro-image +3autogemini-3-1-flash-imagegemini-3-pro-imagegpt-image-2grok-imagine-imagegrok-imagine-image-quality |
quality | enum | por defectoauto | Auto utiliza el nivel equilibrado del modelo elegido: GPT Image 2 medium o Gemini 3.1 Flash 2K. Fast genera imágenes más pequeñas y económicas (GPT Image 2 low o Gemini 3.1 Flash 1K); hd emplea el nivel superior y, con GPT Image 2, cuesta varias veces más que Auto. Gemini 3 Pro cambia el tamaño sin variar el precio.auto · fast · hdautofasthd |
reference_videos | array | por defecto— | Opcional: un vídeo de referencia; se utilizan aproximadamente los primeros 8 s. Solo Gemini 3.1 Flash admite vídeo a imagen. |
Apunta cualquier cliente MCP a pipe2 y tu agente obtiene estas herramientas. Encuentra este pipeline, lee el mismo esquema de arriba y lo ejecuta.
list_pipelinesget_pipeline_schemarun_pipelineget_pipeline_run_statusrequest_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}Recetas que usan este pipeline
Ver todas las recetas-
Un prompt → un reel de baile vertical con IA
Genera una cuadrícula etiquetada de movimientos de baile, úsala como referencia coreográfica para producir un baile sincronizado con la música y combina ambos elementos en un reel vertical.
-
Una caja corriente se abre a un diminuto mundo imposible
Crea una revelación silenciosa de un diminuto océano iluminado por la luna dentro de una caja de madera con tapa articulada: crea la escena abierta, cierra la tapa mediante una edición de imagen y después anima el descubrimiento.
Preguntas frecuentes
¿Qué puede crear el generador de imágenes?
¿Necesito una descripción y también imágenes de referencia?
¿Cuántas imágenes de referencia puedo usar?
¿Qué calidad de imagen puedo esperar?
¿Puede generar texto dentro de la imagen?
¿Cuántos créditos cuesta?
Generador de imágenes con IA
Genera imágenes de alta calidad a partir de una descripción o de fotos de referencia. Desde fotografías de producto y personajes hasta carteles con texto legible o retratos fotorrealistas: explica lo que buscas y recibe una imagen terminada en segundos.
Lo que puedes crear
- Fotografía de producto: imágenes de catálogo, escenas cotidianas y creatividades aspiracionales sin necesidad de estudio
- Arte de personajes: diseño de conceptos y variaciones a partir de una descripción o una foto de referencia
- Carteles con texto legible: tipografía nítida en alfabetos latinos y no latinos (japonés, coreano, chino, hindi, bengalí y árabe)
- Imágenes editoriales: portadas, cabeceras y publicaciones para redes en cualquier estilo
- Variaciones coherentes con la marca: sube una foto de producto o una referencia y crea imágenes que mantengan su identidad visual
Cómo funciona
- Describe la imagen: escribe lo que quieres o sube fotos de referencia. Auto y los modelos Gemini admiten hasta 14; GPT Image 2 admite hasta 5.
- Elige un modelo: o deja la selección en Auto para que Pipe2.ai decida entre borradores económicos, calidad HD equilibrada o tipografía premium
- Cómo decide Auto: los carteles con mucho texto utilizan el modelo especializado en tipografía; los retratos fotorrealistas, el que destaca en rostros y detalles de producto
- Perfecciona el resultado: modifica la descripción, añade referencias o cambia la relación de aspecto y vuelve a generar
Consejos para las indicaciones
- Concreta el sujeto, el estilo y la iluminación: «un telescopio antiguo de latón sobre un escritorio de madera, con luz cálida de tarde» funciona mejor que «telescopio»
- Para incluir texto en la imagen, escribe entre comillas el contenido exacto: «un cartel que diga "GRAN INAUGURACIÓN" en tipografía sans serif gruesa»
- Sube imágenes de referencia para anclar la pose, el color o la forma del producto en varias generaciones
- Elige la relación de aspecto según el destino: 1:1 para redes, 16:9 para banners y 9:16 para publicaciones verticales