grok-imagine-2.0-extGrok Imagine 2.0 Ext es un modelo de generación de imágenes a partir de texto disponible mediante la API asíncrona de APIMart. Cada solicitud puede producir de 1 a 12 imágenes en una de las 7 relaciones de aspecto compatibles, con cobro según la cantidad de imágenes entregadas correctamente.

Image link valid for 72 hours
Precios transparentes sin tarifas ocultas. Paga solo por lo que uses.
* Los costos reales dependen del resultado final.
Un flujo específico de texto a imagen con parámetros de generación claros
Genera recursos visuales a partir de texto para flujos creativos y de producto
Configura el acceso, envía una tarea de texto a imagen y consulta el resultado
Inicia sesión en APIMart o crea una cuenta para acceder al panel.
Añade fondos al saldo de la cuenta antes de enviar solicitudes de generación en producción.
Crea una clave de API, envía grok-imagine-2.0-ext con un prompt de texto y consulta el ID de tarea devuelto para obtener las URL de las imágenes.
Respuestas sobre entradas, cantidad, relaciones de aspecto, tareas, calidad, URL y cobro
Solo admite la generación de imágenes a partir de texto. Envía un prompt de texto que no esté vacío; no se admiten la generación de imagen a imagen, las URL de imágenes ni las imágenes con roles.
El parámetro n acepta cualquier entero del 1 al 12 y su valor predeterminado es 1. Una interfaz sencilla puede ofrecer las opciones recomendadas 1, 4, 8 y 12.
Los 7 valores recomendados son 1:1, 2:3, 3:2, 3:4, 4:3, 9:16 y 16:9. No envíes valores no admitidos como 1:2, 2:1, 4:5 o auto.
Envía una solicitud POST a /v1/images/generations, guarda el ID devuelto y consulta /v1/tasks/{task_id}. Cuando la tarea esté completa, lee en el resultado las URL de las imágenes devueltas correctamente.
La calidad es fija: usa resolution=quality u omite el campo, sin elegir niveles de 1K, 2K o 4K. Los resultados solo se proporcionan mediante URL, que caduca a las 72 horas; guárdalos a tiempo.
El cobro se basa en la cantidad real de imágenes entregadas correctamente. Si se completan menos imágenes de las solicitadas, solo se cobran las correctas; las tareas fallidas no se cobran.
Explora más modelos de la misma categoría.

Nano banana
Nano Banana (gemini-2.5-flash-image-preview) is Google DeepMind's fast, conversational image generation and editing model. It delivers natural-language text-to-image, precise multi-turn edits, strong character consistency, and multi-image fusion at low latency.

Doubao Seedream 5.0 Pro
Seedream 5.0 Pro (doubao-seedream-5-0-pro) is ByteDance's quality-first text-to-image model. It produces cinematic 1K and 2K images with best-in-class text rendering, supports up to 10 reference images for style and character consistency, and unifies generation and editing in a single API call.

Midjourney
Midjourney is a leading text-to-image AI model renowned for its painterly aesthetics, strong composition, and cinematic lighting. Generate high-quality images from text prompts or reference images, with fine-grained control over style, aspect ratio, and creative parameters — accessible programmatically through APIMart's unified API, no Discord required.

Wan 2.7 Image
wan‑2‑7‑image is an advanced image generation model in Alibaba’s Wan 2.7 series designed to create high‑quality visuals from text prompts. It excels at generating detailed, realistic images with accurate object representation and rich composition. The model supports multimodal input (e.g., combining text with reference images) to influence style and structure, and it’s well‑suited for creative workflows such as marketing assets, product visuals, social media graphics, and artistic content production. With strong semantic understanding and prompt adherence, wan‑2‑7‑image delivers both fidelity and expressive visual output.