grok-imagine-2.0-extGrok Imagine 2.0 Ext est un modèle de génération d’images à partir de texte, disponible via l’API asynchrone d’APIMart. Chaque requête peut produire de 1 à 12 images dans l’un des 7 formats pris en charge, avec une facturation fondée sur le nombre d’images effectivement livrées avec succès.

Image link valid for 72 hours
Tarification transparente sans frais cachés. Ne payez que ce que vous utilisez.
* Les coûts réels dépendent du résultat final.
Un flux texte-vers-image ciblé, avec des paramètres de génération explicites
Générez des ressources visuelles à partir de texte pour vos processus créatifs et produit
Configurez votre accès, envoyez une tâche texte-vers-image et interrogez l’API pour obtenir le résultat
Connectez-vous à APIMart ou créez un compte pour accéder au tableau de bord.
Ajoutez des fonds à votre solde avant d’envoyer des requêtes de génération en production.
Créez une clé API, envoyez grok-imagine-2.0-ext avec une consigne textuelle, puis interrogez l’identifiant de tâche reçu pour obtenir les URL.
Réponses sur les entrées, le nombre d’images, les formats, les tâches, la qualité, les URL et la facturation
Le modèle prend uniquement en charge la génération d’images à partir de texte. Envoyez une consigne textuelle non vide ; la génération image-vers-image, les URL d’images et les images associées à des rôles ne sont pas acceptées.
Le paramètre n accepte tout entier de 1 à 12 et vaut 1 par défaut. Une interface simple peut proposer les choix recommandés 1, 4, 8 et 12.
Les 7 rapports recommandés sont 1:1, 2:3, 3:2, 3:4, 4:3, 9:16 et 16:9. N’envoyez pas de valeurs non prises en charge comme 1:2, 2:1, 4:5 ou auto.
Envoyez une requête POST à /v1/images/generations, conservez l’identifiant retourné et interrogez /v1/tasks/{task_id}. Lorsque la tâche est terminée, lisez dans le résultat les URL des images renvoyées avec succès.
La qualité est fixe : utilisez resolution=quality ou omettez-le, sans choisir de palier 1K, 2K ou 4K. Les résultats sont fournis uniquement par URL, qui expire après 72 heures ; enregistrez-les à temps.
La facturation repose sur le nombre réel d’images livrées avec succès. Si moins d’images réussissent que prévu, seules celles-ci sont facturées ; une tâche échouée ne l’est pas.
Découvrez d'autres modèles de la même catégorie.

Nano banana
Nano Banana (gemini-2.5-flash-image-preview) is Google DeepMind's fast, conversational image generation and editing model. It delivers natural-language text-to-image, precise multi-turn edits, strong character consistency, and multi-image fusion at low latency.

Doubao Seedream 5.0 Pro
Seedream 5.0 Pro (doubao-seedream-5-0-pro) is ByteDance's quality-first text-to-image model. It produces cinematic 1K and 2K images with best-in-class text rendering, supports up to 10 reference images for style and character consistency, and unifies generation and editing in a single API call.

Midjourney
Midjourney is a leading text-to-image AI model renowned for its painterly aesthetics, strong composition, and cinematic lighting. Generate high-quality images from text prompts or reference images, with fine-grained control over style, aspect ratio, and creative parameters — accessible programmatically through APIMart's unified API, no Discord required.

Wan 2.7 Image
wan‑2‑7‑image is an advanced image generation model in Alibaba’s Wan 2.7 series designed to create high‑quality visuals from text prompts. It excels at generating detailed, realistic images with accurate object representation and rich composition. The model supports multimodal input (e.g., combining text with reference images) to influence style and structure, and it’s well‑suited for creative workflows such as marketing assets, product visuals, social media graphics, and artistic content production. With strong semantic understanding and prompt adherence, wan‑2‑7‑image delivers both fidelity and expressive visual output.