Créez une image, appliquez une retouche image aux zones choisies, préservez les sujets récurrents et exploitez une image externe au fil du processus créatif.
Aperçu d’un modèle multimodal d’image où chaque image et la retouche image soutiennent des révisions précises, des concepts ancrés et une conception itérative.
APIMart prépare l’intégration de l’API Gemini Nano Banana 2.1. Lorsque l’intégration sera prête, cette page présentera les identifiants de modèle pris en charge, les formats de requête, les limites, les tarifs et les modalités d’accès.
Génération, retouche image, ancrage, cohérence et contrôles créatifs
Processus visuels pour chaque image des équipes créatives, commerciales, produit et contenu
Capacités image, entrées, retouche, contrôles et traitement d’image avec APIMart
C’est un modèle multimodal de Google conçu pour la génération d’image, la retouche image, la création d’image ancrée par recherche et les révisions successives.
Le modèle accepte du texte et des images et peut employer une vidéo comme contexte afin d’associer des instructions à une référence d’image et à d’autres éléments visuels.
La retouche image peut se poursuivre sur plusieurs tours, avec notamment des masques qui dirigent les changements vers les zones choisies d’une image.
La cohérence des sujets est une priorité annoncée, utile lorsque la même personne, le même produit ou le même objet revient dans chaque image liée.
Google Search et la recherche d’images peuvent fournir un contexte externe lorsque la création d’une image dépend d’informations actuelles ou de références réelles.
La documentation mentionne les sorties 1K, 2K et 4K ainsi qu’un vaste choix de formats pour une image carrée, verticale, horizontale ou panoramique.
Le réglage temperature n’est pas pris en charge. Il en va de même pour topP et topK, ainsi que pour seed et logprobs; ces paramètres ne doivent pas être envoyés.
APIMart prépare l’intégration de l’API Gemini Nano Banana 2.1. Une fois prête, cette page publiera les identifiants, formats de requête, limites, tarifs et modalités d’accès.
Découvrez d'autres modèles de la même catégorie.

Nano banana
Nano Banana (gemini-2.5-flash-image-preview) is Google DeepMind's fast, conversational image generation and editing model. It delivers natural-language text-to-image, precise multi-turn edits, strong character consistency, and multi-image fusion at low latency.

Seedream 5.0 Pro
Seedream 5.0 Pro (seedream-5-0-pro) is quality-first text-to-image model. It produces cinematic 1K and 2K images with best-in-class text rendering, supports up to 10 reference images for style and character consistency, and unifies generation and editing in a single API call.

Midjourney
Midjourney is a leading text-to-image AI model renowned for its painterly aesthetics, strong composition, and cinematic lighting. Generate high-quality images from text prompts or reference images, with fine-grained control over style, aspect ratio, and creative parameters — accessible programmatically through APIMart's unified API, no Discord required.

Wan 2.7 Image
wan‑2‑7‑image is an advanced image generation model in Alibaba’s Wan 2.7 series designed to create high‑quality visuals from text prompts. It excels at generating detailed, realistic images with accurate object representation and rich composition. The model supports multimodal input (e.g., combining text with reference images) to influence style and structure, and it’s well‑suited for creative workflows such as marketing assets, product visuals, social media graphics, and artistic content production. With strong semantic understanding and prompt adherence, wan‑2‑7‑image delivers both fidelity and expressive visual output.