MAI-Image-2.6 von Microsoft AI verbessert Textdarstellung, Porträts, 3D-Bilder, Produkt- und Markenvisuals sowie fotorealistische Ergebnisse. Entdecken Sie die bestätigten Fähigkeiten, während APIMart den API-Zugang vorbereitet.
Ein erster Blick auf die von Microsoft AI angekündigten Bildfunktionen
APIMart bereitet die Integration der MAI-Image-2.6 API vor. Zum Start veröffentlicht diese Seite unterstützte Eingabemodi, Parameter, Auflösungen, Limits, Preise und Zugangsdaten.
Bestätigte Fähigkeiten aus der Microsoft-AI-Ankündigung und dem Arena-Debüt
Kreativ- und Produktionsszenarien auf Basis der angekündigten Fähigkeiten
Bestätigte Modellinformationen und der kommende APIMart-Zugang
Die MAI-Image-2.6 API wird programmatischen Zugang zum Bildmodell von Microsoft AI bieten. Bestätigt sind Fortschritte bei Textdarstellung, Porträts, 3D, kommerziellem Design und Fotorealismus.
Zum Start belegte das Modell mit 1.336 Punkten Platz 2. Microsoft meldet insgesamt 79 Elo und bei der Textdarstellung 91 Elo mehr als MAI-Image-2.5.
Ja. Microsoft bestätigt eine deutlich stärkere Textdarstellung und meldet in dieser Arena-Kategorie ein Plus von 91 Elo gegenüber MAI-Image-2.5.
Microsoft nennt die Arbeit mit mehreren Referenzen und besseres Grounding. Anzahl, Dateivorgaben und APIMart-Workflows werden nach Integrationstests veröffentlicht.
Microsoft hat mehr Kontrolle über Format und Auflösung angekündigt, aber noch keine vollständigen Parameter veröffentlicht. APIMart dokumentiert die tatsächlich verfügbaren Optionen.
Der API-Zugang kommt bald; ein genaues Datum wurde nicht genannt. Dokumentation, Limits und Preise folgen mit der fertigen Integration.
Der endgültige API-Umfang ist noch nicht bestätigt. Eingaben, Referenzmodi, Auflösungen, Parameter, Konditionen und Preise werden zum Start veröffentlicht.
Sie erreichen uns über den Live-Chat unten rechts auf der Seite, per E-Mail an [email protected] oder über unsere Discord-Community. Unser Team wird sich so schnell wie möglich bei Ihnen melden.
Entdecken Sie weitere Modelle derselben Kategorie.

Nano banana
Nano Banana (gemini-2.5-flash-image-preview) is Google DeepMind's fast, conversational image generation and editing model. It delivers natural-language text-to-image, precise multi-turn edits, strong character consistency, and multi-image fusion at low latency.

Doubao Seedream 5.0 Pro
Seedream 5.0 Pro (doubao-seedream-5-0-pro) is ByteDance's quality-first text-to-image model. It produces cinematic 1K and 2K images with best-in-class text rendering, supports up to 10 reference images for style and character consistency, and unifies generation and editing in a single API call.

Midjourney
Midjourney is a leading text-to-image AI model renowned for its painterly aesthetics, strong composition, and cinematic lighting. Generate high-quality images from text prompts or reference images, with fine-grained control over style, aspect ratio, and creative parameters — accessible programmatically through APIMart's unified API, no Discord required.

Wan 2.7 Image
wan‑2‑7‑image is an advanced image generation model in Alibaba’s Wan 2.7 series designed to create high‑quality visuals from text prompts. It excels at generating detailed, realistic images with accurate object representation and rich composition. The model supports multimodal input (e.g., combining text with reference images) to influence style and structure, and it’s well‑suited for creative workflows such as marketing assets, product visuals, social media graphics, and artistic content production. With strong semantic understanding and prompt adherence, wan‑2‑7‑image delivers both fidelity and expressive visual output.