MAI-Image-2.6 mejora el texto, los retratos, las imágenes 3D, los visuales de producto y marca y el resultado fotorrealista. Explora las capacidades confirmadas mientras APIMart prepara el acceso por API.
Un primer vistazo a las capacidades de imagen anunciadas por Microsoft AI
APIMart prepara la integración de MAI-Image-2.6. Al lanzarse, esta página publicará los modos de entrada, parámetros, resoluciones, límites, precios y detalles de acceso.
Capacidades confirmadas en el anuncio de Microsoft AI y el debut en Arena
Escenarios creativos y de producción basados en las capacidades anunciadas
Información confirmada del modelo y próximo acceso en APIMart
Ofrecerá acceso programático al modelo de imágenes de Microsoft AI. Microsoft ha confirmado mejoras en texto, retratos, 3D, diseño comercial y fotorrealismo.
En el lanzamiento quedó n.º 2 con 1.336 puntos. Microsoft anuncia 79 Elo de mejora general y 91 Elo en texto frente a MAI-Image-2.5.
Sí. Microsoft confirma un texto más sólido y una mejora de 91 Elo en esa categoría de Arena.
Microsoft menciona varias referencias y una base semántica más rica. Cantidades, archivos y flujos de APIMart se publicarán tras las pruebas de integración.
Microsoft ha anunciado más control sobre formato y resolución sin publicar todos los parámetros. APIMart documentará las opciones realmente disponibles.
El acceso por API llegará pronto, pero no hay una fecha exacta. La documentación, los límites y los precios se publicarán con la integración.
El alcance final no está confirmado. Entradas, referencias, resoluciones, parámetros, condiciones comerciales y precios se publicarán en el lanzamiento.
Puedes contactarnos a través del chat en vivo en la esquina inferior derecha de la página, enviarnos un correo a [email protected] o unirte a nuestra comunidad de Discord. Nuestro equipo te responderá lo antes posible.
Explora más modelos de la misma categoría.

Nano banana
Nano Banana (gemini-2.5-flash-image-preview) is Google DeepMind's fast, conversational image generation and editing model. It delivers natural-language text-to-image, precise multi-turn edits, strong character consistency, and multi-image fusion at low latency.

Doubao Seedream 5.0 Pro
Seedream 5.0 Pro (doubao-seedream-5-0-pro) is ByteDance's quality-first text-to-image model. It produces cinematic 1K and 2K images with best-in-class text rendering, supports up to 10 reference images for style and character consistency, and unifies generation and editing in a single API call.

Midjourney
Midjourney is a leading text-to-image AI model renowned for its painterly aesthetics, strong composition, and cinematic lighting. Generate high-quality images from text prompts or reference images, with fine-grained control over style, aspect ratio, and creative parameters — accessible programmatically through APIMart's unified API, no Discord required.

Wan 2.7 Image
wan‑2‑7‑image is an advanced image generation model in Alibaba’s Wan 2.7 series designed to create high‑quality visuals from text prompts. It excels at generating detailed, realistic images with accurate object representation and rich composition. The model supports multimodal input (e.g., combining text with reference images) to influence style and structure, and it’s well‑suited for creative workflows such as marketing assets, product visuals, social media graphics, and artistic content production. With strong semantic understanding and prompt adherence, wan‑2‑7‑image delivers both fidelity and expressive visual output.