Создавайте новые визуальные концепции, применяйте редактирование изображений к выбранным областям, сохраняйте повторяющиеся объекты и используйте внешний контекст.
Обзор мультимодальной модели, где редактирование изображений дополняет генерацию, точечные правки, обоснованные концепции и последовательную дизайнерскую работу.
APIMart готовит интеграцию API Gemini Nano Banana 2.1. Когда интеграция будет готова, на этой странице будут опубликованы поддерживаемые идентификаторы моделей, форматы запросов, ограничения, цены и сведения о доступе.
Генерация, редактирование изображений, поиск, согласованность и творческое управление
Практические процессы для творческих, коммерческих, продуктовых команд и обработки изображений
Возможности изображений, входные данные, редактирование, управление и доступ через APIMart
Это мультимодальная модель Google для генерации изображений, редактирования изображений, создания с поисковым контекстом и последовательной доработки.
Модель работает с текстом и изображениями, а также использует видео как входной контекст, объединяя инструкции с визуальными референсами.
Редактирование изображений можно продолжать в нескольких диалоговых шагах, включая правки по маске для выбранных областей существующего материала.
Согласованность объектов является одним из приоритетов модели и полезна для повторного изображения человека, товара или предмета в связанных материалах.
Google Search и поиск изображений предоставляют внешний контекст для задач, которым нужны актуальные сведения или реальные визуальные материалы.
Документация указывает разрешения 1K, 2K и 4K и широкий выбор соотношений сторон для квадратных, портретных, альбомных и панорамных компоновок.
Параметр temperature не поддерживается. То же относится к topP и topK, а также к seed и logprobs; приложение не должно передавать их в запросе.
APIMart готовит интеграцию API Gemini Nano Banana 2.1. После ее готовности здесь появятся идентификаторы моделей, форматы запросов, ограничения, цены и сведения о доступе.
Откройте для себя другие модели в той же категории.

Nano banana
Nano Banana (gemini-2.5-flash-image-preview) is Google DeepMind's fast, conversational image generation and editing model. It delivers natural-language text-to-image, precise multi-turn edits, strong character consistency, and multi-image fusion at low latency.

Seedream 5.0 Pro
Seedream 5.0 Pro (seedream-5-0-pro) is quality-first text-to-image model. It produces cinematic 1K and 2K images with best-in-class text rendering, supports up to 10 reference images for style and character consistency, and unifies generation and editing in a single API call.

Midjourney
Midjourney is a leading text-to-image AI model renowned for its painterly aesthetics, strong composition, and cinematic lighting. Generate high-quality images from text prompts or reference images, with fine-grained control over style, aspect ratio, and creative parameters — accessible programmatically through APIMart's unified API, no Discord required.

Wan 2.7 Image
wan‑2‑7‑image is an advanced image generation model in Alibaba’s Wan 2.7 series designed to create high‑quality visuals from text prompts. It excels at generating detailed, realistic images with accurate object representation and rich composition. The model supports multimodal input (e.g., combining text with reference images) to influence style and structure, and it’s well‑suited for creative workflows such as marketing assets, product visuals, social media graphics, and artistic content production. With strong semantic understanding and prompt adherence, wan‑2‑7‑image delivers both fidelity and expressive visual output.