Официально выпущенная Google мультимодальная видеомодель поддерживает генерацию, редактирование на естественном языке, интерполяцию кадров и продолжение видео. APIMart предоставляет её через отдельный официальный канал с отслеживанием асинхронных задач и тарификацией по разрешению.
Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
Создавайте видео из текста, анимируйте референсные изображения, интерполируйте начальный и конечный кадры или редактируйте готовый ролик. Выбирайте 360p, 720p, 1080p или 4K и управляйте задачами через асинхронный процесс APIMart.
50K+
Активные пользователи
99.9%
Время работы
2x
Быстрее
70%
Экономия
Документированные настройки для генерации, интерполяции, редактирования и продолжения видео
Используйте документированные режимы ввода для управляемого производства и автоматизации
Создайте ключ, отправьте корректный асинхронный запрос и получите готовый ролик
Войдите в APIMart, создайте API-ключ и отправляйте его как Bearer-токен в заголовке Authorization. Храните ключ на сервере и не публикуйте его в клиентском коде.
Установите model в gemini-omni-1.1-flash и передайте prompt либо хотя бы одно поддерживаемое изображение или видео. По умолчанию resolution равно 720p, а aspect_ratio — 16:9.
Отправьте задачу и проверяйте полученный task_id до завершения. URL ролика находится в result.videos[0].url; скачайте файл, если результат нужно хранить долго.
Входные данные, параметры, ограничения, тарификация и обработка задач в APIMart
Это официально выпущенная Google мультимодальная видеомодель для создания видео из текста и изображений, интерполяции первого и последнего кадров, редактирования и последовательного продолжения. В APIMart используйте отдельный ID модели gemini-omni-1.1-flash с единым видеоинтерфейсом.
Поддерживаются model, prompt, resolution, aspect_ratio, image_urls, first_frame_image, last_frame_image, image_with_roles, video_urls, metadata.task и extend_from_task_id. Необходимо передать prompt или хотя бы одно изображение либо видео.
Нет. Ролики длятся примерно 3–10 секунд, но API не предоставляет параметр duration. Результат имеет частоту 24 кадра/с и включает сгенерированный звук.
Для анимации изображения передайте только first_frame_image, а для интерполяции — first_frame_image вместе с last_frame_image. Если отправить только last_frame_image, API вернёт ошибку 400 invalid_frame_images. Пропорции кадров должны совпадать и соответствовать aspect_ratio.
Допускается суммарно до 10 изображений с учётом начального и конечного кадров и не более одного референсного или редактируемого видео длительностью до 10 секунд. Поддерживаются публичные HTTP(S) URL и совместимые base64 data URL. Аудио и ссылки YouTube не поддерживаются.
Отправьте POST /v1/videos/generations и сохраните task_id. Опрашивайте GET /v1/tasks/{task_id} каждые 5–10 секунд до статуса completed или failed. Для заданий 4K и задач с видео установите тайм-аут клиента до 10 минут.
Для прямого редактирования передайте один ролик в video_urls и краткий промпт. Чтобы продолжить предыдущий результат без повторной загрузки, укажите ID успешной задачи APIMart в extend_from_task_id. Она должна принадлежать текущему пользователю и быть создана моделью Omni.
Выбранное разрешение определяет стоимость выходных токенов. APIMart сначала резервирует средства за максимум 10 секунд, а после успеха корректирует списание по фактическим токенам. Неудачная задача не оплачивается, а при нехватке средств возвращается HTTP 402.
Интерфейс не принимает system prompt, temperature, отдельное поле negative prompt, аудиофайлы и параметр duration. Ограничения и требования к звуку указывайте непосредственно в prompt.
Вы можете обратиться к нам через чат в правом нижнем углу страницы, написать на [email protected] или присоединиться к нашему сообществу в Discord. Наша команда ответит вам как можно скорее.
Откройте для себя другие модели в той же категории.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.