O modelo de vídeo multimodal lançado oficialmente pelo Google oferece geração, edição em linguagem natural, interpolação de quadros e extensão de vídeo. A APIMart o disponibiliza por um canal oficial dedicado, com acompanhamento assíncrono e cobrança por resolução.
Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
Gere a partir de texto, anime imagens de referência, interpole entre os quadros inicial e final ou edite um clipe existente. Escolha 360p, 720p, 1080p ou 4K e gerencie cada tarefa pelo fluxo assíncrono da APIMart.
50K+
Usuários Ativos
99.9%
Tempo Ativo
2x
Mais Rápido
70%
Economia de Custos
Controles documentados para geração, interpolação, edição e extensão
Use os modos de entrada documentados para produção e automação controladas
Crie uma chave, envie uma solicitação assíncrona válida e recupere o vídeo concluído
Entre na APIMart, crie uma chave de API e envie-a como token Bearer no cabeçalho Authorization. Mantenha a chave no servidor e nunca a exponha em código cliente público.
Defina model como gemini-omni-1.1-flash e forneça um prompt ou pelo menos uma imagem ou vídeo compatível. Se omitidos, resolution usa 720p e aspect_ratio usa 16:9.
Envie a solicitação e consulte o task_id retornado até a conclusão. Obtenha a URL em result.videos[0].url e baixe os resultados que precisam ser mantidos por longo prazo.
Entradas, parâmetros, limites, cobrança e processamento de tarefas na APIMart
É o modelo de vídeo multimodal lançado oficialmente pelo Google para texto em vídeo, imagem em vídeo, interpolação entre quadros inicial e final, edição e extensão conversacional. Na APIMart, use o ID dedicado gemini-omni-1.1-flash com a API de vídeo unificada.
A solicitação aceita model, prompt, resolution, aspect_ratio, image_urls, first_frame_image, last_frame_image, image_with_roles, video_urls, metadata.task e extend_from_task_id. É necessário fornecer um prompt ou pelo menos uma imagem ou vídeo.
Não. Os clipes gerados têm aproximadamente 3–10 segundos, mas esta API não oferece o parâmetro duration. A saída tem 24 fps e inclui áudio gerado.
Use apenas first_frame_image para imagem em vídeo ou envie junto com last_frame_image para interpolação. Enviar somente last_frame_image produz o erro 400 invalid_frame_images. As duas imagens devem ter as mesmas proporções e corresponder a aspect_ratio.
Você pode fornecer até 10 imagens no total, incluindo os quadros inicial e final, e no máximo um vídeo de referência ou para edição com até 10 segundos. URLs HTTP(S) públicas e data URLs base64 compatíveis são aceitas. Entradas de áudio e links do YouTube não são compatíveis.
Envie POST /v1/videos/generations e salve o task_id. Consulte GET /v1/tasks/{task_id} a cada 5–10 segundos até o status completed ou failed. Use um tempo limite de cliente de até 10 minutos para tarefas em 4K ou com entrada de vídeo.
Para edição direta, envie um clipe em video_urls e um prompt objetivo. Para continuar um resultado sem novo upload, informe o ID de uma tarefa bem-sucedida da APIMart em extend_from_task_id. A tarefa deve pertencer ao usuário atual e ter sido criada com um modelo Omni.
A resolução selecionada define a tarifa dos tokens de saída. A APIMart primeiro reserva créditos para um resultado máximo de 10 segundos e ajusta o custo ao uso real após o sucesso. Uma tarefa com falha não é cobrada e saldo insuficiente retorna HTTP 402.
O endpoint não aceita system prompt, temperature, campo específico de negative prompt, entrada de áudio nem parâmetro duration. Escreva exclusões e orientações de som diretamente no prompt.
Você pode nos contatar pelo chat ao vivo no canto inferior direito da página, enviar um e-mail para [email protected] ou entrar na nossa comunidade do Discord. Nossa equipe responderá o mais rápido possível.
Explore mais modelos da mesma categoria.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.