Ce modèle vidéo multimodal officiellement lancé par Google prend en charge la génération, le montage en langage naturel, l’interpolation d’images et la prolongation de vidéos. APIMart le propose via un canal officiel dédié, avec suivi asynchrone et facturation selon la résolution.
Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
Générez depuis du texte, animez des images de référence, interpolez une première et une dernière image ou modifiez une séquence existante. Choisissez 360p, 720p, 1080p ou 4K et gérez chaque tâche avec le flux asynchrone d’APIMart.
50K+
Utilisateurs actifs
99.9%
Disponibilité
2x
Plus rapide
70%
Économies
Des contrôles documentés pour la génération, l’interpolation, le montage et la prolongation
Utilisez les modes d’entrée documentés pour des créations et des automatisations maîtrisées
Créez une clé, envoyez une requête asynchrone valide et récupérez la vidéo terminée
Connectez-vous à APIMart, créez une clé API et envoyez-la comme jeton Bearer dans l’en-tête Authorization. Conservez-la côté serveur et ne l’exposez jamais dans du code client public.
Définissez model sur gemini-omni-1.1-flash et fournissez un prompt ou au moins une image ou vidéo compatible. Par défaut, resolution vaut 720p et aspect_ratio vaut 16:9.
Envoyez la requête et interrogez le task_id retourné jusqu’à la fin. L’URL se trouve dans result.videos[0].url ; téléchargez les résultats que vous souhaitez conserver durablement.
Entrées, paramètres, limites, facturation et gestion des tâches sur APIMart
Il s’agit du modèle vidéo multimodal officiellement lancé par Google pour la génération texte-vidéo et image-vidéo, l’interpolation de la première à la dernière image, le montage et la prolongation conversationnelle. Sur APIMart, utilisez l’identifiant dédié gemini-omni-1.1-flash avec l’API vidéo unifiée.
La requête accepte model, prompt, resolution, aspect_ratio, image_urls, first_frame_image, last_frame_image, image_with_roles, video_urls, metadata.task et extend_from_task_id. Un prompt ou au moins une image ou vidéo est requis.
Non. Les vidéos générées durent environ 3 à 10 secondes, mais cette API ne propose aucun paramètre duration. La sortie est à 24 ips et comprend l’audio généré.
Utilisez first_frame_image seul pour animer une image, ou associez-le à last_frame_image pour l’interpolation. Envoyer uniquement last_frame_image produit l’erreur 400 invalid_frame_images. Les deux images doivent avoir les mêmes proportions et correspondre à aspect_ratio.
Vous pouvez fournir jusqu’à 10 images au total, images de début et de fin comprises, ainsi qu’une seule vidéo de référence ou à modifier de 10 secondes maximum. Les URL HTTP(S) publiques et les data URL base64 compatibles sont acceptées. Les entrées audio et les liens YouTube ne le sont pas.
Envoyez POST /v1/videos/generations et conservez le task_id, puis interrogez GET /v1/tasks/{task_id} toutes les 5 à 10 secondes jusqu’au statut completed ou failed. Prévoyez un délai client pouvant atteindre 10 minutes pour les tâches 4K ou avec vidéo.
Pour un montage direct, transmettez une vidéo dans video_urls et un prompt ciblé. Pour poursuivre un résultat sans le téléverser à nouveau, placez l’ID d’une tâche APIMart réussie dans extend_from_task_id. Cette tâche doit appartenir à l’utilisateur actuel et avoir été créée avec un modèle Omni.
La résolution choisie fixe le tarif des jetons de sortie. APIMart réserve d’abord les crédits correspondant à 10 secondes au maximum, puis ajuste le coût selon les jetons réellement utilisés. Une tâche échouée n’est pas facturée et un solde insuffisant renvoie HTTP 402.
L’API n’accepte pas de system prompt, de temperature, de champ negative prompt, d’entrée audio ni de paramètre duration. Écrivez directement dans prompt les exclusions et les consignes sonores.
Vous pouvez nous joindre via le chat en direct en bas à droite de la page, nous envoyer un e-mail à [email protected], ou rejoindre notre communauté Discord. Notre équipe vous répondra dans les plus brefs délais.
Découvrez d'autres modèles de la même catégorie.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.