
Guide API Vidu : modèle MoE et accès série Q
Accédez à Vidu MoE, Q3 Pro et Q3 Turbo via une clé APIMart. Comparez les modèles, des prix dès 0,048 $/sec et le flux API asynchrone texte/image-vers-vidéo.
S'il fallait résumer en une ligne : utilisez Vidu MoE pour la logique de prompt plus difficile, Q3 Pro pour la sortie finale et Q3 Turbo pour les tests à moindre coût, le tout via une seule configuration APIMart.
Voici la version courte sur laquelle vous pouvez agir tout de suite :
- Je peux accéder à Vidu MoE, Vidu Q3 Pro et Vidu Q3 Turbo via APIMart avec une seule clé API et un seul flux de requête principal.
- L'endpoint central est
POST https://api.apimart.ai/v1/videos/generations. - Les jobs vidéo sont asynchrones, j'obtiens donc d'abord un
task_id, puis je sondeGET /v1/tasks/{task_id}ou j'utilisecallback_url. - Vidu prend en charge :
- le texte-vers-vidéo
- l'image-vers-vidéo
- la vidéo basée sur référence
- les transitions première-dernière image
- Les modèles Q3 ajoutent un audio intégré comme les dialogues, les effets sonores et la musique.
- Les clips peuvent durer jusqu'à 16 secondes, avec une sortie en 540p, 720p ou 1080p.
- La tarification APIMart de l'article indique :
- Q3 Pro : environ 0,12 $/sec en 720p
- Q3 Turbo : environ 0,048 $/sec en 720p
- Les liens de sortie expirent après 24 heures, je dois donc télécharger les fichiers peu après le succès.

Comparaison rapide
| Modèle | Meilleur usage | Atout principal | Compromis principal | Prix dans l'article |
|---|---|---|---|---|
| Vidu MoE | Prompts multi-scènes plus difficiles | Meilleur contrôle du prompt et logique de scène | Plus lent et plus coûteux | Premium |
| Vidu Q3 Pro | Vidéos finales | Sortie de meilleure qualité, 1080p, synchro audio-vidéo | Coûte plus cher que Turbo | $0.12/sec |
| Vidu Q3 Turbo | Tests, brouillons, travail par lots | Coût plus bas et temps d'attente réduit | Moins de détails visuels que Pro | $0.048/sec |
Ce qui me frappe, c'est la simplicité du changement : dans la plupart des cas, je change juste le champ model et garde le reste de la configuration identique. Cela fait que l'article porte moins sur le travail de configuration et davantage sur le choix du bon modèle pour le coût, le temps d'attente et la qualité de sortie.
Les modèles Vidu expliqués : MoE vs série Q

Le modèle MoE de Vidu : de quoi il s'agit et quand l'utiliser
Le modèle MoE (Mixture of Experts) envoie différentes parties d'une tâche de génération à des experts spécialisés pour le mouvement, la cohérence de scène et le contrôle du prompt. Il a le plus de sens pour les prompts multi-scènes ou plus longs où la cohérence compte plus que la vitesse brute.
Il y a un hic, toutefois. MoE demande plus de calcul et a un temps de rotation plus lent que la série Q [7]. Pour des prompts simples, c'est souvent plus que ce dont vous avez besoin.
La série Q de Vidu et Vidu Q3 Pro : des performances pour la production
Si MoE est le spécialiste, la série Q est l'option conçue pour le travail de production. Vidu Q3 Pro est conçu pour une sortie cinématographique soignée et des vidéos pilotées par storyboard [7]. Il prend en charge la vidéo 1080p, des clips jusqu'à 16 secondes et la génération audio-vidéo avec dialogues et effets sonores synchronisés [1][2][4]. Sur APIMart, Q3 Pro démarre à 0,12 $ la seconde [2][3].
Vidu Q3 Turbo penche davantage vers la vitesse et le coût plus bas, avec un changement de scène plus rapide [6][7]. Sur APIMart, Q3 Turbo démarre à 0,048 $ la seconde [3].
Comment choisir entre MoE et la série Q pour votre flux
Ce choix se résume surtout à la complexité du prompt, au temps de rotation et au budget. Si votre flux dépend d'un suivi strict des instructions et d'une logique multi-scènes, optez pour MoE. Si vous avez besoin d'une sortie soignée avec synchro audio-visuelle, Q3 Pro est le meilleur choix. Sinon, Kling V3 offre une autre option haute fidélité pour la vidéo IA cinématographique. Si votre objectif principal est l'itération rapide ou un coût par clip plus bas, Q3 Turbo est le choix pratique.
Le tableau ci-dessous associe chaque modèle au type de travail qu'il gère le mieux. Pour ceux qui comparent les options haut de gamme, Sora 2 offre des capacités cinématographiques similaires avec un audio synchronisé.
| Modèle | Idéal pour | Forces | Compromis | Latence | Prix (USD/sec) |
|---|---|---|---|---|---|
| Vidu MoE | Récits multi-scènes complexes | Suivi des instructions, logique de scène, cohérence | Coût de calcul plus élevé, rotation plus lente | Élevée | Premium |
| Vidu Q3 Pro | Production cinématographique | Qualité visuelle, synchro audio-visuelle, génération de storyboard | Coût plus élevé que Turbo | Moyenne | $0.12 [2] |
| Vidu Q3 Turbo | Itération rapide et traitement par lots | Vitesse de génération, rentabilité, changement de scène plus rapide | Détails visuels légèrement plus faibles | Faible | $0.048 [3] |
Ensuite, voyez comment sélectionner un modèle, vous authentifier et envoyer la requête via APIMart.
Comment accéder à Vidu via APIMart

Configuration du compte, authentification et gestion des clés API
Après avoir choisi un modèle, vous pouvez envoyer des jobs via APIMart avec une seule clé API. D'abord, créez un compte APIMart et générez votre clé depuis la page de gestion des clés API du tableau de bord [2][3].
Envoyez chaque requête avec un jeton Bearer dans l'en-tête Authorization :
Authorization: Bearer YOUR_API_KEY
Pour le stockage, gardez les clés dans des variables d'environnement ou un gestionnaire de secrets comme AWS Secrets Manager ou GCP Secret Manager. Il est aussi utile d'utiliser des clés distinctes pour le développement, le staging et la production. Si une clé est exposée, faites-la tourner tout de suite. Faites de même selon un calendrier régulier. Et quand vous journalisez les requêtes, n'enregistrez que le task_id - jamais le jeton lui-même [5].
Trouver les modèles Vidu, les prix et le schéma d'entrée dans APIMart
Une fois connecté, consultez le catalogue avant d'envoyer quoi que ce soit. C'est là que vous pouvez confirmer les noms de modèles, les entrées prises en charge et les prix actuels. Dans le catalogue d'APIMart, les modèles Vidu sont listés sous Video Generation. Vous pouvez aussi trouver d'autres modèles performants comme MiniMax-Hailuo-02 dans la même catégorie. Utilisez cette page pour comparer le schéma d'entrée, la résolution et le coût par seconde entre MoE, Q3 Pro et Q3 Turbo [2][3].
Les principaux champs à surveiller sont :
modelpromptdurationresolutionaspect_ratio
Pour les jobs texte-vers-vidéo, utilisez aspect_ratio. Pour les jobs basés sur image, le système utilise plutôt le ratio de l'image source [2]. Les prompts texte sont limités à 2 000 caractères [2][3].
Endpoints, structure de requête et gestion des jobs asynchrones
Après avoir choisi le modèle, soumettez la requête de génération et suivez le job asynchrone avec le task_id renvoyé. Envoyez une requête POST à https://api.apimart.ai/v1/videos/generations, puis sondez le statut du job avec GET https://api.apimart.ai/v1/tasks/{task_id} [2][5].
Les jobs passent par ces états :
submittedqueueingprocessingsuccessoufailed
Si vous voulez qu'APIMart notifie votre app quand le job est terminé, ajoutez callback_url et recevez le résultat par webhook [5]. Une fois le job en succès, téléchargez le fichier tout de suite. À partir de là, vous pouvez mapper les champs de requête vers un flux texte-vers-vidéo ou un flux basé sur référence.
Intégration pas à pas pour le texte-vers-vidéo et la vidéo basée sur référence
Flux texte-vers-vidéo de base avec sélection de modèle
Après avoir choisi un modèle dans le catalogue, le flux texte-vers-vidéo est assez simple. Envoyez votre clé API depuis le côté serveur dans l'en-tête Authorization sous la forme Bearer {your_api_key}.
Voici une charge utile minimale pour un job texte-vers-vidéo avec viduq3-pro :
{
"model": "viduq3-pro",
"prompt": "A red fox running through a snowy forest at dusk, cinematic slow motion",
"duration": 8,
"resolution": "720p",
"aspect_ratio": "16:9",
"audio": true
}
La réponse inclut un task_id et un statut comme submitted, queueing ou processing. Ensuite, vous pouvez soit sonder GET /v1/tasks/{task_id} avec le task_id renvoyé, soit passer un callback_url dans la requête pour que la plateforme notifie votre app quand le job atteint success ou failed [1][7][10]. Si vous voulez passer à viduq3-turbo, vous changez surtout juste le champ model.
Le schéma asynchrone reste le même entre les modes. Ce qui change, ce sont les champs d'entrée.
Ajout d'entrées image ou de référence et contrôles avancés
Pour l'image-vers-vidéo, passez une URL d'image dans le tableau image_urls. Utilisez 0 image pour le texte-vers-vidéo, 1 pour l'image-vers-vidéo et 2 pour le mode première-dernière image [2]. Dans les modes basés sur image, le format d'image de sortie provient de l'image source, vous pouvez donc omettre aspect_ratio [2]. Si vous téléversez des fichiers directement au lieu d'utiliser des URL, gardez chaque image au format PNG, JPEG ou WebP, sous 50 Mo, et gardez le corps HTTP total sous 20 Mo [9][8].
Pour la génération basée sur référence, utilisez l'endpoint /reference2video avec un tableau subjects. Définissez chaque sujet avec un name et ses images, puis appelez-le dans le prompt avec @subjectname. Les modèles Q3 autorisent jusqu'à 7 images de référence ou descriptions textuelles dans la fonctionnalité subjects [6]. Si vous utilisez le mode première-dernière image, gardez les deux images proches en format d'image, idéalement dans un ratio de 0,8 à 1,25, pour réduire les échecs [8]. Quand des visages ou des mains sont impliqués, gardez les prompts de mouvement subtils pour réduire les artefacts de distorsion [5].
Le tableau ci-dessous montre les principaux paramètres des deux flux :
| Paramètre | Type | Plage / options valides | S'applique à |
|---|---|---|---|
model | String | viduq3-pro, viduq3-turbo | Tous |
prompt | String | Max 2 000 caractères | Tous (requis pour le texte-vers-vidéo ; optionnel pour l'image-vers-vidéo) |
duration | Integer | 1–16s | Tous |
resolution | String | 540p, 720p, 1080p | Tous |
aspect_ratio | String | 16:9, 9:16, 4:3, 3:4, 1:1 | Texte-vers-vidéo uniquement |
audio | Boolean | true, false | true par défaut pour Q3 |
seed | Integer | -1 à 4,294,967,295 | Tous |
off_peak | Boolean | true, false | Tous |
callback_url | String | URL de webhook optionnelle pour les mises à jour de statut | Tous |
Réglez un seed fixe pendant les tests si vous voulez le même résultat visuel d'une exécution à l'autre [2][9]. Pour les jobs par lots non urgents, réglez off_peak sur true. Ces tâches s'achèvent généralement dans les 48 heures et consomment moins de crédits [1][6].
Suivi de l'usage, du coût et de la fiabilité en production
Une fois votre requête fonctionnelle, le job suivant consiste à garder le coût et la fiabilité sous contrôle en production.
Journalisez le task_id et l'horodatage de chaque requête. Cela vous donne un moyen sûr de déboguer sans stocker d'identifiants sensibles [5]. Il est aussi utile de suivre séparément le temps de file d'attente et le temps de génération, pour distinguer le délai de la plateforme de la latence du modèle.
Pour l'estimation des coûts, Vidu Q3 Pro en 720p coûte environ 0,12 $ par seconde sur APIMart, et Q3 Turbo environ 0,048 $ par seconde [3]. Réglez des alertes automatiques à 50 %, 80 % et 100 % de votre plafond de budget mensuel pour que les dépenses ne s'emballent pas [5].
Les relances comptent aussi. Sur les erreurs 5xx, utilisez un backoff exponentiel : réessayez à 2 secondes, puis 5 secondes, puis 15 secondes avant de montrer une erreur à l'utilisateur [5]. Les modèles de la série Vidu Q3 sont fournis avec un SLA de 99,9 % pour les charges de production [3], mais des échecs éphémères surviennent quand même, les relances doivent donc faire partie de toute version mise en production.
Liste de contrôle de sélection de modèle et points clés
Liste de contrôle de cas d'usage pour développeurs, créateurs et équipes produit
Choisissez selon trois critères : complexité du prompt, vitesse et qualité de sortie. Le tableau ci-dessous transforme la comparaison des modèles en un choix de mise en production pratique.
| Scénario | Meilleur modèle | Pourquoi |
|---|---|---|
| Pubs multi-scènes, storyboards, prompts complexes | Vidu MoE (viduq3-mix) | Idéal pour les prompts riches en instructions et les transitions de scène intelligentes |
| Promos de marque finales, visuels produit soignés | Vidu Q3 Pro (viduq3-pro) | Sortie 1080p cinématographique haute fidélité ; ~0,12 $/sec en 720p [3] |
| Prototypage rapide, brouillons et clips courts | Vidu Q3 Turbo (viduq3-turbo) | Idéal pour l'itération rapide à gros volume ; ~0,048 $/sec en 720p [3] |
| Cohérence des personnages entre les références | Vidu Q3 Pro (viduq3-pro) | Prend en charge jusqu'à 7 images de référence et requiert une entrée image [6][8] |
Une fois que vous avez choisi une ligne, gardez le même schéma de requête que dans la section d'intégration. En clair : lancez les idées dans Q3 Turbo, puis passez le rendu final en 1080p à Q3 Pro. C'est un flux simple, et il vous aide à avancer vite sans dépenser plus que nécessaire.
Pour les clips où la fidélité de mouvement compte le plus, visez 5 à 10 secondes au lieu de tendre vers le maximum de 16 secondes. Les clips plus courts donnent souvent un mouvement plus serré et moins de tracas.
Points clés à retenir avant la mise en production
MoE est le choix pour la logique complexe et multi-scènes. Q3 Pro vous donne une sortie 1080p cinématographique haute fidélité [3]. Q3 Turbo est l'option à moindre coût à 0,048 $/sec en 720p [3].
Sur APIMart, basculer entre ces modèles n'est qu'un simple changement du paramètre model. Tout le reste de la requête reste identique [3]. Cela veut dire que vous pouvez tester un modèle, passer à un autre et garder votre travail d'intégration stable.
Utilisez le même flux asynchrone à chaque fois :
- Soumettre la requête
- Récupérer le
task_id - Sonder le statut ou utiliser
callback_url
Aussi, téléchargez les vidéos générées peu après qu'elles soient prêtes. Les liens de sortie expirent après 24 heures [3][11].
FAQ
Par quel modèle Vidu commencer ?
Commencez par le modèle qui correspond à vos besoins en vitesse, audio et contrôle visuel.
- viduq3-pro : idéal pour la synchro audio-visuelle et la segmentation des plans
- viduq3-turbo : génération plus rapide que la version pro
- viduq1 ou viduq2 : choix solides pour une production vidéo stable et un mouvement de caméra fiable
Comment suivre un job vidéo après l'avoir soumis ?
Vous pouvez suivre votre tâche de génération vidéo de deux façons.
Pour la production, la meilleure option est d'inclure un callback_url dans votre requête initiale. Dans ce cas, l'API Vidu envoie les mises à jour de la tâche et les métadonnées du résultat directement à votre URL, automatiquement. Cela veut dire que vous n'avez pas à vérifier le statut de la tâche vous-même en continu.
L'autre option est de sonder l'API de requête de statut avec le task_id que vous obtenez après la soumission. Une fois que l'état de la tâche passe à success, la réponse inclura l'URL de téléchargement de la vidéo et d'autres métadonnées associées.
Quelles entrées et limites dois-je connaître avant d'intégrer ?
Avant d'intégrer l'API Vidu, assurez-vous que vos entrées restent dans ces limites :
- Images : PNG, JPEG, JPG ou WebP uniquement ; chaque fichier doit faire moins de 50 Mo et au moins 128×128 pixels
- Corps de requête HTTP total : 20 Mo max
- Prompts texte : jusqu'à 5 000 caractères
- Données passthrough de la charge utile : jusqu'à 1 048 576 caractères
Les limites de durée dépendent du modèle que vous utilisez. Q3 prend en charge 1–16 secondes, Q2 prend en charge 1–10 secondes, et Q1 prend en charge 5 secondes.
De plus, gardez vos clés API en sécurité. Ne les exposez pas dans le code côté client. Envoyez plutôt les requêtes via un intermédiaire côté serveur.
Choisissez le modèle qui vous convient dans le marketplace
Essayez les modèles de chat, image et vidéo sur le marketplace APIMart, puis découvrez rapidement leurs capacités avec une API unifiée.