APIMart
Guide API Vidu : modèle MoE et accès série Q

Guide API Vidu : modèle MoE et accès série Q

Accédez à Vidu MoE, Q3 Pro et Q3 Turbo via une clé APIMart. Comparez les modèles, des prix dès 0,048 $/sec et le flux API asynchrone texte/image-vers-vidéo.

Tutoriel

S'il fallait résumer en une ligne : utilisez Vidu MoE pour la logique de prompt plus difficile, Q3 Pro pour la sortie finale et Q3 Turbo pour les tests à moindre coût, le tout via une seule configuration APIMart.

Voici la version courte sur laquelle vous pouvez agir tout de suite :

  • Je peux accéder à Vidu MoE, Vidu Q3 Pro et Vidu Q3 Turbo via APIMart avec une seule clé API et un seul flux de requête principal.
  • L'endpoint central est POST https://api.apimart.ai/v1/videos/generations.
  • Les jobs vidéo sont asynchrones, j'obtiens donc d'abord un task_id, puis je sonde GET /v1/tasks/{task_id} ou j'utilise callback_url.
  • Vidu prend en charge :
  • Les modèles Q3 ajoutent un audio intégré comme les dialogues, les effets sonores et la musique.
  • Les clips peuvent durer jusqu'à 16 secondes, avec une sortie en 540p, 720p ou 1080p.
  • La tarification APIMart de l'article indique :
    • Q3 Pro : environ 0,12 $/sec en 720p
    • Q3 Turbo : environ 0,048 $/sec en 720p
  • Les liens de sortie expirent après 24 heures, je dois donc télécharger les fichiers peu après le succès.
Modèles de l'API Vidu comparés : MoE vs Q3 Pro vs Q3 Turbo
Modèles de l'API Vidu comparés : MoE vs Q3 Pro vs Q3 Turbo

Comparaison rapide

ModèleMeilleur usageAtout principalCompromis principalPrix dans l'article
Vidu MoEPrompts multi-scènes plus difficilesMeilleur contrôle du prompt et logique de scènePlus lent et plus coûteuxPremium
Vidu Q3 ProVidéos finalesSortie de meilleure qualité, 1080p, synchro audio-vidéoCoûte plus cher que Turbo$0.12/sec
Vidu Q3 TurboTests, brouillons, travail par lotsCoût plus bas et temps d'attente réduitMoins de détails visuels que Pro$0.048/sec

Ce qui me frappe, c'est la simplicité du changement : dans la plupart des cas, je change juste le champ model et garde le reste de la configuration identique. Cela fait que l'article porte moins sur le travail de configuration et davantage sur le choix du bon modèle pour le coût, le temps d'attente et la qualité de sortie.

Les modèles Vidu expliqués : MoE vs série Q

Vidu

Le modèle MoE de Vidu : de quoi il s'agit et quand l'utiliser

Le modèle MoE (Mixture of Experts) envoie différentes parties d'une tâche de génération à des experts spécialisés pour le mouvement, la cohérence de scène et le contrôle du prompt. Il a le plus de sens pour les prompts multi-scènes ou plus longs où la cohérence compte plus que la vitesse brute.

Il y a un hic, toutefois. MoE demande plus de calcul et a un temps de rotation plus lent que la série Q [7]. Pour des prompts simples, c'est souvent plus que ce dont vous avez besoin.

La série Q de Vidu et Vidu Q3 Pro : des performances pour la production

Si MoE est le spécialiste, la série Q est l'option conçue pour le travail de production. Vidu Q3 Pro est conçu pour une sortie cinématographique soignée et des vidéos pilotées par storyboard [7]. Il prend en charge la vidéo 1080p, des clips jusqu'à 16 secondes et la génération audio-vidéo avec dialogues et effets sonores synchronisés [1][2][4]. Sur APIMart, Q3 Pro démarre à 0,12 $ la seconde [2][3].

Vidu Q3 Turbo penche davantage vers la vitesse et le coût plus bas, avec un changement de scène plus rapide [6][7]. Sur APIMart, Q3 Turbo démarre à 0,048 $ la seconde [3].

Comment choisir entre MoE et la série Q pour votre flux

Ce choix se résume surtout à la complexité du prompt, au temps de rotation et au budget. Si votre flux dépend d'un suivi strict des instructions et d'une logique multi-scènes, optez pour MoE. Si vous avez besoin d'une sortie soignée avec synchro audio-visuelle, Q3 Pro est le meilleur choix. Sinon, Kling V3 offre une autre option haute fidélité pour la vidéo IA cinématographique. Si votre objectif principal est l'itération rapide ou un coût par clip plus bas, Q3 Turbo est le choix pratique.

Le tableau ci-dessous associe chaque modèle au type de travail qu'il gère le mieux. Pour ceux qui comparent les options haut de gamme, Sora 2 offre des capacités cinématographiques similaires avec un audio synchronisé.

ModèleIdéal pourForcesCompromisLatencePrix (USD/sec)
Vidu MoERécits multi-scènes complexesSuivi des instructions, logique de scène, cohérenceCoût de calcul plus élevé, rotation plus lenteÉlevéePremium
Vidu Q3 ProProduction cinématographiqueQualité visuelle, synchro audio-visuelle, génération de storyboardCoût plus élevé que TurboMoyenne$0.12 [2]
Vidu Q3 TurboItération rapide et traitement par lotsVitesse de génération, rentabilité, changement de scène plus rapideDétails visuels légèrement plus faiblesFaible$0.048 [3]

Ensuite, voyez comment sélectionner un modèle, vous authentifier et envoyer la requête via APIMart.

Comment accéder à Vidu via APIMart

APIMart

Configuration du compte, authentification et gestion des clés API

Après avoir choisi un modèle, vous pouvez envoyer des jobs via APIMart avec une seule clé API. D'abord, créez un compte APIMart et générez votre clé depuis la page de gestion des clés API du tableau de bord [2][3].

Envoyez chaque requête avec un jeton Bearer dans l'en-tête Authorization :

Authorization: Bearer YOUR_API_KEY

Pour le stockage, gardez les clés dans des variables d'environnement ou un gestionnaire de secrets comme AWS Secrets Manager ou GCP Secret Manager. Il est aussi utile d'utiliser des clés distinctes pour le développement, le staging et la production. Si une clé est exposée, faites-la tourner tout de suite. Faites de même selon un calendrier régulier. Et quand vous journalisez les requêtes, n'enregistrez que le task_id - jamais le jeton lui-même [5].

Trouver les modèles Vidu, les prix et le schéma d'entrée dans APIMart

Une fois connecté, consultez le catalogue avant d'envoyer quoi que ce soit. C'est là que vous pouvez confirmer les noms de modèles, les entrées prises en charge et les prix actuels. Dans le catalogue d'APIMart, les modèles Vidu sont listés sous Video Generation. Vous pouvez aussi trouver d'autres modèles performants comme MiniMax-Hailuo-02 dans la même catégorie. Utilisez cette page pour comparer le schéma d'entrée, la résolution et le coût par seconde entre MoE, Q3 Pro et Q3 Turbo [2][3].

Les principaux champs à surveiller sont :

  • model
  • prompt
  • duration
  • resolution
  • aspect_ratio

Pour les jobs texte-vers-vidéo, utilisez aspect_ratio. Pour les jobs basés sur image, le système utilise plutôt le ratio de l'image source [2]. Les prompts texte sont limités à 2 000 caractères [2][3].

Endpoints, structure de requête et gestion des jobs asynchrones

Après avoir choisi le modèle, soumettez la requête de génération et suivez le job asynchrone avec le task_id renvoyé. Envoyez une requête POST à https://api.apimart.ai/v1/videos/generations, puis sondez le statut du job avec GET https://api.apimart.ai/v1/tasks/{task_id} [2][5].

Les jobs passent par ces états :

  • submitted
  • queueing
  • processing
  • success ou failed

Si vous voulez qu'APIMart notifie votre app quand le job est terminé, ajoutez callback_url et recevez le résultat par webhook [5]. Une fois le job en succès, téléchargez le fichier tout de suite. À partir de là, vous pouvez mapper les champs de requête vers un flux texte-vers-vidéo ou un flux basé sur référence.

Intégration pas à pas pour le texte-vers-vidéo et la vidéo basée sur référence

Flux texte-vers-vidéo de base avec sélection de modèle

Après avoir choisi un modèle dans le catalogue, le flux texte-vers-vidéo est assez simple. Envoyez votre clé API depuis le côté serveur dans l'en-tête Authorization sous la forme Bearer {your_api_key}.

Voici une charge utile minimale pour un job texte-vers-vidéo avec viduq3-pro :

{
  "model": "viduq3-pro",
  "prompt": "A red fox running through a snowy forest at dusk, cinematic slow motion",
  "duration": 8,
  "resolution": "720p",
  "aspect_ratio": "16:9",
  "audio": true
}

La réponse inclut un task_id et un statut comme submitted, queueing ou processing. Ensuite, vous pouvez soit sonder GET /v1/tasks/{task_id} avec le task_id renvoyé, soit passer un callback_url dans la requête pour que la plateforme notifie votre app quand le job atteint success ou failed [1][7][10]. Si vous voulez passer à viduq3-turbo, vous changez surtout juste le champ model.

Le schéma asynchrone reste le même entre les modes. Ce qui change, ce sont les champs d'entrée.

Ajout d'entrées image ou de référence et contrôles avancés

Pour l'image-vers-vidéo, passez une URL d'image dans le tableau image_urls. Utilisez 0 image pour le texte-vers-vidéo, 1 pour l'image-vers-vidéo et 2 pour le mode première-dernière image [2]. Dans les modes basés sur image, le format d'image de sortie provient de l'image source, vous pouvez donc omettre aspect_ratio [2]. Si vous téléversez des fichiers directement au lieu d'utiliser des URL, gardez chaque image au format PNG, JPEG ou WebP, sous 50 Mo, et gardez le corps HTTP total sous 20 Mo [9][8].

Pour la génération basée sur référence, utilisez l'endpoint /reference2video avec un tableau subjects. Définissez chaque sujet avec un name et ses images, puis appelez-le dans le prompt avec @subjectname. Les modèles Q3 autorisent jusqu'à 7 images de référence ou descriptions textuelles dans la fonctionnalité subjects [6]. Si vous utilisez le mode première-dernière image, gardez les deux images proches en format d'image, idéalement dans un ratio de 0,8 à 1,25, pour réduire les échecs [8]. Quand des visages ou des mains sont impliqués, gardez les prompts de mouvement subtils pour réduire les artefacts de distorsion [5].

Le tableau ci-dessous montre les principaux paramètres des deux flux :

ParamètreTypePlage / options validesS'applique à
modelStringviduq3-pro, viduq3-turboTous
promptStringMax 2 000 caractèresTous (requis pour le texte-vers-vidéo ; optionnel pour l'image-vers-vidéo)
durationInteger1–16sTous
resolutionString540p, 720p, 1080pTous
aspect_ratioString16:9, 9:16, 4:3, 3:4, 1:1Texte-vers-vidéo uniquement
audioBooleantrue, falsetrue par défaut pour Q3
seedInteger-1 à 4,294,967,295Tous
off_peakBooleantrue, falseTous
callback_urlStringURL de webhook optionnelle pour les mises à jour de statutTous

Réglez un seed fixe pendant les tests si vous voulez le même résultat visuel d'une exécution à l'autre [2][9]. Pour les jobs par lots non urgents, réglez off_peak sur true. Ces tâches s'achèvent généralement dans les 48 heures et consomment moins de crédits [1][6].

Suivi de l'usage, du coût et de la fiabilité en production

Une fois votre requête fonctionnelle, le job suivant consiste à garder le coût et la fiabilité sous contrôle en production.

Journalisez le task_id et l'horodatage de chaque requête. Cela vous donne un moyen sûr de déboguer sans stocker d'identifiants sensibles [5]. Il est aussi utile de suivre séparément le temps de file d'attente et le temps de génération, pour distinguer le délai de la plateforme de la latence du modèle.

Pour l'estimation des coûts, Vidu Q3 Pro en 720p coûte environ 0,12 $ par seconde sur APIMart, et Q3 Turbo environ 0,048 $ par seconde [3]. Réglez des alertes automatiques à 50 %, 80 % et 100 % de votre plafond de budget mensuel pour que les dépenses ne s'emballent pas [5].

Les relances comptent aussi. Sur les erreurs 5xx, utilisez un backoff exponentiel : réessayez à 2 secondes, puis 5 secondes, puis 15 secondes avant de montrer une erreur à l'utilisateur [5]. Les modèles de la série Vidu Q3 sont fournis avec un SLA de 99,9 % pour les charges de production [3], mais des échecs éphémères surviennent quand même, les relances doivent donc faire partie de toute version mise en production.

Liste de contrôle de sélection de modèle et points clés

Liste de contrôle de cas d'usage pour développeurs, créateurs et équipes produit

Choisissez selon trois critères : complexité du prompt, vitesse et qualité de sortie. Le tableau ci-dessous transforme la comparaison des modèles en un choix de mise en production pratique.

ScénarioMeilleur modèlePourquoi
Pubs multi-scènes, storyboards, prompts complexesVidu MoE (viduq3-mix)Idéal pour les prompts riches en instructions et les transitions de scène intelligentes
Promos de marque finales, visuels produit soignésVidu Q3 Pro (viduq3-pro)Sortie 1080p cinématographique haute fidélité ; ~0,12 $/sec en 720p [3]
Prototypage rapide, brouillons et clips courtsVidu Q3 Turbo (viduq3-turbo)Idéal pour l'itération rapide à gros volume ; ~0,048 $/sec en 720p [3]
Cohérence des personnages entre les référencesVidu Q3 Pro (viduq3-pro)Prend en charge jusqu'à 7 images de référence et requiert une entrée image [6][8]

Une fois que vous avez choisi une ligne, gardez le même schéma de requête que dans la section d'intégration. En clair : lancez les idées dans Q3 Turbo, puis passez le rendu final en 1080p à Q3 Pro. C'est un flux simple, et il vous aide à avancer vite sans dépenser plus que nécessaire.

Pour les clips où la fidélité de mouvement compte le plus, visez 5 à 10 secondes au lieu de tendre vers le maximum de 16 secondes. Les clips plus courts donnent souvent un mouvement plus serré et moins de tracas.

Points clés à retenir avant la mise en production

MoE est le choix pour la logique complexe et multi-scènes. Q3 Pro vous donne une sortie 1080p cinématographique haute fidélité [3]. Q3 Turbo est l'option à moindre coût à 0,048 $/sec en 720p [3].

Sur APIMart, basculer entre ces modèles n'est qu'un simple changement du paramètre model. Tout le reste de la requête reste identique [3]. Cela veut dire que vous pouvez tester un modèle, passer à un autre et garder votre travail d'intégration stable.

Utilisez le même flux asynchrone à chaque fois :

  • Soumettre la requête
  • Récupérer le task_id
  • Sonder le statut ou utiliser callback_url

Aussi, téléchargez les vidéos générées peu après qu'elles soient prêtes. Les liens de sortie expirent après 24 heures [3][11].

FAQ

Par quel modèle Vidu commencer ?

Commencez par le modèle qui correspond à vos besoins en vitesse, audio et contrôle visuel.

  • viduq3-pro : idéal pour la synchro audio-visuelle et la segmentation des plans
  • viduq3-turbo : génération plus rapide que la version pro
  • viduq1 ou viduq2 : choix solides pour une production vidéo stable et un mouvement de caméra fiable

Comment suivre un job vidéo après l'avoir soumis ?

Vous pouvez suivre votre tâche de génération vidéo de deux façons.

Pour la production, la meilleure option est d'inclure un callback_url dans votre requête initiale. Dans ce cas, l'API Vidu envoie les mises à jour de la tâche et les métadonnées du résultat directement à votre URL, automatiquement. Cela veut dire que vous n'avez pas à vérifier le statut de la tâche vous-même en continu.

L'autre option est de sonder l'API de requête de statut avec le task_id que vous obtenez après la soumission. Une fois que l'état de la tâche passe à success, la réponse inclura l'URL de téléchargement de la vidéo et d'autres métadonnées associées.

Quelles entrées et limites dois-je connaître avant d'intégrer ?

Avant d'intégrer l'API Vidu, assurez-vous que vos entrées restent dans ces limites :

  • Images : PNG, JPEG, JPG ou WebP uniquement ; chaque fichier doit faire moins de 50 Mo et au moins 128×128 pixels
  • Corps de requête HTTP total : 20 Mo max
  • Prompts texte : jusqu'à 5 000 caractères
  • Données passthrough de la charge utile : jusqu'à 1 048 576 caractères

Les limites de durée dépendent du modèle que vous utilisez. Q3 prend en charge 1–16 secondes, Q2 prend en charge 1–10 secondes, et Q1 prend en charge 5 secondes.

De plus, gardez vos clés API en sécurité. Ne les exposez pas dans le code côté client. Envoyez plutôt les requêtes via un intermédiaire côté serveur.

Prêt à essayer ?

Choisissez le modèle qui vous convient dans le marketplace

Essayez les modèles de chat, image et vidéo sur le marketplace APIMart, puis découvrez rapidement leurs capacités avec une API unifiée.

Modèles chatModèles imageModèles vidéo
Explorer le marketplace