

Guide de l'API Suno v5.5 — génération de chansons IA et voix
Un guide pas à pas de l'API Suno v5.5 — configurer l'accès, générer des chansons par mode, gérer les voix, prolonger les clips, stocker les fichiers et vérifier les droits commerciaux sur la musique.
Vous pouvez transformer une invite textuelle en chanson en environ 30 à 90 secondes, puis faire passer ce fichier par la révision, le stockage et la publication avec un flux d'API simple.
Si je devais résumer ce guide, cela reviendrait à ceci :
-
Je configure l'accès à l'API avec une clé, des en-têtes et du polling
-
Je choisis le bon mode : description, paroles personnalisées ou musique seule
-
Je façonne le résultat avec de courtes invites, des indications vocales et l'extension de clip
-
Je fais passer les brouillons par les stems, le mixage, l'export et l'approbation
-
Je stocke rapidement les fichiers, car les liens de résultat peuvent expirer sous 24 à 72 heures
-
Je vérifie les droits commerciaux, les registres de consentement et les journaux d'approbation avant la publication
Ce guide s'adresse surtout à celles et ceux qui veulent intégrer la génération de chansons dans un pipeline de contenu opérationnel, et pas seulement la tester à la main. Cela inclut les équipes d'applications, les équipes publicitaires, les producteurs de podcasts, les studios de jeux et les monteurs de films.
Quelques chiffres comptent d'emblée :
-
Les morceaux peuvent durer jusqu'à 240 secondes
-
Le premier polling devrait attendre environ 5 à 10 secondes
-
Le polling se poursuit en général toutes les 5 à 10 secondes
-
Les erreurs de limite de débit comme 429 nécessitent un court délai avant nouvelle tentative
-
Les dates des journaux d'approbation devraient être stockées au format américain, comme 07/16/2026
Ce que j'apprécie dans cette configuration, c'est que le chemin est simple : envoyer la requête → obtenir l'ID de tâche → interroger le statut → télécharger l'audio → le stocker → vérifier les droits.
Voici la version courte du flux de travail :
| Étape | Ce que je fais |
|---|---|
| Accès | Ajouter la clé d'API, l'en-tête d'auth et le corps JSON |
| Génération | Envoyer l'invite avec le bon mode et le bon modèle |
| Voix | Utiliser les invites de voix par défaut, les voix clonées ou les flux de voix édités |
| Édition | Prolonger les clips, séparer les stems, mixer et exporter |
| Révision | Vérifier les paroles, l'usage de la ressemblance et les conditions commerciales |
| Stockage | Enregistrer les fichiers MP3/WAV approuvés sur S3, Drive ou un autre emplacement permanent |
Autrement dit : il s'agit moins de « faire une chanson » que de construire un système de production musicale reproductible avec des entrées claires, des étapes de révision et une gestion des fichiers.

Configurer l'accès à l'API Suno v5.5 pour un projet opérationnel

Votre première requête se résume à trois choses : les identifiants, les en-têtes et le polling asynchrone.
Clés d'API, authentification et structure de requête de base
Créez votre compte, puis générez une clé d'API dans la zone de gestion des clés du tableau de bord. Avant de passer en production, définissez des quotas et des listes blanches d'IP.
Ne codez jamais votre clé en dur dans les fichiers source. Placez-la plutôt dans une variable d'environnement :
SUNO_API_KEY=your_key_here
Pour le travail local, utilisez un fichier .env. En production, utilisez un gestionnaire de secrets comme GitHub Secrets ou AWS Secrets Manager. Sur chaque requête, envoyez ces en-têtes :
-
Authorization: Bearer YOUR_API_KEY -
Content-Type: application/json
Le flux de requête est plutôt simple. Envoyez la requête POST, stockez l'ID de tâche, attendez 5 à 10 secondes, puis interrogez le statut toutes les 5 à 10 secondes jusqu'à ce que la tâche renvoie SUCCESS et vous fournisse une URL audio. [2][7][3] Dans la plupart des cas, la génération prend 30 à 90 secondes. [2][3]
Dès que le morceau est prêt, téléchargez-le ou déplacez-le vers un stockage permanent, comme un bucket S3. C'est important, car une URL de résultat temporaire peut ne pas rester disponible longtemps.
| Code d'erreur | Signification | Que faire |
|---|---|---|
| 401 | Non autorisé | Vérifiez la clé. |
| 402 | Paiement requis | Ajoutez des crédits. |
| 429 | Limite de débit atteinte | Attendez 30 secondes et réessayez. |
| 503 | Service indisponible | Réessayez dans 1 minute. |
Pour le champ model de votre charge utile JSON, définissez explicitement "suno-v5.5" ou l'identifiant équivalent le plus récent documenté par votre fournisseur. Si vous avez besoin d'une version de modèle précise, ne vous fiez pas aux valeurs par défaut.
Utiliser APIMart comme couche de flux de travail

APIMart envoie les requêtes Suno via un seul flux de travail côté serveur, ce qui garde les identifiants hors du code client. En clair, les jetons bruts restent hors du client, et chaque appel passe par la même couche d'intégration.
Dans chaque requête, définissez le paramètre model explicitement afin que la requête aille vers Suno v5.5, ou vers le modèle dont vous avez besoin pour l'étape suivante. Une fois l'accès configuré, l'élément suivant est la conception de l'invite et les réglages de sortie.
Générer des chansons avec la bonne invite, le bon mode et les bons réglages de sortie
Une fois l'accès configuré, choisissez le mode de génération et le format de sortie avant d'écrire l'invite. Dans les flux de travail de l'API Suno, custom_mode et instrumental sont les principaux champs à décider en amont avant de générer de l'audio [5][8]. Ensuite, vous pouvez façonner les voix et les étapes de révision pour transformer des brouillons bruts en ressources réellement utilisables, ou les intégrer dans des flux de travail de génération de vidéo IA.
Mode description ou mode paroles personnalisées
Le mode description (custom_mode: false) laisse l'IA écrire les paroles et choisir le style musical à partir d'une courte invite textuelle. C'est idéal quand vous voulez une sortie rapide avec une direction légère. Le mode paroles personnalisées (custom_mode: true) vous met aux commandes. Vous fournissez les paroles exactes, des balises de section comme [Verse], [Chorus], [Bridge] et [Outro], ainsi que des détails de style tels que le genre, l'ambiance et le tempo. Cela le rend plus adapté aux publicités, aux chansons de marque et aux morceaux de créateurs avec une structure définie [5][3].
| Mode | Vitesse | Contrôle | Cas d'usage le plus adapté | Entrée requise |
|---|---|---|---|---|
| Description | Le plus rapide | Faible (piloté par l'IA) | Pistes d'arrière-plan, beats lo-fi, mise en ambiance | Courte invite descriptive |
| Paroles personnalisées | Plus lent | Élevé (défini par l'utilisateur) | Jingles publicitaires, chansons de marque, narration | Paroles complètes + balises de style + titre |
| Instrumental | Rapide | Moyen | Podcasts, transitions vidéo, nappes d'ambiance | Balises de style + instrumental: true |
Si vous voulez une sortie uniquement instrumentale, définissez instrumental: true. Utilisez ensuite negative_tags pour bloquer les voix que vous ne voulez pas, comme "vocals, singing, voice" [6][5].
Modèles d'invite pour les publicités, la musique de marque et le contenu de créateur
Un modèle d'invite simple fonctionne bien ici : [genre] [mood] [instruments] [voice] [era/influence]. Essayez de le limiter à environ 8 à 12 termes clés pour que le modèle ne s'égare pas [3]. Trop de signaux mélangés peuvent le déstabiliser.
Le mode doit correspondre à la tâche. Utilisez le mode description quand vous visez une atmosphère. Utilisez le mode paroles personnalisées quand la chanson doit porter un message, une accroche de marque ou une histoire. Vous pouvez aussi préciser directement la texture vocale avec des expressions comme "soft female vocals", "deep male baritone" ou "ethereal" pour garder le son aligné sur un ton de marque ou un style de chaîne [3][5].
Planifier la sortie pour un usage en production
Utilisez l'API extend pour enchaîner des clips en une chanson plus unifiée de 2 à 4 minutes. Il est aussi utile d'inclure un [Outro] dédié ou un marqueur de fin clair pour que le morceau se conclue proprement [3].
Pour le travail de production, générez plusieurs versions, téléchargez chacune immédiatement et enregistrez une version instrumentale à côté de chaque piste vocale. Cela vous donne un plan B si une version vocale ne convient pas à la publicité, au montage ou à la révision finale. Il est aussi utile de stocker chaque ressource avec son invite et ses métadonnées dans un dossier de projet cohérent.
Ensuite, affinez les voix et les étapes d'édition pour que la meilleure version soit prête pour la révision.
Gérer les voix, les étapes d'édition et les contrôles de flux de travail commercial
Voix par défaut, voix clonées et flux de voix personnalisées
Suno v5.5 vous offre trois flux de travail vocaux, et choisir le bon dès le départ peut vous épargner beaucoup de nettoyage plus tard.
Les voix par défaut sont la voie la plus rapide. Vous décrivez le style vocal dans votre invite — quelque chose comme soft female vocals, ethereal ou deep male baritone — et le modèle se charge du reste [3]. Cette option fonctionne bien pour des brouillons commerciaux rapides quand vous n'avez pas besoin d'une identité vocale fixe [5].
Les voix clonées demandent plus de préparation, mais elles vous donnent un son stable et reconnaissable. N'utilisez les voix clonées que lorsque vous disposez d'un consentement clair et documenté du propriétaire de la voix [4].
Les flux de voix personnalisées vont encore plus loin. Ils utilisent les flux d'édition de Suno v5.5 et des fonctionnalités comme Swap Vocals ou Swap Sound pour affiner la ressource finale sur plusieurs passes [1][5].
| Type de voix | Cohérence de marque | Effort de préparation | Besoins de gouvernance |
|---|---|---|---|
| Voix par défaut | Basée sur l'invite | Minimal | Faible — droits IA standard |
| Voix clonées | Élevée — ressemblance spécifique | Modéré — données d'entraînement requises | Élevé — consentement et documents juridiques requis |
| Personnalisées | Très élevée — modèles sur mesure | Élevé — édition itérative | Modéré — approbation interne requise |
Une fois la voie vocale choisie, l'étape suivante est simple : faire passer le brouillon par l'édition et la validation.
Du brouillon de chanson à la ressource utilisable
La première génération est un brouillon. Ce n'est pas la ressource finale.
Le flux de travail ressemble à ceci : brouillon → prolonger → séparer les stems → mixer → exporter.
Commencez par vérifier les paroles et le ton vocal par rapport à votre brief. Séparez ensuite les stems pour que les voix et les instrumentaux se trouvent sur des couches distinctes. Cela donne à votre équipe audio de la marge pour travailler dans un DAW comme FL Studio ou Ableton, où elle peut appliquer EQ, compression et réverbération. Ensuite, exportez la version finale au format WAV et attachez des métadonnées comme le BPM, le genre et les balises de style avant de l'enregistrer dans le dossier de projet.
| Étape de production | Action | Outils |
|---|---|---|
| Brouillon | Générer un clip initial avec une accroche | API Suno v5.5, paroles structurées |
| Extension | Enchaîner les clips pour atteindre 2 à 4 minutes | Fonctionnalité d'API Extend Music |
| Affinage | Séparer voix et instrumentaux | API de séparation de stems |
| Post-production | Mixage, EQ, Auto-Tune | DAW (FL Studio, Ableton) |
| Export | Convertir en WAV, attacher BPM et genre | Étiquetage de métadonnées, conversion WAV |
Téléchargez immédiatement l'audio approuvé.
Licences, usage commercial et contrôles d'approbation interne
Avant la publication, clarifiez les droits et consignez l'approbation pour chaque morceau terminé.
D'abord, confirmez que le compte utilisé pour générer la chanson inclut des droits d'usage commercial.
Mettez ensuite en place une étape légère d'approbation interne. Signalez toute invite ou tout jeu de paroles mentionnant des noms d'artistes précis ou des ressemblances non autorisées. Les requêtes liées à des ressemblances non autorisées ou à des noms d'artistes peuvent être rejetées [5][6]. Si vous travaillez avec des ressources de voix clonées, conservez les registres de consentement avec le fichier audio.
Pour le suivi d'audit, consignez l'ID de tâche, le titre de la chanson, la durée, les balises de style et la date d'approbation pour chaque ressource finalisée. Utilisez le format de date américain — comme 07/16/2026 — et notez qui l'a approuvée [5][3].
Construire un pipeline musical APIMart de bout en bout
Un pipeline de production simple pour les équipes
Une fois vos choix d'invite, de voix et de licence verrouillés, reliez-les dans un seul flux reproductible : brief en entrée, audio approuvé en sortie, puis stockage pour la vidéo, les publicités ou les réseaux sociaux.
Envoyez le brief à Suno via APIMart. L'API renvoie un ID de tâche, et votre couche d'orchestration — comme n8n — peut exécuter une boucle de polling jusqu'à ce que la tâche revienne en SUCCESS [2][5]. Patientez 10 secondes avant le premier polling pour ne pas envoyer de requêtes supplémentaires inutilement.
L'objectif est simple : associer chaque transfert à un outil ou une API pour que le processus se déroule sans que quelqu'un doive courir après les fichiers ou les mises à jour de statut à la main.
| Phase du flux de travail | Outil / API | Action clé |
|---|---|---|
| Brief | LLM | Générer paroles et balises de style à partir d'un thème |
| Génération | API de génération Suno (APIMart) | Soumettre une requête POST avec invite et mode |
| Suivi du statut | Boucle de polling n8n | Vérifier le statut de la tâche toutes les 5 à 10 secondes |
| Révision humaine | Formulaire de révision | Approuver ou rejeter avant le stockage |
| Stockage | Google Drive / S3 | Télécharger et stocker le MP3/WAV avec métadonnées |
| Production | Suite de montage | Importer l'audio dans des modèles vidéo ou publicitaires |
Un détail compte ici : les URL audio générées sont temporaires et peuvent expirer sous 24 à 72 heures [5]. Votre pipeline doit donc télécharger les fichiers approuvés immédiatement et les déplacer vers un stockage permanent avant la fermeture de cette fenêtre.
Une fois le flux de base opérationnel, ajoutez un routage d'échec pour que les générations rejetées reviennent à l'étape de l'invite. Il en va de même pour les réponses content_policy_violation — renvoyez-les pour des modifications d'invite afin que la file continue d'avancer au lieu de rester bloquée [5].
Premiers pas
Commencez par un flux de travail que vous pouvez répéter, puis développez à partir de là seulement après qu'il fonctionne de bout en bout. Choisissez d'abord un cas d'usage — un jingle publicitaire, une piste d'arrière-plan de marque ou une bande-son de créateur.
Avant toute mise en ligne, vérifiez que votre forfait inclut clairement des droits d'usage commercial [1]. Utilisez ensuite APIMart comme la couche qui relie la génération musicale à votre flux de contenu IA plus large, pour qu'une seule requête de chanson puisse traverser un système que votre équipe peut réutiliser encore et encore.
FAQ
Comment choisir entre le mode description, paroles personnalisées et instrumental ?
Choisissez selon le niveau de contrôle que vous voulez.
-
Utilisez le mode description si vous voulez que l'IA compose les paroles et l'arrangement à partir d'une invite textuelle.
-
Utilisez le mode personnalisé si vous voulez fournir vos propres paroles et votre propre structure de chanson.
-
Utilisez le mode instrumental si vous voulez un morceau sans voix, comme de la musique d'arrière-plan ou des jingles.
Que dois-je stocker avec chaque morceau généré pour l'approbation commerciale ?
Conservez un registre clair pour chaque morceau que vous créez. Au minimum, stockez :
-
l'ID de tâche unique
-
le fichier audio final généré
-
des métadonnées telles que le titre de la chanson, la durée et les balises de style ou les invites
-
la version du modèle et la date de création
Ce registre facilite grandement la vérification de la conformité des licences et le maintien d'une piste d'audit pour l'usage commercial.
Comment empêcher les liens audio temporaires d'expirer en production ?
Les liens audio de l'API Suno v5.5 sont temporaires. Dans la plupart des cas, ils expirent sous 24 à 72 heures, ils ne conviennent donc pas comme ressources de production à long terme.
Voici le geste le plus sûr : dès que votre polling de statut indique que la tâche s'est terminée avec succès, téléchargez le fichier audio immédiatement et envoyez-le vers un stockage persistant.
Cela peut être quelque chose comme :
-
Google Drive
-
Votre système de fichiers local
Si vous attendez trop longtemps, le lien peut expirer et le fichier pourrait avoir disparu quand votre application tente de le récupérer.
Choisissez le modèle qui vous convient dans le marketplace
Essayez les modèles de chat, image et vidéo sur le marketplace APIMart, puis découvrez rapidement leurs capacités avec une API unifiée.
