

Guia da API Suno v5.5 — Geração de Músicas e Vozes com IA
Um guia passo a passo da API Suno v5.5 — configure o acesso, gere músicas por modo, gerencie vozes, estenda clipes, armazene arquivos e verifique direitos comerciais.
Você pode transformar um prompt de texto em uma música em cerca de 30 a 90 segundos e, em seguida, mover esse arquivo para revisão, armazenamento e lançamento com um fluxo de API simples.
Se eu tivesse que resumir este guia, ele se reduz a isto:
-
Configuro o acesso à API com uma chave, cabeçalhos e polling
-
Escolho o modo certo: descrição, letras personalizadas ou somente música
-
Molde a saída com prompts curtos, indicações de voz e extensão de clipe
-
Movo os rascunhos por stems, mixagem, exportação e aprovação
-
Armazeno arquivos rápido porque os links de resultado podem expirar em 24 a 72 horas
-
Verifico direitos comerciais, registros de consentimento e logs de aprovação antes do lançamento
Este guia é voltado principalmente para pessoas que querem tornar a geração de músicas parte de um pipeline de conteúdo funcional, e não apenas testá-la manualmente. Isso inclui equipes de apps, equipes de anúncios, produtores de podcasts, estúdios de jogos e editores de cinema.
Alguns números importam desde já:
-
As faixas podem chegar a 240 segundos
-
O primeiro poll deve aguardar cerca de 5 a 10 segundos
-
O polling geralmente continua a cada 5 a 10 segundos
-
Erros de limite de taxa como 429 exigem um curto atraso de repetição
-
As datas para logs de aprovação devem ser armazenadas no formato dos EUA, como 07/16/2026
O que eu gosto nessa configuração é que o caminho é simples: enviar requisição → obter ID da tarefa → consultar status → baixar áudio → armazená-lo → revisar direitos.
Aqui está a versão curta do fluxo de trabalho:
| Etapa | O que eu faço |
|---|---|
| Acesso | Adicionar chave de API, cabeçalho de autenticação e corpo JSON |
| Geração | Enviar prompt com o modo e modelo certos |
| Voz | Usar prompts de voz padrão, vozes clonadas ou fluxos de voz editados |
| Edição | Estender clipes, separar stems, mixar e exportar |
| Revisão | Verificar letras, uso de semelhança e termos comerciais |
| Armazenamento | Salvar arquivos MP3/WAV aprovados no S3, Drive ou outro local permanente |
Em outras palavras: isto tem menos a ver com "fazer uma música" e mais com construir um sistema de produção musical repetível com entradas claras, etapas de revisão e tratamento de arquivos.

Configure o acesso à API Suno v5.5 para um projeto funcional

Sua primeira requisição se resume a três coisas: credenciais, cabeçalhos e polling assíncrono.
Chaves de API, autenticação e estrutura básica da requisição
Crie sua conta e, em seguida, gere uma chave de API na área de gerenciamento de chaves do painel. Antes de passar para produção, defina cotas e listas de IPs permitidos.
Nunca deixe sua chave fixa no código-fonte. Coloque-a em uma variável de ambiente:
SUNO_API_KEY=your_key_here
Para trabalho local, use um arquivo .env. Em produção, use um gerenciador de segredos como o GitHub Secrets ou o AWS Secrets Manager. Em cada requisição, envie estes cabeçalhos:
-
Authorization: Bearer YOUR_API_KEY -
Content-Type: application/json
O fluxo da requisição é bem simples. Envie a requisição POST, armazene o ID da tarefa, aguarde de 5 a 10 segundos e depois faça polling a cada 5 a 10 segundos até que o job retorne SUCCESS e forneça uma URL de áudio. [2][7][3] Na maioria dos casos, a geração leva de 30 a 90 segundos. [2][3]
Assim que a faixa estiver pronta, baixe-a ou mova-a para armazenamento permanente, como um bucket S3. Isso importa porque uma URL de resultado temporária pode não ficar disponível por muito tempo.
| Código de erro | Significado | O que fazer |
|---|---|---|
| 401 | Não autorizado | Verifique a chave. |
| 402 | Pagamento necessário | Adicione créditos. |
| 429 | Limite de taxa atingido | Aguarde 30 segundos e tente novamente. |
| 503 | Serviço indisponível | Tente novamente em 1 minuto. |
Para o campo model no seu payload JSON, defina explicitamente "suno-v5.5" ou o identificador equivalente mais recente que seu provedor documentar. Se você precisar de uma versão de modelo específica, não confie nos padrões.
Usando o APIMart como camada de fluxo de trabalho

O APIMart envia requisições Suno por um único fluxo de trabalho no lado do servidor, o que mantém as credenciais fora do código do cliente. Em termos simples, os tokens brutos ficam fora do cliente, e cada chamada passa pela mesma camada de integração.
Em cada requisição, defina o parâmetro model explicitamente para que a requisição vá para o Suno v5.5, ou para qualquer modelo que você precise na próxima etapa. Com o acesso configurado, a próxima peça é o design do prompt e as configurações de saída.
Gere músicas com o prompt, o modo e as configurações de saída certos
Uma vez configurado o acesso, escolha o modo de geração e o formato de saída antes de escrever o prompt. Nos fluxos de trabalho da API Suno, custom_mode e instrumental são os principais campos a decidir de antemão antes de gerar o áudio [5][8]. Depois disso, você pode moldar as vozes e as etapas de revisão para transformar rascunhos brutos em ativos que você realmente pode usar, ou integrá-los a fluxos de geração de vídeo com IA.
Modo Descrição vs. Modo Letras Personalizadas
O Modo Descrição (custom_mode: false) deixa a IA escrever as letras e escolher o estilo musical a partir de um prompt de texto curto. É melhor quando você quer saída rápida com pouca direção. O Modo Letras Personalizadas (custom_mode: true) coloca você no comando. Você fornece as letras exatas, tags de seção como [Verse], [Chorus], [Bridge] e [Outro], além de detalhes de estilo como gênero, clima e andamento. Isso o torna mais adequado para anúncios, músicas de marca e faixas de criadores com uma estrutura definida [5][3].
| Modo | Velocidade | Controle | Caso de uso ideal | Entrada necessária |
|---|---|---|---|---|
| Descrição | Mais rápido | Baixo (orientado por IA) | Faixas de fundo, batidas lo-fi, ambientação | Prompt descritivo curto |
| Letras Personalizadas | Mais lento | Alto (definido pelo usuário) | Jingles de anúncios, músicas de marca, narrativa | Letras completas + tags de estilo + título |
| Instrumental | Rápido | Médio | Podcasts, transições de vídeo, camadas ambientes | Tags de estilo + instrumental: true |
Se você quiser saída somente instrumental, defina instrumental: true. Em seguida, use negative_tags para bloquear vocais que você não quer, como "vocals, singing, voice" [6][5].
Padrões de prompt para anúncios, música de marca e conteúdo de criadores
Um padrão de prompt simples funciona bem aqui: [genre] [mood] [instruments] [voice] [era/influence]. Tente mantê-lo em cerca de 8 a 12 termos-chave para que o modelo não se desvie [3]. Sinais misturados demais podem confundi-lo.
O modo deve combinar com o trabalho. Use o modo descrição quando estiver buscando atmosfera. Use o modo letras personalizadas quando a música precisar carregar uma mensagem, uma frase de marca ou uma história. Você também pode indicar a textura vocal diretamente com frases como "soft female vocals", "deep male baritone" ou "ethereal" para manter o som alinhado a um tom de marca ou estilo de canal [3][5].
Planejamento de saída para uso em produção
Use a API extend para encadear clipes em uma música mais unificada de 2 a 4 minutos. Também ajuda incluir um [Outro] dedicado ou algum marcador de finalização claro para que a faixa encerre de forma limpa [3].
Para trabalho de produção, gere mais de uma versão, baixe cada uma imediatamente e salve um corte instrumental ao lado de qualquer faixa vocal. Isso lhe dá uma alternativa caso uma versão vocal não se encaixe no anúncio, na edição ou na revisão final. Também ajuda armazenar cada ativo com seu prompt e metadados em uma pasta de projeto consistente.
Em seguida, refine as vozes e as etapas de edição para que a melhor versão esteja pronta para revisão.
Gerencie vozes, etapas de edição e controles de fluxo comercial
Vozes padrão, vozes clonadas e fluxos de voz personalizada
O Suno v5.5 oferece três fluxos vocais, e escolher o certo no início pode economizar muito trabalho de limpeza depois.
As vozes padrão são o caminho mais rápido. Você descreve o estilo vocal no seu prompt — algo como soft female vocals, ethereal ou deep male baritone — e o modelo cuida do resto [3]. Essa opção funciona bem para rascunhos comerciais rápidos quando você não precisa de uma identidade de voz fixa [5].
As vozes clonadas exigem mais configuração, mas dão a você um som estável e reconhecível. Use vozes clonadas apenas quando tiver consentimento claro e documentado do dono da voz [4].
Os fluxos de voz personalizada vão mais longe. Eles usam os fluxos de edição do Suno v5.5 e recursos como Swap Vocals ou Swap Sound para ajustar o ativo final ao longo de várias passagens [1][5].
| Tipo de voz | Consistência de marca | Esforço de configuração | Necessidades de governança |
|---|---|---|---|
| Vozes padrão | Baseada em prompt | Mínimo | Baixo — direitos de IA padrão |
| Vozes clonadas | Alta — semelhança específica | Moderado — dados de treinamento necessários | Alto — consentimento e documentos legais necessários |
| Personalizada | Muito alta — modelos personalizados | Alto — edição iterativa | Moderado — aprovação interna necessária |
Depois de escolher o caminho da voz, a próxima etapa é simples: mover o rascunho pela edição e pela aprovação.
Do rascunho de música ao ativo utilizável
A primeira geração é um rascunho. Não é o ativo finalizado.
O fluxo de trabalho é assim: Rascunho → estender → separar stems → mixar → exportar.
Comece verificando as letras e o tom vocal em relação ao seu briefing. Depois separe os stems para que vocais e instrumentais fiquem em camadas separadas. Isso dá à sua equipe de áudio espaço para trabalhar dentro de uma DAW como o FL Studio ou o Ableton, onde podem aplicar EQ, compressão e reverb. Depois disso, exporte a versão final como WAV e anexe metadados como BPM, gênero e tags de estilo antes de salvá-la na pasta do projeto.
| Etapa de produção | Ação | Ferramentas |
|---|---|---|
| Rascunho | Gerar clipe inicial com gancho | API Suno v5.5, letras estruturadas |
| Extensão | Encadear clipes para atingir 2 a 4 minutos | Recurso de API Extend Music |
| Refinamento | Separar vocais e instrumentais | API separadora de stems |
| Pós-produção | Mixagem, EQ, Auto-Tune | DAW (FL Studio, Ableton) |
| Exportação | Converter para WAV, anexar BPM e gênero | Marcação de metadados, conversão WAV |
Baixe o áudio aprovado imediatamente.
Licenciamento, uso comercial e verificações de aprovação interna
Antes do lançamento, resolva os direitos e registre a aprovação de cada faixa finalizada.
Primeiro, confirme que a conta usada para gerar a música inclui direitos de uso comercial.
Em seguida, configure uma etapa leve de aprovação interna. Sinalize qualquer prompt ou conjunto de letras que mencione nomes específicos de artistas ou semelhanças não autorizadas. Requisições ligadas a semelhanças não autorizadas ou nomes de artistas podem ser rejeitadas [5][6]. Se estiver trabalhando com ativos de voz clonada, mantenha os registros de consentimento junto ao arquivo de áudio.
Para rastreamento de auditoria, registre o ID da tarefa, o título da música, a duração, as tags de estilo e a data de aprovação de cada ativo finalizado. Use o formato de data dos EUA — como 07/16/2026 — e registre quem o aprovou [5][3].
Construa um pipeline de música APIMart de ponta a ponta
Um pipeline de produção simples para equipes
Uma vez fixadas suas escolhas de prompt, voz e licenciamento, una tudo em um único fluxo repetível: briefing entra, áudio aprovado sai e depois é armazenado para vídeo, anúncios ou redes sociais.
Envie o briefing ao Suno pelo APIMart. A API retorna um ID de tarefa, e sua camada de orquestração — como o n8n — pode executar um loop de polling até que o job retorne como SUCCESS [2][5]. Espere 10 segundos antes do primeiro poll para não enviar requisições extras à toa.
O objetivo é simples: mapear cada transferência para uma ferramenta ou API para que o processo rode sem que alguém precise perseguir arquivos ou atualizações de status manualmente.
| Estágio do fluxo de trabalho | Ferramenta / API | Ação principal |
|---|---|---|
| Briefing | LLM | Gerar letras e tags de estilo a partir de um tema |
| Geração | API de geração Suno (APIMart) | Enviar requisição POST com prompt e modo |
| Rastreamento de status | Loop de polling do n8n | Verificar status da tarefa a cada 5 a 10 segundos |
| Revisão humana | Formulário de revisão | Aprovar ou rejeitar antes do armazenamento |
| Armazenamento | Google Drive / S3 | Baixar e armazenar MP3/WAV com metadados |
| Produção | Suíte de edição | Importar áudio para modelos de vídeo ou anúncio |
Um detalhe importa aqui: as URLs de áudio geradas são temporárias e podem expirar dentro de 24 a 72 horas [5]. Então seu pipeline deve baixar os arquivos aprovados imediatamente e movê-los para armazenamento permanente antes que essa janela feche.
Depois que o fluxo básico estiver funcionando, adicione roteamento de falhas para que gerações rejeitadas voltem para a etapa de prompt. O mesmo vale para respostas de content_policy_violation — envie-as de volta para mudanças de prompt para que a fila continue avançando em vez de travar [5].
Primeiros passos
Comece com um fluxo de trabalho que você possa repetir e depois cresça a partir daí somente após ele funcionar de ponta a ponta. Escolha primeiro um caso de uso — um jingle de anúncio, uma faixa de fundo de marca ou uma trilha de criador.
Antes de qualquer coisa entrar no ar, verifique se o seu plano inclui claramente direitos de uso comercial [1]. Depois use o APIMart como a camada que conecta a geração de música ao seu fluxo de conteúdo de IA mais amplo, para que uma requisição de música possa percorrer um sistema que sua equipe pode usar repetidamente.
Perguntas frequentes
Como escolho entre os modos descrição, letras personalizadas e instrumental?
Escolha com base em quanto controle você quer.
-
Use o modo Descrição se quiser que a IA crie as letras e a composição a partir de um prompt de texto.
-
Use o modo Personalizado se quiser fornecer suas próprias letras e estrutura de música.
-
Use o modo Instrumental se quiser uma faixa sem vocais, como música de fundo ou jingles.
O que devo armazenar com cada faixa gerada para aprovação comercial?
Mantenha um registro claro de cada faixa que você fizer. No mínimo, armazene:
-
o ID único da tarefa
-
o arquivo de áudio final gerado
-
metadados como título da música, duração e tags de estilo ou prompts
-
a versão do modelo e a data de criação
Esse registro torna muito mais fácil verificar a conformidade de licenciamento e manter uma trilha de auditoria para uso comercial.
Como posso evitar que links de áudio temporários expirem em produção?
Os links de áudio da API Suno v5.5 são temporários. Na maioria dos casos, expiram dentro de 24 a 72 horas, então não são adequados para ativos de produção de longo prazo.
Aqui está a jogada mais segura: assim que o polling de status mostrar que a tarefa foi concluída com sucesso, baixe o arquivo de áudio imediatamente e envie-o para armazenamento persistente.
Isso pode ser algo como:
-
Google Drive
-
Seu sistema de arquivos local
Se você esperar demais, o link pode expirar e o arquivo pode sumir quando seu app tentar buscá-lo.
Escolha o modelo que você quer no marketplace
Teste modelos de chat, imagem e vídeo no marketplace da APIMart e experimente rapidamente as capacidades dos modelos com uma API unificada.
