APIMart
APIMart

Guia da API Suno v5.5 — Geração de Músicas e Vozes com IA

Um guia passo a passo da API Suno v5.5 — configure o acesso, gere músicas por modo, gerencie vozes, estenda clipes, armazene arquivos e verifique direitos comerciais.

Tutorial

Você pode transformar um prompt de texto em uma música em cerca de 30 a 90 segundos e, em seguida, mover esse arquivo para revisão, armazenamento e lançamento com um fluxo de API simples.

Se eu tivesse que resumir este guia, ele se reduz a isto:

  • Configuro o acesso à API com uma chave, cabeçalhos e polling

  • Escolho o modo certo: descrição, letras personalizadas ou somente música

  • Molde a saída com prompts curtos, indicações de voz e extensão de clipe

  • Movo os rascunhos por stems, mixagem, exportação e aprovação

  • Armazeno arquivos rápido porque os links de resultado podem expirar em 24 a 72 horas

  • Verifico direitos comerciais, registros de consentimento e logs de aprovação antes do lançamento

Este guia é voltado principalmente para pessoas que querem tornar a geração de músicas parte de um pipeline de conteúdo funcional, e não apenas testá-la manualmente. Isso inclui equipes de apps, equipes de anúncios, produtores de podcasts, estúdios de jogos e editores de cinema.

Alguns números importam desde já:

  • As faixas podem chegar a 240 segundos

  • O primeiro poll deve aguardar cerca de 5 a 10 segundos

  • O polling geralmente continua a cada 5 a 10 segundos

  • Erros de limite de taxa como 429 exigem um curto atraso de repetição

  • As datas para logs de aprovação devem ser armazenadas no formato dos EUA, como 07/16/2026

O que eu gosto nessa configuração é que o caminho é simples: enviar requisição → obter ID da tarefa → consultar status → baixar áudio → armazená-lo → revisar direitos.

Aqui está a versão curta do fluxo de trabalho:

EtapaO que eu faço
AcessoAdicionar chave de API, cabeçalho de autenticação e corpo JSON
GeraçãoEnviar prompt com o modo e modelo certos
VozUsar prompts de voz padrão, vozes clonadas ou fluxos de voz editados
EdiçãoEstender clipes, separar stems, mixar e exportar
RevisãoVerificar letras, uso de semelhança e termos comerciais
ArmazenamentoSalvar arquivos MP3/WAV aprovados no S3, Drive ou outro local permanente

Em outras palavras: isto tem menos a ver com "fazer uma música" e mais com construir um sistema de produção musical repetível com entradas claras, etapas de revisão e tratamento de arquivos.

APIMart
Pipeline de música da API [Suno](https://suno.com/home) v5.5: do prompt à faixa publicada

Configure o acesso à API Suno v5.5 para um projeto funcional

APIMart

Sua primeira requisição se resume a três coisas: credenciais, cabeçalhos e polling assíncrono.

Chaves de API, autenticação e estrutura básica da requisição

Crie sua conta e, em seguida, gere uma chave de API na área de gerenciamento de chaves do painel. Antes de passar para produção, defina cotas e listas de IPs permitidos.

Nunca deixe sua chave fixa no código-fonte. Coloque-a em uma variável de ambiente:

SUNO_API_KEY=your_key_here

Para trabalho local, use um arquivo .env. Em produção, use um gerenciador de segredos como o GitHub Secrets ou o AWS Secrets Manager. Em cada requisição, envie estes cabeçalhos:

  • Authorization: Bearer YOUR_API_KEY

  • Content-Type: application/json

O fluxo da requisição é bem simples. Envie a requisição POST, armazene o ID da tarefa, aguarde de 5 a 10 segundos e depois faça polling a cada 5 a 10 segundos até que o job retorne SUCCESS e forneça uma URL de áudio. [2][7][3] Na maioria dos casos, a geração leva de 30 a 90 segundos. [2][3]

Assim que a faixa estiver pronta, baixe-a ou mova-a para armazenamento permanente, como um bucket S3. Isso importa porque uma URL de resultado temporária pode não ficar disponível por muito tempo.

Código de erroSignificadoO que fazer
401Não autorizadoVerifique a chave.
402Pagamento necessárioAdicione créditos.
429Limite de taxa atingidoAguarde 30 segundos e tente novamente.
503Serviço indisponívelTente novamente em 1 minuto.

Para o campo model no seu payload JSON, defina explicitamente "suno-v5.5" ou o identificador equivalente mais recente que seu provedor documentar. Se você precisar de uma versão de modelo específica, não confie nos padrões.

Usando o APIMart como camada de fluxo de trabalho

APIMart

O APIMart envia requisições Suno por um único fluxo de trabalho no lado do servidor, o que mantém as credenciais fora do código do cliente. Em termos simples, os tokens brutos ficam fora do cliente, e cada chamada passa pela mesma camada de integração.

Em cada requisição, defina o parâmetro model explicitamente para que a requisição vá para o Suno v5.5, ou para qualquer modelo que você precise na próxima etapa. Com o acesso configurado, a próxima peça é o design do prompt e as configurações de saída.

Gere músicas com o prompt, o modo e as configurações de saída certos

Uma vez configurado o acesso, escolha o modo de geração e o formato de saída antes de escrever o prompt. Nos fluxos de trabalho da API Suno, custom_mode e instrumental são os principais campos a decidir de antemão antes de gerar o áudio [5][8]. Depois disso, você pode moldar as vozes e as etapas de revisão para transformar rascunhos brutos em ativos que você realmente pode usar, ou integrá-los a fluxos de geração de vídeo com IA.

Modo Descrição vs. Modo Letras Personalizadas

O Modo Descrição (custom_mode: false) deixa a IA escrever as letras e escolher o estilo musical a partir de um prompt de texto curto. É melhor quando você quer saída rápida com pouca direção. O Modo Letras Personalizadas (custom_mode: true) coloca você no comando. Você fornece as letras exatas, tags de seção como [Verse], [Chorus], [Bridge] e [Outro], além de detalhes de estilo como gênero, clima e andamento. Isso o torna mais adequado para anúncios, músicas de marca e faixas de criadores com uma estrutura definida [5][3].

ModoVelocidadeControleCaso de uso idealEntrada necessária
DescriçãoMais rápidoBaixo (orientado por IA)Faixas de fundo, batidas lo-fi, ambientaçãoPrompt descritivo curto
Letras PersonalizadasMais lentoAlto (definido pelo usuário)Jingles de anúncios, músicas de marca, narrativaLetras completas + tags de estilo + título
InstrumentalRápidoMédioPodcasts, transições de vídeo, camadas ambientesTags de estilo + instrumental: true

Se você quiser saída somente instrumental, defina instrumental: true. Em seguida, use negative_tags para bloquear vocais que você não quer, como "vocals, singing, voice" [6][5].

Padrões de prompt para anúncios, música de marca e conteúdo de criadores

Um padrão de prompt simples funciona bem aqui: [genre] [mood] [instruments] [voice] [era/influence]. Tente mantê-lo em cerca de 8 a 12 termos-chave para que o modelo não se desvie [3]. Sinais misturados demais podem confundi-lo.

O modo deve combinar com o trabalho. Use o modo descrição quando estiver buscando atmosfera. Use o modo letras personalizadas quando a música precisar carregar uma mensagem, uma frase de marca ou uma história. Você também pode indicar a textura vocal diretamente com frases como "soft female vocals", "deep male baritone" ou "ethereal" para manter o som alinhado a um tom de marca ou estilo de canal [3][5].

Planejamento de saída para uso em produção

Use a API extend para encadear clipes em uma música mais unificada de 2 a 4 minutos. Também ajuda incluir um [Outro] dedicado ou algum marcador de finalização claro para que a faixa encerre de forma limpa [3].

Para trabalho de produção, gere mais de uma versão, baixe cada uma imediatamente e salve um corte instrumental ao lado de qualquer faixa vocal. Isso lhe dá uma alternativa caso uma versão vocal não se encaixe no anúncio, na edição ou na revisão final. Também ajuda armazenar cada ativo com seu prompt e metadados em uma pasta de projeto consistente.

Em seguida, refine as vozes e as etapas de edição para que a melhor versão esteja pronta para revisão.

Gerencie vozes, etapas de edição e controles de fluxo comercial

Vozes padrão, vozes clonadas e fluxos de voz personalizada

O Suno v5.5 oferece três fluxos vocais, e escolher o certo no início pode economizar muito trabalho de limpeza depois.

As vozes padrão são o caminho mais rápido. Você descreve o estilo vocal no seu prompt — algo como soft female vocals, ethereal ou deep male baritone — e o modelo cuida do resto [3]. Essa opção funciona bem para rascunhos comerciais rápidos quando você não precisa de uma identidade de voz fixa [5].

As vozes clonadas exigem mais configuração, mas dão a você um som estável e reconhecível. Use vozes clonadas apenas quando tiver consentimento claro e documentado do dono da voz [4].

Os fluxos de voz personalizada vão mais longe. Eles usam os fluxos de edição do Suno v5.5 e recursos como Swap Vocals ou Swap Sound para ajustar o ativo final ao longo de várias passagens [1][5].

Tipo de vozConsistência de marcaEsforço de configuraçãoNecessidades de governança
Vozes padrãoBaseada em promptMínimoBaixo — direitos de IA padrão
Vozes clonadasAlta — semelhança específicaModerado — dados de treinamento necessáriosAlto — consentimento e documentos legais necessários
PersonalizadaMuito alta — modelos personalizadosAlto — edição iterativaModerado — aprovação interna necessária

Depois de escolher o caminho da voz, a próxima etapa é simples: mover o rascunho pela edição e pela aprovação.

Do rascunho de música ao ativo utilizável

A primeira geração é um rascunho. Não é o ativo finalizado.

O fluxo de trabalho é assim: Rascunho → estender → separar stems → mixar → exportar.

Comece verificando as letras e o tom vocal em relação ao seu briefing. Depois separe os stems para que vocais e instrumentais fiquem em camadas separadas. Isso dá à sua equipe de áudio espaço para trabalhar dentro de uma DAW como o FL Studio ou o Ableton, onde podem aplicar EQ, compressão e reverb. Depois disso, exporte a versão final como WAV e anexe metadados como BPM, gênero e tags de estilo antes de salvá-la na pasta do projeto.

Etapa de produçãoAçãoFerramentas
RascunhoGerar clipe inicial com ganchoAPI Suno v5.5, letras estruturadas
ExtensãoEncadear clipes para atingir 2 a 4 minutosRecurso de API Extend Music
RefinamentoSeparar vocais e instrumentaisAPI separadora de stems
Pós-produçãoMixagem, EQ, Auto-TuneDAW (FL Studio, Ableton)
ExportaçãoConverter para WAV, anexar BPM e gêneroMarcação de metadados, conversão WAV

Baixe o áudio aprovado imediatamente.

Licenciamento, uso comercial e verificações de aprovação interna

Antes do lançamento, resolva os direitos e registre a aprovação de cada faixa finalizada.

Primeiro, confirme que a conta usada para gerar a música inclui direitos de uso comercial.

Em seguida, configure uma etapa leve de aprovação interna. Sinalize qualquer prompt ou conjunto de letras que mencione nomes específicos de artistas ou semelhanças não autorizadas. Requisições ligadas a semelhanças não autorizadas ou nomes de artistas podem ser rejeitadas [5][6]. Se estiver trabalhando com ativos de voz clonada, mantenha os registros de consentimento junto ao arquivo de áudio.

Para rastreamento de auditoria, registre o ID da tarefa, o título da música, a duração, as tags de estilo e a data de aprovação de cada ativo finalizado. Use o formato de data dos EUA — como 07/16/2026 — e registre quem o aprovou [5][3].

Construa um pipeline de música APIMart de ponta a ponta

Um pipeline de produção simples para equipes

Uma vez fixadas suas escolhas de prompt, voz e licenciamento, una tudo em um único fluxo repetível: briefing entra, áudio aprovado sai e depois é armazenado para vídeo, anúncios ou redes sociais.

Envie o briefing ao Suno pelo APIMart. A API retorna um ID de tarefa, e sua camada de orquestração — como o n8n — pode executar um loop de polling até que o job retorne como SUCCESS [2][5]. Espere 10 segundos antes do primeiro poll para não enviar requisições extras à toa.

O objetivo é simples: mapear cada transferência para uma ferramenta ou API para que o processo rode sem que alguém precise perseguir arquivos ou atualizações de status manualmente.

Estágio do fluxo de trabalhoFerramenta / APIAção principal
BriefingLLMGerar letras e tags de estilo a partir de um tema
GeraçãoAPI de geração Suno (APIMart)Enviar requisição POST com prompt e modo
Rastreamento de statusLoop de polling do n8nVerificar status da tarefa a cada 5 a 10 segundos
Revisão humanaFormulário de revisãoAprovar ou rejeitar antes do armazenamento
ArmazenamentoGoogle Drive / S3Baixar e armazenar MP3/WAV com metadados
ProduçãoSuíte de ediçãoImportar áudio para modelos de vídeo ou anúncio

Um detalhe importa aqui: as URLs de áudio geradas são temporárias e podem expirar dentro de 24 a 72 horas [5]. Então seu pipeline deve baixar os arquivos aprovados imediatamente e movê-los para armazenamento permanente antes que essa janela feche.

Depois que o fluxo básico estiver funcionando, adicione roteamento de falhas para que gerações rejeitadas voltem para a etapa de prompt. O mesmo vale para respostas de content_policy_violation — envie-as de volta para mudanças de prompt para que a fila continue avançando em vez de travar [5].

Primeiros passos

Comece com um fluxo de trabalho que você possa repetir e depois cresça a partir daí somente após ele funcionar de ponta a ponta. Escolha primeiro um caso de uso — um jingle de anúncio, uma faixa de fundo de marca ou uma trilha de criador.

Antes de qualquer coisa entrar no ar, verifique se o seu plano inclui claramente direitos de uso comercial [1]. Depois use o APIMart como a camada que conecta a geração de música ao seu fluxo de conteúdo de IA mais amplo, para que uma requisição de música possa percorrer um sistema que sua equipe pode usar repetidamente.

Perguntas frequentes

Como escolho entre os modos descrição, letras personalizadas e instrumental?

Escolha com base em quanto controle você quer.

  • Use o modo Descrição se quiser que a IA crie as letras e a composição a partir de um prompt de texto.

  • Use o modo Personalizado se quiser fornecer suas próprias letras e estrutura de música.

  • Use o modo Instrumental se quiser uma faixa sem vocais, como música de fundo ou jingles.

O que devo armazenar com cada faixa gerada para aprovação comercial?

Mantenha um registro claro de cada faixa que você fizer. No mínimo, armazene:

  • o ID único da tarefa

  • o arquivo de áudio final gerado

  • metadados como título da música, duração e tags de estilo ou prompts

  • a versão do modelo e a data de criação

Esse registro torna muito mais fácil verificar a conformidade de licenciamento e manter uma trilha de auditoria para uso comercial.

Os links de áudio da API Suno v5.5 são temporários. Na maioria dos casos, expiram dentro de 24 a 72 horas, então não são adequados para ativos de produção de longo prazo.

Aqui está a jogada mais segura: assim que o polling de status mostrar que a tarefa foi concluída com sucesso, baixe o arquivo de áudio imediatamente e envie-o para armazenamento persistente.

Isso pode ser algo como:

  • Google Drive

  • Seu sistema de arquivos local

Se você esperar demais, o link pode expirar e o arquivo pode sumir quando seu app tentar buscá-lo.

Pronto para testar?

Escolha o modelo que você quer no marketplace

Teste modelos de chat, imagem e vídeo no marketplace da APIMart e experimente rapidamente as capacidades dos modelos com uma API unificada.

Modelos de chatModelos de imagemModelos de vídeo
Explorar marketplace