APIMart
APIMart

Guía de la API de Suno v5.5 - Generación de canciones y voces con IA

Guía paso a paso de la API de Suno v5.5 - configura el acceso, genera canciones por modo, gestiona voces, extiende clips, almacena archivos y verifica los derechos musicales comerciales.

Tutorial

Puedes convertir un texto en una canción en unos 30–90 segundos y luego pasar ese archivo a revisión, almacenamiento y publicación con un flujo de API sencillo.

Si tuviera que resumir esta guía, se reduce a esto:

  • Configuro el acceso a la API con una clave, cabeceras y sondeo (polling)

  • Elijo el modo adecuado: descripción, letra personalizada o solo música

  • Doy forma al resultado con prompts breves, indicaciones de voz y extensión de clips

  • Muevo los borradores por stems, mezcla, exportación y aprobación

  • Almaceno los archivos rápido porque los enlaces de resultado pueden expirar en 24–72 horas

  • Reviso los derechos comerciales, los registros de consentimiento y los registros de aprobación antes de publicar

Esta guía es sobre todo para quienes quieren hacer de la generación de canciones parte de un pipeline de contenido operativo, no solo probarla a mano. Eso incluye equipos de apps, equipos de publicidad, productores de podcasts, estudios de videojuegos y editores de cine.

Algunos números importan desde el principio:

  • Las pistas pueden durar hasta 240 segundos

  • El primer sondeo debe esperar unos 5–10 segundos

  • El sondeo suele continuar cada 5–10 segundos

  • Los errores de límite de tasa como 429 necesitan un breve retardo antes de reintentar

  • Las fechas de los registros de aprobación deben guardarse en formato de EE. UU., como 07/16/2026

Lo que me gusta de esta configuración es que el recorrido es simple: enviar solicitud → obtener ID de tarea → sondear estado → descargar audio → almacenarlo → revisar derechos.

Aquí tienes la versión corta del flujo de trabajo:

PasoQué hago
AccesoAñadir clave de API, cabecera de autenticación y cuerpo JSON
GeneraciónEnviar el prompt con el modo y el modelo correctos
VozUsar prompts de voz por defecto, voces clonadas o flujos de voz editados
EdiciónExtender clips, separar stems, mezclar y exportar
RevisiónVerificar letras, uso de imagen/semejanza y condiciones comerciales
AlmacenamientoGuardar archivos MP3/WAV aprobados en S3, Drive u otra ubicación permanente

Dicho de otro modo: esto no va tanto de "hacer una canción" como de construir un sistema de producción musical repetible con entradas claras, pasos de revisión y gestión de archivos.

APIMart
Pipeline musical de la API de [Suno](https://suno.com/home) v5.5: del prompt a la pista publicada

Configura el acceso a la API de Suno v5.5 para un proyecto operativo

APIMart

Tu primera solicitud se reduce a tres cosas: credenciales, cabeceras y sondeo asíncrono.

Claves de API, autenticación y estructura básica de la solicitud

Crea tu cuenta y luego genera una clave de API en el área de gestión de claves del panel. Antes de pasar a producción, configura cuotas y listas blancas de IP.

Nunca escribas tu clave directamente en los archivos de código. En su lugar, colócala en una variable de entorno:

SUNO_API_KEY=your_key_here

Para el trabajo local, usa un archivo .env. En producción, usa un gestor de secretos como GitHub Secrets o AWS Secrets Manager. En cada solicitud, envía estas cabeceras:

  • Authorization: Bearer YOUR_API_KEY

  • Content-Type: application/json

El flujo de la solicitud es bastante simple. Envía la solicitud POST, guarda el ID de tarea, espera 5–10 segundos y luego sondea cada 5–10 segundos hasta que el trabajo devuelva SUCCESS y te dé una URL de audio. [2][7][3] En la mayoría de los casos, la generación tarda 30–90 segundos. [2][3]

En cuanto la pista esté lista, descárgala o muévela a un almacenamiento permanente, como un bucket de S3. Eso importa porque una URL de resultado temporal puede no seguir disponible por mucho tiempo.

Código de errorSignificadoQué hacer
401No autorizadoRevisa la clave.
402Pago requeridoAñade créditos.
429Límite de tasa alcanzadoEspera 30 segundos y reintenta.
503Servicio no disponibleReintenta en 1 minuto.

Para el campo model en tu payload JSON, establece explícitamente "suno-v5.5" o el identificador equivalente más reciente que documente tu proveedor. Si necesitas una versión concreta del modelo, no confíes en los valores por defecto.

Usar APIMart como capa de flujo de trabajo

APIMart

APIMart envía las solicitudes a Suno a través de un único flujo de trabajo del lado del servidor, lo que mantiene las credenciales fuera del código del cliente. En términos sencillos, los tokens en bruto no llegan al cliente y cada llamada pasa por la misma capa de integración.

En cada solicitud, establece el parámetro model explícitamente para que la solicitud vaya a Suno v5.5, o al modelo que necesites para el siguiente paso. Con el acceso configurado, la siguiente pieza es el diseño del prompt y los ajustes de salida.

Genera canciones con el prompt, el modo y los ajustes de salida correctos

Una vez configurado el acceso, elige el modo de generación y el formato de salida antes de escribir el prompt. En los flujos de la API de Suno, custom_mode e instrumental son los campos principales que decidir de antemano antes de generar audio [5][8]. Después de eso, puedes dar forma a las voces y a los pasos de revisión para convertir borradores toscos en activos que realmente puedas usar, o integrarlos en flujos de generación de vídeo con IA.

Modo Descripción vs. Modo Letra personalizada

El Modo Descripción (custom_mode: false) deja que la IA escriba la letra y elija el estilo musical a partir de un texto breve. Es lo mejor cuando quieres resultados rápidos con poca dirección. El Modo Letra personalizada (custom_mode: true) te pone al mando. Tú aportas la letra exacta, etiquetas de sección como [Verse], [Chorus], [Bridge] y [Outro], además de detalles de estilo como género, ambiente y tempo. Eso lo hace más adecuado para anuncios, canciones de marca y pistas de creadores con una estructura definida [5][3].

ModoVelocidadControlCaso de uso idealEntrada requerida
DescripciónEl más rápidoBajo (guiado por IA)Pistas de fondo, ritmos lo-fi, ambientaciónPrompt descriptivo breve
Letra personalizadaMás lentoAlto (definido por el usuario)Jingles publicitarios, canciones de marca, narrativaLetra completa + etiquetas de estilo + título
InstrumentalRápidoMedioPodcasts, transiciones de vídeo, camas ambientalesEtiquetas de estilo + instrumental: true

Si quieres una salida solo instrumental, establece instrumental: true. Luego usa negative_tags para bloquear las voces que no quieras, como "vocals, singing, voice" [6][5].

Patrones de prompt para anuncios, música de marca y contenido de creadores

Aquí funciona bien un patrón de prompt simple: [genre] [mood] [instruments] [voice] [era/influence]. Intenta mantenerlo en unos 8–12 términos clave para que el modelo no se desvíe [3]. Demasiadas señales mezcladas pueden despistarlo.

El modo debe coincidir con el trabajo. Usa el modo descripción cuando busques atmósfera. Usa el modo letra personalizada cuando la canción tenga que transmitir un mensaje, un eslogan de marca o una historia. También puedes indicar la textura vocal directamente con frases como "soft female vocals", "deep male baritone" o "ethereal" para mantener el sonido alineado con el tono de una marca o el estilo de un canal [3][5].

Planificación de la salida para uso en producción

Usa la API extend para encadenar clips en una canción más unificada de 2–4 minutos. También ayuda incluir un [Outro] dedicado o algún marcador de final claro para que la pista se cierre limpiamente [3].

Para el trabajo de producción, genera más de una versión, descarga cada una de inmediato y guarda un corte instrumental junto con cualquier pista vocal. Eso te da un respaldo por si una versión vocal no encaja en el anuncio, el montaje o la revisión final. También ayuda almacenar cada activo con su prompt y metadatos en una carpeta de proyecto consistente.

A continuación, refina las voces y los pasos de edición para que la mejor versión esté lista para revisión.

Gestiona voces, pasos de edición y controles de flujo de trabajo comercial

Voces por defecto, voces clonadas y flujos de voz personalizados

Suno v5.5 te ofrece tres flujos de trabajo vocales, y elegir el correcto desde el principio puede ahorrar mucha limpieza después.

Las voces por defecto son el camino más rápido. Describes el estilo vocal en tu prompt —algo como soft female vocals, ethereal o deep male baritone— y el modelo se encarga del resto [3]. Esta opción funciona bien para borradores comerciales rápidos cuando no necesitas una identidad de voz fija [5].

Las voces clonadas requieren más configuración, pero te dan un sonido estable y reconocible. Usa voces clonadas solo cuando tengas un consentimiento claro y documentado del propietario de la voz [4].

Los flujos de voz personalizados van más allá. Estos usan los flujos de edición de Suno v5.5 y funciones como Swap Vocals o Swap Sound para afinar el activo final en varias pasadas [1][5].

Tipo de vozCoherencia de marcaEsfuerzo de configuraciónNecesidades de gobernanza
Voces por defectoBasada en promptsMínimoBaja - derechos de IA estándar
Voces clonadasAlta - semejanza específicaModerado - se requieren datos de entrenamientoAlta - se requieren consentimiento y documentos legales
PersonalizadasMuy alta - modelos a medidaAlto - edición iterativaModerada - se requiere aprobación interna

Una vez elegido el camino de la voz, el siguiente paso es simple: mover el borrador por la edición y la aprobación.

De la canción borrador al activo utilizable

La primera generación es un borrador. No es el activo terminado.

El flujo de trabajo se ve así: Borrador → extender → separar stems → mezclar → exportar.

Empieza comparando la letra y el tono vocal con tu brief. Luego separa los stems para que las voces y los instrumentos queden en capas independientes. Eso le da a tu equipo de audio espacio para trabajar dentro de un DAW como FL Studio o Ableton, donde pueden aplicar EQ, compresión y reverberación. Después de eso, exporta la versión final como WAV y adjunta metadatos como BPM, género y etiquetas de estilo antes de guardarla en la carpeta del proyecto.

Paso de producciónAcciónHerramientas
BorradorGenerar clip inicial con ganchoAPI de Suno v5.5, letra estructurada
ExtensiónEncadenar clips para alcanzar 2–4 minutosFunción de la API Extend Music
RefinamientoSeparar voces e instrumentosAPI de separación de stems
PosproducciónMezcla, EQ, Auto-TuneDAW (FL Studio, Ableton)
ExportaciónConvertir a WAV, adjuntar BPM y géneroEtiquetado de metadatos, conversión a WAV

Descarga el audio aprobado de inmediato.

Licencias, uso comercial y verificaciones de aprobación interna

Antes de publicar, aclara los derechos y registra la aprobación de cada pista terminada.

Primero, confirma que la cuenta usada para generar la canción incluye derechos de uso comercial.

Luego configura un paso ligero de aprobación interna. Marca cualquier prompt o conjunto de letras que mencione nombres de artistas específicos o semejanzas no autorizadas. Las solicitudes vinculadas a semejanzas no autorizadas o nombres de artistas pueden ser rechazadas [5][6]. Si trabajas con activos de voz clonada, conserva los registros de consentimiento junto al archivo de audio.

Para el seguimiento de auditoría, registra el ID de tarea, el título de la canción, la duración, las etiquetas de estilo y la fecha de aprobación de cada activo finalizado. Usa el formato de fecha de EE. UU. —como 07/16/2026— y anota quién lo aprobó [5][3].

Construye un pipeline musical de APIMart de extremo a extremo

Un pipeline de producción sencillo para equipos

Una vez fijadas tus decisiones de prompt, voz y licencia, únelas en un único flujo repetible: entra el brief, sale el audio aprobado y luego se almacena para vídeo, anuncios o redes sociales.

Envía el brief a Suno a través de APIMart. La API devuelve un ID de tarea, y tu capa de orquestación —como n8n— puede ejecutar un bucle de sondeo hasta que el trabajo vuelva como SUCCESS [2][5]. Espera 10 segundos antes del primer sondeo para no enviar solicitudes de más sin motivo.

El objetivo es simple: mapear cada transferencia a una herramienta o API para que el proceso funcione sin que alguien tenga que perseguir archivos o actualizaciones de estado a mano.

Etapa del flujo de trabajoHerramienta / APIAcción clave
BriefLLMGenerar letra y etiquetas de estilo a partir de un tema
GeneraciónAPI de generación de Suno (APIMart)Enviar solicitud POST con prompt y modo
Seguimiento de estadoBucle de sondeo de n8nComprobar el estado de la tarea cada 5–10 segundos
Revisión humanaFormulario de revisiónAprobar o rechazar antes del almacenamiento
AlmacenamientoGoogle Drive / S3Descargar y almacenar MP3/WAV con metadatos
ProducciónSuite de ediciónImportar el audio a plantillas de vídeo o anuncios

Un detalle importa aquí: las URL de audio generado son temporales y pueden expirar en un plazo de 24 a 72 horas [5]. Por eso tu pipeline debería descargar los archivos aprobados de inmediato y moverlos a un almacenamiento permanente antes de que se cierre esa ventana.

Una vez que el flujo básico funcione, añade un enrutamiento de fallos para que las generaciones rechazadas vuelvan a la etapa del prompt. Lo mismo aplica a las respuestas content_policy_violation: devuélvelas para cambios en el prompt de modo que la cola siga avanzando en lugar de quedarse atascada [5].

Primeros pasos

Empieza con un flujo de trabajo que puedas repetir y luego crece a partir de ahí solo después de que funcione de extremo a extremo. Elige primero un caso de uso: un jingle publicitario, una pista de fondo de marca o una banda sonora de creador.

Antes de que algo salga en producción, comprueba que tu plan incluya claramente derechos de uso comercial [1]. Luego usa APIMart como la capa que conecta la generación musical con tu flujo de trabajo de contenido con IA más amplio, para que una sola solicitud de canción pueda recorrer un sistema que tu equipo pueda usar una y otra vez.

Preguntas frecuentes

¿Cómo elijo entre el modo descripción, letra personalizada e instrumental?

Elige según cuánto control quieras.

  • Usa el modo Descripción si quieres que la IA cree la letra y la composición a partir de un texto.

  • Usa el modo Personalizado si quieres aportar tu propia letra y estructura de canción.

  • Usa el modo Instrumental si quieres una pista sin voces, como música de fondo o jingles.

¿Qué debo almacenar con cada pista generada para la aprobación comercial?

Mantén un registro claro de cada pista que hagas. Como mínimo, almacena:

  • el ID de tarea único

  • el archivo de audio final generado

  • metadatos como el título de la canción, la duración y las etiquetas de estilo o los prompts

  • la versión del modelo y la fecha de creación

Ese registro hace mucho más fácil verificar el cumplimiento de licencias y mantener un rastro de auditoría para uso comercial.

¿Cómo puedo evitar que los enlaces de audio temporales expiren en producción?

Los enlaces de audio de la API de Suno v5.5 son temporales. En la mayoría de los casos, expiran en un plazo de 24 a 72 horas, así que no son adecuados para activos de producción a largo plazo.

Aquí está la jugada más segura: en cuanto tu sondeo de estado muestre que la tarea terminó correctamente, descarga el archivo de audio de inmediato y envíalo a un almacenamiento persistente.

Eso puede ser algo como:

  • Google Drive

  • Tu sistema de archivos local

Si esperas demasiado, el enlace puede expirar y el archivo podría desaparecer cuando tu app intente recuperarlo.

¿Listo para probar?

Elige el modelo que quieres en el marketplace

Prueba modelos de chat, imagen y video en el marketplace de APIMart y experimenta rápidamente sus capacidades con una API unificada.

Modelos de chatModelos de imagenModelos de video
Explorar marketplace