

Guía de la API de Suno v5.5 - Generación de canciones y voces con IA
Guía paso a paso de la API de Suno v5.5 - configura el acceso, genera canciones por modo, gestiona voces, extiende clips, almacena archivos y verifica los derechos musicales comerciales.
Puedes convertir un texto en una canción en unos 30–90 segundos y luego pasar ese archivo a revisión, almacenamiento y publicación con un flujo de API sencillo.
Si tuviera que resumir esta guía, se reduce a esto:
-
Configuro el acceso a la API con una clave, cabeceras y sondeo (polling)
-
Elijo el modo adecuado: descripción, letra personalizada o solo música
-
Doy forma al resultado con prompts breves, indicaciones de voz y extensión de clips
-
Muevo los borradores por stems, mezcla, exportación y aprobación
-
Almaceno los archivos rápido porque los enlaces de resultado pueden expirar en 24–72 horas
-
Reviso los derechos comerciales, los registros de consentimiento y los registros de aprobación antes de publicar
Esta guía es sobre todo para quienes quieren hacer de la generación de canciones parte de un pipeline de contenido operativo, no solo probarla a mano. Eso incluye equipos de apps, equipos de publicidad, productores de podcasts, estudios de videojuegos y editores de cine.
Algunos números importan desde el principio:
-
Las pistas pueden durar hasta 240 segundos
-
El primer sondeo debe esperar unos 5–10 segundos
-
El sondeo suele continuar cada 5–10 segundos
-
Los errores de límite de tasa como 429 necesitan un breve retardo antes de reintentar
-
Las fechas de los registros de aprobación deben guardarse en formato de EE. UU., como 07/16/2026
Lo que me gusta de esta configuración es que el recorrido es simple: enviar solicitud → obtener ID de tarea → sondear estado → descargar audio → almacenarlo → revisar derechos.
Aquí tienes la versión corta del flujo de trabajo:
| Paso | Qué hago |
|---|---|
| Acceso | Añadir clave de API, cabecera de autenticación y cuerpo JSON |
| Generación | Enviar el prompt con el modo y el modelo correctos |
| Voz | Usar prompts de voz por defecto, voces clonadas o flujos de voz editados |
| Edición | Extender clips, separar stems, mezclar y exportar |
| Revisión | Verificar letras, uso de imagen/semejanza y condiciones comerciales |
| Almacenamiento | Guardar archivos MP3/WAV aprobados en S3, Drive u otra ubicación permanente |
Dicho de otro modo: esto no va tanto de "hacer una canción" como de construir un sistema de producción musical repetible con entradas claras, pasos de revisión y gestión de archivos.

Configura el acceso a la API de Suno v5.5 para un proyecto operativo

Tu primera solicitud se reduce a tres cosas: credenciales, cabeceras y sondeo asíncrono.
Claves de API, autenticación y estructura básica de la solicitud
Crea tu cuenta y luego genera una clave de API en el área de gestión de claves del panel. Antes de pasar a producción, configura cuotas y listas blancas de IP.
Nunca escribas tu clave directamente en los archivos de código. En su lugar, colócala en una variable de entorno:
SUNO_API_KEY=your_key_here
Para el trabajo local, usa un archivo .env. En producción, usa un gestor de secretos como GitHub Secrets o AWS Secrets Manager. En cada solicitud, envía estas cabeceras:
-
Authorization: Bearer YOUR_API_KEY -
Content-Type: application/json
El flujo de la solicitud es bastante simple. Envía la solicitud POST, guarda el ID de tarea, espera 5–10 segundos y luego sondea cada 5–10 segundos hasta que el trabajo devuelva SUCCESS y te dé una URL de audio. [2][7][3] En la mayoría de los casos, la generación tarda 30–90 segundos. [2][3]
En cuanto la pista esté lista, descárgala o muévela a un almacenamiento permanente, como un bucket de S3. Eso importa porque una URL de resultado temporal puede no seguir disponible por mucho tiempo.
| Código de error | Significado | Qué hacer |
|---|---|---|
| 401 | No autorizado | Revisa la clave. |
| 402 | Pago requerido | Añade créditos. |
| 429 | Límite de tasa alcanzado | Espera 30 segundos y reintenta. |
| 503 | Servicio no disponible | Reintenta en 1 minuto. |
Para el campo model en tu payload JSON, establece explícitamente "suno-v5.5" o el identificador equivalente más reciente que documente tu proveedor. Si necesitas una versión concreta del modelo, no confíes en los valores por defecto.
Usar APIMart como capa de flujo de trabajo

APIMart envía las solicitudes a Suno a través de un único flujo de trabajo del lado del servidor, lo que mantiene las credenciales fuera del código del cliente. En términos sencillos, los tokens en bruto no llegan al cliente y cada llamada pasa por la misma capa de integración.
En cada solicitud, establece el parámetro model explícitamente para que la solicitud vaya a Suno v5.5, o al modelo que necesites para el siguiente paso. Con el acceso configurado, la siguiente pieza es el diseño del prompt y los ajustes de salida.
Genera canciones con el prompt, el modo y los ajustes de salida correctos
Una vez configurado el acceso, elige el modo de generación y el formato de salida antes de escribir el prompt. En los flujos de la API de Suno, custom_mode e instrumental son los campos principales que decidir de antemano antes de generar audio [5][8]. Después de eso, puedes dar forma a las voces y a los pasos de revisión para convertir borradores toscos en activos que realmente puedas usar, o integrarlos en flujos de generación de vídeo con IA.
Modo Descripción vs. Modo Letra personalizada
El Modo Descripción (custom_mode: false) deja que la IA escriba la letra y elija el estilo musical a partir de un texto breve. Es lo mejor cuando quieres resultados rápidos con poca dirección. El Modo Letra personalizada (custom_mode: true) te pone al mando. Tú aportas la letra exacta, etiquetas de sección como [Verse], [Chorus], [Bridge] y [Outro], además de detalles de estilo como género, ambiente y tempo. Eso lo hace más adecuado para anuncios, canciones de marca y pistas de creadores con una estructura definida [5][3].
| Modo | Velocidad | Control | Caso de uso ideal | Entrada requerida |
|---|---|---|---|---|
| Descripción | El más rápido | Bajo (guiado por IA) | Pistas de fondo, ritmos lo-fi, ambientación | Prompt descriptivo breve |
| Letra personalizada | Más lento | Alto (definido por el usuario) | Jingles publicitarios, canciones de marca, narrativa | Letra completa + etiquetas de estilo + título |
| Instrumental | Rápido | Medio | Podcasts, transiciones de vídeo, camas ambientales | Etiquetas de estilo + instrumental: true |
Si quieres una salida solo instrumental, establece instrumental: true. Luego usa negative_tags para bloquear las voces que no quieras, como "vocals, singing, voice" [6][5].
Patrones de prompt para anuncios, música de marca y contenido de creadores
Aquí funciona bien un patrón de prompt simple: [genre] [mood] [instruments] [voice] [era/influence]. Intenta mantenerlo en unos 8–12 términos clave para que el modelo no se desvíe [3]. Demasiadas señales mezcladas pueden despistarlo.
El modo debe coincidir con el trabajo. Usa el modo descripción cuando busques atmósfera. Usa el modo letra personalizada cuando la canción tenga que transmitir un mensaje, un eslogan de marca o una historia. También puedes indicar la textura vocal directamente con frases como "soft female vocals", "deep male baritone" o "ethereal" para mantener el sonido alineado con el tono de una marca o el estilo de un canal [3][5].
Planificación de la salida para uso en producción
Usa la API extend para encadenar clips en una canción más unificada de 2–4 minutos. También ayuda incluir un [Outro] dedicado o algún marcador de final claro para que la pista se cierre limpiamente [3].
Para el trabajo de producción, genera más de una versión, descarga cada una de inmediato y guarda un corte instrumental junto con cualquier pista vocal. Eso te da un respaldo por si una versión vocal no encaja en el anuncio, el montaje o la revisión final. También ayuda almacenar cada activo con su prompt y metadatos en una carpeta de proyecto consistente.
A continuación, refina las voces y los pasos de edición para que la mejor versión esté lista para revisión.
Gestiona voces, pasos de edición y controles de flujo de trabajo comercial
Voces por defecto, voces clonadas y flujos de voz personalizados
Suno v5.5 te ofrece tres flujos de trabajo vocales, y elegir el correcto desde el principio puede ahorrar mucha limpieza después.
Las voces por defecto son el camino más rápido. Describes el estilo vocal en tu prompt —algo como soft female vocals, ethereal o deep male baritone— y el modelo se encarga del resto [3]. Esta opción funciona bien para borradores comerciales rápidos cuando no necesitas una identidad de voz fija [5].
Las voces clonadas requieren más configuración, pero te dan un sonido estable y reconocible. Usa voces clonadas solo cuando tengas un consentimiento claro y documentado del propietario de la voz [4].
Los flujos de voz personalizados van más allá. Estos usan los flujos de edición de Suno v5.5 y funciones como Swap Vocals o Swap Sound para afinar el activo final en varias pasadas [1][5].
| Tipo de voz | Coherencia de marca | Esfuerzo de configuración | Necesidades de gobernanza |
|---|---|---|---|
| Voces por defecto | Basada en prompts | Mínimo | Baja - derechos de IA estándar |
| Voces clonadas | Alta - semejanza específica | Moderado - se requieren datos de entrenamiento | Alta - se requieren consentimiento y documentos legales |
| Personalizadas | Muy alta - modelos a medida | Alto - edición iterativa | Moderada - se requiere aprobación interna |
Una vez elegido el camino de la voz, el siguiente paso es simple: mover el borrador por la edición y la aprobación.
De la canción borrador al activo utilizable
La primera generación es un borrador. No es el activo terminado.
El flujo de trabajo se ve así: Borrador → extender → separar stems → mezclar → exportar.
Empieza comparando la letra y el tono vocal con tu brief. Luego separa los stems para que las voces y los instrumentos queden en capas independientes. Eso le da a tu equipo de audio espacio para trabajar dentro de un DAW como FL Studio o Ableton, donde pueden aplicar EQ, compresión y reverberación. Después de eso, exporta la versión final como WAV y adjunta metadatos como BPM, género y etiquetas de estilo antes de guardarla en la carpeta del proyecto.
| Paso de producción | Acción | Herramientas |
|---|---|---|
| Borrador | Generar clip inicial con gancho | API de Suno v5.5, letra estructurada |
| Extensión | Encadenar clips para alcanzar 2–4 minutos | Función de la API Extend Music |
| Refinamiento | Separar voces e instrumentos | API de separación de stems |
| Posproducción | Mezcla, EQ, Auto-Tune | DAW (FL Studio, Ableton) |
| Exportación | Convertir a WAV, adjuntar BPM y género | Etiquetado de metadatos, conversión a WAV |
Descarga el audio aprobado de inmediato.
Licencias, uso comercial y verificaciones de aprobación interna
Antes de publicar, aclara los derechos y registra la aprobación de cada pista terminada.
Primero, confirma que la cuenta usada para generar la canción incluye derechos de uso comercial.
Luego configura un paso ligero de aprobación interna. Marca cualquier prompt o conjunto de letras que mencione nombres de artistas específicos o semejanzas no autorizadas. Las solicitudes vinculadas a semejanzas no autorizadas o nombres de artistas pueden ser rechazadas [5][6]. Si trabajas con activos de voz clonada, conserva los registros de consentimiento junto al archivo de audio.
Para el seguimiento de auditoría, registra el ID de tarea, el título de la canción, la duración, las etiquetas de estilo y la fecha de aprobación de cada activo finalizado. Usa el formato de fecha de EE. UU. —como 07/16/2026— y anota quién lo aprobó [5][3].
Construye un pipeline musical de APIMart de extremo a extremo
Un pipeline de producción sencillo para equipos
Una vez fijadas tus decisiones de prompt, voz y licencia, únelas en un único flujo repetible: entra el brief, sale el audio aprobado y luego se almacena para vídeo, anuncios o redes sociales.
Envía el brief a Suno a través de APIMart. La API devuelve un ID de tarea, y tu capa de orquestación —como n8n— puede ejecutar un bucle de sondeo hasta que el trabajo vuelva como SUCCESS [2][5]. Espera 10 segundos antes del primer sondeo para no enviar solicitudes de más sin motivo.
El objetivo es simple: mapear cada transferencia a una herramienta o API para que el proceso funcione sin que alguien tenga que perseguir archivos o actualizaciones de estado a mano.
| Etapa del flujo de trabajo | Herramienta / API | Acción clave |
|---|---|---|
| Brief | LLM | Generar letra y etiquetas de estilo a partir de un tema |
| Generación | API de generación de Suno (APIMart) | Enviar solicitud POST con prompt y modo |
| Seguimiento de estado | Bucle de sondeo de n8n | Comprobar el estado de la tarea cada 5–10 segundos |
| Revisión humana | Formulario de revisión | Aprobar o rechazar antes del almacenamiento |
| Almacenamiento | Google Drive / S3 | Descargar y almacenar MP3/WAV con metadatos |
| Producción | Suite de edición | Importar el audio a plantillas de vídeo o anuncios |
Un detalle importa aquí: las URL de audio generado son temporales y pueden expirar en un plazo de 24 a 72 horas [5]. Por eso tu pipeline debería descargar los archivos aprobados de inmediato y moverlos a un almacenamiento permanente antes de que se cierre esa ventana.
Una vez que el flujo básico funcione, añade un enrutamiento de fallos para que las generaciones rechazadas vuelvan a la etapa del prompt. Lo mismo aplica a las respuestas content_policy_violation: devuélvelas para cambios en el prompt de modo que la cola siga avanzando en lugar de quedarse atascada [5].
Primeros pasos
Empieza con un flujo de trabajo que puedas repetir y luego crece a partir de ahí solo después de que funcione de extremo a extremo. Elige primero un caso de uso: un jingle publicitario, una pista de fondo de marca o una banda sonora de creador.
Antes de que algo salga en producción, comprueba que tu plan incluya claramente derechos de uso comercial [1]. Luego usa APIMart como la capa que conecta la generación musical con tu flujo de trabajo de contenido con IA más amplio, para que una sola solicitud de canción pueda recorrer un sistema que tu equipo pueda usar una y otra vez.
Preguntas frecuentes
¿Cómo elijo entre el modo descripción, letra personalizada e instrumental?
Elige según cuánto control quieras.
-
Usa el modo Descripción si quieres que la IA cree la letra y la composición a partir de un texto.
-
Usa el modo Personalizado si quieres aportar tu propia letra y estructura de canción.
-
Usa el modo Instrumental si quieres una pista sin voces, como música de fondo o jingles.
¿Qué debo almacenar con cada pista generada para la aprobación comercial?
Mantén un registro claro de cada pista que hagas. Como mínimo, almacena:
-
el ID de tarea único
-
el archivo de audio final generado
-
metadatos como el título de la canción, la duración y las etiquetas de estilo o los prompts
-
la versión del modelo y la fecha de creación
Ese registro hace mucho más fácil verificar el cumplimiento de licencias y mantener un rastro de auditoría para uso comercial.
¿Cómo puedo evitar que los enlaces de audio temporales expiren en producción?
Los enlaces de audio de la API de Suno v5.5 son temporales. En la mayoría de los casos, expiran en un plazo de 24 a 72 horas, así que no son adecuados para activos de producción a largo plazo.
Aquí está la jugada más segura: en cuanto tu sondeo de estado muestre que la tarea terminó correctamente, descarga el archivo de audio de inmediato y envíalo a un almacenamiento persistente.
Eso puede ser algo como:
-
Google Drive
-
Tu sistema de archivos local
Si esperas demasiado, el enlace puede expirar y el archivo podría desaparecer cuando tu app intente recuperarlo.
Elige el modelo que quieres en el marketplace
Prueba modelos de chat, imagen y video en el marketplace de APIMart y experimenta rápidamente sus capacidades con una API unificada.
