APIMart
Lyria 3.5 traz vocais expressivos e músicas mais longas

Lyria 3.5 traz vocais expressivos e músicas mais longas

Conheça o Lyria 3.5 no Google Flow Music, com vocais expressivos, letras mais claras, faixas de 184 segundos, prompts estruturados, acesso à API e limitações.

Insights de Modelos

Em uma frase, o Lyria 3.5 parece mais útil quando preciso de um canto mais claro, melhor interpretação das letras e músicas que permaneçam coerentes por até 184 segundos.

Em resumo:

  • Os vocais parecem ser a principal atualização. Eu avaliaria o timbre, a emoção, o controle da respiração e se o cantor permanece consistente do início ao fim.
  • A duração importa mais agora. O modelo aceita faixas de até 3 minutos e 4 segundos, então eu testaria o fluxo da música inteira, não apenas os primeiros 20 segundos.
  • A estrutura é guiada pelo prompt. Tags como [Verse], [Chorus] e [Bridge], junto com marcações de tempo, ajudam a moldar a música.
  • O suporte a idiomas é amplo. A pronúncia foi ajustada para 8 idiomas: inglês, alemão, espanhol, francês, hindi, japonês, coreano e português.
  • As limitações do fluxo de trabalho são claras. Não há edição em múltiplos turnos, portanto cada resultado é gerado de uma só vez. Para obter uma versão melhor, é necessário executar o prompt novamente.
  • Os melhores casos de uso são fáceis de identificar. Anúncios precisam de ganchos claros, jogos exigem seções repetidas estáveis, educação requer palavras compreensíveis e equipes de criação precisam avançar rapidamente do rascunho ao resultado final.

Se você estiver decidindo se deve usá-lo, eu manteria o teste simples: os vocais continuam naturais? A música permanece consistente por 184 segundos? Minha equipe consegue usar o resultado sem uma longa etapa de ajustes?

Principais diferenças entre Lyria 3 Clip e Lyria 3.5 Pro
Principais diferenças entre Lyria 3 Clip e Lyria 3.5 Pro

Google DeepMind lança o Lyria 3.5 no Flow Music

Google DeepMind

Comparação rápida

ModeloDuração máximaUso principalControle de estruturaMelhor para
Lyria 3 Clip30 segundosIdeias musicais curtasBásicoClipes sociais, vinhetas de anúncios, testes iniciais de prompts
Lyria 3.5 / Pro184 segundosSaídas com duração de músicaTags de seção + marcações de tempoAnúncios, jogos, educação, faixas mais longas para criadores

Vejo o Lyria 3.5 menos como uma coleção de “novos recursos” e mais como uma pergunta direta: ele economiza tempo quando passo de demos curtas para faixas que posso publicar ou entregar?

Vocais expressivos: o que mudou e como avaliar a diferença

O Google DeepMind afirma que o Lyria 3.5 melhora a musicalidade, as letras e a qualidade vocal [1]. Na prática, o que importa é mais simples: o que você realmente consegue ouvir e o que pode verificar por conta própria.

Realismo vocal, dinâmica e fraseado emocional

Comece ouvindo a faixa inteira, não apenas as primeiras linhas. O principal teste é descobrir se a voz permanece natural de uma frase para outra. O Lyria 3.5 aceita interpretações mais sutis, incluindo versos com voz sussurrada, refrões suaves e harmonias leves [1]. Esses detalhes podem fazer a música soar expressiva em vez de plana e mecânica.

Uma boa maneira de testar isso é usar prompts diretos de timbre, como “breathy”, “raspy”, “airy” ou “deep baritone” [4]. Em seguida, ouça com atenção. Essa textura vocal se mantém durante toda a música? Os finais das frases soam naturais ou parecem cortados e estranhos? Depois, teste um arranjo mais longo e verifique se os ganhos vocais continuam presentes.

Pronúncia e clareza das letras nas músicas geradas

Em vinhetas publicitárias e conteúdo de marca, a inteligibilidade da letra não é opcional. Se as pessoas não entendem as palavras, a mensagem se perde. O Lyria 3.5 busca melhorar esse aspecto com uma separação clara entre os vocais e o instrumental, mesmo em arranjos densos [1].

A pronúncia é otimizada para oito idiomas: inglês, alemão, espanhol, francês, hindi, japonês, coreano e português [5]. Se você estiver criando música para uma campanha internacional, escreva o prompt no idioma de destino.

Depois, faça um teste exigente. Use uma mixagem densa e confira se os vocais continuam compreensíveis do início ao fim. Em seguida, estenda a música para vários minutos e ouça novamente. O importante não é apenas saber se as palavras estão claras no começo, mas se essa clareza permanece à medida que o arranjo cresce.

Contexto mais longo: como o Lyria 3.5 lida com a estrutura de uma música completa

De clipes curtos a músicas com vários minutos

Passar de um clipe de 30 segundos para uma faixa de 3 minutos muda mais do que a duração. Isso altera toda a forma da música.

Clipes curtos normalmente funcionam como loops ou prévias de uma única seção. O Lyria 3.5, por outro lado, consegue lidar com uma estrutura completa — introduções, versos, refrões, pontes e finais — em uma única geração de até 184 segundos [5]. Portanto, o principal teste não é apenas saber se o modelo consegue continuar. É verificar se a música ainda parece planejada depois que a primeira seção termina.

O Google afirma que o modelo planeja a estrutura da música antes de gerar o áudio, o que ajuda a manter as transições coerentes [2].

Você pode orientar essa estrutura no prompt com tags de seção como [Verse], [Chorus], [Bridge], [Intro] e [Outro]. Também é possível adicionar marcações de tempo entre colchetes, como [0:50 - 1:10] Chorus. Essas instruções ajudam a definir as mudanças de seção ao longo da faixa.

ModeloDuração máxima aproximadaTratamento das seçõesPontos fortes de continuidadeTipos de fluxo de trabalho mais adequados
Lyria 3 Clip30 segundos [5]Básico (loops/prévias)Iteração rápida, ritmo consistente no curto prazoClipes para redes sociais, vinhetas publicitárias, efeitos sonoros de interface
Lyria 3.5 / Pro184 segundos (3 min) [5]Avançado (verso, refrão, ponte, final)Raciocínio estrutural, transições com marcações de tempo, instrumentação estávelProdução de músicas completas, trilhas de jogos, educação

A próxima verificação é simples: essas instruções estruturais continuam funcionando quando o arranjo começa a evoluir?

Como a continuidade aparece em uma saída real

Uma faixa mais longa não é automaticamente coerente. O verdadeiro teste é saber se o modelo consegue manter o andamento e a tonalidade, retomar motivos de forma lógica e passar entre seções sem parecer aleatório.

O Lyria 3.5 permite definir o andamento e a tonalidade no início. Assim, uma introdução de piano solo pode crescer para um arranjo maior com cordas e manter a mesma ideia melódica, em vez de seguir por outra direção no meio da música.

Ao usar o Lyria 3.5 com um prompt estruturado — incluindo tags de seção, marcações de tempo, andamento e tonalidade — preste atenção a alguns pontos:

  • O arranjo se desenvolve de maneira lógica?
  • As transições acontecem de forma limpa?
  • A faixa evita repetições que você não pediu?

Um contexto mais longo só importa quando os motivos, o andamento e as transições permanecem estáveis durante toda a música. Se a estrutura for mantida, o modelo se encaixa em usos de produção que exigem áudio de maior duração.

Fluxos de trabalho, ferramentas e limitações de integração

Casos de uso: anúncios, jogos, educação e produção criativa

Quando os vocais e a estrutura da música parecerem estáveis, a próxima pergunta é simples: o Lyria 3.5 se encaixa na forma como sua equipe já trabalha? Isso depende muito do objetivo. Anúncios exigem precisão de tempo, jogos precisam de continuidade, educação requer fala clara e equipes criativas muitas vezes precisam apenas avançar rapidamente.

Vinhetas publicitárias submetem a expressão vocal e a estrutura aos testes mais exigentes. Em um anúncio curto, não há espaço para um gancho que chega tarde ou termina de forma estranha. O principal teste é verificar se ele funciona dentro da duração do anúncio.

Trilhas de jogos precisam de loops suaves e um tom estável em períodos mais longos. Se uma seção se repete, ela não pode desviar ou soar diferente na segunda ou terceira passagem. Uma boa configuração de prompt ajuda. Definir BPM, tonalidade e lista de instrumentos fixos facilita a manutenção da mesma sensação em várias versões [6].

O áudio educacional aproveita ao máximo os ganhos de clareza vocal do Lyria 3.5. Nesse caso, a dicção clara importa mais do que um arranjo sofisticado. Se a letra é difícil de entender, a aula deixa de funcionar. Teste primeiro a inteligibilidade e depois pense na música ao redor.

Os fluxos de criadores para conteúdo social costumam valorizar mais a velocidade do que o acabamento. Uma abordagem prática é começar com rascunhos rápidos para testar gênero e atmosfera e, depois que a ideia estiver definida, passar para uma versão mais longa e de melhor qualidade [3][2].

Pontos de acesso atuais e o que eles significam para sua equipe

O Lyria 3.5 está disponível no Google Flow Music, no aplicativo Gemini, no YouTube Shorts por meio do Dream Track e no Google Vids. Desenvolvedores também podem acessá-lo pelo Google AI Studio e pela Gemini API usando a Interactions API [1][4][3].

Uma limitação merece destaque: o Lyria 3.5 não aceita edição em múltiplos turnos. Cada saída é gerada de uma só vez a partir do primeiro prompt [3][2]. Se o clipe não ficar como esperado, você não consegue refiná-lo passo a passo. É necessário enviar outro prompt e gerar uma nova versão.

Isso muda a maneira como as equipes devem criar seus pipelines. Em vez de planejar um ciclo de edição com várias interações, faz mais sentido gerar diversas variações para cada prompt e escolher a melhor. É menos parecido com editar uma sessão em uma DAW e mais com gravar várias tomadas para depois selecionar a que funciona.

Para acesso pela API, a Interactions API é o caminho recomendado em vez do método padrão generateContent. Ela aceita entradas multimodais, incluindo texto e até 10 imagens, e foi criada para trabalhos de geração musical mais longos em ambientes de produção [6][2].

Como a APIMart se encaixa em pipelines de produção com vários modelos

APIMart

Nesse ponto, o projeto da integração se torna tão importante quanto a saída do modelo.

A geração musical quase nunca é a única tarefa de um fluxo de produção. Um anúncio de 60 segundos pode precisar de roteiro, locução, elementos visuais e uma faixa musical, todos produzidos ao mesmo tempo e combinados depois. A APIMart oferece acesso a 500+ modelos de IA por meio de uma única API compatível com OpenAI, ajudando as equipes a executar o Lyria 3.5 ao lado de tarefas de linguagem, imagem e vídeo sem gerenciar integrações separadas [website].

Isso pode simplificar a cobrança e reduzir o atrito de trocar entre ferramentas. O teste direto é descobrir se uma única API economiza tempo no roteamento, na revisão e nas transferências entre equipes.

Conclusão: uma estrutura prática para avaliar o Lyria 3.5

A avaliação do Lyria 3.5 se resume a duas perguntas simples: os vocais parecem mais naturais e emocionalmente expressivos e o contexto mais longo produz músicas estáveis e coerentes por até 184 segundos? Se a resposta for sim, a próxima etapa é verificar a adequação ao fluxo de trabalho, o acesso e o tratamento das exportações.

Para testar o timbre, experimente prompts como “Airy Female Soprano”, “Deep Male Baritone” ou “Raspy Rocker” e analise a clareza das letras nos idiomas necessários para o projeto [4][5].

Use tags de seção e marcações de tempo para confirmar que a estrutura se mantém durante os 184 segundos completos [2]. Se ela se desfizer, o modelo não está pronto para produção. Uma faixa que muda de clima ou perde o andamento no meio de uma execução de 184 segundos não está pronta para uso real, por melhores que sejam os primeiros 30 segundos.

Pontos principais para os testes internos

Teste o Lyria 3.5 em três áreas:

  • Vocais: são mais importantes quando as letras e a emoção carregam o conteúdo, como em anúncios, áudio educacional e materiais narrativos para criadores.
  • Continuidade: é mais importante quando uma faixa precisa manter a estrutura sem se perder, como em trilhas de jogos, vinhetas publicitárias e outros formatos musicais longos.
  • Adequação ao fluxo de trabalho: depende de três verificações práticas — se você precisa de acesso à API, de exportação em MP3 ou WAV e de uma integração limpa com seu pipeline de mídia.

Use o Lyria 3 Clip para ajustar os prompts antes de executar uma geração completa com o Lyria 3.5 Pro.

Perguntas frequentes

Como devo testar a qualidade vocal?

Defina características vocais claras nos prompts, como gênero, textura ou alcance. Por exemplo, você pode pedir an airy female soprano ou a raspy rocker. Continue ajustando esses detalhes até que os vocais correspondam ao som desejado.

É melhor começar pelo modelo de prévia mais rápido. Assim, você pode testar diferentes prompts vocais sem perder tempo e só passar para composições completas depois de encontrar uma voz adequada.

O Lyria 3.5 consegue criar músicas completas?

Sim. O Lyria 3.5 pode gerar músicas completas com o modelo Pro. Ele cria faixas de até 3 minutos, com partes como versos, refrões e pontes.

O modelo Clip é limitado a segmentos de 30 segundos. O Pro oferece mais controle sobre a duração e o fluxo musical, seja por prompts de texto ou tags estruturais.

Quais são as principais limitações do fluxo de trabalho?

O Lyria 3.5 tem algumas limitações que precisam ser consideradas:

  • Apenas geração em um único turno. Isso significa que você não pode continuar refinando o mesmo clipe em uma cadeia de prompts.
  • Você recebe um clipe de áudio por prompt, com duração máxima de 184 segundos.
  • Os filtros de segurança bloqueiam solicitações de vozes de artistas específicos ou letras protegidas por direitos autorais.

A API também tem um limite: 10 solicitações regionais de previsão on-line por minuto e por modelo-base.

Pronto para testar?

Escolha o modelo que você quer no marketplace

Teste modelos de chat, imagem e vídeo no marketplace da APIMart e experimente rapidamente as capacidades dos modelos com uma API unificada.

Modelos de chatModelos de imagemModelos de vídeo
Explorar marketplace