Suno Speech (beta): como criar locuções, narrações e spoken word com IA e música de fundo em uma única faixa
O Suno Speech é um novo beta na página Create do Suno que gera uma voz falada e a música de fundo ao mesmo tempo. Como funcionam os modos Simple e Advanced, os controles Vocal Gender, Background music e Variety, exemplos de prompts, os limites conhecidos do beta e o que o Suno ainda não anunciou.

Em 1º de outubro de 2026 o Suno abriu o Speech (beta) para todo mundo na web, no iOS e no Android. É o primeiro recurso do Suno que não é sobre cantar: você digita uma ideia ou cola um roteiro, descreve a voz e a música que quer, e o Suno gera uma performance falada e a trilha sonora juntas, em uma única faixa. O Suno chama isso de “o primeiro modelo de áudio que gera voz e música juntas como uma faixa coesa”.
A versão curta: o Suno Speech é uma ferramenta de locução com IA que já vem com um compositor. O modo Simple escreve o texto para você a partir de uma ideia de uma linha; o modo Advanced lê o seu próprio roteiro no estilo que você descrever. A música de fundo vem ligada por padrão e pode ser desligada para uma narração limpa. Uma take pode ter cerca de oito minutos. O Suno ainda não publicou o custo em créditos, a lista de idiomas nem uma API, e diz claramente que o beta ainda tem arestas.
Fontes de tudo abaixo: o anúncio do Suno assinado pelo Chief Product Officer Jack Brody, a nota de versão de 1º de outubro, o vídeo tutorial oficial do Suno How to Use Suno Speech (Beta) (as capturas da interface neste artigo vêm dele), a cobertura do The Verge e a repercussão no X. Quando o Suno não disse algo, dizemos isso em vez de chutar. Este site é uma ferramenta independente de download do Suno e não tem vínculo com o Suno.

Suno Speech em resumo
| Suno Speech (beta) | |
|---|---|
| Lançamento | 1º de outubro de 2026, como beta aberto depois de um mês de testes com um grupo pequeno |
| Onde | suno.com e os apps do Suno para iOS e Android, em Create → Speech |
| Quem pode usar | Todo mundo, segundo o Suno; nenhuma restrição por plano foi anunciada |
| O que gera | Uma voz falada e música original em uma única faixa; a música pode ser desligada |
| Modos | Simple (descreva a ideia) e Advanced (roteiro próprio + estilo de fala) |
| Controles | Vocal Gender (Male / Female), Background music (On / Off), controle deslizante Variety |
| Duração | Até cerca de 8 minutos por take |
| Ainda não anunciado | Custo em créditos por take, idiomas suportados, API, usar sua própria Voice como narrador |
O que o Suno Speech realmente faz
Hoje a maior parte das locuções com IA são dois trabalhos. Uma ferramenta de texto para fala (TTS) lê o roteiro, uma ferramenta de música ou um banco de trilhas fornece o fundo, e alguém junta as duas coisas num editor e acerta os volumes. O Suno Speech faz as duas coisas numa só passada. Como a trilha é gerada junto com a voz, ela pode crescer quando a interpretação fica dramática e recuar quando o narrador desacelera, em vez de tocar embaixo sempre no mesmo nível.
O Suno apresenta o recurso com exemplos bem-humorados. A nota de versão fala em “histórias para dormir sobre piano suave, discursos motivacionais sobre tambores de estádio, listas de compras em ASMR e mais”. No anúncio, Brody lista o que o time fez enquanto desenvolvia: mensagens de amigos transformadas em “leituras dramáticas exageradamente produzidas”, áudios comuns com “trilhas desnecessariamente épicas”, meditações, poemas, discursos de incentivo e histórias para os filhos dormirem. O tutorial do Suno acrescenta usos mais práticos: um audioguia de museu, um aviso de estação de trem, uma peça de spoken word e uma explicação para estudar.
Também não é o primeiro modelo de voz do Suno. Antes de apostar tudo em músicas, o Suno lançou em 2023 o Bark, um modelo de texto para fala de código aberto. O Speech é o primeiro modelo de voz integrado ao próprio app do Suno.
Como usar o Suno Speech na web
Abra suno.com/create. O painel da esquerda agora tem três abas: Songs, Speech e Sounds. Clique em Speech. O painel mostra um selo vermelho de BETA, e no topo você escolhe entre Simple e Advanced.
Modo Simple: descreva a ideia pronta

No modo Simple você escreve um só prompt que diz o que é falado, quem fala e o que toca por baixo. Você não escreve o roteiro: o Suno escreve. No tutorial, o prompt é um audioguia de museu para uma exposição obviamente falsa sobre a invenção do botão soneca — “narrador calmo e sério, um pouco dramático, com uma música orquestral elegante por baixo” — e o Suno devolve uma narração completa (“Welcome to Gallery 7. Please stand a respectful distance from the glass…”) com uma trilha orquestral combinando. O resultado no tutorial tem pouco mais de cinco minutos, e o pedido volta com duas takes, do mesmo jeito que uma geração de música.
O exemplo do The Verge, “a pirate captain rallying his crew” (um capitão pirata incentivando a tripulação), mostra como é pouco o que você precisa digitar.
Modo Advanced: seu roteiro, sua direção

Mude para Advanced quando você já sabe exatamente o que deve ser dito. São duas caixas:
- Custom script: “Write or paste your speech” (escreva ou cole seu texto). É o que o Suno vai interpretar.
- Style of speech: “Describe the delivery: tone, pacing, mood and setting” (descreva a interpretação: tom, ritmo, clima e cenário). Aqui você dirige a performance e, se a música estiver ligada, também a trilha.
A melhor demonstração do tutorial mantém o mesmo aviso curto e muda só o estilo. “Locutor de estação de trem calmo e profissional, ritmo lento e medido, totalmente sério” produz uma leitura impassível de “Attention passengers, the 6:42 train to nowhere in particular is now boarding on platform 9.” Troque o estilo para “locutor cada vez mais frenético tentando continuar profissional; começa controlado e fica mais rápido e exasperado a cada frase” e as mesmas palavras voltam como uma interpretação completamente diferente.
A dica do Suno para o roteiro é simples: escreva como se fala, em parágrafos normais. Você não precisa de formatação de letra nem de tags de seção entre colchetes como [Verse] ou [Chorus], como faria numa música.
Os controles do Advanced: Vocal Gender, Background music e Variety

- Vocal Gender: Male ou Female. Na visão inicial nenhum está selecionado, então só é preciso quando o gênero importa.
- Background music: ligado por padrão. Coloque em Off quando precisar de áudio falado limpo: narração para um vídeo em que você vai pôr a sua própria trilha, diálogos, instruções ou qualquer caso em que você já tenha a música.
- Variety: o quanto as takes podem variar. Fica em Normal por padrão; mova para a esquerda para leituras mais previsíveis e para a direita para leituras mais surpreendentes.
Suno Speech no iPhone e no Android

O Speech também está nos apps; se não aparecer, o anúncio do Suno no X pede para “atualizar o app para a versão mais recente”. No app você escolhe Speech no menu do topo do Create, e os campos do Advanced viram chips: Backing music on (toque no × para remover), Script e Tone. O exemplo de celular do tutorial é para estudar — “Tenho prova amanhã. Explique osmose para mim como um professor paciente. Comece com uma analogia simples e depois me dê uma explicação curta que eu consiga lembrar na prova” —, transformando anotações em algo para ouvir a caminho da aula.
Exemplos de prompts para o Suno Speech
Eles seguem o padrão dos exemplos do Suno: primeiro o que é a peça, depois a voz, depois a música.
História para dormir (modo Simple)
A two-minute bedtime story about a fox who learns to share fireflies. Soft, warm storyteller voice with a gentle smile in it, slow pace. Quiet piano and soft night pads underneath, lullaby tempo.
Discurso motivacional (modo Simple)
A coach’s half-time pep talk to a team that is losing 2–0. Loud, rallying, building to a shout. Stadium drums and brass that grow with every line.
Seu próprio roteiro (modo Advanced)
Custom script: cole o texto exato em parágrafos curtos.
Style of speech: Warm adult narrator, intimate and conversational, steady pace, clear pronunciation. Sparse felt piano underneath, voice forward in the mix, gentle ending.
Locução limpa, sem música (modo Advanced)
Background music: Off. Variety: todo para a esquerda.
Style of speech: Neutral, friendly product-demo narrator, medium pace, clear diction. No background music.
O Suno não publicou quais idiomas o Speech suporta; se for usar em português, teste primeiro com um roteiro curto antes de partir para um longo.
Dicas para resultados melhores
- Dirija a interpretação, não só o conteúdo. Tom, ritmo, clima e cenário são as quatro coisas que o próprio texto de ajuda do Suno pede. “Começa calmo, acelera e termina sem fôlego” funciona melhor que “dramático”.
- Dê ao roteiro forma de fala. Frases curtas, pontuação onde quem fala respiraria, quebras de parágrafo entre ideias. Rimas e refrões repetidos podem puxar o modelo para uma leitura rítmica, meio cantada.
- Teste o estilo com um roteiro curto. O aviso de trem do tutorial mostra que as mesmas palavras podem soar totalmente diferentes; acerte o estilo com algumas linhas antes de colar um roteiro de cinco minutos.
- Ouça comparando com o seu texto. Confira nomes, números e qualquer palavra que precise ser exata antes de publicar. É uma ferramenta criativa, não um motor de TTS palavra por palavra.
- Para só voz, some sinais. O interruptor principal é Background music em Off. Uma dica inicial da comunidade, reunida pelo aireiter, acrescenta levar Variety todo para a esquerda e escrever “No background music.” no campo de estilo ou de tom, porque às vezes a música entrava mesmo assim. Trate isso como gambiarra, não como garantia.
- Não imite pessoas reais. Descreva a voz por idade, textura, sotaque e atitude em vez de citar alguém cuja voz você não tem permissão para usar.
O que o Suno diz que o beta ainda erra
O Suno é incomumente franco. “Beta é beta de verdade”, escreve Brody. “De vez em quando, sotaques britânicos podem dar uma volta pela Austrália e voltar. Pausas dramáticas podem ficar muito dramáticas.” Conte com uma parte das takes mudando de sotaque no meio do roteiro, esticando demais uma pausa ou lendo uma palavra de um jeito diferente do que você queria. Gerar duas takes e escolher a melhor faz parte do processo.
Coisas que o Suno ainda não publicou:
- Custo em créditos. Nem o anúncio nem a nota de versão dão um preço por take ou dizem se os planos gratuito e pago têm limites diferentes. A tela Create mostra o seu saldo; confira antes de uma leva de roteiros longos.
- Idiomas. Não há uma lista publicada de idiomas suportados.
- Sua própria voz. O recurso separado Voices permite cantar músicas com a sua voz verificada. Nada do que o Suno publicou diz que uma Voice salva pode ser usada como narrador no Speech.
- Uma API. O Speech está só no site e nos apps, como o resto do Suno. Nossa explicação sobre a API do Suno mostra o que isso significa para desenvolvedores.
- Direitos específicos do Speech. O Suno não publicou termos separados para o Speech. A regra geral é que o uso comercial vem com o que é criado num plano pago, e o que é criado no plano gratuito é para uso pessoal; nosso guia jurídico entra nos detalhes.
Suno Speech x ferramenta de texto para fala
O Suno Speech e ferramentas como a ElevenLabs resolvem problemas diferentes. Escolha o Suno Speech quando a performance e a música andam juntas: histórias para dormir, poemas, meditações, trailers, brindes, personagens, leituras dramáticas do grupo da família. Escolha uma ferramenta de TTS dedicada quando precisar de a mesma voz em centenas de clipes, tempo exato, pronúncia perfeita ou uma API: tutoriais de produto, audiolivros, acessibilidade, apps. As duas também podem conviver: faça no Suno a versão com trilha e guarde uma leitura seca de TTS para o que precisa ser preciso.
O que estão dizendo no X
O anúncio do Suno no X foi curto: “Speech is now in Beta. Try the first model ever that creates spoken audio with matching background music. Update your app for the latest.” (“O Speech está em beta. Experimente o primeiro modelo que cria áudio falado com música de fundo combinando. Atualize o app”). Perfis de notícias de IA repercutiram em poucas horas; o divulgador chinês de IA Gorden Sun (@Gorden_Sun) resumiu como um passo natural para uma empresa que já gera vozes cantadas, com o diferencial de que “a voz gerada combina perfeitamente com a música de fundo”.
Nem todo mundo se convenceu. No r/SunoAI um usuário chamou a própria demo do Suno de “preocupantemente ruim” (citado no guia do aireiter linkado acima), e o The Verge lembrou que voz com IA é um campo concorrido, da ElevenLabs à Adobe, e leu o lançamento em parte como o Suno diversificando além da música. No mesmo dia, o CEO Mikey Shulman disse à Bloomberg que o Suno já está “muito além” dos 2 milhões de assinantes e US$ 300 milhões de receita divulgados da última vez, sem dar um número novo.
Baixar faixas do Suno Speech
As takes do Speech aparecem no seu workspace ao lado das suas músicas, com a etiqueta SPEECH e os mesmos botões de curtir, fixar e compartilhar. Para guardar um arquivo, use o download oficial do Suno do seu plano; até o Suno dizer o contrário, conte com os mesmos limites de download das músicas.
O Suno Music Downloader funciona com links públicos do Suno. Se você publicar uma faixa do Speech e o link de compartilhamento abrir uma página normal suno.com/song/…, cole o link e salve uma cópia para ouvir em M4A, MP3, WAV ou MP4 para uso pessoal, sem entrar no Suno e sem gastar sua cota de downloads. O Speech ainda está em beta, então se um link do Speech não carregar na ferramenta, avise a gente que vamos verificar.
Perguntas frequentes
O que é o Suno Speech? O Suno Speech é um recurso beta da página Create do Suno que gera áudio falado — narrações, locuções, histórias, discursos — junto com música de fundo original em uma única faixa. O Suno lançou o recurso em 1º de outubro de 2026 e o apresenta como o primeiro modelo de áudio que cria voz e música ao mesmo tempo.
O Suno Speech é gratuito? O Suno diz que o beta está aberto a todos na web e no celular, mas não publicou quantos créditos custa uma take do Speech nem se os limites mudam conforme o plano. Seu saldo de créditos aparece na tela Create.
Como usar o Suno Speech? Abra o Create no suno.com ou no app e escolha Speech. No modo Simple, descreva a peça, a voz e a música em um único prompt. No modo Advanced, cole o seu texto em Custom script, descreva a interpretação em Style of speech e ajuste Vocal Gender, Background music e Variety se precisar.
O Suno Speech faz locução sem música? Sim. Desligue Background music no modo Advanced ou remova o chip Backing music no celular. Alguns usuários também escrevem “No background music.” no estilo e baixam o Variety, porque durante o beta às vezes a música aparecia.
Quanto tempo pode ter uma faixa do Suno Speech? Até cerca de oito minutos por take, segundo o tutorial do Suno.
Posso usar minha própria voz no Suno Speech? O Suno não disse isso. Vozes pessoais fazem parte do recurso separado Voices, para músicas, e nada do que foi publicado indica que uma Voice salva possa narrar uma faixa do Speech.
O Suno Speech tem API? Não. Como o resto do Suno, o Speech só está disponível no site e nos apps para iOS e Android.
O Suno Speech substitui o texto para fala? Não para tudo. Ele funciona melhor em peças curtas e expressivas em que a música faz parte do resultado. Para narrações longas, exatas ou repetíveis, uma ferramenta de TTS dedicada ainda é mais previsível, e o próprio Suno avisa que no beta os sotaques e as pausas podem variar.
Posso baixar faixas do Suno Speech com o Suno Music Downloader? A ferramenta lê links públicos do Suno. Uma faixa do Speech publicada que abra como uma página normal de suno.com/song pode ser salva como uma música; o Speech é novo e está em beta, então avise a gente se um link do Speech não funcionar.
Vamos atualizar este artigo quando o Suno publicar preços, idiomas ou outras mudanças no Speech.


