Voz falada e sussurro que insistem em virar canto
Por que o Suno canta o que você pediu para ser falado.
Pedir narração, sussurro ou fala no meio de uma música é uma das instruções que o Suno mais ignora. Você escreve spoken word, whispered, falado, e sai melodia cantada do mesmo jeito.
A razão é simples: o modelo foi treinado em música, e música é cantada. Fala é a exceção estatística. Quando o prompt fica ambíguo, ele volta para o comportamento dominante.
O que aumenta as chances
Não resolve sempre, mas melhora bastante:
- Colocar a instrução na estrutura da letra, como marcação de seção, e não só no prompt de estilo.
- Empilhar descritores no mesmo sentido:
spoken, no melody, monotone, conversational, deadpan. Um só é fácil de ignorar; quatro apontando para o mesmo lugar, nem tanto. - Escrever o trecho falado sem estrutura de verso — frases irregulares, sem rima, sem métrica. Letra que parece letra convida melodia.
- Reduzir a instrumentação naquele trecho. Sobre uma base densa, o modelo tende a cantar para a voz competir.
Quando precisa ser garantido
Para uma abertura narrada, uma vinheta ou uma fala de personagem que não pode sair errada, o caminho confiável é produzir a fala fora do Suno — gravando você mesmo ou usando um gerador de voz — e juntar as duas coisas em um editor de áudio.
É mais rápido do que parece: gerar a música instrumental no Suno, gravar a fala no celular, alinhar as duas no editor. Dez minutos contra uma hora tentando convencer o modelo.
Sussurro é o caso mais difícil de todos. Mesmo empilhando descritores, o resultado costuma ser canto suave em vez de sussurro real. Se sussurro é essencial para a faixa, planeje gravar por fora desde o começo.