Trilha sonora e áudio por bloco
Música e efeitos são ancoragem emocional, não decoração. Trilha errada no bloco errado gera atrito inconsciente e derruba retenção sem que ninguém saiba explicar por quê.
Atualizado em 06 de ago. de 2026
Áudio é a camada mais negligenciada e uma das que mais afeta retenção. Música desconectada do bloco gera atrito inconsciente: o espectador não sabe por que saiu, só sentiu que "não estava gostando".
O mapa por bloco
| Bloco da VSL | Áudio |
|---|---|
| Lead / hook | SFX marcados (apito, swoosh, impacto) + música épica ou de suspense |
| História / fundo do poço | Lenta, dramática, melancólica |
| Mecanismo | Volume baixo drasticamente — a atenção precisa ser intelectual |
| Prova | Neutra, quase ausente; deixa o dado falar |
| Pitch / oferta | Volta pro épico e empolgante |
O erro mais caro dessa tabela é o mecanismo: trilha alta durante a explicação compete com a compreensão, e o mecanismo é justamente onde a crença é instalada.
Gabriel Figueiredo (SDE #135) descreve a mesma régua com outra divisão — suave e corporativa na apresentação do expert, triste e profunda no fundo do poço, épica e inspiradora na descoberta do mecanismo.
Efeitos sonoros ambientais
Reforçam a cena e aumentam imersão:
- Ondas e gaivotas quando o ator está na praia.
- Ambiente de escritório, trânsito, cozinha conforme o cenário.
- Humor quando o nicho permite (ex.: SFX cômico em anúncio de constipação).
Áudio gerado por IA
Ferramentas como ElevenLabs e MiniMax:
- Gere bloco por bloco, frase a frase. Nunca o áudio inteiro de uma vez — se errar no meio, você perde os créditos do arquivo todo e refaz.
- Ajuste a escrita para a leitura da IA. Escreva "vinte" em vez de "20"; modelos gringos leem números com entonação errada em português.
- Ajuste entonação fonética palavra a palavra nos pontos críticos (nome do produto, promessa).
Erros
- Funk durante a explicação de uma descoberta científica — incongruência de tom destrói credibilidade.
- Trilha alta no mecanismo.
- Gerar áudio inteiro de uma vez com IA.
- Trilha genérica de biblioteca reconhecível — a mesma música de mil anúncios sinaliza "anúncio".
Variação
Clonagem de voz do expert real no ElevenLabs ou HeyGen — permite gerar variações de copy sem regravar, mantendo a voz que a audiência já reconhece.