Nivelar o podcast antes de publicar
Rode “Podcast / voz” em cada episódio para o público não precisar ajustar o volume a cada vez.
Guide
A normalização de volume faz um lote de arquivos soar no mesmo nível: episódios de podcast com volumes diferentes, trechos de entrevista de origens distintas que sobem e descem quando emendados, material que precisa chegar a −14 LUFS antes de subir para uma plataforma. É o modo “Normalizar volume” dentro da aba “Volume” do Estúdio de áudio e vídeo e usa o filtro loudnorm do ffmpeg com processamento EBU R128 em duas passagens.
Atualizado em 2026-09-274 min read
A normalização de volume faz um lote de arquivos soar no mesmo nível: episódios de podcast com volumes diferentes, trechos de entrevista de origens distintas que sobem e descem quando emendados, material que precisa chegar a −14 LUFS antes de subir para uma plataforma. É o modo “Normalizar volume” dentro da aba “Volume” do Estúdio de áudio e vídeo e usa o filtro loudnorm do ffmpeg com processamento EBU R128 em duas passagens.
São três predefinições: podcast / voz com −16 LUFS, pico real de −1,5 dBTP e faixa de volume de 11 LU; streaming de música com −14 LUFS, −1 dBTP e 11 LU; rádio EBU R128 com −23 LUFS, −2 dBTP e 7 LU. “Duas passagens” significa que a primeira percorre o arquivo inteiro apenas medindo (loudness integrado, pico real, LRA e limiar) e a segunda devolve as medições ao loudnorm para aplicar ganho linear, com menos sensação de “bombeamento” que o modo dinâmico de uma passagem. Em vídeos, apenas o áudio é recodificado; a imagem é copiada.
<original-name>_normalizado.mp3 e assim por diante; em vídeo, a saída mantém o contêiner de origem, por exemplo <original-name>_normalizado.mp4.| Entrada | Saída | Observação |
|---|---|---|
3 MP3 de podcast, em cerca de −21, −17 e −12 LUFS |
todos com “Podcast / voz” → todos em −16 LUFS |
Basta processar cada um; com o mesmo destino, a percepção fica igual |
gravação com 2 minutos de silêncio puro no início |
a medição da 1ª passagem pode falhar → aviso para usar o modo dinâmico de uma passagem |
Corte antes com “Remover silêncios” para um resultado mais preciso |
MP4 de entrevista |
imagem copiada e áudio recodificado em AAC 192 kbps, nivelado no destino |
O tempo é o de duas passagens de decodificação do áudio |
Rode “Podcast / voz” em cada episódio para o público não precisar ajustar o volume a cada vez.
Nivele celular, gravador e reunião on-line em −16 LUFS antes de mesclar.
Entregue em −14 LUFS e −1 dBTP para evitar que a plataforma reduza o volume automaticamente.
Normalize cada um dos vários MP4: como a imagem não é recodificada, a qualidade não sofre.
O ajuste de volume multiplica o sinal às cegas; a normalização mede primeiro o quão alto está o arquivo, calcula o ganho necessário e limita o pico real para não estourar — o resultado é “dentro do padrão”, e não “6 dB mais alto”.
A primeira passagem não encontrou medições, o que costuma acontecer com grandes trechos de silêncio ou arquivos corrompidos. O modo dinâmico ajusta em tempo real, em uma passagem, e também chega perto do destino, mas pode deixar uma leve oscilação de volume.
Programas de voz pedem podcast (−16); músicas e trilhas pedem streaming (−14); só escolha rádio (−23, bem mais baixo) para entrega a emissoras de TV ou conforme a norma europeia de radiodifusão.
A análise e o processamento das duas passagens acontecem no navegador, com ffmpeg.wasm, e o arquivo não é enviado; no primeiro uso, cerca de 31 MB do motor são baixados de um CDN (o domínio de recursos do site ou o jsDelivr), e essa requisição não inclui o conteúdo de áudio ou vídeo.
Atualizado em 2026-09-27
Duas passagens de loudnorm (EBU R128) para nivelar o áudio ao volume padrão de podcast, música ou radiodifusão
Todo o processamento é feito localmente no navegador; os arquivos não são enviados a nenhum servidor