Homogénéiser des podcasts avant diffusion
Passez chaque épisode en « Podcast / voix » : l'auditeur n'a plus à régler le volume d'un épisode à l'autre.
Guide
La normalisation audio fait sonner un lot de fichiers au même niveau : des épisodes de podcast aux volumes inégaux, des extraits d'interviews de sources différentes qui sautent du fort au faible, ou un fichier à livrer à −14 LUFS avant publication. C'est le mode « Normalisation audio » de l'onglet « Réglage du volume » de l'atelier audio et vidéo ; il s'appuie sur le filtre loudnorm de ffmpeg pour un traitement EBU R128 en deux passes.
Mis à jour le 2026-09-274 min read
La normalisation audio fait sonner un lot de fichiers au même niveau : des épisodes de podcast aux volumes inégaux, des extraits d'interviews de sources différentes qui sautent du fort au faible, ou un fichier à livrer à −14 LUFS avant publication. C'est le mode « Normalisation audio » de l'onglet « Réglage du volume » de l'atelier audio et vidéo ; il s'appuie sur le filtre loudnorm de ffmpeg pour un traitement EBU R128 en deux passes.
Trois préréglages : podcast / voix à −16 LUFS, vrai pic −1,5 dBTP, plage de sonie 11 LU ; streaming musical à −14 LUFS, −1 dBTP, 11 LU ; diffusion EBU R128 à −23 LUFS, −2 dBTP, 7 LU. « Deux passes » signifie que la première parcourt tout le fichier en mesurant seulement (sonie intégrée, vrai pic, LRA, seuil), puis que la seconde réinjecte ces mesures dans loudnorm pour appliquer un gain linéaire, avec bien moins d'effet de pompage que le mode dynamique en une passe. Sur une vidéo, seul l'audio est réencodé : l'image est copiée telle quelle.
| Entrée | Sortie | Remarque |
|---|---|---|
3 épisodes de podcast MP3, environ −21, −17 et −12 LUFS |
« Podcast / voix » sur chacun → tous à −16 LUFS |
Traitez-les séparément : à cible identique, le ressenti s'unifie |
2 minutes de silence pur au début d'un enregistrement |
La mesure de la passe 1 peut échouer → message conseillant le mode dynamique en une passe |
Coupez d'abord avec « Retrait des silences » pour un résultat plus juste |
MP4 d'interview |
Image copiée, audio réencodé en AAC 192 kbps et ramené à la cible |
Durée d'exécution : environ deux décodages audio |
Passez chaque épisode en « Podcast / voix » : l'auditeur n'a plus à régler le volume d'un épisode à l'autre.
Ramenez d'abord téléphone, dictaphone et réunion en ligne à −16 LUFS, puis fusionnez.
Livrez à −14 LUFS et −1 dBTP pour éviter que la plateforme ne baisse automatiquement le niveau.
Normalisez chacun des MP4 : l'image n'est pas réencodée, la qualité reste intacte.
Le réglage du volume multiplie à l'aveugle par un coefficient ; la normalisation audio mesure d'abord le niveau réel du fichier, puis calcule le gain nécessaire et plafonne le vrai pic. Le résultat « atteint une norme » au lieu de « monter de 6 dB ».
La première passe n'a pas réussi à extraire de mesure, souvent à cause de longs silences ou d'un fichier corrompu. Le mode dynamique ajuste en temps réel sur une seule passe et approche aussi la cible, mais peut laisser entendre de légères variations de niveau.
Podcast (−16) pour les émissions de voix ; streaming musical (−14) pour les chansons et les bandes-son ; diffusion (−23, nettement plus silencieux) uniquement pour une livraison télévisée ou conforme à la norme européenne de radiodiffusion.
L'analyse et le traitement des deux passes se font localement dans le navigateur avec ffmpeg.wasm, sans envoi de fichier ; au premier usage, environ 31 MB de moteur sont téléchargés depuis un CDN (domaine des ressources du site ou jsDelivr), une requête qui ne contient ni audio ni vidéo.
Mis à jour le 2026-09-27
Filtre loudnorm en deux passes (EBU R128) pour aligner le son sur les normes podcast, musique ou diffusion
Tout le traitement s’effectue localement dans votre navigateur ; aucun fichier n’est envoyé vers un serveur