Inhalt anzeigen
- Tiefe
- Fortgeschritten
Dialognormalisierung (Dialnorm)
Was ist Dialognormalisierung — und warum ist jeder Sender anders laut?
Die Dialognormalisierung ist eine Zahl, die im codierten Tonsignal
mitläuft und angibt, wie laut die Dialoge einer Produktion im Mittel
abgemischt wurden. Der Decoder im AV-Prozessor liest sie und stellt die
Wiedergabeverstärkung so ein, dass gesprochener Text aus jeder Quelle
auf demselben Pegel landet. Kürzel und Feldname lauten dialnorm.
Du kennst den Moment: Der Film läuft angenehm, dann kommt die Werbung und Du greifst zur Fernbedienung. Genau dagegen bekommt jede Produktion vom Tonstudio eine Notiz mit auf den Weg, wie laut in ihr gesprochen wird. Dein Gerät liest diese Notiz und dreht die laute Produktion von sich aus etwas leiser, bevor Du es tun musst. Steht darin eine falsche Zahl — und das kommt vor —, macht Dein Gerät genau das Falsche, und der Sprung ist da. Deine Anlage ist dann in Ordnung; die Notiz war es nicht.
Ausführliche Erklärung
Was im Bitstrom steht
Das Feld gehört zu den Metadaten, die Dolby Laboratories mit dem Verfahren AC-3 eingeführt hat und die seither in den Nachfolgeverfahren weitergeführt werden. Es beziffert die mittlere Dialoglautheit der Produktion als Abstand zur Vollaussteuerung der digitalen Skala, also in dBFS, und der zulässige Bereich reicht von −1 bis −31 dBFS in Schritten von einem Dezibel. Eine Produktion mit lauten Dialogen bekommt einen Wert nahe null, eine zurückhaltend abgemischte einen Wert weit darunter.
Zwei Dinge stehen dort ausdrücklich nicht. Das Feld beschreibt nicht den Spitzenpegel des Programms — Effekte dürfen weit darüber liegen —, und es beschreibt auch nichts, das der Codierer selbst herausgefunden hätte. Die Zahl wird von Menschen gesetzt: im Studio, im Sendehaus, beim Anlegen einer Disc. Wie sie zu bestimmen ist, sagt heute das Messverfahren der Empfehlung ITU-R BS.1770, das auch hinter den LUFS-Angaben steht und beim Eintrag Lautheitsnormalisierung erklärt wird.
Was der Decoder daraus macht
Der Bezugswert ist −31 dBFS. Ein Programm, dessen Dialoge genau dort liegen, wird unverändert wiedergegeben. Bei jedem höheren Wert dämpft der Decoder um die Differenz: Steht im Signal −24 dBFS, nimmt er sieben Dezibel zurück, bei −27 dBFS vier. Das Ergebnis ist ein einheitlicher Dialogpegel über alle Quellen hinweg, ohne dass jemand nachregelt.
Wichtig ist, woran die Dämpfung ansetzt. Sie wirkt auf das gesamte Signal und auf alle Kanäle gleichzeitig, verschiebt also die Wiedergabe als Ganzes. Die Abstände innerhalb des Films — leiser Dialog, lauter Effekt — bleiben dabei unangetastet, und am Frequenzgang ändert sich nichts.
Damit hängt an dem Feld eine Folge, die im eingemessenen Raum zählt: Deine Skala am Prozessor bedeutet nicht mehr für jede Quelle dasselbe. Steht dort „−15", der Film führt aber einen Wert von −24 dBFS mit, hörst Du effektiv bei −22. Was der Referenzpegel an der Anzeige überhaupt erst nachvollziehbar macht, hebt eine unpassend gesetzte Dialognormalisierung also wieder auf.
Warum die Lautstärkesprünge trotzdem bleiben
Das Verfahren funktioniert genau so weit, wie die eingetragene Zahl stimmt. Drei Fälle erzeugen den Sprung, den Kunden beschreiben.
Erstens die falsch gesetzte Angabe. Wird ein Wert pauschal auf −31 gestellt, obwohl die Produktion deutlich lauter gemischt ist, unterbleibt die Dämpfung und der Beitrag steht heraus. Das ist der klassische Werbeblock; gegen ihn hat die Rundfunkaufsicht in mehreren Ländern eigene Vorgaben zur Aussteuerung erlassen.
Zweitens der Wechsel zwischen Zuspielwegen. Eine App im Fernseher, die den Ton selbst decodiert und als PCM weiterreicht, hat die Metadaten bereits verarbeitet oder verworfen, bevor der Prozessor sie sehen könnte. Ob die Auswertung stattgefunden hat, ist von außen nicht sichtbar — auffällig wird nur, dass derselbe Film über zwei Wege verschieden laut ist.
Drittens die abgeschaltete Auswertung. Manche Prozessoren erlauben es, die Dialognormalisierung zu ignorieren. Wer das tut, bekommt eine Skala zurück, die für alle Quellen dasselbe bedeutet, und handelt sich die Sprünge zwischen den Produktionen wieder ein.
Rundfunk und Disc gehen verschiedene Wege
Im Fernsehen ist die Angabe ein laufend gepflegter Wert: Das Sendehaus misst die Lautheit seines Programms und stellt den Wert entsprechend ein, damit der Zuschauer beim Umschalten Ruhe hat. Auf einer Disc dagegen ist die Produktion abgeschlossen und die Angabe fest.
Aus dieser Verschiedenheit folgt eine Beobachtung, die im Heimkino oft für Verwirrung sorgt: Filmtonspuren auf Disc sind häufig so angelegt, dass keine Dämpfung anfällt, während Fernsehprogramme regelmäßig gedämpft werden. Ein Film wirkt bei derselben Reglerstellung deshalb kräftiger als das laufende Programm, und das ist kein Fehler der Anlage.
Häufiges Missverständnis
„Dialnorm ist der Nachtmodus." Beide greifen am Pegel an, und deshalb werden sie verwechselt. Die Dynamikbegrenzung arbeitet fortlaufend: Sie nimmt laute Stellen stärker zurück als leise und verkleinert damit den Abstand innerhalb des Films. Die Dialognormalisierung stellt einmal für das ganze Programm eine Verstärkung ein und lässt jeden Abstand darin unberührt. Die Verwirrung hat einen realen Kern — in den Dolby-Verfahren beziehen sich die Steuerdaten der Dynamikbegrenzung auf denselben Dialogpegel, den dieses Feld beziffert. Wer den einen Wert verstellt, verändert deshalb die Wirkung des anderen mit.
„Dialnorm macht die Dialoge lauter." Der Name legt es nahe, und die Kundenfrage dahinter — „ich verstehe die Sprache nicht" — ist eine andere. Angehoben wird hier gar nichts, schon gar nicht ein einzelner Kanal: Die Angabe beschreibt den Dialogpegel und dient als Maßstab für die Dämpfung des gesamten Signals. Gegen schwer verständliche Sprache helfen der Center-Pegel, die Aufstellung und der Raum, und wie diese zusammenwirken, steht bei Sprachverständlichkeit.
Nicht zu verwechseln mit
- Lautheitsnormalisierung der Verteiler: Ein Streamingdienst misst jeden Beitrag und passt ihn vor der Auslieferung an. Das passiert auf der Verteilseite und ohne Metadaten im Signal, während die Dialognormalisierung eine Angabe im Bitstrom ist, die erst der Decoder auswertet. Die technischen Empfehlungen dazu nehmen Bild-mit-Ton-Inhalte ausdrücklich aus — siehe Lautheitsnormalisierung.
- Dynamikbegrenzung oder Nachtmodus: Sie verkleinert den Abstand zwischen leisen und lauten Stellen und wirkt fortlaufend. Siehe Dynamikumfang und Kompression.
- Dialoganhebung und Center-Pegel: Eine Änderung der Balance zwischen den Kanälen. Sie zielt auf Verständlichkeit, die Dialognormalisierung auf einen einheitlichen Gesamtpegel.
- Referenzpegel: Der Bezugspunkt, auf den ein Raum kalibriert wird. Er steht in keiner Datei und in keinem Signal; die Dialognormalisierung verschiebt die Wiedergabe gegenüber diesem Punkt. Siehe Referenzpegel.
- Vollaussteuerung (0 dBFS): Die Obergrenze der digitalen Skala, auf die sich der Zahlenwert bezieht. Wie analoge und digitale Skala zusammenhängen, klärt Bezugspegel zwischen analoger und digitaler Skala.
- Gehörrichtige Lautstärke: Eine pegelabhängige Korrektur des Frequenzgangs im Wiedergabegerät. Sie ändert die Klangbalance, die Dialognormalisierung nur die Verstärkung. Siehe Gehörrichtige Lautstärke.
In der Planung
Ein eingemessenes Heimkino, sauber kalibriert, der Kunde meldet sich nach zwei Wochen: Bei Filmen von der Disc stimmt alles, das Fernsehen sei „dumpf und zu leise", und er müsse jedes Mal um etwa fünf Dezibel nachdrehen.
Zu klären ist zuerst das Konzept. Soll die Anlage jede Quelle auf einen gemeinsamen Dialogpegel bringen, oder soll die Skala für alle Quellen dieselbe absolute Bedeutung behalten? Beides gleichzeitig gibt es nicht, und die Antwort hängt an der Nutzung — ein Raum, in dem überwiegend Filme in voller Länge laufen, entscheidet anders als ein Wohnzimmer mit viel laufendem Programm.
Die Prüfung selbst hat dann eine Reihenfolge. Zuerst wird nachgesehen, ob der Ton überhaupt codiert am Prozessor ankommt oder ob ein Zuspieler ihn vorher zu PCM wandelt; im zweiten Fall ist die Auswertung schon passiert und jede Einstellung am Prozessor bleibt wirkungslos. Danach wird der Unterschied gemessen statt geschätzt, mit demselben Testmaterial über beide Wege. Erst dann steht die Frage nach der Geräteeinstellung an — und sie lautet, ob dieser Prozessor die Auswertung überhaupt freigibt und ob eine quellenbezogene Pegelkorrektur der ruhigere Weg ist.
Verknüpfte Inhalte
Wie Lautheit gemessen wird und was die Verteiler damit machen, steht bei Lautheitsnormalisierung. Der Bezugspunkt der Kalibrierung ist der Referenzpegel, die Auslegungsfrage dahinter beantwortet Wie laut muss ein Heimkino sein?. Was Dynamikbegrenzung und Nachtmodus tun, führt Dynamikumfang und Kompression aus; welche Stufen der Signalweg im Gerät durchläuft, zeigt AV-Prozessor-Architektur. Für die Rechenregeln hinter den Pegelangaben: Dezibel.
Quellen
Das Feld und das Verhalten des Decoders sind in der AC-3-Spezifikation ATSC A/52 festgelegt, die für diese Seite nicht im Volltext eingesehen wurde; Wertebereich und Bezugswert stehen deshalb mit Prüfvermerk. Die empfohlene Praxis für das Setzen des Wertes im Fernsehen beschreibt ATSC A/85, hier nur als Regelwerk geführt und ohne Zahlenwert. Das Messverfahren, aus dem der einzutragende Wert bestimmt wird, ist die Empfehlung ITU-R BS.1770.