Zum Inhalt
Tastatur
  • Hilfe anzeigen?
  • Untermenü öffnen↓ / Space
  • Untermenü schließenEsc
  • Studio finden→ Studio
Tiefe
Fortgeschritten

Lautheit und Lautheitsnormalisierung (LUFS, ITU-R BS.1770)

Was ist Lautheitsnormalisierung — und was sagt eine Angabe in LUFS?

Lautheit in diesem Sinn ist eine gemessene Eigenschaft eines Programmsignals: wie laut ein Titel, eine Sendung oder eine Podcastfolge im Mittel ist, ermittelt nach dem Verfahren der Empfehlung ITU-R BS.1770 und angegeben in LUFS. Lautheitsnormalisierung heißt, dass ein Verteiler jeden Beitrag anhand dieser Messung auf einen gemeinsamen Zielwert bringt — mit einer einzigen Pegelanpassung für das ganze Stück, nicht mit einem Eingriff in den Klang.

Früher war jede Platte, jeder Sender und jede Folge unterschiedlich laut, und Du hast nach jedem Wechsel nachgeregelt. Heute misst die Technik vorher nach, wie laut ein Beitrag im Schnitt ist, und dreht ihn beim Abspielen passend leiser oder lauter. Am Klang selbst ändert das nichts — es ist genau der Handgriff, den Du sonst selbst gemacht hättest, nur automatisch und für alle gleich. Deshalb fällt der Wechsel von einem Lied zum nächsten heute kaum noch auf. Und deshalb bringt es einer Produktion nichts mehr, einfach lauter zu sein als die anderen.

Ausführliche Erklärung

Was gemessen wird

Ein Schalldruckpegel beschreibt, wie stark die Luft an einem bestimmten Ort schwankt. Die Lautheit nach BS.1770 beschreibt etwas anderes: eine Eigenschaft des Signals selbst, gemessen im Gerät und nicht im Raum. Der Bezugspunkt ist die Vollaussteuerung der digitalen Kette, weshalb die Werte negativ sind — daher das FS in LUFS, für Full Scale. Wie laut dasselbe Signal am Ohr ankommt, hängt danach immer noch am Lautstärkesteller, am Verstärker, am Wirkungsgrad des Lautsprechers und am Hörabstand.

Herausgeberin des Messverfahrens ist die Internationale Fernmeldeunion in Genf, genauer deren Funkgruppe ITU-R. Drei Zutaten machen das Verfahren aus. Erstens eine Frequenzbewertung, die den Höhenbereich etwas stärker gewichtet, weil Kopf und Ohrmuschel ihn am Trommelfell anheben. Zweitens eine Mittelung über die Zeit, sodass der Verlauf des ganzen Programms zählt und nicht ein einzelner Schlag. Drittens eine Schwelle, unterhalb derer sehr leise Passagen aus der Rechnung fallen — sonst zöge eine lange Pause den Wert eines Stücks nach unten, und ein Hörspiel wäre schon deshalb leiser als ein Popsong.

Zwei Kürzel bezeichnen dabei dasselbe: LUFS und LKFS. Ein LU ist ein Unterschied von einem Dezibel, nur ausdrücklich auf die Lautheit bezogen statt auf einen Schalldruck.

Welche Zielwerte empfohlen sind

Für die Verteilung über das Internet hat die Audio Engineering Society im September 2021 ein technisches Dokument vorgelegt, das drei Werte nennt: −18 LUFS für Inhalte mit messbarem Sprachanteil, −16 LUFS für titelnormalisierte Musik und −14 LUFS für den lautesten Titel eines albumnormalisierten Bestands. Nach Formaten aufgeschlüsselt sind das Nachrichten und Wortbeiträge mit −18, Popmusik mit −16, Mischformate und Sport mit −17 und Hörspiel mit −18 LUFS. Für den Spitzenwert nennt das Dokument eine Obergrenze von −1 dBTP am Eingang des Codecs, damit die Datenreduktion keine Übersteuerung erzeugt.

Der Abstand zwischen Sprache und Musik ist der aufschlussreiche Teil daran. In formalen Hörtests wurde Sprache, die auf dieselbe gemessene Lautheit normalisiert war wie Musik, typischerweise 2 bis 3 dB lauter empfunden — das Messverfahren bewertet die beiden Materialarten also nicht gleich. Deshalb empfiehlt das Dokument ausdrücklich, Musik um diesen Betrag höher zu normalisieren als Sprache.

Zwei Einschränkungen gehören unmittelbar dazu. Das Dokument richtet sich an Verteiler, also an Streamingdienste und Onlineradios, und ausdrücklich nicht an die Produktion und nicht an Bild-mit-Ton-Inhalte. Und es beschreibt, was empfohlen wird, nicht was eine bestimmte Plattform tatsächlich tut.

Was die Normalisierung mit der Dynamik macht

Über zwei Jahrzehnte wurden Musikproduktionen immer stärker komprimiert und begrenzt, weil die lautere Aufnahme im direkten Vergleich zunächst besser wirkt. Die Normalisierung entzieht diesem Anreiz seine Grundlage: Wer lauter mastert, wird jetzt einfach leiser abgespielt, und übrig bleiben die Nebenwirkungen — abgeschnittene Impulse und ein Signal, das dauerhaft nahe am Maximum liegt. Was Dynamikumfang und Kompression genau sind, führt der Eintrag Dynamikumfang aus.

Wichtig ist die Richtung dieses Zusammenhangs: Die Normalisierung selbst komprimiert nichts. Sie ändert einen einzigen Pegelwert für das ganze Stück, und der Abstand zwischen leisesten und lautesten Anteilen bleibt exakt so, wie er in der Produktion angelegt wurde.

Häufiges Missverständnis

„Die Normalisierung macht alle Musik gleich und nimmt ihr die Dynamik." Sie tut das Gegenteil, und zwar aus einem einfachen Grund: Sie greift nur an einer Stelle ein, nämlich an der Verstärkung des gesamten Beitrags. Innerhalb eines Stücks bleibt jeder Unterschied zwischen leise und laut erhalten. Was verschwindet, ist der Sprung zwischen zwei Beiträgen — und mit ihm der Grund, ein Stück absichtlich platt zu machen, damit es im Vergleich gewinnt.

„LUFS ist eine Lautstärkeangabe wie Dezibel am Verstärker." Ein LUFS-Wert sagt nichts darüber, wie laut es bei Dir im Raum wird. Er beschreibt das Signal vor der Wiedergabekette. Zwei Anlagen, die denselben normalisierten Titel abspielen, erzeugen bei gleicher Reglerstellung sehr unterschiedliche Schalldrücke, weil Verstärkung und Wirkungsgrad dazwischenstehen.

Nicht zu verwechseln mit

  • Schalldruck und Schalldruckpegel: Die akustische Größe am Hörplatz in Pascal beziehungsweise Dezibel. Sie beschreibt, was im Raum ankommt; die Lautheit beschreibt eine Eigenschaft des Signals, das hineingeschickt wird.
  • Phon und Sone: Die psychoakustische Lautheit eines Hörereignisses, berechnet nach ISO 532. Sie beziffert, wie laut ein Mensch etwas empfindet. Die Lautheit nach BS.1770 ist dagegen eine gemessene Signaleigenschaft mit einer festen Rechenvorschrift — siehe Phon und Sone.
  • Dynamikumfang: Der Abstand zwischen leisesten und lautesten Anteilen, also eine Spanne. Die Lautheit ist ein einzelner Mittelwert.
  • Dialognormalisierung: Eine Pegelangabe im Tonformat, die die mittlere Dialoglautheit einer Filmproduktion beschreibt und im Prozessor die Wiedergabeverstärkung setzt. Sie betrifft Bild-mit-Ton-Inhalte, die das Dokument der Audio Engineering Society gerade nicht behandelt; erklärt wird sie bei Sprachverständlichkeit.
  • Gehörrichtige Lautstärke: Eine pegelabhängige Korrektur im Wiedergabegerät. Sie setzt an, nachdem das Signal im Haus angekommen ist, und ändert den Frequenzgang statt der Verstärkung — siehe Gehörrichtige Lautstärke.

In der Planung

Eine MultiRoom-Anlage spielt in Küche und Bad morgens Nachrichten, tagsüber Podcasts und abends Musik. Für die Nebenräume ist eine feste Maximallautstärke je Zone eingerichtet, damit niemand versehentlich auf Anschlag dreht. Die Rückmeldung nach vier Wochen: Musik ist zu laut, Wortbeiträge sind zu leise.

Zu klären ist zuerst das Konzept: Welches Programm ist in dieser Zone der bestimmende Fall? Wo Sprache die wesentliche Nutzung ist, wird die Zone dafür ausgelegt, und Musik läuft dort mit dem Nachteil — nicht umgekehrt. Das Verfahren folgt daraus: Der Abstand zwischen beiden Materialarten ist kein Zufall, sondern hat mit den 2 bis 3 dB einen bekannten Betrag, und eine Zone mit gemischter Nutzung braucht deshalb entweder getrennte Vorgaben je Quelle oder eine Reserve nach oben. Erst danach ist die Gerätefrage sinnvoll — und sie lautet, ob die eingesetzte Plattform überhaupt quellenabhängige Pegelvorgaben kennt.

Verknüpfte Inhalte

Warum dieselbe Aufnahme bei geringer Lautstärke dünner wirkt und was eine Korrektur dagegen leisten kann, steht bei Gehörrichtige Lautstärke und ausführlich auf der Wissensseite Menschliches Hören und Lautheit. Die Rechenregeln hinter den Pegelangaben klärt der Eintrag Dezibel, die physikalische Größe am Hörplatz Schalldruck und die Einheiten der empfundenen Lautstärke Phon und Sone. Was die Lautheitssprünge zwischen Produktionen für eine MultiRoom-Anlage bedeuten, behandelt Podcast, Hörbuch und Radio im ganzen Haus.

Quellen

Das Messverfahren und die Einheit gehen auf die Empfehlung ITU-R BS.1770 zurück, die für diese Seite nur über den Katalog erfasst und nicht im Volltext eingesehen wurde. Die Zielwerte, die Formatzuordnung, die Obergrenze für den Spitzenwert und die Feststellung, dass Sprache bei gleicher gemessener Lautheit 2 bis 3 dB lauter empfunden wird, stammen aus dem technischen Dokument AESTD1008 der Audio Engineering Society vom 24. September 2021, das für die Seite zur Sprachwiedergabe im Volltext eingesehen wurde und von dort übernommen ist. EBU R 128 ist als Regelwerk des europäischen Rundfunks geführt, aber ohne Zahlenwert, weil der Text nicht eingesehen wurde.

Tastaturkürzel