Text-to-SpeechBarrierefreiheit

Das Lesen geht rapide zurück – warum Text-to-Speech zur Usability-Funktion wird und nicht nur der Barrierefreiheit dient

Junge Menschen lesen so wenig wie seit 20 Jahren nicht mehr. Text-to-Speech entwickelt sich deshalb vom Nischen-Tool für Barrierefreiheit zur zentralen Usability-Funktion moderner Websites.

Anthony Morris·
Das Lesen geht rapide zurück – warum Text-to-Speech zur Usability-Funktion wird und nicht nur der Barrierefreiheit dient

Jahrelang galt Text-to-Speech (TTS) als Zusatzfunktion für Barrierefreiheit – etwas, das man einbaut, um Menschen mit Sehbeeinträchtigungen oder Leseschwierigkeiten zu unterstützen.

Neue Daten aus dem Annual Literacy Survey 2025 des National Literacy Trust legen nahe, dass diese Sichtweise überholt ist. Lesefreude und Lesehäufigkeit junger Menschen sind auf den tiefsten Stand seit 20 Jahren gefallen – und der Rückgang beschleunigt sich.

Wenn die nächste Generation von Web-Nutzern immer weniger liest, ist TTS kein bloßes Compliance-Häkchen mehr. Es wird zu einer zentralen Usability-Funktion, um dein Publikum zu erreichen und zu halten.

Die Zahlen: 20 Jahre Rückgang beim Lesen

Der Bericht 2025 des National Literacy Trust basiert auf 114.970 Antworten von Kindern und Jugendlichen zwischen 5 und 18 Jahren und zeichnet ein drastisches Bild davon, wie schnell sich Lesegewohnheiten verändern.

Die Lesefreude ist eingebrochen.

  • Nur noch jedes dritte Kind bzw. jeder dritte Jugendliche zwischen 8 und 18 Jahren gibt 2025 an, in der Freizeit gern zu lesen.
  • Das ist ein Rückgang um 36 % seit Beginn der Umfrage im Jahr 2005.
  • Besonders stark war der Rückgang im letzten Jahr bei Kindern im Grundschulalter und bei Jungen zwischen 11 und 16 Jahren.

Tägliches Lesen verschwindet.

  • Weniger als jeder Fünfte im Alter von 8 bis 18 Jahren liest in der Freizeit täglich etwas – der niedrigste je gemessene Wert.
  • Das tägliche Lesen ist seit 2005 um fast 20 Prozentpunkte gesunken.
  • Selbst in der jüngsten Gruppe (Kinder zwischen 5 und 8 Jahren) sank das tägliche Lesen innerhalb eines einzigen Jahres um 3,4 Prozentpunkte auf 44,5 %.

Was junge Menschen wirklich wollen

Die Umfrage fragte auch, was Kinder und Jugendliche motivieren würde, mehr zu lesen. Die Antworten zeigen: Das Problem ist nicht fehlendes Interesse an Informationen oder Geschichten – es ist ein Missverhältnis beim Format.

Was sie zum Lesen motiviert:

  • 2 von 5 sind motivierter, wenn der Lesestoff mit einem Lieblingsfilm oder einer Lieblingsserie (38,1 %) zusammenhängt oder zu ihren Interessen und Hobbys (37,1 %) passt.
  • 3 von 10 lassen sich von einem interessanten Buchcover oder Titel anziehen.
  • Jedem Vierten ist die Freiheit wichtig, selbst zu wählen, was er liest.

Selbst unter Kindern, die wenig Freude am Lesen angeben:

  • sagt fast die Hälfte, dass Lesen ihnen hilft, neue Wörter oder neue Dinge zu lernen.
  • lesen viele in ihrer Freizeit Songtexte, Nachrichtenartikel, Romane, Comics und Fan-Fiction.

Das Muster ist eindeutig:

  • Junge Menschen lehnen Geschichten oder Informationen nicht ab.
  • Sie lehnen das klassische Leseerlebnis als ihren hauptsächlichen Zugang dazu ab.
  • Sie wollen Inhalte, die sie dort abholen, wo sie sind, an Medien anknüpfen, die sie ohnehin nutzen, und auf eine Weise bereitgestellt werden, die sich natürlich und reibungslos anfühlt – und das bedeutet zunehmend Audio-first oder Audio als Option.

Was das für das Web bedeutet

Wenn du Websites, Apps oder digitale Produkte baust, sollten diese Daten grundlegend verändern, wie du über die Bereitstellung von Inhalten denkst.

Die Nutzer, die 2025 auf deine Website kommen – und in den kommenden Jahren erst recht –, lesen mit geringerer Wahrscheinlichkeit lange Texte als Nutzer vor fünf oder zehn Jahren. Das ist kein Ausreißer. Es ist ein Trend über 20 Jahre, der sich weiter verschärft.

Das heißt nicht, dass deine Inhalte weniger wertvoll sind. Es heißt, dass du mehr Wege brauchst, sie bereitzustellen.

  • Text bleibt entscheidend für SEO, Auffindbarkeit und schnelles Überfliegen.
  • Video und Audio sind explodiert, weil sie dazu passen, wie Menschen heute Informationen am liebsten konsumieren.

Text-to-Speech liegt genau an der Schnittstelle:

  • Du behältst deine geschriebenen Inhalte (und alle SEO-Vorteile, die damit einhergehen).
  • Du gibst Nutzern die Möglichkeit, zuzuhören statt zu lesen.

Mit anderen Worten: Die Frage lautet nicht mehr „Sollten wir TTS für eine kleine Gruppe von Nutzern einbauen?“, sondern „Wie viele Nutzer verlieren wir, weil wir nur Text anbieten?“

TTS als Usability-Funktion

TTS wurde traditionell als Anforderung der Barrierefreiheit betrachtet – und das ist es auch, ohne Frage. Screenreader und assistive Technologien sind für Menschen, die darauf angewiesen sind, unverzichtbar.

Die Lesedaten zeigen jedoch, dass TTS auch zu einer Usability-Funktion für alle wird.

Denk an:

  • einen Blogartikel
  • eine Produktbeschreibung
  • eine Dokumentation oder einen Hilfeartikel

Ein Nutzer, der so etwas vor fünf Jahren vielleicht gelesen hätte, springt heute womöglich nach zwei Absätzen ab – einfach, weil er nicht mehr daran gewöhnt ist, lange Texte zu lesen.

Füge einen Play-Button hinzu, der den Inhalt vorliest, und du:

  • machst aus einem Absprung eine engagierte Sitzung.
  • ermöglichst Nutzern Multitasking (Zuhören beim Pendeln, Kochen oder Arbeiten).
  • bedienst die Hörgewohnheiten, die von Podcasts, Hörbüchern und Social Audio geprägt wurden.

Das zeigt sich bereits in der Praxis:

  • Große Nachrichtenseiten bieten inzwischen standardmäßig Audioversionen ihrer Artikel an.
  • Podcasts haben es normal gemacht, Inhalte zu hören, die man früher gelesen hat.

TTS schließt die Lücke zwischen deinen bestehenden schriftlichen Inhalten und den Hörgewohnheiten eines wachsenden Teils deines Publikums – ohne dass du alles manuell umschreiben oder neu aufnehmen musst.

Die Chance für Content Creator

Die Ergebnisse des National Literacy Trust zeigen etwas Subtiles, aber Wichtiges:

  • Junge Menschen schätzen es nach wie vor, aus Texten zu lernen.
  • Sie bevorzugen nur eine andere Darreichungsform.

Für Website-Betreiber, Marketer und Content-Teams ist das eher eine Chance als eine Bedrohung.

Du musst nicht:

  • jeden Artikel durch ein Video ersetzen.
  • deine gesamte Content-Bibliothek neu schreiben.

Du kannst:

  • eine TTS-Ebene über deine bestehenden Inhalte legen.
  • jeden Blogartikel, jeden Hilfeartikel und jede Produktseite in etwas verwandeln, das Nutzer anhören können.

Deine Vorteile:

  • SEO bleibt unangetastet, weil der Text auf der Seite bleibt.
  • Das Engagement steigt, weil Nutzer, die nicht lesen würden, jetzt zuhören können.
  • Die Barrierefreiheit verbessert sich für Menschen mit Sehbeeinträchtigungen, Legasthenie oder hoher kognitiver Belastung.

Tools wie TTS2Go machen das im großen Maßstab praktikabel:

  • Binde das SDK in deine Website ein.
  • Jeder Inhalt bekommt automatisch einen Play-Button.
  • Der erste Zuhörer hört sofort die Sprachsynthese des Browsers, während eine Generierungsanfrage an dein Dashboard geht.
  • Du kannst das generierte Audio manuell freigeben oder das dem KI-Freigabesystem überlassen.
  • Jeder weitere Zuhörer bekommt hochwertiges KI-Audio, gecacht auf einem CDN für schnelle Auslieferung.

So wird deine bestehende Content-Bibliothek mit minimalem Engineering-Aufwand zu einem hybriden Lese- und Hörerlebnis.

Unterm Strich

Die Leseraten sinken – und das seit 20 Jahren. Der Rückgang verlangsamt sich nicht, er wird steiler.

Die jungen Menschen in dieser Umfrage sind deine künftigen Nutzer, Kunden und dein künftiges Publikum. Digitale Erlebnisse zu bauen, die nur für Menschen gut funktionieren, die gern lange Texte lesen, ist eine zunehmend riskante Wette.

Bei Text-to-Speech geht es nicht mehr nur um Compliance oder Häkchen für Barrierefreiheit.

Es geht darum:

  • Nutzer dort abzuholen, wo sie sind – am Smartphone, unterwegs und oft zuhörend statt lesend.
  • Reibung abzubauen zwischen deinen Inhalten und den Menschen, die davon profitieren würden.
  • Deine Website zukunftssicher zu machen für eine Generation, die Audio-Optionen standardmäßig erwartet.

Wenn deine Inhalte wichtig sind, sollten sie lesbar und hörbar sein. 2025 und darüber hinaus ist TTS kein Nice-to-have. Es gehört dazu, das Web für die nächste Generation nutzbar zu machen.