BrowserTools
Startseite / Sonstiges / Text zu Sprache, kostenloser Online-Textvorleser

Text zu Sprache, kostenloser Online-Textvorleser

Füge beliebigen Text ein und lass ihn dir im Browser vorlesen. Wähle eine Stimme, passe Tempo und Tonhöhe an. Privat, kostenlos, nichts wird irgendwohin hochgeladen.

Text zu Sprache, kostenloser Online-Textvorleser wird geladen… Wenn nichts passiert, aktiviere JavaScript.

Dieses kostenlose Text-zu-Sprache-Tool verwandelt geschriebenen Text direkt in deinem Browser in gesprochenes Audio. Füge etwas ein oder tippe es, einen Artikel, den du anhören möchtest, einen E-Mail-Entwurf, Lernnotizen, ein Buchkapitel, und drücke auf Abspielen, um ihn mit einer natürlichen Stimme vorgelesen zu bekommen. Es gibt nichts zu installieren und kein Konto zu erstellen: Der Vorleser funktioniert sofort auf Desktop und Mobilgerät und bewältigt alles von einem einzelnen Satz bis zu mehreren Seiten Text.

Häufig gestellte Fragen

Kann ich die Sprachausgabe als MP3- oder WAV-Datei herunterladen?
Nein, und das ist eine ehrliche Grenze der Technologie und keine fehlende Funktion. Die Web Speech API spielt Audio über die Sprach-Engine des Systems ab und stellt der Seite den Audiostream nicht zur Verfügung, es gibt also nichts, was das Tool erfassen und speichern könnte. Eine herunterladbare MP3 oder WAV zu erzeugen erfordert einen serverseitigen oder Cloud-Dienst für Text zu Sprache, was bedeuten würde, deinen Text hochzuladen. Dieses Tool behält stattdessen bewusst alles auf deinem Gerät.
Welche Stimmen sind verfügbar?
Alle, die dein Betriebssystem und dein Browser bereitstellen. Windows liefert Microsoft-Stimmen, macOS und iOS liefern Apple-Stimmen, Android liefert Google-Stimmen, und Desktop-Chrome fügt eigene zusätzliche Google-Stimmen hinzu. Der Auswahldialog listet jede Stimme auf, die deine Konfiguration bereitstellt, nach Sprache gruppiert, und zeigt die Gesamtzahl an. Du kannst weitere Stimmen hinzufügen, indem du in den Einstellungen deines Betriebssystems zusätzliche Sprachen oder Sprachstimmen installierst.
Warum unterscheiden sich die Stimmen zwischen meinen Geräten?
Weil die Sprache lokal von der eigenen Engine jedes Geräts erzeugt wird, nicht von einem gemeinsamen Server. Dein Windows-Laptop, dein Android-Handy und dein iPad liefern unterschiedliche Stimmpakete verschiedener Hersteller mit, sodass derselbe Text von Gerät zu Gerät ziemlich unterschiedlich klingen kann. Das ist der Preis für einen Vorleser, der sofort verfügbar, kostenlos und völlig privat ist.
Wird mein Text auf einen Server hochgeladen?
Nein. Das gesamte Tool läuft lokal in deinem Browser. Dein Text wird an die in dein Gerät eingebaute Sprach-Engine übergeben und verlässt es nie. Es gibt keinen Server, keine Protokollierung und kein Konto, was das Tool sicher für private Notizen, unveröffentlichte Entwürfe und vertrauliches Material macht.
Wie geht das Tool mit langen Texten um?
Langer Text wird automatisch in satzgroße Abschnitte zerlegt, die in eine Warteschlange gestellt und nacheinander gesprochen werden. Das ist wichtig, weil viele Sprach-Engines sehr lange einzelne Äußerungen stillschweigend abschneiden oder abbrechen. Mit dieser Aufteilung werden selbst mehrseitige Dokumente zuverlässig durchgespielt, und eine Fortschrittsanzeige zeigt, welcher Abschnitt gerade gelesen wird.
Wie funktioniert die Worthervorhebung?
Während des Sprechens kann der Browser Grenzereignisse auslösen, die die Position des gerade gesprochenen Wortes melden, und das Tool nutzt sie, um dieses Wort im Text hervorzuheben. Allerdings meldet nicht jede Stimme diese Ereignisse; manche entfernten oder neuronalen Stimmen tun es schlicht nicht. Wenn deine gewählte Stimme nichts über Wortpositionen verrät, bemerkt das Tool das und zeigt einen kurzen Hinweis, statt eine Hervorhebung vorzutäuschen.
Was machen die Regler für Tempo, Tonhöhe und Lautstärke?
Das Tempo steuert die Sprechgeschwindigkeit, von 0.5 (halbes Tempo, gut für aufmerksames Zuhören oder Sprachenlernen) bis 2 (doppeltes Tempo, gut zum Überfliegen). Die Tonhöhe macht die Stimme auf einer Skala von 0 bis 2 tiefer oder höher, ohne das Tempo zu ändern. Die Lautstärke regelt die Lautheit von 0 bis 1 unabhängig von deiner Systemlautstärke. Ein Zurücksetzen-Knopf stellt die Standardwerte 1, 1 und 1 mit einem Klick wieder her.
Welche Browser unterstützen Text zu Sprache?
Alle modernen Browser unterstützen den Syntheseteil der Web Speech API: Chrome, Edge, Safari und Firefox, auf Desktop wie mobil. Die Details variieren: Chrome lädt seine Stimmenliste asynchron und bietet zusätzliche Google-Stimmen, Safari nutzt Apples Systemstimmen, und die Unterstützung der Hervorhebung an Wortgrenzen hängt von der jeweiligen Stimme ab. Fehlt deinem Browser die Unterstützung komplett, sagt dir das Tool das, statt stumm zu scheitern.
Ist dieses Text-zu-Sprache-Tool kostenlos?
Ja, völlig kostenlos, ohne Zeichenlimits, Abos oder Registrierungen. Da das Audio von deinem eigenen Gerät erzeugt wird und nicht von einem bezahlten Cloud-Dienst, gibt es keine Kosten pro Wort, die weitergegeben werden müssten. Du kannst so viel Text vorlesen lassen, wie du willst, so oft du willst.
Kann es auch andere Sprachen als Englisch vorlesen?
Ja. Die Stimmenliste ist nach Sprache gruppiert, und eine Stimme zu wählen, die zur Sprache deines Textes passt, ergibt die korrekte Aussprache. Die meisten Systeme enthalten von Haus aus Stimmen für große Sprachen wie Spanisch, Französisch, Deutsch, Portugiesisch, Italienisch, Chinesisch und Japanisch. Text mit einer unpassenden Stimme vorzulesen funktioniert technisch, klingt aber falsch, wähle also für das beste Ergebnis eine passende Stimme.

Über Text zu Sprache, kostenloser Online-Textvorleser

Unter der Haube nutzt das Tool die Web Speech API, die Sprachsynthese-Engine, die bereits in deinen Browser und dein Betriebssystem eingebaut ist. Dieses Design hat einen großen Datenschutzvorteil: Dein Text wird nie auf einen Server hochgeladen. Die Wörter, die du einfügst, bleiben auf deinem Gerät, werden von der lokalen Sprach-Engine gesprochen und verschwinden, wenn du die Seite schließt. Es gibt keine von einem entfernten Dienst auferlegten Wortlimits, keine Konten und keine Verarbeitungswarteschlange, denn es gibt überhaupt keinen entfernten Dienst.

Du behältst die volle Kontrolle darüber, wie der Text klingt. Wähle jede auf deinem System installierte Stimme, nach Sprache gruppiert, sodass du schnell Englisch, Spanisch, Französisch, Deutsch, Portugiesisch und Dutzende weitere Optionen findest. Stelle das Sprechtempo fein ein, von langsamen 0.5x für aufmerksames Zuhören bis zu flotten 2x zum Überfliegen, verschiebe die Tonhöhe nach oben oder unten und regle die Lautstärke unabhängig vom Mixer deines Systems. Das macht das Tool weit über das bloße Vorlesen hinaus nützlich: Autoren lektorieren nach Gehör und erwischen holprige Formulierungen, die ihre Augen überspringen, Sprachlerner hören die korrekte Aussprache fremdsprachiger Texte, Menschen mit Sehbehinderung oder Legasthenie konsumieren geschriebene Inhalte bequem, und jeder kann einen langen Artikel in etwas verwandeln, das man nebenbei anhört.

Ein ehrlicher Vorbehalt: Da die Stimmen aus deinem Browser und Betriebssystem stammen, unterscheidet sich die Auswahl zwischen Geräten. Windows, macOS, Android und iOS liefern jeweils eigene Stimmpakete mit, und Chrome fügt eigene Google-Stimmen hinzu, sodass dieselbe Seite auf deinem Handy und deinem Laptop unterschiedlich klingen kann. Manche Stimmen sind natürlich und angenehm, andere merklich roboterhaft, und Funktionen wie die wortweise Hervorhebung hängen davon ab, wie viele Informationen eine Stimme zurückmeldet. Das Tool erkennt, was deine Konfiguration unterstützt, und arbeitet mit den Stimmen, die du hast; fehlt eine Sprache, ist die Lösung, sie in den Einstellungen deines Betriebssystems zu installieren.

Vom Voder zu neuronalen Stimmen: eine kurze Geschichte sprechender Maschinen

Die erste Maschine, die öffentlich sprach, war gar kein Computer. Auf der Weltausstellung 1939 in New York führten die Bell Labs den Voder vor, eine sperrige elektronische Konsole, die wie ein Musikinstrument gespielt wurde. Eine geschulte Bedienerin, meist eine von etwa zwanzig Frauen, die ein Jahr lang geübt hatten, drückte Tasten und einen Handgelenksbügel, um Summ- und Zischquellen zu erkennbaren Wörtern zu formen. Der Voder konnte nicht von allein sprechen; er war der Beweis, dass sich menschliche Sprache aus elektronischen Bausteinen zusammensetzen lässt, und die Menschen standen Schlange, um ihn auf Zuruf Sätze sagen zu hören.

In den folgenden Jahrzehnten lernten Computer das Sprechen, und zwei Meilensteine ragen heraus. 1978 packte Texas Instruments die Sprachsynthese in ein Spielzeug: Der Speak & Spell quetschte ein komplettes Modell des Vokaltrakts auf einen einzigen Chip, sodass ein Buchstabier-Spielzeug für Kinder Wörter laut aussprechen konnte, ein Meilenstein der Unterhaltungselektronik. Unterdessen verfeinerte Dennis Klatt am MIT jahrelang die Formantsynthese, eine Arbeit, aus der 1984 DECtalk wurde. Der berühmteste Nutzer von DECtalk war der Physiker Stephen Hawking, der jahrzehntelang mit einer Stimme sprach, die aus Klatts eigenen Aufnahmen abgeleitet war. Als man ihm neuere, geschmeidigere Stimmen anbot, lehnte Hawking ab: Die roboterhafte DECtalk-Stimme war zu seiner Stimme geworden, und er behielt sie bis zu seinem Tod 2018.

Die moderne Text-zu-Sprache-Technik nahm in den 2010er Jahren eine scharfe Wendung, als neuronale Netze die handgebauten akustischen Regeln ablösten. Systeme wie WaveNet, 2016 von DeepMind veröffentlicht, erzeugten rohe Audio-Wellenformen Sample für Sample und klangen plötzlich verblüffend menschlich, mit natürlichem Atemrhythmus und natürlicher Intonation. Heutige Betriebssysteme liefern Dutzende neuronaler Stimmen in vielen Sprachen mit, und dieselbe Technologie treibt Screenreader, Navigationsansagen und virtuelle Assistenten an. Die Stimmen, die du in diesem Tool hörst, stehen auf dieser ganzen Ahnenreihe, von einer auf einer Weltausstellung von Hand gespielten Konsole bis zu Netzen, die das Sprechen aus Tausenden Stunden von Aufnahmen gelernt haben.

Unterstützen