Kostenloses Text-zu-Sprache Online

Wandle Text mit der Browser-Synthese in Sprache um. Mehrere Stimmen verfügbar. Kostenlos, schnell und komplett im Browser, ohne Anmeldung.

Aktualisiert am

Share:
Home/Text Tools/Text to Speech

Text to Speech

Convert text to speech using your browser's built-in speech synthesis. Choose from multiple voices and languages.

Text Input

0 words, 0 characters, 0 sentences

1.0x

Reading Statistics

Words

0

Characters

0

Sentences

0

Paragraphs

0

Unique Words

0

Syllables

0

Avg Word Length

0

characters

Vocabulary Richness

0%

unique/total

Speed (WPM)

180

Est. Duration

0s

Readability

-

N/A

Syllables/Word

0

Available Voices

0

Languages

0

Voice Browser
0 voices

Saved Bookmarks (0)

No bookmarks yet. Save text and voice settings for quick access later.

Tip: Use Ctrl+Shift+B to quickly save a bookmark.

Pronunciation Dictionary

Define custom pronunciations for words. The replacement text will be spoken instead of the original.

Keyboard Shortcuts

About Text to Speech

This tool uses the Web Speech API built into modern browsers to convert text to speech. The available voices depend on your browser and operating system.

Features:

  • Multiple voices and languages with preview, filtering, favorites, and voice comparison
  • Adjustable speed (0.5x to 2x) with presets, pitch presets (deep to chipmunk), and volume
  • Four highlight modes: word, sentence, paragraph, and karaoke with custom colors
  • SSML support for pauses, emphasis, and character spelling
  • Queue multiple texts to speak in sequence with reordering, shuffle, and auto-play
  • Batch mode with clipboard import, pause/resume, export, and progress tracking
  • Bookmarks with tags, sorting, search, export/import for backup and sharing
  • Auto-detect language with confidence indicator and auto voice selection
  • Custom pronunciation dictionary persisted in localStorage
  • Record and download audio (requires microphone permission)
  • Detailed reading statistics: word count, syllables, vocabulary richness, readability, duration at all speeds
  • 16 keyboard shortcuts for playback, volume, pitch, tabs, highlights, bookmarks, and settings
  • Settings persistence across sessions via localStorage
  • Inline speed adjuster in playback controls
  • Works offline after page load

SSML Tags Supported:

  • <break time="500ms"/> - Insert a pause
  • <emphasis>text</emphasis> - Emphasize text
  • <say-as interpret-as="characters">ABC</say-as> - Spell out characters

Browser Support:

  • Chrome, Edge, Safari, Firefox (latest versions)
  • Voice availability varies by browser and OS
  • Mobile browsers may have limited voice options

Privacy First: All speech synthesis happens locally in your browser using built-in APIs. Your text is never sent to any server. Bookmarks, pronunciation dictionaries, favorite voices, and settings are stored in your browser's localStorage.

Häufig gestellte Fragen

Was ist Text-zu-Sprache?

Text-zu-Sprache ist ein kostenloses Online-Tool, das Text mithilfe der Browser-Synthese in Sprache umwandelt – mit mehreren verfügbaren Stimmen. Es läuft vollständig in deinem Browser, ohne Installation oder Anmeldung.

Kann ich verschiedene Stimmen auswählen?

Ja, das Text-zu-Sprache-Tool bietet mehrere Stimmen und Sprachen, je nachdem, was dein Browser und dein Betriebssystem unterstützen.

Ist Text-zu-Sprache kostenlos nutzbar?

Ja, Text-zu-Sprache ist zu 100 % kostenlos, ohne Registrierung, ohne versteckte Gebühren und ohne Nutzungslimits. Die gesamte Verarbeitung erfolgt lokal in deinem Browser und gewährleistet vollständige Privatsphäre.

Sind meine Daten mit diesem Tool sicher?

Absolut. Text-zu-Sprache verarbeitet alles clientseitig in deinem Browser. Es werden keine Daten auf einen Server hochgeladen oder dort gespeichert. Deine Inhalte bleiben jederzeit privat auf deinem Gerät.

Funktioniert Text-zu-Sprache auf Mobilgeräten?

Ja, Text-zu-Sprache ist vollständig responsiv und funktioniert auf Smartphones und Tablets. Du kannst es auf jedem Gerät mit einem modernen Webbrowser nutzen – ohne App-Download.

Muss ich ein Konto erstellen, um dieses Tool zu nutzen?

Es ist kein Konto und keine Registrierung erforderlich. Öffne einfach Text-zu-Sprache in deinem Browser und beginne sofort mit der Nutzung. Es gibt keine Anmeldebarrieren und keine Nutzungsbeschränkungen.

Kann ich große Textmengen verarbeiten?

Ja, Text-zu-Sprache verarbeitet Texte beliebiger Länge schnell und in Echtzeit. Da alles in deinem Browser läuft, hängt die Leistung von deinem Gerät ab, funktioniert aber in den meisten Fällen einwandfrei.

Wie verwende ich Text-zu-Sprache?

Gib einfach deinen Text in das vorgesehene Feld ein, passe die Einstellungen nach Wunsch an, und das Tool verarbeitet ihn sofort. Anschließend kannst du das Ergebnis in die Zwischenablage kopieren oder herunterladen.

Welche Browser werden unterstützt?

Text-zu-Sprache funktioniert in allen modernen Browsern, darunter Chrome, Firefox, Safari, Edge und Opera. Für das beste Erlebnis verwende die neueste Version deines bevorzugten Browsers.

Wie lange dauert es, meinen Text vorzulesen?

Bei der natürlichen 1x-Geschwindigkeit liest dieses Tool mit etwa 180 Wörtern pro Minute, sodass ein Absatz mit 180 Wörtern rund eine Minute dauert, ein Artikel mit 900 Wörtern etwa fünf Minuten und ein Text mit 1.800 Wörtern ungefähr zehn Minuten. Die Geschwindigkeitseinstellung skaliert diese Schätzung direkt: 2x halbiert die Zeit ungefähr, während 0,5x sie verdoppelt, und das Tool zeigt eine Live-Schätzung der Dauer basierend auf deiner Wortzahl und der gewählten Geschwindigkeit an, bevor du auf Play drückst. Die tatsächliche Zeit weicht leicht ab, weil Satzzeichen natürliche Pausen einfügen und manche Stimmen etwas schneller oder langsamer sprechen als andere. Brauchst du nur einen groben Richtwert, teile deine Wortzahl bei normaler Geschwindigkeit einfach durch 180, um die Minuten zu erhalten. Füge deinen Text oben ein, um die genaue geschätzte Dauer für deine gewählte Stimme und Geschwindigkeit zu sehen.

Warum unterscheiden sich die verfügbaren Stimmen auf meinem Handy von denen auf meinem Laptop?

Dieses Tool nutzt die im Browser integrierte Web Speech API, das heißt, die angebotenen Stimmen sind genau die, die bereits auf deinem jeweiligen Gerät und Betriebssystem installiert sind, statt aus einer festen Cloud-Bibliothek zu stammen. Deshalb ändert sich die Liste zwischen Chrome, Safari und Edge sowie zwischen Windows, macOS, Android und iOS – jede Plattform bringt ihren eigenen Satz mit. Ein Windows-Laptop bietet vielleicht ein Dutzend Stimmen, während ein iPhone eine völlig andere Auswahl zeigt, und das Nachinstallieren zusätzlicher Sprachpakete in den Systemeinstellungen kann weitere hinzufügen. Auch die Qualität variiert, da manche Plattformen hochwertigere Stimmen mitbringen als andere. Da die Sprachsynthese lokal abläuft, werden keine Stimmen von dieser Website heruntergeladen. Öffne das Tool auf dem Gerät, das du verwenden möchtest, durchstöbere die gefilterte Stimmenliste, markiere Favoriten und vergleiche zwei direkt miteinander, um die für dich am besten klingende zu finden.

Kann ich die gesprochene Audioausgabe als Datei herunterladen?

Ja. Neben der Live-Wiedergabe kann das Tool die gesprochene Ausgabe aufzeichnen und als .webm-Audiodatei speichern, die du herunterladen und behalten kannst – praktisch, um aus einem Skript, einer Lernnotiz oder einem Entwurf einen anhörbaren Clip zu machen. Die Aufnahme nutzt den im Browser integrierten Media Recorder und fragt daher nach der Mikrofonberechtigung, um den Audiostream während der Wiedergabe aufzuzeichnen. Die entstehende .webm-Datei läuft in den meisten modernen Browsern und Medienplayern, und du kannst sie anschließend mit einem separaten Konverter in ein anderes Format umwandeln, falls eine bestimmte App MP3 oder WAV benötigt. Alles läuft weiterhin auf deinem Gerät ab, sodass die Aufnahme nirgendwohin hochgeladen wird. Gib deinen Text ein, wähle eine Stimme und Geschwindigkeit, starte dann die Aufnahme, um die Vorlesung festzuhalten, und lade die Datei herunter, sobald sie fertig ist.

Warum spricht das Tool Namen oder Abkürzungen falsch aus, und wie behebe ich das?

Sprachsynthesizer erschließen die Aussprache aus Rechtschreibregeln, weshalb ungewöhnliche Namen, Markenbegriffe, Fremdwörter und Abkürzungen oft falsch klingen, weil sie nicht den gewöhnlichen Sprachmustern folgen. Um das zu beheben, enthält das Tool ein Aussprachewörterbuch: Du ordnest einem kniffligen Wort eine phonetische Schreibweise zu, die die Stimme korrekt ausspricht, und diese Ersetzung wird jedes Mal angewendet, wenn das Wort vorkommt. Zum Beispiel kannst du eine Abkürzung so umschreiben, dass sie Buchstabe für Buchstabe vorgelesen wird, oder einen Namen so notieren, wie er tatsächlich klingt. Ein optionaler SSML-Schalter bietet für fortgeschrittene Fälle feinere Kontrolle über Betonung und Pausen, und manchmal hilft auch schon der Wechsel zu einer anderen Stimme. Füge deine problematischen Wörter oben zum Aussprachewörterbuch hinzu und spiele die Passage danach erneut ab, um zu prüfen, ob jedes Wort jetzt so klingt, wie du es beabsichtigt hast, bevor du aufnimmst oder teilst.

Was ist der Unterschied zwischen den Einstellungen Geschwindigkeit und Tonhöhe?

Geschwindigkeit, auch Rate genannt, bestimmt, wie schnell die Stimme spricht – also wie viele Wörter pro Minute herauskommen –, ohne dass sich dabei ändert, wie hoch oder tief sie klingt. Dieses Tool bietet sechs Voreinstellungen, von 0,5x für sehr langsames, sorgfältiges Zuhören bis zu 2x für das schnelle Überfliegen langer Texte, mit 1x als natürlichem Standard, der mit rund 180 Wörtern pro Minute liest. Die Tonhöhe ist etwas anderes: Sie hebt oder senkt den Klang der Stimme in fünf Stufen, von einem tieferen bis zu einem höheren Register, während die Sprechgeschwindigkeit gleich bleibt. Kurz gesagt: Die Rate verändert das Tempo, die Tonhöhe verändert das Timbre. Du kannst beide unabhängig voneinander einstellen und sie sogar mitten in der Wiedergabe anpassen, um den Klang zu optimieren. Probiere eine langsamere Rate zum Korrekturlesen oder für Sprachübungen und eine höhere Rate zum Überfliegen, und stelle dann oben die Tonhöhe ein, bis sich die Stimme angenehm anhört.

Embed This Tool

Add a free, live version of this widget to your own website or blog post — it runs entirely in your visitors' browsers, with a credit link back to The Toolbox.

Copy & paste this HTML
<iframe src="https://getthetoolbox.com/embed/text-to-speech" title="Free Text to Speech Online — The Toolbox" width="100%" height="280" style="max-width:480px;border:1px solid #e2e8f0;border-radius:12px" loading="lazy"></iframe>
<p style="font-size:12px;margin:4px 0 0"><a href="https://getthetoolbox.com/text-tools/text-to-speech?utm_source=embed&utm_medium=widget" target="_blank" rel="noopener">Free Text to Speech Online</a> by The Toolbox</p>

Über das Text-to-Speech-Tool

Das Text-to-Speech-Tool liest jeden beliebigen Text mit natürlich klingender Stimme vor – direkt in deinem Browser. Füge einen Artikel, ein Kapitel, eine E-Mail oder deinen eigenen Entwurf ein, wähle eine Stimme und drücke auf Play. Entwickelt wurde es für alle, die lieber zuhören als lesen: Pendler, die lange Texte nebenbei aufholen, Autorinnen und Autoren, die einen Entwurf per Gehör gegenlesen, Sprachlernende, die die Aussprache überprüfen, und alle, für die Audio zugänglicher ist als Text auf einem Bildschirm.

Alles läuft lokal ab. Für die Sprachsynthese nutzt das Tool die im Browser integrierte Web Speech API, sodass dein Text niemals auf einen Server hochgeladen wird, es keine Anmeldung braucht und es kein Nutzungslimit gibt. Die angebotenen Stimmen sind genau die, die bereits auf deinem Gerät und Betriebssystem installiert sind – deshalb unterscheidet sich die genaue Liste zwischen Chrome, Safari, Edge sowie zwischen Windows, macOS und Android.

Die Stimme steuern

Drei Einstellungen bestimmen, wie das Vorlesen klingt, und du kannst sie sogar während der Wiedergabe ändern:

  • Stimme – wähle aus den Stimmen, die dein System bereitstellt. Du kannst die Liste filtern, Favoriten markieren und zwei Stimmen direkt miteinander vergleichen, bevor du dich entscheidest.
  • Geschwindigkeit (Rate) – sechs Voreinstellungen von 0,5x (sehr langsam) bis 2x (sehr schnell), mit 1x als natürlicher Standardgeschwindigkeit. Bei normaler Geschwindigkeit liest das Tool mit etwa 180 Wörtern pro Minute, und die Live-Schätzung passt sich der gewählten Geschwindigkeit direkt an.
  • Tonhöhe – fünf Stufen von einem tiefen, sonoren Register bis zu einer hohen „Chipmunk"-Tonlage, sodass du dieselbe Stimme wärmer oder schärfer klingen lassen kannst.

Eine separate Lautstärkeregelung passt die Lautstärke unabhängig von der Systemlautstärke an, und mit Play, Pause und Fortsetzen kannst du mitten im Satz stoppen und später genau dort weitermachen, wo du aufgehört hast.

Mitlese-Hervorhebung und längere Texte

Während die Stimme spricht, hebt das Tool den Text synchron hervor, sodass deine Augen dem Audio folgen können. Du kannst Wort für Wort hervorheben lassen, in einen Karaoke-ähnlichen Modus wechseln und die Hervorhebungsfarbe wählen. Das ist beim Korrekturlesen wirklich hilfreich: Wenn du jedes Wort hörst und gleichzeitig siehst, fallen ausgelassene Wörter, holprige Formulierungen und Schachtelsätze deutlich leichter auf als beim stillen Lesen.

Für größere Aufgaben stehen drei Arbeitsmodi zur Verfügung. Der Einzelmodus liest einen einzelnen Textblock vor. Der Warteschlangenmodus reiht mehrere Textabschnitte aneinander und spielt sie nacheinander ab. Der Batch-Modus arbeitet eine Liste einzelner Einträge der Reihe nach ab, mit Fortschrittsanzeige pro Eintrag, sodass du viele kurze Schnipsel in einem einzigen Durchgang verarbeiten kannst. Jeder Modus zeigt eine geschätzte Dauer basierend auf der Wortzahl und der gewählten Geschwindigkeit.

Aussprache, Sprache und Audio speichern

Ein integriertes Aussprachewörterbuch erlaubt es dir, ein kniffliges Wort durch eine Schreibweise zu ersetzen, die der Synthesizer korrekt ausspricht – praktisch bei Namen, Markenbegriffen und Abkürzungen, die die Standardstimme verschluckt oder falsch betont. Eine optionale automatische Spracherkennung kann die Stimme an die Sprache deines Textes anpassen, und ein SSML-Schalter steht für die feinere Steuerung der Sprachausgabe zur Verfügung.

Du kannst die gesprochene Ausgabe außerdem als Audiodatei speichern. Das Tool zeichnet die Wiedergabe in einer .webm-Datei auf, die du herunterladen und behalten kannst – praktisch, um aus einem Skript einen anhörbaren Clip zu machen. Die Aufnahme nutzt den Media Recorder deines Browsers und fragt daher nach der Mikrofonberechtigung, um das Audio aufzuzeichnen. Lesezeichen runden das Ganze ab: Speichere einen Textabschnitt zusammen mit Stimme und Einstellungen, versieh ihn mit einem Tag und lade ihn später wieder, ohne irgendetwas erneut eingeben zu müssen.

Warum browserbasierte Sprachausgabe praktisch ist

Eine dedizierte Vorlese-App oder ein Cloud-TTS-Dienst kann zwar noch etwas geschliffener klingen, bringt aber meist eine Installation, ein Konto oder eine Abrechnung pro Zeichen mit sich. Dieses Text-to-Speech-Tool tauscht ein wenig Klangfeinschliff gegen sofortigen Zugriff und vollständige Privatsphäre: kein Konto, kein Upload, kein Kontingent. Da die Sprachsynthese auf deinem Gerät läuft, funktioniert sie weiter, selbst wenn die Seite bei wackliger Verbindung bereits geladen ist – und vertrauliche Texte wie ein Vertrag, ein unveröffentlichter Beitrag oder private Notizen verlassen niemals deinen Computer.