Text zu Sprache

Text einfügen, Stimme wählen, Knopf drücken. Alles entsteht im Browser: Die Systemstimme startet sofort, die KI-Stimme braucht einen einmaligen Download, klingt dafür auf jedem Gerät gleich und lässt sich als Datei speichern.

  • 0Zeichen
  • 0Ungefähre Dauer
  • 0Verfügbare Stimmen

Die Systemstimme lässt sich nicht speichern: Der Browser schickt sie direkt an die Soundkarte, ohne der Seite einen Audiostrom zu geben. Die KI-Stimme entsteht auf Ihrem Gerät und kann als WAV heruntergeladen werden.

So geht es

  1. Den vorzulesenden Text einfügen oder tippen.
  2. Für eine gleichmäßige Stimme auf jedem Gerät — und eine Datei zum Behalten — schalten Sie die KI-Stimme ein: Das Modell lädt einmal und bleibt im Browser.
  3. Stimme wählen — die Liste stammt aus den installierten Sprachen des Geräts.
  4. Tempo und Tonhöhe anpassen, falls die Vorgabe zu schnell oder zu flach klingt.
  5. «Vorlesen» drücken; Pause und Fortsetzen an derselben Stelle sind möglich.

Gut zu wissen

Woher die Stimmen kommen

Der Browser bringt keine eigenen Stimmen mit — er fragt das Betriebssystem. Deshalb sieht die Liste auf jedem Gerät anders aus: Ein Telefon hat meist mehrere Stimmen je Sprache, ein Desktop-Linux womöglich gar keine, solange kein Sprachpaket installiert ist. Das heißt zugleich: kein Zeichenlimit und kein Abo — die Arbeit erledigt Software, die Sie schon besitzen.

Zwei Stimmen, zwei Kompromisse

Die Systemstimme kostet nichts: Sie ist bereits installiert und spricht auf Knopfdruck — wie sie klingt, hängt aber vom Rechner ab, und auf einem nackten Linux-Desktop gibt es womöglich gar keine. Die KI-Stimme ist ein heruntergeladenes Modell, das auf Ihrem Gerät rechnet: für Deutsch ist das Piper mit rund sechzig Megabyte. Der Text bleibt so oder so bei Ihnen, und das Ergebnis lässt sich als WAV sichern.

Langer Text wird in Stücken gelesen

Bekommt die Sprachausgabe einen ganzen Artikel, steigt sie unterwegs aus: Chrome hört nach etwa fünfzehn Sekunden auf, wenn die Warteschlange nicht angestoßen wird, und Safari verwirft alles nach den ersten paar hundert Zeichen. Deshalb wird der Text an Satzgrenzen geteilt und Satz für Satz eingereiht. Ein Schnitt nach Zeichenzahl fiele mitten ins Wort — und das hört man als Stottern.

Häufige Fragen

Kann ich die Audiodatei herunterladen?

Ja — mit der KI-Stimme: Sie baut den Ton auf der Seite selbst, deshalb erscheint neben dem Player die Schaltfläche «WAV herunterladen». Die Systemstimme lässt sich nicht speichern: Der Browser schickt sie direkt an die Soundkarte, ohne der Seite einen Audiostrom zu geben.

Die Stimmenliste ist leer. Was nun?

Im System ist keine Stimme installiert. Unter Windows fügt man sie in den Spracheinstellungen hinzu, unter Android und iOS in der Bedienungshilfe, unter Linux über ein Stimmpaket für speech-dispatcher. Danach die Seite neu laden — die Liste wird beim Laden gelesen.

Warum klingt derselbe Text in einem anderen Browser anders?

Weil die Stimme vom System kommt, die Wahl der Standardstimme, der Umgang mit Pausen und das genaue Tempo aber zum Browser gehören. Chrome bietet zusätzlich Netzstimmen an, die glatter klingen und eine Verbindung brauchen.

Geht der Text an einen Server?

Die Seite verschickt keinen Text. Die KI-Stimme lädt ihr Modell einmalig von huggingface und arbeitet danach offline; die eingefügten Wörter verlassen das Gerät nie. Eine als Netzstimme markierte Systemstimme kann den Ton dagegen beim Hersteller anfordern — deshalb werden hier lokale Stimmen bevorzugt.

Ähnliche Tools