Gesprochene Antworten

Zuletzt aktualisiert 2026-08-24

Jede Antwort im Chat hat eine Sprecher-Taste. Diese Seite erklärt, welche Sprachen eine Stimme haben, wie gut sie ist und was sie noch nicht kann – damit Sie nicht erst nach dem Bezahlen feststellen müssen, was fehlt.

Was es tut

Drücken Sie die Sprecher-Taste unter einer Antwort, und sie wird vorgelesen. Nie automatisch – der Ton beginnt nur, wenn Sie es anfordern. Das ist auch das einzige Verhalten, das ein Browser auf dem Handy erlaubt.

Während der Wiedergabe können Sie pausieren, stoppen und die Geschwindigkeit zwischen 0,75× und 2× einstellen. Position und Länge werden angezeigt. Wenn Sie die Sprecher-Taste unter einer anderen Antwort drücken, wechselt die Stimme zu dieser Antwort.

Die Wiedergabe beginnt, während der Rest der Antwort noch generiert wird. Die Wartezeit wächst also nicht mit der Länge der Antwort. Eine Antwort mit 1.300 Zeichen – fast zwei Minuten Sprechzeit – beginnt nach etwa zwei Sekunden zu sprechen, genauso wie eine einzeilige Antwort.

Welche Sprache sie spricht

Die Stimme folgt der Sprache der Antwort, nicht der Sprache der Benutzeroberfläche. Eine englische Oberfläche, die ein russisches Gespräch führt, wird auf Russisch vorgelesen. Die meisten Produkte machen es genau andersherum und lesen die Antwort nach den Regeln der falschen Sprache.

Zahlen werden als Wörter ausgesprochen, nicht Ziffer für Ziffer. Ein Codeblock wird als Codeblock angekündigt, statt als eine Minute voller Zeichensetzung vorgelesen zu werden.

Sprachen mit einer Stimme

Von unseren 46 Sprachen haben 38 eine gemessene Stimme. Zehn von ihnen sind zudem für eine expressive Wiedergabe ausgelegt – dieser Teil ist geschrieben und gemessen, wurde jedoch noch nicht aktiviert, sodass alle Sprachen derzeit klar und nicht gefühlvoll vorgelesen werden.

🔑 Welche davon gerade aktiv sind, kann weniger sein, während die Maschinen dahinter hochgefahren werden. Die Sprecher-Taste erscheint nur dort, wo sie tatsächlich funktioniert. Sie erhalten keine Stimme, die dann versagt.

Vorlesen und bereit für die Darstellung
Deutsch · Englisch · Spanisch · Französisch · Italienisch · Koreanisch · Portugiesisch (Brasilien) · Portugiesisch (Portugal) · Russisch · Chinesisch (Vereinfacht). Diese zehn sind die ersten, die Expressive Delivery erreichen wird. Heute lesen sie sich wie der Rest.
Wird vorgelesen
Arabisch · Aserbaidschanisch · Bulgarisch · Katalanisch · Kroatisch · Tschechisch · Dänisch · Niederländisch · Filipino · Finnisch · Griechisch · Hebräisch · Hindi · Ungarisch · Indonesisch · Japanisch · Malaiisch · Norwegisch · Polnisch · Rumänisch · Serbisch · Slowakisch · Swahili · Schwedisch · Thai · Türkisch · Ukrainisch · Vietnamesisch
Keine Stimme
Bengalisch · Burmesisch · Kasachisch · Paschtunisch · Persisch · Urdu · Usbekisch · Chinesisch (Traditionell)

Persisch und warum es leer ist

Persisch ist die einzige Sprache auf der letzten Liste mit echter Nutzung dahinter. Das Fehlen ist kein Versehen. Jede Engine, die wir lizenzieren konnten, wurde diesen Monat daran gemessen, und keine erreichte die Qualität, die wir verlangen. Eine liest nur 15 Sprachen sauber, eine passt nicht zur Hardware, eine kommt kaputt heraus.

Wir sagen es lieber so, als eine Stimme zu liefern, die die Sprache zerfetzt. Wenn etwas die Kriterien erfüllt, wird es hier erscheinen.

Wie die Qualität gemessen wurde

Jede Sprache wurde gleich geprüft: Text sprechen, Audio mit einem separaten System transkribieren und Wort für Wort mit dem Gesendeten vergleichen. Die Grenze liegt bei einer Fehlerquote von fünf Prozent. Alle 38 Sprachen liegen darunter, und sechs von ihnen liegen bei null.

🔑 Was das misst, ist, ob die Wörter richtig herauskommen. Es misst nicht, ob die Stimme natürlich klingt, was kein automatischer Test sicher entscheiden kann. Betrachten Sie es als untere Grenze, nicht als Urteil, und beurteilen Sie den Rest mit Ihren eigenen Ohren.

Was es noch nicht kann

Keine Wort-für-Wort-Hervorhebung
Die Engine liefert keine Zeitstempel. Schätzungen basierend auf Zeichenzahlen weichen innerhalb eines einzigen Satzes ab. Wir haben es gebaut, gemessen und ausgeschaltet, statt etwas auszuliefern, das über den Text wandert.
Der Ausdruck ist nicht aktiviert
Die Maschine ist vorhanden und wurde vermessen – die Stimme kann seufzen, lachen oder in ein Flüstern übergehen, wenn die Antwort es erfordert. Sie ist noch nicht mit dem Chat verbunden, daher hat nichts, was Sie heute hören, damit zu tun. Zehn Sprachen sind dafür bereit; für die übrigen ist eine Engine erforderlich, die Emotionen und eine breite Sprachabdeckung gleichzeitig bietet, die unter einer von uns nutzbaren Lizenz nicht existiert.
Nicht jede Sprache zu jedem Zeitpunkt
Siehe den Hinweis oben: Die Abdeckung ist das, was gemessen wurde. Was aktiv ist, kann kleiner sein, während Maschinen bereitgestellt werden.

Wie viel Sie bekommen

Der kostenlose Chat liest täglich eine kleine Anzahl von Antworten vor, während die kostenpflichtigen Tarife deutlich mehr vorliest. Die genauen Zahlen finden Sie auf der Preisseite – alles übersichtlich an einem Ort, damit es bei der Leistung nie zu Unstimmigkeiten kommt.

Die Obergrenze für Bezahlkunden ist aus Absicht hoch, nicht unendlich. Ein Endpunkt ohne Obergrenze hat auch keine Untergrenze, wenn ein Konto geteilt oder verkauft wird. Die Maschinen, die das Audio erzeugen, werden stundenweise gemietet. Die Zahl liegt weit über dem, was eine Person an einem Tag hört.

Eine bereits abgespielte Antwort wird nicht mitten unterbrochen, wenn das Limit erreicht ist. Die Zählung erfolgt einmal pro Wiedergabe, nicht einmal pro Satz.

Was mit dem Audio passiert

Nichts wird gespeichert. Das Audio wird für die Anfrage erzeugt und auf unserer Seite nie auf die Festplatte geschrieben. Wenn Sie stoppen, wird die Arbeit auf dem Server abgebrochen, statt dass sie weiterläuft, damit niemand sie hört.

Das ist dieselbe Regel wie der Rest des Dienstes, und das ist der Grund, warum es keine Bibliothek Ihrer vorgelesenen Antworten zum Durchsuchen gibt: Es gibt nichts zu durchsuchen.