SovrGPT Dokumentation

Stimmen

Die synthetischen Stimmen fürs Vorlesen — entworfen, mehrsprachig, mit Hörproben. Wählbar in der App und über die API.

SovrGPT liest Antworten vor — im Chat über den Lautsprecher-Knopf unter jeder Antwort, über die API mit POST /v1/audio/speech. Welche Stimme dabei spricht, wählen Sie selbst. Diese Seite zeigt den Katalog und lässt Sie reinhören.

Was diese Stimmen sind — und was nicht

Die deutschen Stimmen des Katalogs sind entworfen, nicht aufgenommen: aus einer schriftlichen Beschreibung (Geschlecht, Altersgruppe, Klangfarbe, Tempo) mit einem Sprachmodell erzeugt (Qwen3-TTS-VoiceDesign, Apache 2.0). Sie gehören keiner realen Person — es gibt kein biometrisches Merkmal, das jemandem zugeordnet werden könnte. Die Stimme, die in der Produkt-Tour auf der Startseite spricht, ist eine davon (bib-m-40).

Gesprochen werden sie zur Laufzeit von einem europäischen Sprachmodell-Anbieter am EU-Endpunkt (siehe Datenschutz). Jede Ausgabe ist als KI-generiert gekennzeichnet — im Dateikopf (ID3/LIST/VorbisComment) und im Chat sichtbar am Knopf (KI-Kennzeichnung).

Mehrsprachig

Alle Katalog-Stimmen sprechen die neun Sprachen des Sprachmodells: Deutsch, Englisch, Französisch, Spanisch, Italienisch, Portugiesisch, Niederländisch, Hindi und Arabisch. Sie geben den Text in der Sprache wieder, in der er geschrieben ist — es gibt keinen Sprachschalter.

Ehrlich dazu: die deutschen Stimmen wurden für Deutsch entworfen. Deutsch und Englisch haben wir gemessen (jede Hörprobe wird rücktranskribiert und muss wortgleich zurückkommen; außerdem prüfen wir, dass kein Einschwing-Knacks am Satzanfang steht). In den übrigen Sprachen bleibt laut Anbieter eine Färbung der Ausgangssprache hörbar — für englische Texte ohne deutsche Färbung gibt es die Systemstimme paul-en.

Der Katalog

Stand 2026-09-19 enthält der Katalog sechs entworfene deutsche Stimmen — vier männliche (Mitte 30, Anfang 40, Mitte 40, Anfang 50) und zwei weibliche (Mitte 30, Anfang 40) — sowie eine englische Systemstimme. Die Liste unten ist live: eine neu eingetragene Stimme erscheint hier ohne Wartezeit. Jede Karte trägt zwei Hörproben (Deutsch, Englisch) mit demselben festen Satz, damit sich die Stimmen vergleichen lassen.

Stimmen werden geladen …

Stimme wählen

  • Im Chat: unter Einstellungen → Stimmen die Stimme wählen; der Lautsprecher-Knopf benutzt sie ab dem nächsten Vorlesen. Die Wahl gilt für Sie als Nutzer, in jeder Organisation, die die Stimmenauswahl hat.
  • Über die API: voice: "bib-m-40" in POST /v1/audio/speech; den Katalog liefert GET /v1/audio/voices — inklusive der Auskunft, ob Ihre Organisation wählen darf. Details in der Audio-API.

Die Stimmenauswahl ist ab Tarif Starter enthalten. Eine Organisation darunter kann sie über die Berechtigung „Stimmen“ freigeschaltet bekommen — sprechen Sie uns an. Ohne beides bleibt es bei der Systemstimme; die Hörproben hier sind für alle da.

Neue Stimmen

Neue Stimmen werden von uns entworfen und in den Katalog eingetragen — mit Beschreibung, Primärsprache und Hörproben. Sie brauchen dafür weder eine Aufnahme noch eine Einwilligung: eine entworfene Stimme hat keinen Sprecher. Wenn Sie eine bestimmte Stimmlage oder einen Charakter brauchen, beschreiben Sie ihn uns.

Stimmen