Stimmen
Die synthetischen Stimmen fürs Vorlesen — entworfen, mehrsprachig, mit Hörproben. Wählbar in der App und über die API.
SovrGPT liest Antworten vor — im Chat über den Lautsprecher-Knopf unter jeder
Antwort, über die API mit POST /v1/audio/speech. Welche Stimme dabei spricht,
wählen Sie selbst. Diese Seite zeigt den Katalog und lässt Sie reinhören.
Was diese Stimmen sind — und was nicht
Die deutschen Stimmen des Katalogs sind entworfen, nicht aufgenommen: aus einer
schriftlichen Beschreibung (Geschlecht, Altersgruppe, Klangfarbe, Tempo) mit einem
Sprachmodell erzeugt (Qwen3-TTS-VoiceDesign, Apache 2.0). Sie gehören keiner
realen Person — es gibt kein biometrisches Merkmal, das jemandem zugeordnet
werden könnte. Die Stimme, die in der Produkt-Tour auf der Startseite spricht,
ist eine davon (bib-m-40).
Gesprochen werden sie zur Laufzeit von einem europäischen Sprachmodell-Anbieter am EU-Endpunkt (siehe Datenschutz). Jede Ausgabe ist als KI-generiert gekennzeichnet — im Dateikopf (ID3/LIST/VorbisComment) und im Chat sichtbar am Knopf (KI-Kennzeichnung).
Mehrsprachig
Alle Katalog-Stimmen sprechen die neun Sprachen des Sprachmodells: Deutsch, Englisch, Französisch, Spanisch, Italienisch, Portugiesisch, Niederländisch, Hindi und Arabisch. Sie geben den Text in der Sprache wieder, in der er geschrieben ist — es gibt keinen Sprachschalter.
Ehrlich dazu: die deutschen Stimmen wurden für Deutsch entworfen. Deutsch und
Englisch haben wir gemessen (jede Hörprobe wird rücktranskribiert und muss
wortgleich zurückkommen; außerdem prüfen wir, dass kein Einschwing-Knacks am
Satzanfang steht). In den übrigen Sprachen bleibt laut Anbieter eine Färbung der
Ausgangssprache hörbar — für englische Texte ohne deutsche Färbung gibt es die
Systemstimme paul-en.
Der Katalog
Stand 2026-09-19 enthält der Katalog sechs entworfene deutsche Stimmen — vier männliche (Mitte 30, Anfang 40, Mitte 40, Anfang 50) und zwei weibliche (Mitte 30, Anfang 40) — sowie eine englische Systemstimme. Die Liste unten ist live: eine neu eingetragene Stimme erscheint hier ohne Wartezeit. Jede Karte trägt zwei Hörproben (Deutsch, Englisch) mit demselben festen Satz, damit sich die Stimmen vergleichen lassen.
Stimmen werden geladen …
Stimme wählen
- Im Chat: unter Einstellungen → Stimmen die Stimme wählen; der Lautsprecher-Knopf benutzt sie ab dem nächsten Vorlesen. Die Wahl gilt für Sie als Nutzer, in jeder Organisation, die die Stimmenauswahl hat.
- Über die API:
voice: "bib-m-40"inPOST /v1/audio/speech; den Katalog liefertGET /v1/audio/voices— inklusive der Auskunft, ob Ihre Organisation wählen darf. Details in der Audio-API.
Die Stimmenauswahl ist ab Tarif Starter enthalten. Eine Organisation darunter kann sie über die Berechtigung „Stimmen“ freigeschaltet bekommen — sprechen Sie uns an. Ohne beides bleibt es bei der Systemstimme; die Hörproben hier sind für alle da.
Neue Stimmen
Neue Stimmen werden von uns entworfen und in den Katalog eingetragen — mit Beschreibung, Primärsprache und Hörproben. Sie brauchen dafür weder eine Aufnahme noch eine Einwilligung: eine entworfene Stimme hat keinen Sprecher. Wenn Sie eine bestimmte Stimmlage oder einen Charakter brauchen, beschreiben Sie ihn uns.
Modelle
Sprach-LLMs, Embeddings, Re-Ranker und Sprache (STT/TTS) — alle EU-gehostet.
Coding in der IDE
SovrGPT als Modell-Backend für Kilo Code, Cline, Roo Code, Continue, OpenCode, Qwen Code, goose, Zed, Theia, OpenHands, Cursor und Aider — souveräne EU-Modelle direkt im Editor, mit ehrlichen Angaben zu Latenz, Telemetrie, Freigaben und Grenzen.