Erste Schritte
In fünf Minuten vom ersten Login zum ersten API-Call.
1. Konto anlegen
- Auf sovrgpt.com/login gehen.
- E-Mail eintragen → es kommt ein Magic-Link (kein Passwort, keine Kreditkarte).
- Link öffnen — fertig. Es wird automatisch ein persönlicher Workspace angelegt.
2. Ersten Chat starten
Im Chat-UI (sovrgpt.com/chat):
- Modell oben rechts wählen (Default ist
gemma-4-12bmit 262k Kontext). - Frage eingeben, ggf. Werkzeuge im Composer aktivieren:
- Web-Suche (Brave — 🔴 Anbieter in den USA, je Chat opt-in, standardmässig aus;
siehe Datenschutz) — derselbe Schalter erlaubt dem Modell
zusätzlich, eine Seite zu öffnen und zu lesen (
fetch_url), etwa eine Adresse, die Sie in den Chat kopiert haben. - Bild-Generierung (Z-Image / FLUX.2)
- Video-Generierung (LTX-Video)
- Marketplace-Connectoren (GitHub, Notion, …)
- Web-Suche (Brave — 🔴 Anbieter in den USA, je Chat opt-in, standardmässig aus;
siehe Datenschutz) — derselbe Schalter erlaubt dem Modell
zusätzlich, eine Seite zu öffnen und zu lesen (
- Antwort streamt zurück. Cold-Start tritt nur auf, wenn das Modell länger nicht benutzt wurde — im Default-Tier gemessen 5,5 bis 9,5 Minuten (drei Läufe: 332 s / 504 s / 574 s), bei den größeren Tiers ähnlich. Warm antwortet das Modell in unter 10 Sekunden.
3. Modell wechseln
Pro Chat speicherbar. Die Tiers auf eigener Hardware:
| Tier | Modell-ID | Kontext | Nutzungs-Profil |
|---|---|---|---|
default | gemma-4-12b | 262k | Allzweck, versteht Bilder |
balanced | qwen3.8-27b | 131k | Mehr Tiefe, stark beim Programmieren |
vision | gemma-4-26b-a4b | 262k | Bilder verstehen |
coder-mini | qwen3.6-35b-a3b | 131k | Agentisches Programmieren über IDE-Erweiterungen |
reasoning | qwen3.5-9b-deepseek-v4-flash | 16k | Sichtbarer Gedankengang |
llama | llama-3.1-8b | 16k | Llama-spezifische Lasten. ⚠️ Keine Werkzeuge/Websuche |
🔑 Das stärkste Modell auf eigener Hardware ist qwen3.8-27b — nicht das mit dem
eindrucksvollsten Tier-Namen. Tier-Schlüssel sind technische Bezeichner aus der Anfangszeit und
kein Qualitätsversprechen.
🔴 Am 2026-09-11 zurückgezogen: qwen3.5-35b-a3b (premium), qwen3-coder-next-fp8 (coder) und qwen3.5-9b (default-legacy). Beide waren von aktiven Modellen überholt — premium hatte mit 8 192 Token das
kleinste Kontextfenster im Katalog, coder verlor gegen qwen3.6-35b-a3b bei einem Viertel des
Kontexts. Bestehende Integrationen brechen nicht: die Rollennamen coder, coding,
qwen-coder und qwen-premium zeigen jetzt auf die Nachfolger, und wer die exakte alte Modell-Id
schickt, bekommt den Standard-Tier plus die Kopfzeile x-sovrgpt-model-substituted
(siehe Chat Completions).
⚡ Wenn es sofort antworten soll: alle Tiers oben fahren auf eigener Hardware herunter, wenn
sie nicht gebraucht werden — der erste Aufruf nach einer Pause wartet 3 bis 15 Minuten auf den
Kaltstart. Die Modelle im europäischen Partner-Rechenzentrum (tensorx-…, stackit-…) haben
keinen Kaltstart. Die vollständige Liste mit Kaltstart-Messwerten steht in
Modelle.
4. API-Key erzeugen
Für eigene Integrationen (Skripte, Apps, Automatisierungen):
- Settings → API-Keys.
- „Neuer API-Key" → Name vergeben.
- Key wird einmalig im Klartext angezeigt — sofort kopieren.
- Org-scoped: Der Key arbeitet im Kontext der aktiven Org (Quota, Logs, RLS).
5. Erster API-Call
curl https://sovrgpt.com/api/v1/chat/completions \
-H "Authorization: Bearer $SOVR_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemma-4-12b",
"messages": [{ "role": "user", "content": "Hallo SovrGPT!" }]
}'Komplette API-Doku: API-Referenz.
6. Team-Org einladen (optional)
Wenn mehrere Personen an denselben Chats / Connectoren / API-Keys arbeiten sollen:
- In der Sidebar „+ Neue Team-Organisation" klicken.
- Slug + Name vergeben.
- Mitglieder per E-Mail einladen, Rollen vergeben (
owner/admin/member).
Mehr in Organisationen & Teams.
Häufige Stolperfallen
- Cold-Start: Beim ersten Aufruf eines lange nicht genutzten Modells dauert die erste Antwort 30 s – 5 min (je nach Tier). Folge-Aufrufe sind warm.
- API-Key verloren: Lässt sich nicht erneut anzeigen — neuen Key erzeugen, alten widerrufen.
- 403 in Marketplace: Connector benötigt vermutlich Admin-Rolle in der Team-Org.