SovrGPT Dokumentation

Erste Schritte

In fünf Minuten vom ersten Login zum ersten API-Call.

1. Konto anlegen

  1. Auf sovrgpt.com/login gehen.
  2. E-Mail eintragen → es kommt ein Magic-Link (kein Passwort, keine Kreditkarte).
  3. Link öffnen — fertig. Es wird automatisch ein persönlicher Workspace angelegt.

2. Ersten Chat starten

Im Chat-UI (sovrgpt.com/chat):

  1. Modell oben rechts wählen (Default ist gemma-4-12b mit 262k Kontext).
  2. Frage eingeben, ggf. Werkzeuge im Composer aktivieren:
    • Web-Suche (Brave — 🔴 Anbieter in den USA, je Chat opt-in, standardmässig aus; siehe Datenschutz) — derselbe Schalter erlaubt dem Modell zusätzlich, eine Seite zu öffnen und zu lesen (fetch_url), etwa eine Adresse, die Sie in den Chat kopiert haben.
    • Bild-Generierung (Z-Image / FLUX.2)
    • Video-Generierung (LTX-Video)
    • Marketplace-Connectoren (GitHub, Notion, …)
  3. Antwort streamt zurück. Cold-Start tritt nur auf, wenn das Modell länger nicht benutzt wurde — im Default-Tier gemessen 5,5 bis 9,5 Minuten (drei Läufe: 332 s / 504 s / 574 s), bei den größeren Tiers ähnlich. Warm antwortet das Modell in unter 10 Sekunden.

3. Modell wechseln

Pro Chat speicherbar. Die Tiers auf eigener Hardware:

TierModell-IDKontextNutzungs-Profil
defaultgemma-4-12b262kAllzweck, versteht Bilder
balancedqwen3.8-27b131kMehr Tiefe, stark beim Programmieren
visiongemma-4-26b-a4b262kBilder verstehen
coder-miniqwen3.6-35b-a3b131kAgentisches Programmieren über IDE-Erweiterungen
reasoningqwen3.5-9b-deepseek-v4-flash16kSichtbarer Gedankengang
llamallama-3.1-8b16kLlama-spezifische Lasten. ⚠️ Keine Werkzeuge/Websuche

🔑 Das stärkste Modell auf eigener Hardware ist qwen3.8-27b — nicht das mit dem eindrucksvollsten Tier-Namen. Tier-Schlüssel sind technische Bezeichner aus der Anfangszeit und kein Qualitätsversprechen.

🔴 Am 2026-09-11 zurückgezogen: qwen3.5-35b-a3b (premium), qwen3-coder-next-fp8 (coder) und qwen3.5-9b (default-legacy). Beide waren von aktiven Modellen überholt — premium hatte mit 8 192 Token das kleinste Kontextfenster im Katalog, coder verlor gegen qwen3.6-35b-a3b bei einem Viertel des Kontexts. Bestehende Integrationen brechen nicht: die Rollennamen coder, coding, qwen-coder und qwen-premium zeigen jetzt auf die Nachfolger, und wer die exakte alte Modell-Id schickt, bekommt den Standard-Tier plus die Kopfzeile x-sovrgpt-model-substituted (siehe Chat Completions).

Wenn es sofort antworten soll: alle Tiers oben fahren auf eigener Hardware herunter, wenn sie nicht gebraucht werden — der erste Aufruf nach einer Pause wartet 3 bis 15 Minuten auf den Kaltstart. Die Modelle im europäischen Partner-Rechenzentrum (tensorx-…, stackit-…) haben keinen Kaltstart. Die vollständige Liste mit Kaltstart-Messwerten steht in Modelle.

4. API-Key erzeugen

Für eigene Integrationen (Skripte, Apps, Automatisierungen):

  1. Settings → API-Keys.
  2. „Neuer API-Key" → Name vergeben.
  3. Key wird einmalig im Klartext angezeigt — sofort kopieren.
  4. Org-scoped: Der Key arbeitet im Kontext der aktiven Org (Quota, Logs, RLS).

5. Erster API-Call

curl https://sovrgpt.com/api/v1/chat/completions \
  -H "Authorization: Bearer $SOVR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemma-4-12b",
    "messages": [{ "role": "user", "content": "Hallo SovrGPT!" }]
  }'

Komplette API-Doku: API-Referenz.

6. Team-Org einladen (optional)

Wenn mehrere Personen an denselben Chats / Connectoren / API-Keys arbeiten sollen:

  1. In der Sidebar „+ Neue Team-Organisation" klicken.
  2. Slug + Name vergeben.
  3. Mitglieder per E-Mail einladen, Rollen vergeben (owner / admin / member).

Mehr in Organisationen & Teams.

Häufige Stolperfallen

  • Cold-Start: Beim ersten Aufruf eines lange nicht genutzten Modells dauert die erste Antwort 30 s – 5 min (je nach Tier). Folge-Aufrufe sind warm.
  • API-Key verloren: Lässt sich nicht erneut anzeigen — neuen Key erzeugen, alten widerrufen.
  • 403 in Marketplace: Connector benötigt vermutlich Admin-Rolle in der Team-Org.
Erste Schritte