Modelle

Offene Modelle, selbst betrieben oder bei europäischen Partnern.

Offene Modelle der aktuellen Generation, darunter Gemma 4, Qwen 3.8 und GLM 5.3, meist unter Apache-2.0- oder MIT-Lizenz. Bei den Partnern antworten sie ohne Wartezeit, und Sie wählen je Chat. Hier steht, welches Modell wofür taugt und wo es läuft.

Schnell

Gemma 4 12B mit 262k Token Kontext: mehrere hundert Seiten in einer Frage. Für den Alltag.

Ausgewogen

Qwen 3.8 27B für Berichte, Auswertungen und längere Korrespondenz. Im Selbstbetrieb oder ohne Kaltstart im Partner-Rechenzentrum.

Stark

Qwen 3.8 Max und Kimi K3 im Partner-Rechenzentrum, GPT-OSS 120B bei STACKIT in Deutschland. Für lange Texte und schwierige Sachverhalte.

Denken

Zeigt den Gedankengang getrennt von der Antwort. Wie gründlich das Modell nachdenkt, stellen Sie in bis zu drei Stufen ein.

Sehen

Gemma 4 versteht Bilder: Skizzen, Baupläne, Formulare, Fotos.

Coden

GLM 5.3 ohne Kaltstart und Qwen 3.6 35B-A3B im Selbstbetrieb, für Cline, Continue, Zed und Aider.

Außerdem im Katalog

Embeddings

Machen Texte durchsuchbar und sind die Grundlage der Wissensbasis. Mehrsprachig (BGE-M3).

Re-Ranker

Sortiert Suchtreffer nach ihrer Relevanz für die Frage (BGE-Reranker).

Vorlesen

Deutsche und internationale Stimmen in neun Sprachen, erzeugt in EU-Rechenzentren. Hörproben im Stimmenkatalog.

Diktat

Ins Mikrofon sprechen, der Text erscheint im Eingabefeld (Voxtral, EU-Endpunkt).

Decision Engine

Wahrscheinlichkeiten für feste Optionen, in Millisekunden.

Alle Modelle, die heute im Chat wählbar sind

Diese Liste kommt direkt aus dem Modellkatalog des Produkts — derselben Quelle, die den Modellwähler und die API speist. Sie ist damit immer der aktuelle Stand und keine gepflegte Kopie.

Selbst betrieben5 Modelle

Läuft auf Hardware, die wir selbst mieten und konfigurieren — in Rechenzentren in Rumänien, Schweden, Tschechien, den Niederlanden und Frankreich sowie in Island und Norwegen (EWR).

  • Gemma 4 12B

    Standard

    Google DeepMind · US · Apache 2.0

    selbst betrieben in europäischen Rechenzentren · Powered by Gemma

  • Qwen 3.8 27B

    Allrounder

    Alibaba · CN · Apache 2.0

    selbst betrieben in europäischen Rechenzentren

  • Tiefdenker · 9B

    Reasoning

    Jackrong (Community-Distill) · CN · Apache 2.0

    selbst betrieben in europäischen Rechenzentren

  • Gemma 4 26B-A4B (Vision)

    Vision

    Google DeepMind · US · Apache 2.0

    selbst betrieben in europäischen Rechenzentren · Powered by Gemma

  • Coder mini · 35B-A3B

    Coder · schnell

    Alibaba · CN · Apache 2.0

    selbst betrieben in europäischen Rechenzentren

Im Partner-Betrieb15 Modelle

Läuft bei europäischen Partnern mit vertraglich zugesicherter Nullspeicherung der Ein- und Ausgaben. Kein Kaltstart, dafür fremde Hardware.

  • Qwen 3.6 27B · STACKIT

    Allrounder · Deutschland

    Alibaba · CN · Apache 2.0

    STACKIT (Schwarz Digital), Deutschland

  • GPT-OSS 120B · STACKIT

    Gründlich · regelbar

    OpenAI · US · Apache 2.0

    STACKIT (Schwarz Digital), Deutschland

  • Gemma 4 31B · STACKIT

    Vision · Deutschland

    Google DeepMind · US · Apache 2.0

    STACKIT (Schwarz Digital), Deutschland

  • Qwen 3.8 Max

    Bestes Ergebnis

    Alibaba · CN · Apache 2.0

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • Qwen 3.8 27B · ohne Kaltstart

    Allrounder · sofort

    Alibaba · CN · Apache 2.0

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • Kimi K3

    Gründlich

    Moonshot AI · CN · Modified MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • DeepSeek V4 Flash

    Schnell & günstig

    DeepSeek · CN · MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • DeepSeek V4 Pro

    Stark & sofort

    DeepSeek · CN · MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • Kimi K2.7 Code

    Coder · sofort

    Moonshot AI · CN · Modified MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • MiniMax M3

    Gründlich · günstig

    MiniMax · CN · Lizenz ungeprüft

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • GLM 5.2

    Vielseitig · sofort

    Z.ai · CN · MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • GLM 5.3

    Bester Code

    Z.ai · CN · GLM-5.3-Lizenz (MIT-artig)

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • Qwen 3.8 Flash

    Alltag · sparsam

    Alibaba · CN · Qwen Community 1.0

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • DeepSeek V4.1 Flash

    Stark & günstig

    DeepSeek · CN · MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

  • GLM 5.3 Flash

    Günstig · sofort

    Z.ai · CN · MIT

    europäisches Partner-Rechenzentrum (Irland/Finnland)

Eigene Modelle lassen sich zusätzlich einbinden (eigener Endpunkt oder eigener Anbieterschlüssel). Sie erscheinen dann nur in Ihrer Organisation und stehen nicht in dieser Liste.

Entscheidungsmodelle

Die Decision Engine wird als Version gewählt, nicht als Grundmodell. Welche Laufzeit dahinter rechnet, legt die Plattform fest — die Region steht in jeder Antwort.

  • SovrGPT Decision Engine v1Vorgabe

    sovr-decision-v1

    Betrieb: Deutschland

    Bilder: ja

  • SovrGPT Decision Engine v2

    sovr-decision-v2

    Betrieb: EU (Irland/Finnland)

    Bilder: ja

Demo anfragen Dokumentation Decision Engine Sicherheit und Souveränität
Modelle – offene Modelle in EU-Rechenzentren | SovrGPT