SovrGPT Dokumentation

Wissensbasis (RAG)

Eigene Dokumente hochladen und Antworten daraus belegen lassen — tenant-isolierte Retrieval-Augmented Generation auf EU-Infrastruktur.

Die Wissensbasis ist die durchsuchbare Dokumentensammlung einer Organisation. Technisch ist es RAG (Retrieval-Augmented Generation): Vor der Antwort durchsucht SovrGPT Ihre eigenen Dokumente, reicht die passenden Stellen ans Modell und belegt die Antwort mit Quellen. Das Modell rät also nicht, sondern liest nach — und nennt, wo es nachgelesen hat.

Was es kann

  • Eigene Dokumente als Wissensquelle: PDF, Word, Excel, Text, Markdown.
  • Belegte Antworten: Fundstellen werden zitiert — nachvollziehbar, wichtig für Verwaltung, Recht und Compliance.
  • Pro Chat steuerbar: Sie entscheiden je Unterhaltung, ob die Wissensbasis genutzt wird, nur die Wissensbasis, nur Web, oder eine Kombination.
  • Strikt mandantengetrennt: Eine Organisation sieht niemals das Wissen einer anderen.

Wissensquellen pro Chat wählen

Im Composer wählen Sie die Wissensquelle (RAG:-Pille). Es gibt fünf Modi:

ModusVerhalten
AusKeine Wissensbasis — normaler Chat.
WissensbasisAntworten mit Ihrer Wissensbasis anreichern.
Nur WissensbasisAusschließlich aus der Wissensbasis antworten (kein Weltwissen).
WebNur Web-Suche, ohne Wissensbasis.
Wissensbasis + WebWissensbasis und Web-Suche kombinieren.

Die Organisation legt einen Standard-Modus fest; jeder Chat kann ihn überschreiben. „Nur Wissensbasis" ist ideal, wenn Antworten ausschließlich auf freigegebenen Hausunterlagen beruhen sollen.

Dokumente verwalten

Unter Einstellungen → Wissen (RAG):

  1. Dateien hochladen (PDF/Word/Excel/Text/Markdown). Der Text wird extrahiert, in Abschnitte zerlegt, in Vektoren umgewandelt und gespeichert.
  2. Dokumentenliste einsehen, einzelne Dokumente löschen.
  3. Quota im Blick behalten (Anzahl Dokumente und Gesamtgröße).

Inhalte werden verschlüsselt in der EU gespeichert und bleiben auf diese Organisation beschränkt.

Wie die Suche funktioniert

SovrGPT kombiniert zwei Verfahren und ordnet die Treffer anschließend neu:

  1. Hybrid-Suche — Keyword (Postgres-Volltext) und semantische Vektor-Suche (pgvector) werden zusammengeführt.
  2. Reranking — ein Cross-Encoder (bge-reranker-base) sortiert die besten Treffer nach tatsächlicher Relevanz.
  3. Injektion + Zitat — die Top-Stellen gehen ins Modell, die Antwort verweist auf die Fundstellen.

Embedding und Reranking laufen auf EU-souveränen Endpunkten — kein Hyperscaler, keine Daten außerhalb der EU.

Tenant-Isolation (nicht verhandelbar)

Strikte Trennung pro Organisation ist die Kern-Anforderung des Features:

  • org_id auf jeder RAG-Tabelle — kein Datensatz ohne Organisation.
  • Row Level Security: Lesen nur für Mitglieder der Organisation; Schreiben ausschließlich serverseitig (nie direkt vom Client).
  • Verschlüsselte Ablage in EU-Rechenzentren.

Verfügbarkeit (Tarife)

FunktionAb Tarif
Wissensbasis hochladen & abrufen (RAG)Pro
Web-Suche als Quellealle Tarife

Reicht das Tier nicht aus, zeigt die RAG:-Pille einen Upgrade-Hinweis.

Abgrenzung: Wissensbasis vs. Datei-Anhang

  • Wissensbasis = persistente Wissensbasis der Organisation, über alle Chats hinweg durchsuchbar.
  • Datei-Anhang im Chat = flüchtig: eine Datei wird nur für die laufende Unterhaltung berücksichtigt und nicht dauerhaft indexiert.

Verwandte Themen: Marketplace · Eigene Systeme anbinden · DSGVO & Compliance.

Wissensbasis (RAG)