Datenquellen

Welche Quellen ein Outpost anbindet, welche meinGPT direkt anbindet, und wie eine Verbindung zustande kommt.

Eine Datenquelle bekommt in meinGPT ihren Namen und ihre Berechtigungen — dort entscheidet sich, wer sie finden darf. Ordner auf einem Outpost-Rechner entstehen dagegen dort und werden hier nur übernommen; wie viel ein Ordner herausgibt, entscheidet ebenfalls der Outpost. Wo ihre Dokumente liegen, entscheidet sich danach — und für einen Teil der Quellen ist die Antwort „auf einem Rechner bei euch“, und genau dafür gibt es den Outpost.

Wer holt die Dateien?

QuellenWo konfiguriert
meinGPT direktSharePoint, OneDrive, Google Drive, Confluence, S3, WebDAV, Web-CrawlerVollständig in meinGPT. Kein eigener Rechner nötig.
Nur über einen OutpostOrdner auf einem Rechner — auch SMB-Freigaben, sofern eingebunden; in der separat freigeschalteten Dienste-Vorschau auch Datenbanken und lokale MCP-ServerDatenquelle in meinGPT, Verknüpfung im Outpost

Dienste sind nicht allgemein freigeschaltet

Datenbanken und MCP-Server erscheinen nur, wenn die kontrollierte Dienste-Vorschau für euren Workspace aktiviert ist. Ohne diese Freischaltung zeigt der Outpost ausschließlich dateibasierte Freigaben.

Im Standardfall braucht ihr keinen Outpost

Wenn eure Dokumente in SharePoint oder Google Drive liegen, bindet meinGPT sie direkt an. Ein Outpost lohnt sich, wenn Quelldateien und Suchindex in eurem Netz bleiben oder Systeme aus der Cloud gar nicht erreichbar sind — ein Netzlaufwerk und eine Datenbank im eigenen Netz sind es nicht. Was eine Anfrage übertragen darf, legt ihr pro Ordner am Outpost fest.

So kommt eine Outpost-Quelle zustande

Zwei Hälften an zwei Orten, in dieser Reihenfolge:

  1. Im Outpost: Ordner freigeben — Pfad wählen und festlegen, wie viel er herausgibt.
  2. In meinGPT: den gemeldeten Ordner unter Freigaben übernehmen und benennen. Dort entscheidet sich, wer ihn finden darf.

In meinGPT gibt es keinen Knopf, der einen Ordner anlegt. Sucht ihr ihn, fehlt Schritt 1 — er passiert auf dem Rechner.

Der Dialog im Outpost kennt nur einen Quellentyp: einen Ordnerpfad auf diesem Rechner — auch eine dauerhaft eingebundene SMB-Freigabe zählt dazu. S3-Speicher, WebDAV und Web-Crawler bindet ihr ausschließlich direkt in meinGPT an. Ist ein solcher Dienst aus dem Internet nicht erreichbar, etwa ein internes MinIO oder eine Nextcloud, braucht es dafür eine eigene Verbindungsart (IP Allowlisting, Enterprise Connection Network oder VPN) statt eines Outposts — siehe Guide: On-Premise.

Quellen im Detail

Braucht einen Outpost

Direkt in meinGPT, kein Outpost nötig

Was bei jeder Quelle gleich ist

  1. Der Outpost holt die Dateien in seinen Arbeitsbereich auf diesem Rechner.
  2. Er extrahiert Text, teilt ihn in Abschnitte, kodiert sie und legt sie im Suchverzeichnis ab.
  3. Spätere Läufe verarbeiten nur, was sich geändert hat.
  4. Was er nicht lesen kann, überspringt er — und protokolliert es nach Dateiendung in der Zeile des Ordners unter Freigaben.

Punkt 4 ist der, den man im Blick behalten muss: eine übersprungene Datei ist nicht auffindbar, und die Suche sagt das niemandem. → Konsole & Betrieb

Berechtigungen entstehen in meinGPT, nicht im Dateisystem

Datei-, NTFS-, AD- und POSIX-Rechte werden nicht in den Index übernommen. Wer eine Datenquelle in meinGPT sehen darf, findet alles darin. Die Aufteilung in Datenquellen ist euer Berechtigungsmodell.

Ausnahme: Für lokale NTFS-Ordner gibt es die Beta-Funktion Windows-Nutzerrechte (Beta), die echte NTFS-Berechtigungen je Nutzer:in berücksichtigt — Details unter Ordner auf diesem Rechner.

War diese Seite hilfreich?