---
title: "Datenquellen"
description: "Welche Quellen ein Outpost anbindet, welche meinGPT direkt anbindet, und wie eine Verbindung zustande kommt."
canonical_url: "https://meingpt.com/docs/integrations/vault/sources"
language: de
---

# Datenquellen

Eine **Datenquelle** bekommt in meinGPT ihren Namen und ihre Berechtigungen — dort entscheidet sich, **wer** sie finden darf. Ordner auf einem Outpost-Rechner entstehen dagegen dort und werden hier nur übernommen; **wie viel** ein Ordner herausgibt, entscheidet ebenfalls der Outpost. Wo ihre Dokumente liegen, entscheidet sich danach — und für einen Teil der Quellen ist die Antwort „auf einem Rechner bei euch“, und genau dafür gibt es den Outpost.

## Wer holt die Dateien?

|                            | Quellen                                                                                                                                              | Wo konfiguriert                                     |
| -------------------------- | ---------------------------------------------------------------------------------------------------------------------------------------------------- | --------------------------------------------------- |
| **meinGPT direkt**         | SharePoint, OneDrive, Google Drive, Confluence, S3, WebDAV, Web-Crawler                                                                              | Vollständig in meinGPT. Kein eigener Rechner nötig. |
| **Nur über einen Outpost** | Ordner auf einem Rechner — auch SMB-Freigaben, sofern eingebunden; in der separat freigeschalteten Dienste-Vorschau auch Datenbanken und lokale MCP-Server | Datenquelle in meinGPT, Verknüpfung im Outpost      |

**Dienste sind nicht allgemein freigeschaltet**

Datenbanken und MCP-Server erscheinen nur, wenn die kontrollierte
Dienste-Vorschau für euren Workspace aktiviert ist. Ohne diese Freischaltung
zeigt der Outpost ausschließlich dateibasierte Freigaben.

**Im Standardfall braucht ihr keinen Outpost**

Wenn eure Dokumente in SharePoint oder Google Drive liegen, bindet meinGPT sie
direkt an. Ein Outpost lohnt sich, wenn Quelldateien und Suchindex in eurem
Netz bleiben oder Systeme aus der Cloud gar nicht erreichbar sind — ein
Netzlaufwerk und eine Datenbank im eigenen Netz sind es nicht. Was eine
Anfrage übertragen darf, legt ihr pro Ordner am Outpost fest.

## So kommt eine Outpost-Quelle zustande

Zwei Hälften an zwei Orten, in dieser Reihenfolge:

1. **Im Outpost:** Ordner freigeben — Pfad wählen und festlegen, wie viel er herausgibt.
2. **In meinGPT:** den gemeldeten Ordner unter _Freigaben_ **übernehmen** und benennen. Dort entscheidet sich, **wer** ihn finden darf.

In meinGPT gibt es keinen Knopf, der einen Ordner anlegt. Sucht ihr ihn, fehlt Schritt 1 — er passiert auf dem Rechner.

Der Dialog im Outpost kennt nur einen Quellentyp: einen Ordnerpfad auf diesem Rechner — auch eine dauerhaft eingebundene SMB-Freigabe zählt dazu. S3-Speicher, WebDAV und Web-Crawler bindet ihr ausschließlich direkt in meinGPT an. Ist ein solcher Dienst aus dem Internet nicht erreichbar, etwa ein internes MinIO oder eine Nextcloud, braucht es dafür eine eigene Verbindungsart (IP Allowlisting, Enterprise Connection Network oder VPN) statt eines Outposts — siehe [Guide: On-Premise](/docs/integrations/guide-on-premise).

## Quellen im Detail

### Braucht einen Outpost

### [Ordner auf diesem Rechner](/docs/integrations/vault/sources/local)

Lokale Ordner und gemountete Netzlaufwerke — der häufigste Fall.

### [SMB-Freigabe](/docs/integrations/vault/sources/smb)

Windows- und Samba-Freigaben.

### Direkt in meinGPT, kein Outpost nötig

### [S3-Speicher](/docs/integrations/sources/s3)

AWS S3 und S3-kompatible Speicher.

### [WebDAV](/docs/integrations/sources/webdav)

Nextcloud, ownCloud und andere WebDAV-Server.

### [Web-Crawler](/docs/integrations/sources/webcrawler)

Öffentliche oder interne Websites.

### [SharePoint / OneDrive](/docs/integrations/sources/sharepoint)

Dokumentbibliotheken und OneDrive.

### [Google Drive](/docs/integrations/sources/google-drive)

Dateien aus Google Drive.

### [Confluence](/docs/integrations/sources/confluence)

Seiten und Anhänge aus Confluence.

## Was bei jeder Quelle gleich ist

1. Der Outpost holt die Dateien in seinen Arbeitsbereich auf diesem Rechner.
2. Er extrahiert Text, teilt ihn in Abschnitte, kodiert sie und legt sie im Suchverzeichnis ab.
3. Spätere Läufe verarbeiten nur, was sich geändert hat.
4. Was er nicht lesen kann, überspringt er — und protokolliert es nach Dateiendung in der Zeile des Ordners unter **Freigaben**.

Punkt 4 ist der, den man im Blick behalten muss: eine übersprungene Datei ist nicht auffindbar, und die Suche sagt das niemandem. → [Konsole & Betrieb](/docs/integrations/vault/operations)

**Berechtigungen entstehen in meinGPT, nicht im Dateisystem**

Datei-, NTFS-, AD- und POSIX-Rechte werden **nicht** in den Index übernommen.
Wer eine Datenquelle in meinGPT sehen darf, findet alles darin. Die Aufteilung
in Datenquellen *ist* euer Berechtigungsmodell.

Ausnahme: Für lokale NTFS-Ordner gibt es die Beta-Funktion **Windows-Nutzerrechte (Beta)**, die echte NTFS-Berechtigungen je Nutzer:in berücksichtigt — Details unter [Ordner auf diesem Rechner](/docs/integrations/vault/sources/local).
