← Back to home

Sicherheitsübersicht

Last updated: 24. April 2026

FileGPT.dev konzipiert und implementiert private RAG-Systeme für technische Dokumentenprozesse. Diese Seite beschreibt die Architekturprinzipien, Sicherheitsmaßnahmen und bekannten Einschränkungen in transparenten technischen Begriffen.

1. Architekturprinzip: Souveränität by Design

Jedes Kundenprojekt erhält eine eigene, isolierte Infrastruktur — kein gemeinsam genutzter Multi-Tenant-Stack. Die Systemarchitektur folgt diesen Grundsätzen:

  1. Dokumente werden aus freigegebenen Quellen (DMS, Dateisystem, ERP-Export) in die definierte Umgebung übernommen.
  2. Parsing, OCR und Normalisierung laufen innerhalb der vereinbarten Infrastrukturgrenze.
  3. Einbettungen werden lokal oder in einem kundenkontrollierten Cloud-Tenant erzeugt — nicht bei externen öffentlichen APIs, sofern nicht ausdrücklich vereinbart.
  4. Der Vektorindex wird getrennt nach Mandant, Projekt und Berechtigungsmodell gespeichert.
  5. Das Sprachmodell erhält ausschließlich die für die jeweilige Anfrage freigegebenen Dokumentausschnitte.
  6. Antworten enthalten Quellenverweise; Zugriffe und Änderungen werden auditierbar protokolliert.

2. Sicherheitsprinzipien

  • Minimale Rechtevergabe: Authentifizierte Endpunkte und rollenbasierte Zugriffskontrollen werden über alle Dokumenten- und Retrieval-Operationen eingesetzt.
  • Datenminimierung: Das Sprachmodell erhält ausschließlich die für eine Anfrage relevanten Ausschnitte — keine vollständigen Dokumentarchive.
  • Physische und logische Isolation: Dokumente, Einbettungen und Modelle verbleiben innerhalb der definierten Systemgrenze. Keine Übertragung in fremde Mandanten oder öffentliche APIs ohne explizite Vereinbarung.
  • Defense in Depth: Eingabevalidierung, Ratenbegrenzung und kontrollierter Zugriff auf Speicherressourcen reduzieren das Missbrauchsrisiko.
  • Berechtigungsvererbung: Bestehende Rollen aus DMS, ERP oder Identity-Providern (OIDC, Entra ID) werden übernommen — die KI schafft keine neuen Zugriffsrechte.

3. Datenhaltung und Verarbeitung

  • Dokumente werden in der vereinbarten Umgebung gespeichert; Löschung erfolgt auf Kundenweisung oder nach vertraglich festgelegten Fristen.
  • Extrahierter Text, Dokumentsegmente und Einbettungen sind an die Quelldokumente gekoppelt und werden bei deren Löschung entfernt.
  • Anfragen, Antworten und Audit-Ereignisse werden innerhalb der Systemgrenze protokolliert.
  • Telemetrie und Betriebslogs verbleiben in der vereinbarten Infrastruktur und werden nicht an Drittdienste ohne Kundenvereinbarung übermittelt.

4. Verschlüsselung und Transport

  • Kommunikation zwischen Client und System sowie zwischen Systemkomponenten erfolgt über TLS.
  • Speicher- und Datenbankverschlüsselung im Ruhezustand wird durch die Infrastrukturanbieter des jeweiligen Deployments bereitgestellt.
  • Für Air-Gapped-Umgebungen entfällt externe Netzwerkkommunikation vollständig; die Konfiguration wird im Assessment dokumentiert.

5. KI-Modelle: Auswahl und Kontrolle

Das eingesetzte Sprachmodell wird im Rahmen des Assessments gemeinsam mit dem Kunden ausgewählt — abhängig von Schutzklasse, Infrastruktur und Use Case. Mögliche Optionen reichen von lokal betriebenen Open-Source-Modellen (vLLM, Ollama) bis hin zu vertraglich kontrollierten Enterprise-API-Diensten.

Kundendaten werden nicht zum Training eigener Modelle verwendet. Die Verarbeitung durch Drittanbieter-Modelle erfolgt ausschließlich auf Basis der im Projekt vereinbarten und dokumentierten Konfiguration.

6. Monitoring und Missbrauchsprävention

  • Authentifizierungsprüfungen auf allen geschützten Endpunkten und Server-Aktionen.
  • Schemavalidierung für Ingestion- und Abfrageanfragen.
  • Ratenbegrenzung und Zugriffskontrollen für Hochlade-, Retrieval- und Löschoperationen.
  • Betriebsprotokolle für Zuverlässigkeit und Incident-Analyse, innerhalb der vereinbarten Systemgrenze.

7. Bekannte Einschränkungen und Restrisiken

  • Generative Ausgaben können inkorrekt sein, auch wenn Quellenverweise angezeigt werden. Menschliche Prüfung bleibt erforderlich.
  • Retrieval kann den falschen Abschnitt auswählen; Tabellen können beim Parsing strukturelle Informationen verlieren.
  • Kein Sicherheitssystem kann alle Risiken vollständig eliminieren oder eine Null-Incident-Garantie bieten.
  • Konfigurationen außerhalb des definierten Stacks (Netzwerk, Identity-Provider, Backup-Systeme) können das Risikoprofil wesentlich beeinflussen und liegen in der Verantwortung des Kunden.

8. Zugehörige Dokumentation

Weitere Informationen zur Datenverarbeitung und zu Betroffenenrechten finden Sie in der Datenschutzerklärung sowie im Auftragsverarbeitungsvertrag (AVV).

9. Sicherheitskontakt

Sicherheits- und Compliance-Fragen richten Sie bitte an info@filegpt.dev.