auraHub · DSGVO und Sprachmodelle

Die Plattform ist nicht das Problem.

Wenn auraHub auf Ihrer eigenen Infrastruktur läuft, bleiben Ihre Daten bei Ihnen. Wer entscheidet, was mit Prompts und Antworten passiert, ist die Wahl des Sprachmodells. Drei Stufen für drei Anwendungsfälle.

Oliver Range auraNexus.ai · 28. Mai 2026 9 min Lesezeit
01 / Problem

Wer DSGVO sagt, meint die Plattform. Das Risiko sitzt im Modell.

Definition

DSGVO-konforme KI-Plattform bezeichnet eine KI-Anwendung, deren Plattform vollständig in der Infrastruktur des Unternehmens läuft und deren Sprachmodell pro Anwendungsfall in einer abgestuften Sicherheitsarchitektur eingebunden wird. Die Plattform regelt Datenhaltung, Rechte und Audit. Das Sprachmodell entscheidet, was mit Prompts und Antworten passiert, sobald sie die Infrastruktur verlassen.

In Prüfungen mit IT-Sicherheit und Datenschutzbeauftragten taucht eine Frage immer wieder zuerst auf: Läuft das auf unseren Servern? Sobald die Antwort Ja lautet, gilt die Plattform als gelöst und die Diskussion springt zur Lizenz. Das ist verständlich, aber an dieser Stelle wird das eigentliche Risiko übersehen.

Eine KI-Plattform besteht aus zwei Ebenen. Auf der einen liegen Prompts, hochgeladene Dokumente, Nutzerrechte, Protokolle, Wissensquellen und Konfiguration. Diese Ebene können Sie technisch und vertraglich vollständig in Ihrem Haus halten. Auf der anderen Ebene sitzt das Sprachmodell, das die eigentliche Antwort erzeugt. Hier wird entschieden, ob Inhalte das Haus verlassen, in welche Region sie wandern, wie lange sie dort liegen und ob ein Anbieter darauf trainieren darf.

Die produktive Frage lautet deshalb nicht läuft das bei uns, sondern welches Modell sieht welche Daten in welcher Stufe. Genau diese Frage lässt sich mit auraHub als selbst gehosteter KI-Plattform strukturiert beantworten, weil Plattform und Modell architektonisch sauber getrennt sind. Die rechtliche Grundlage dafür liefert die Datenschutz-Grundverordnung, deren Pflichten je nach Stufe unterschiedlich greifen.

Moderner Arbeitsplatz mit auraHub-Dashboard auf einem Monitor, im Hintergrund Blick auf den Kölner Dom. Die Plattform läuft in der eigenen Infrastruktur am Standort Frechen bei Köln.
Arbeitsplatz mit auraHub-Dashboard und Blick auf den Kölner Dom. Die Plattform läuft in Ihrem Haus, Sie sehen sie jeden Tag.
2 Ebenen
Plattform und Sprachmodell
3 Sicherheitsstufen
pro Anwendungsfall
6 DSGVO-Bausteine
im Überblick
02 / Architektur

Zwei Ebenen. Eine klare Trennung.

auraHub läuft vollständig in Ihrer eigenen Umgebung, wahlweise on-premises auf Ihren Servern, in Ihrer Private Cloud oder air-gapped, also ohne Verbindung zum Internet. Damit verbleiben alle plattformseitigen Daten physisch bei Ihnen. Auf dieser Ebene findet kein Transfer in ein Drittland statt, kein Cloud-Zwang, keine Verlagerung in fremde Verantwortung.

Server im Rechenzentrum mit moderner Netzwerk-Infrastruktur. Symbolbild für die selbst gehostete Plattform-Ebene von auraHub in der eigenen Unternehmensinfrastruktur.
Die physische Plattform-Ebene: Server in Ihrer eigenen oder Ihrer Private-Cloud-Infrastruktur, auf denen auraHub direkt läuft.

Was bei Ihnen bleibt

Konkret bleiben in Ihrer Infrastruktur: Prompts und Eingaben, hochgeladene Dokumente, Nutzer- und Rechteverwaltung, Protokolle und Logs, eingebundene Wissensquellen sowie die gesamte Konfiguration der Plattform. Diese Ebene ist datenschutzrechtlich der unkritische Teil. Sie haben volle Kontrolle, keinen Drittlandtransfer auf Plattformebene und keinen Cloud-Zwang.

Was das Sprachmodell sieht

Sobald ein Prompt verarbeitet werden soll, ruft auraHub das eingestellte Sprachmodell auf. Genau hier verlässt der Inhalt potenziell die Infrastruktur, je nach Stufe nicht (lokales Modell), in eine EU-Region (Azure OpenAI Service in EU-Datenresidenz) oder über Standardvertragsklauseln in die USA (OpenAI oder Anthropic direkt). Diese Stufe lässt sich pro Anwendungsfall einstellen, nicht pauschal für das ganze System. Eine vergleichbare Architektur kennen Sie möglicherweise aus unserem auraIR-Setup für Investor Relations, das nach derselben Logik arbeitet.

auraHub-Architektur: Plattform und Sprachmodell getrennt Ihre Infrastruktur EBENE PLATTFORM On-premises, Private Cloud oder air-gapped Prompts und Eingaben Hochgeladene Dokumente Nutzer und Rechte Protokolle und Logs Wissensquellen Konfiguration BEWERTUNG Volle Kontrolle, kein Drittlandtransfer auf Plattformebene, kein Cloud-Zwang. API-AUFRUF nach gewählter Stufe Sprachmodell-Ebene EBENE MODELL Drei Sicherheitsstufen, pro Anwendungsfall einstellbar STUFE 1 Lokales Sprachmodell Höchste Sicherheit, Verarbeitung im Haus STUFE 2 Azure OpenAI EU EU-Datenresidenz, AVV über Microsoft STUFE 3 OpenAI oder Anthropic direkt SCC-abgesichert, kein Training auf API-Daten
Plattform und Sprachmodell sind getrennt. Was bei Ihnen bleibt, und was die Wahl der Stufe entscheidet.
03 / Drei Stufen

Lokal, EU oder abgesichert. Sie wählen pro Anwendungsfall.

Die drei Stufen unterscheiden sich nicht im Funktionsumfang von auraHub, sondern in dem, was außerhalb Ihres Hauses geschieht. Die Wahl wird für jeden Anwendungsfall einzeln getroffen und kann zwischen Anwendungsfällen wechseln, ohne dass die Plattform umgebaut wird.

Stufe 1 · Höchste Sicherheit
Lokales Sprachmodell
vLLM, LM Studio oder Jan.ai. Daten verlassen die Infrastruktur nie, kein externer Transfer, keine externe Speicherung. Geeignet für hochsensible Mandanten- und Patientendaten.
Stufe 2 · EU-Datenresidenz
Azure OpenAI EU
EU-Region wie Sweden oder France. Verarbeitung in EU-Rechenzentren, Daten bleiben in der EU. AVV über Microsoft, kein Training auf Ihren Daten. Geeignet für reguläre Geschäftsdaten mit EU-Pflicht.
Stufe 3 · SCC-abgesichert
OpenAI oder Anthropic direkt
Direkte API der Anbieter. Verarbeitung in den USA, abgesichert über Standardvertragsklauseln. Kein Training auf API-Daten gemäß OpenAI Enterprise Privacy und Anthropic Commercial Terms. Geeignet für unkritische Workloads.

Kurze Begriffsklarheit

AVV meint den Auftragsverarbeitungsvertrag nach Artikel 28 DSGVO, in dem der Cloud-Anbieter sich verpflichtet, Ihre Daten nur in Ihrem Auftrag und nach Ihren Weisungen zu verarbeiten. SCC steht für Standardvertragsklauseln, ein von der EU-Kommission vorgegebenes Vertragswerk, das den Transfer personenbezogener Daten in Drittländer absichert. Bei einem lokalen Modell entfallen beide, weil keine Daten außer Haus gehen.

Drei Sicherheitsstufen für das Sprachmodell EBENE SPRACHMODELL Drei Sicherheitsstufen zur Wahl STUFE 1 Höchste Sicherheit Lokales LLM vLLM · LM Studio · Jan.ai DATEN Verlassen die Infrastruktur nie, vollständig im Haus. TRANSFER Kein externer Transfer, keine API nach außen. SPEICHERUNG Keine externe Speicherung. EIGNUNG Hochsensible Mandanten- und Patientendaten STUFE 2 EU-Datenresidenz Azure OpenAI EU EU-Region · Sweden, France DATEN Verarbeitung in EU-Rechen- zentren, Daten bleiben in EU. VERTRAG AVV über Microsoft, kein Training auf Ihren Daten. SPEICHERUNG Bis 30 Tage, nur Missbrauch. Mit ZDR: keine. EIGNUNG Reguläre Geschäftsdaten mit EU-Pflicht STUFE 3 SCC-abgesichert OpenAI / Anthropic Direkt-API der Anbieter DATEN Verarbeitung in den USA, abgesichert über SCC. TRAINING Kein Training auf API-Daten. SPEICHERUNG OpenAI 30 Tage, Anthropic 7 Tage. Mit ZDR: keine. EIGNUNG Unkritische Workloads
Drei Sicherheitsstufen am Sprachmodell. Lokal für hochsensible Daten, EU für reguläre Geschäftsdaten, SCC-abgesichert für unkritische Workloads.
04 / Speicherzeiten

Wie lange Ihre Eingaben außerhalb des Hauses liegen.

Auch wenn das Sprachmodell nicht auf Ihren Daten trainiert, können Eingaben für eine begrenzte Zeit beim Anbieter gespeichert werden, in der Regel zur Missbrauchserkennung. Die Speicherzeiten unterscheiden sich pro Anbieter und sinken in den letzten Jahren systematisch. Für besonders schutzbedürftige Daten gibt es die Premium-Option Zero Data Retention, abgekürzt ZDR, bei der keinerlei Speicherung mehr stattfindet.

Variante Speicherung der Inhalte Training auf Inhalten
Lokales LLM Keine externe Speicherung Nein
Azure OpenAI EU (Standard) Bis 30 Tage, nur Missbrauchserkennung, in EU-Region Nein
OpenAI API (Standard) Bis 30 Tage, danach gelöscht Nein
Anthropic API (Standard) 7 Tage (seit September 2025 von 30 reduziert) Nein
Mit Zero Data Retention Keine Speicherung nach der Antwort, nur In-Memory Nein

Premium-Option Zero Data Retention

Für besonders sensible Verarbeitung, etwa Finanz- und Investor-Relations-Daten (wie in unserem auraIR-Setup für börsennotierte Unternehmen), bietet Anthropic im Rahmen eines Enterprise-Agreements Zero Data Retention. Ein- und Ausgaben werden dann nach der Antwort nicht mehr gespeichert, nicht in Missbrauchs-Logs abgelegt und keinem menschlichen Review zugeführt. Die Verarbeitung erfolgt rein im Arbeitsspeicher.

Diese Stufe ist gesondert zu beantragen und an einen qualifizierenden Vertrag gebunden. Microsoft (Azure) und OpenAI bieten ZDR analog für Enterprise- beziehungsweise Microsoft-Customer-Agreements. Ein Hinweis aus der Praxis: Bei Anthropic werden Ergebnisse der Sicherheitsklassifikatoren auch unter ZDR weiter vorgehalten, das ist beim Risikomodell zu berücksichtigen.

05 / DSGVO-Bausteine

Sechs Bausteine. Eine konsistente Prüfung.

Die folgenden sechs Bausteine decken die DSGVO-relevanten Pflichten beim Einsatz von auraHub ab und lassen sich in jeder Auditfrage konsistent beantworten.

Artikel 28

Auftragsverarbeitungsvertrag

Mit jedem Cloud-Anbieter verfügbar und vor Nutzung zu schließen. Regelt nach Art. 28 DSGVO, dass der Anbieter Ihre Daten nur in Ihrem Auftrag verarbeitet.

Drittland

Transfer abgesichert

Bei US-Anbietern über Standardvertragsklauseln. Entfällt vollständig bei lokalem oder EU-Modell, weil dort kein Drittlandtransfer stattfindet.

Training

Kein Training auf Ihren Daten

Bei API- und Business-Tarifen vertraglich zugesichert. Wichtige Abgrenzung zu Consumer-Apps, bei denen Eingaben standardmäßig für Modelltraining genutzt werden können.

Retention

Datenminimierung

Kurze Speicherfristen auf Anbieterseite, optional Zero Data Retention für regulierte Daten. Plattformseitig steuern Sie die Aufbewahrung über Ihre eigene Konfiguration.

Open Source

Auditierbarkeit

Quellcode der Plattform ist einsehbar, Datenflüsse sind prüfbar. Wichtig für interne Revision, externe Audits und für Vertrauen gegenüber Kunden, Investoren und Aufsicht.

Zugriff

Granulare Rechte

Rollen- und Gruppenrechte, Single Sign-On über OpenID Connect (ein offener Standard für zentrale Anmeldung), verschlüsselte Secrets. Wer was sehen darf, ist konfigurierbar bis auf die Quellenebene.

06 / Empfehlung

Eine Plattform. Stufenweise Modellwahl pro Anwendungsfall.

Der entscheidende Hebel für die Bewertung in Ihrem Haus ist die stufenweise Modellwahl pro Anwendungsfall. Hochsensible Fälle laufen über ein lokales Modell ohne jeden Datenabfluss. Reguläre Geschäftsdaten laufen über Azure in der EU. Unkritische Workloads laufen über die Direkt-API.

Wo Cloud-Modelle auf besonders schützenswerte Daten treffen, sichert Zero Data Retention die Verarbeitung ohne jede Speicherung ab. So lässt sich jeder Use Case einzeln auf das passende Schutzniveau einstellen, ohne den gesamten Betrieb auf die maximale Sicherheitsstufe ziehen zu müssen. Das senkt Kosten dort, wo sie keinen zusätzlichen Schutz erkaufen, und konzentriert Aufwand dort, wo er wirkt.

Was das für Ihre Bewertung heißt

Drei Fragen reichen, um pro Anwendungsfall in die passende Stufe zu kommen. Erstens: welche Datenkategorie wird verarbeitet, etwa Personendaten nach Artikel 9 DSGVO, Geschäftsgeheimnis oder unkritisch? Zweitens: welche regulatorische Anforderung gilt, etwa berufsrechtliche Verschwiegenheit, branchenspezifische Vorgabe oder allgemein DSGVO? Drittens: wie häufig läuft der Anwendungsfall, und rechtfertigt das Betriebsmodell ein lokales Modell oder reicht die Cloud-Variante? Wenn Sie eine erste Einschätzung Ihrer Fälle brauchen, begleiten wir das im Rahmen unserer KI-Beratung.

07 / Workflow

Wie Sie zur richtigen Stufenwahl kommen.

  • 01

    Anwendungsfälle sammeln

    Listen Sie zwischen drei und zehn konkrete Anwendungsfälle, in denen auraHub eingesetzt werden soll. Beispiele: Pressespiegel zusammenfassen, Vertragsentwürfe prüfen, Kundenanfragen kategorisieren, Patientenbriefe vorstrukturieren.

  • 02

    Datenkategorie zuordnen

    Pro Anwendungsfall: handelt es sich um besonders schützenswerte Daten nach Artikel 9 DSGVO, um reguläre personenbezogene Daten, um Geschäftsgeheimnisse oder um unkritische öffentliche Daten? Diese Zuordnung steuert direkt die Stufenwahl.

  • 03

    Stufe auswählen

    Stufe 1 lokal für hochsensible Daten und berufsrechtliche Verschwiegenheit. Stufe 2 Azure EU für reguläre Geschäftsdaten mit EU-Pflicht. Stufe 3 Direkt-API für unkritische Workloads. ZDR aktivieren, sobald sensible Daten Cloud-Modelle berühren.

  • 04

    Verträge schließen

    AVV mit allen relevanten Anbietern (Microsoft, OpenAI, Anthropic) abschließen. ZDR explizit beantragen, falls vorgesehen. Standardvertragsklauseln prüfen, wo Drittland-Transfer stattfindet.

  • 05

    Konfiguration und Audit

    auraHub pro Anwendungsfall auf die gewählte Stufe konfigurieren. Rollen und Rechte gemäß Anwendungsfall vergeben. Datenflüsse einmal vollständig dokumentieren, dann regelmäßig wiederprüfen.

$ Beratung anfragen

auraHub in Ihrem Haus.

Wir begleiten Sie von der ersten Bewertung Ihrer Anwendungsfälle bis zur produktiven Inbetriebnahme. Mit Ihren Datenschutz- und IT-Verantwortlichen, in Ihrer Infrastruktur, mit der passenden Stufenwahl pro Anwendungsfall.

Termin vereinbaren →
FAQ / Reference

Häufig gestellte Fragen

Was bedeutet selbst gehostete KI-Plattform?

Eine selbst gehostete KI-Plattform läuft in Ihrer eigenen Infrastruktur, wahlweise on-premises auf Ihren Servern, in Ihrer Private Cloud oder air-gapped ohne Internetverbindung. Alle plattformseitigen Daten wie Prompts, Dokumente, Nutzerrechte und Protokolle bleiben physisch in Ihrem Haus. auraHub ist als selbst gehostete KI-Plattform konzipiert.

Welche Sicherheitsstufen bietet auraHub am Sprachmodell?

Drei Stufen. Stufe 1 nutzt ein lokales Sprachmodell ohne jeden externen Datenabfluss. Stufe 2 nutzt Azure OpenAI in einer EU-Region mit Auftragsverarbeitungsvertrag über Microsoft. Stufe 3 nutzt die direkten APIs von OpenAI oder Anthropic, abgesichert über Standardvertragsklauseln. Die Stufe wird pro Anwendungsfall gewählt.

Was ist Zero Data Retention?

Zero Data Retention ist eine Premium-Option für regulierte Daten. Ein- und Ausgaben werden nach der Antwort nicht mehr gespeichert, nicht in Missbrauchs-Logs abgelegt und keinem menschlichen Review zugeführt. Die Verarbeitung erfolgt rein im Arbeitsspeicher. Anthropic, Microsoft Azure und OpenAI bieten ZDR im Rahmen von Enterprise-Verträgen an.

Wird auf unseren Daten trainiert?

Nein. Bei API- und Business-Tarifen ist vertraglich zugesichert, dass kein Training auf den übermittelten Daten stattfindet. Das ist ein zentraler Unterschied zu Consumer-Apps wie ChatGPT Free, bei denen Daten standardmäßig für Modelltraining genutzt werden können.

Wie lange werden Eingaben außerhalb des Hauses gespeichert?

Beim lokalen LLM gar nicht. Azure OpenAI EU speichert standardmäßig bis 30 Tage zur Missbrauchserkennung in einer EU-Region. OpenAI API speichert standardmäßig bis 30 Tage, Anthropic 7 Tage (seit September 2025 von 30 reduziert). Mit Zero Data Retention entfällt jede Speicherung nach der Antwort.

Welche DSGVO-Bausteine sind abgedeckt?

Sechs Bausteine: Auftragsverarbeitungsvertrag nach Artikel 28, Drittlandtransfer abgesichert über Standardvertragsklauseln (entfällt bei lokal oder EU), kein Training auf Ihren Daten, Datenminimierung und kurze Retention, Open Source und Auditierbarkeit des Plattform-Quellcodes, granulare Zugriffskontrolle mit Rollen, Gruppenrechten und SSO über OpenID Connect.

Welche Stufe passt zu welchem Anwendungsfall?

Hochsensible Mandanten- oder Patientendaten laufen über ein lokales Sprachmodell. Reguläre Geschäftsdaten mit EU-Pflicht über Azure OpenAI EU. Unkritische Workloads über die Direkt-API von OpenAI oder Anthropic. Wo Cloud-Modelle auf besonders schützenswerte Daten treffen, sichert Zero Data Retention die Verarbeitung ohne jede Speicherung ab.

OR
@oliverrange
Oliver Range
Gründer auraNexus.ai · AI Manager (TÜV)

Gründer mehrerer Digitalunternehmen, darunter Die Medialysten (Exit an Linkfluence). Berater für DSGVO-konforme KI-Plattformen im DACH-Mittelstand. Entwickelt mit auraNexus.ai KI-Anwendungen für Kommunikation, Steuerberatung, Kanzleien, Gesundheitswesen und Fertigung.

// read next