Der KI-Server steht in Österreich. Die Daten verlassen das Rechenzentrum nicht. Damit ist der Betrieb DSGVO-konform. So einfach ist es leider nicht.

Der Standort der Hardware ist wichtig, beantwortet aber nur einen Teil der Fragen. Für die DSGVO zählt die gesamte Verarbeitung: Welche Daten gelangen in das System? Wer kann darauf zugreifen? Welche Protokolle entstehen? Werden externe Dienste eingebunden? Und lassen sich personenbezogene Informationen wieder vollständig löschen? Ein lokaler Betrieb kann viele Datenschutzrisiken reduzieren. Eine rechtmäßige Verarbeitung entsteht dadurch aber nicht automatisch.

DSGVO-konform ist keine Produkteigenschaft

Ein Anbieter kann eine technisch sichere Plattform bereitstellen. Ob der konkrete Einsatz DSGVO-konform ist, hängt jedoch vom Unternehmen, dem Verwendungszweck und den verarbeiteten Daten ab.

Ein internes System zur Zusammenfassung technischer Dokumentationen ist anders zu bewerten als eine KI, die Bewerbungen analysiert, Kundendaten auswertet oder medizinische Informationen verarbeitet. Dasselbe Modell kann in einem Anwendungsfall unproblematisch und in einem anderen rechtlich unzulässig sein. Die österreichische Datenschutzbehörde stellt klar, dass die DSGVO auch beim Einsatz von KI vollständig anwendbar bleibt. Verantwortliche müssen unter anderem Rechtmäßigkeit, Transparenz, Zweckbindung, Datenminimierung, Richtigkeit, Speicherbegrenzung sowie Integrität und Vertraulichkeit sicherstellen.

Der Serverstandort ersetzt diese Prüfung nicht.

Welche Daten verarbeitet eine KI?

Bei generativer KI konzentriert sich die Aufmerksamkeit meist auf den Prompt. Tatsächlich umfasst die Verarbeitung deutlich mehr.

Je nach System können folgende Daten betroffen sein:

  • Eingaben und hochgeladene Dateien
  • Gesprächsverläufe
  • Unternehmensdokumente
  • personenbezogene Informationen in den Dokumenten
  • Textabschnitte und Embeddings eines RAG-Systems
  • generierte Antworten
  • Benutzerkonten und Berechtigungen
  • Nutzungs-, Fehler- und Sicherheitsprotokolle
  • Zwischenspeicher und Backups

Auch scheinbar harmlose Fragen können personenbezogene oder vertrauliche Informationen enthalten. Mitarbeitende kopieren beispielsweise Inhalte aus E-Mails, Verträgen, Tickets oder Personalunterlagen in das System. Damit wird aus einer allgemeinen KI-Anwendung schnell eine Verarbeitung von Kunden-, Beschäftigten- oder Geschäftsdaten. Embeddings sind ebenfalls nicht automatisch anonym. Können sie weiterhin einem Dokument, einer Person oder einem Datensatz zugeordnet werden, müssen sie entsprechend geschützt und in das Löschkonzept einbezogen werden.

Wer trägt die Verantwortung?

Das Unternehmen, das über Zweck und Einsatz der KI entscheidet, bleibt in der Regel datenschutzrechtlich verantwortlich. Das gilt auch dann, wenn das System von einem externen Anbieter entwickelt oder betrieben wird.

Ein Managed-Hosting-Anbieter kann als Auftragsverarbeiter tätig sein. Dafür braucht es einen Auftragsverarbeitungsvertrag, der Aufgaben, Weisungen, Schutzmaßnahmen, Löschung und den Einsatz weiterer Dienstleister regelt. Nutzt ein Anbieter Kundendaten hingegen für eigene Zwecke, etwa zur allgemeinen Produktverbesserung oder zum Training eigener Modelle, kann sich seine datenschutzrechtliche Rolle verändern. Entscheidend ist daher nicht die Produktbezeichnung, sondern die tatsächliche Verarbeitung:

  • Wer bestimmt den Zweck?
  • Wer entscheidet über die eingesetzten Mittel?
  • Wer hat administrativen Zugriff?
  • Wer darf Daten für eigene Zwecke verwenden?
  • Welche Unterauftragnehmer sind beteiligt?

Eine pauschale Aussage wie „Wir verwenden Ihre Daten nicht zum Training“ beantwortet diese Fragen noch nicht.

Ohne Zweck und Rechtsgrundlage kein zulässiger Betrieb

Vor dem Start muss feststehen, wofür das KI-System eingesetzt wird. Eine Formulierung wie „Nutzung künstlicher Intelligenz im Unternehmen“ ist dafür zu ungenau.

Der Zweck sollte den konkreten Anwendungsfall beschreiben, beispielsweise die Beantwortung interner Fragen auf Grundlage freigegebener technischer Dokumentationen. Erst danach lässt sich beurteilen, welche Daten wirklich notwendig sind und welche Rechtsgrundlage infrage kommt. Für personenbezogene Daten braucht es einen Rechtfertigungstatbestand nach Art. 6 DSGVO. Werden besondere Kategorien personenbezogener Daten verarbeitet, gelten zusätzlich die strengeren Anforderungen des Art. 9 DSGVO. Dazu zählen unter anderem Gesundheitsdaten, biometrische Daten sowie Informationen über politische oder religiöse Überzeugungen.
(Q: Bekanntmachung der Datenschutzbehörde zum Verhältnis zwischen der DSGVO und der Verordnung (EU) über künstliche Intelligenz (KI-VO) für Verantwortliche des privaten Bereichs)

Die österreichische Datenschutzbehörde weist außerdem darauf hin, dass die verantwortliche Stelle die Einhaltung der Datenschutzvorgaben nachweisen können muss. Dokumentation ist damit kein Nebenthema, sondern Teil der Rechenschaftspflicht. (Q: Informationen der Datenschutzbehörde für Verantwortliche des privaten Bereichs)

Was bedeutet ein wirklich lokaler Betrieb?

Bei einem vollständig lokalen System läuft nicht nur das Sprachmodell auf der vereinbarten Infrastruktur. Auch die angrenzenden Komponenten müssen berücksichtigt werden:

  • Dokumentenverarbeitung und Texterkennung
  • Embedding-Modell
  • Vektor-Datenbank
  • Benutzerverwaltung und Berechtigungen
  • Chat- und Sitzungsverläufe
  • Protokollierung und Monitoring
  • Backups und Wiederherstellung
  • Administrations- und Supportzugänge

Eine lokale Vektor-Datenbank reicht nicht, wenn Dokumentauszüge anschließend an ein externes Sprachmodell übertragen werden. Dasselbe gilt, wenn Embeddings über eine fremde Schnittstelle erstellt werden. Weitere Datenverbindungen können durch Telemetrie, Fehlerberichte, Inhaltsfilter oder Lizenzprüfungen entstehen. Ein belastbarer lokaler Betrieb muss ausgehende Verbindungen deshalb technisch kontrollieren und dokumentieren.

Datenstandort ist nicht gleich Datenhoheit

„Hosting in der EU“ sagt zunächst nur etwas über den physischen Speicherort aus. Offen bleibt, welchem Unternehmen die Plattform gehört, von wo aus Support geleistet wird und welche weiteren Parteien Zugriff erhalten können.

Bei externen Anbietern sollten Unternehmen mindestens prüfen:

  • Sitz und Konzernstruktur des Anbieters
  • Standorte aller beteiligten Systeme
  • Liste der Unterauftragnehmer
  • Fernwartungs- und Supportzugriffe
  • Übermittlungen in Staaten außerhalb des EWR
  • eingesetzte Vertrags- und Schutzmaßnahmen
  • Nutzung der Daten für Training oder Analyse
  • Löschfristen für produktive Daten und Backups

Ein europäischer Server verhindert keine Datenübermittlung, wenn die eigentliche Verarbeitung über eine externe API erfolgt.

Löschen betrifft mehr als den Chatverlauf

Personenbezogene Daten dürfen nicht unbegrenzt gespeichert werden. Unternehmen brauchen daher ein Löschkonzept, das alle Komponenten umfasst. Wird ein Dokument entfernt, müssen auch daraus erzeugte Chunks, Embeddings und Suchindizes berücksichtigt werden. Gleiches gilt für Chatverläufe, Protokolle, Zwischenspeicher und Sicherungskopien. In der Praxis wird genau dieser Punkt häufig unterschätzt. Ein Eintrag kann in der Benutzeroberfläche verschwunden sein und dennoch in einer Vektor-Datenbank, einem Fehlerprotokoll oder einem Backup weiterbestehen.

Der Anbieter sollte deshalb erklären können, wie eine Löschung technisch durchgeführt wird, welche Systeme davon betroffen sind und wann die Daten auch aus Backups verschwinden.

Wann braucht es eine Datenschutz-Folgenabschätzung?

Eine Datenschutz-Folgenabschätzung ist erforderlich, wenn eine Verarbeitung voraussichtlich ein hohes Risiko für die Rechte und Freiheiten natürlicher Personen mit sich bringt. Das kann etwa bei umfangreicher Verarbeitung sensibler Daten, systematischer Überwachung oder Bewertung von Personen der Fall sein. Besondere Vorsicht ist geboten, wenn eine KI Entscheidungen über Bewerbungen, Kredite, Versicherungen oder vergleichbare Bereiche vorbereitet oder automatisiert trifft.

In solchen Fällen reicht ein formaler menschlicher Klick am Ende des Prozesses möglicherweise nicht aus. Maßgeblich ist, welchen tatsächlichen Einfluss die KI auf die Entscheidung hat. Die Vorgaben zu automatisierten Entscheidungen nach Art. 22 DSGVO müssen gesondert geprüft werden.

Diese Fragen sollten vor dem Start beantwortet sein

Vor dem produktiven Einsatz einer KI sollten Unternehmen zumindest klären:

  • Welchen konkreten Zweck erfüllt das System?
  • Welche personenbezogenen Daten werden verarbeitet?
  • Welche Rechtsgrundlage gilt?
  • Wer ist Verantwortlicher und wer Auftragsverarbeiter?
  • Wo laufen Modell, RAG, Protokollierung und Backups?
  • Welche externen Verbindungen bestehen?
  • Wer besitzt administrative Zugriffsrechte?
  • Werden Daten für Training oder Produktverbesserung verwendet?
  • Wie werden Auskunft, Berichtigung und Löschung umgesetzt?
  • Ist eine Datenschutz-Folgenabschätzung notwendig?

Sind diese Fragen nicht eindeutig beantwortet, fehlt keine einzelne Datenschutzerklärung. Es fehlt die Grundlage für einen kontrollierten Betrieb.

Fazit: Lokal ist ein Vorteil, aber kein Freibrief

Lokales KI-Hosting reduziert Abhängigkeiten und erleichtert die Kontrolle über Datenflüsse. DSGVO-Konformität entsteht aber erst durch einen klaren Zweck, eine passende Rechtsgrundlage, dokumentierte Verantwortlichkeiten und technische Schutzmaßnahmen. Entscheidend ist nicht nur, wo der KI-Server steht. Entscheidend ist, wer an welcher Stelle welche Daten verarbeitet und ob diese Verarbeitung nachvollziehbar, begrenzt und überprüfbar bleibt.

Sie möchten eine KI-Infrastruktur in Österreich betreiben und die Datenflüsse nachvollziehbar halten? Wir unterstützen bei der technischen Planung und beim kontrollierten Betrieb von Managed AI Hosting.

Weiterführende Quellen