KI-Agenten und DSGVO: was Unternehmen vor dem Start klären sollten
Personenbezogene Daten im Prompt, Auftragsverarbeitung, Drittland, Löschung und Transparenz: was vor dem Livegang eines KI-Agenten geklärt sein sollte.
Ein KI-Agent verarbeitet fast immer personenbezogene Daten: Name, Nachrichten, Bestellungen, Vorlieben. Das ist mit der DSGVO vereinbar, wenn es von Anfang an mitgedacht wird. Nachträglich wird es teuer. Dieser Artikel sammelt die Punkte, die ich mit Kunden vor dem Bau eines Agenten kläre, aus Sicht der Technik.
Welche Daten fließen wohin?
Bevor über Paragrafen gesprochen wird, braucht es eine einfache Übersicht. Bei jedem Agenten frage ich:
- Was schreibt der Nutzer in den Chat, und was könnte er schreiben?
- Welche Daten aus deinem System landen im Kontext des Modells?
- Was geben die Werkzeuge zurück, und was davon braucht das Modell wirklich?
- Was wird gespeichert, wo, und wie lange?
- Welche externen Dienste sind beteiligt (Modellanbieter, Vektordatenbank, Logging)?
Aus dieser Übersicht ergeben sich der Eintrag im Verzeichnis von Verarbeitungstätigkeiten, die Rechtsgrundlage (bei einer Funktion, die der Nutzer aktiv verwendet, häufig die Vertragserfüllung nach Art. 6 Abs. 1 lit. b DSGVO) und die Frage, ob eine Datenschutz-Folgenabschätzung nötig ist.
Modellanbieter: Vertrag und Drittland
Der Anbieter des Sprachmodells verarbeitet die Daten in deinem Auftrag. Dafür brauchst du einen Auftragsverarbeitungsvertrag (Art. 28 DSGVO). Die großen Anbieter stellen ihn für ihre Geschäftskunden-Schnittstellen bereit, meist als Teil der Vertragsbedingungen.
Darüber hinaus zu prüfen:
- Training: Ist vertraglich ausgeschlossen, dass deine Eingaben zum Training der Modelle verwendet werden? Bei den API-Zugängen für Unternehmen ist das üblich, bei Verbraucherprodukten nicht unbedingt. Deshalb nie das Chatfenster eines Endkundenprodukts für Kundendaten nutzen.
- Speicherdauer beim Anbieter: Wie lange werden Anfragen zur Missbrauchserkennung aufbewahrt, und lässt sich das verkürzen?
- Drittland: Sitzt der Anbieter in den USA, braucht es eine Grundlage für die Übermittlung, etwa die Zertifizierung nach dem EU-US Data Privacy Framework oder Standardvertragsklauseln. Einige Anbieter bieten inzwischen Verarbeitung in europäischen Rechenzentren an.
Datenminimierung im Prompt
Der einfachste Datenschutz ist der, der gar nicht erst nötig wird. Ein Agent braucht erstaunlich selten den echten Namen oder die E-Mail-Adresse eines Nutzers:
- Statt des Profils eine knappe Zusammenfassung in den Kontext geben, etwa „mag Sport und Konzerte, meist abends aktiv".
- Interne IDs statt Namen verwenden. Die Werkzeuge im Backend lösen sie auf, das Modell sieht sie nie im Klartext.
- Werkzeugergebnisse auf die Felder kürzen, die für die Antwort nötig sind.
- Für Ähnlichkeitssuchen (Embeddings) nur die Felder einbetten, die der Suche dienen, und das in der Datenschutzerklärung nennen.
Nebeneffekt: Weniger Kontext heißt auch geringere Kosten pro Anfrage. Datenschutz und Wirtschaftlichkeit ziehen hier an einem Strang.
Gedächtnis, Auskunft und Löschung
Merkt sich der Agent etwas über Nutzer, gelten dafür dieselben Rechte wie für alle anderen Daten: Auskunft (Art. 15), Berichtigung (Art. 16) und Löschung (Art. 17). Technisch heißt das:
- Gemerkte Vorlieben in einer eigenen, lesbaren Tabelle speichern, nicht verstreut in Gesprächsprotokollen.
- In der App eine Ansicht „Was der Assistent über dich weiß" anbieten, mit Löschen pro Eintrag und für alles.
- Beim Löschen des Kontos auch Gedächtnis, Interaktionsdaten und Embeddings entfernen. Das wird gern vergessen, weil diese Daten in anderen Tabellen oder Diensten liegen.
- Gesprächsverläufe nur so lange aufbewahren, wie sie gebraucht werden, und Fristen im Code durchsetzen, nicht nur in der Richtlinie.
Transparenz und AI Act
Nutzer müssen erfahren, dass sie mit einer KI sprechen und welche Daten dabei wohin gehen. Die Datenschutzerklärung nennt den Modellanbieter als Empfänger, den Zweck und die Speicherdauer.
Dazu kommt die europäische KI-Verordnung (AI Act). Nach dem Stand bei Veröffentlichung gelten ihre Transparenzpflichten seit August 2026: KI-Systeme, die direkt mit Menschen interagieren, müssen so gestaltet sein, dass Nutzer wissen, dass sie mit einer KI sprechen, sofern das nicht ohnehin offensichtlich ist. Ein gut sichtbarer Hinweis im Chat und ein erkennbarer Name für den Assistenten erledigen das in der Praxis.
Automatisierte Entscheidungen
Art. 22 DSGVO setzt Grenzen, wenn ein System ohne menschliche Beteiligung Entscheidungen trifft, die Menschen rechtlich oder ähnlich erheblich betreffen, etwa eine Kreditentscheidung oder eine Bewerberauswahl. Für solche Fälle ist ein Agent, der allein entscheidet, die falsche Bauweise. Die bessere: Der Agent bereitet vor, ein Mensch entscheidet.
Für die meisten Alltagsaufgaben (Events empfehlen, Termine vorschlagen, Fragen beantworten) greift das nicht. Das Prinzip „vorschlagen, bestätigen lassen" ist aber auch dort die richtige Grundhaltung, wie ich in KI-Agent in die eigene App integrieren beschreibe.
Checkliste vor dem Livegang
- Datenflüsse dokumentiert, Verarbeitungsverzeichnis ergänzt
- Rechtsgrundlage pro Zweck festgelegt
- Auftragsverarbeitungsvertrag mit dem Modellanbieter abgeschlossen
- Grundlage für Drittlandübermittlung geprüft, Training ausgeschlossen
- Kontext und Werkzeugergebnisse auf das Nötige gekürzt
- Gedächtnis einsehbar und löschbar, Kontolöschung räumt alles ab
- Speicherfristen für Verläufe und Logs im Code umgesetzt
- KI im Chat klar gekennzeichnet, Datenschutzerklärung aktualisiert
- Keine allein automatisierten Entscheidungen mit erheblicher Wirkung
- Bei sensiblen Daten (Gesundheit, Religion u. ä.): Folgenabschätzung geprüft
Wenn diese Punkte von Anfang an im Konzept stehen, kosten sie kaum zusätzliche Entwicklungszeit. Eine Übersicht, was die Entwicklung insgesamt kostet, findest du in Was kostet ein eigener KI-Agent?
Häufige Fragen
Darf ich einen KI-Agenten mit einem US-Anbieter DSGVO-konform betreiben?
Grundsätzlich ja, mit Auftragsverarbeitungsvertrag, einer Grundlage für die Drittlandübermittlung wie dem EU-US Data Privacy Framework oder Standardvertragsklauseln, ausgeschlossenem Training auf deinen Daten und einer passenden Datenschutzerklärung. Einige Anbieter bieten auch Verarbeitung in der EU an.
Muss ich kennzeichnen, dass Nutzer mit einer KI sprechen?
Ja. Nach den Transparenzpflichten des AI Act, die seit August 2026 gelten, müssen Nutzer erkennen können, dass sie mit einem KI-System interagieren, sofern das nicht offensichtlich ist. Ein sichtbarer Hinweis im Chat reicht in der Praxis meist aus.
