Datenschutz bei KI-Umfragen: Was darf an ChatGPT & Co.?

Wann Umfragedaten an eine KI gehen dürfen: DSGVO, Betriebsrat, AI Act und Anbieterzusagen im Überblick, mit sieben Regeln für datensparsame KI-Umfragen.

Philipp Hund

Philipp Hund

Geschäftsführer IWOP, leitet die Entwicklung von Survkit

Aktualisiert: Oktober 2026

Welche Daten bekommt eine KI zu sehen, wenn sie eine Umfrage baut oder auswertet, und darf sie das? Bei einer Mitarbeiterbefragung oder einem Führungsfeedback geht es um Meinungen von Beschäftigten über ihre Arbeit und ihre Vorgesetzten. Wer solche Antworten unbedacht in einen KI-Chat kopiert, hat schnell ein Problem, mit dem Datenschutz, mit dem Betriebsrat und mit dem Vertrauen der Teilnehmenden.

Dieser Beitrag zeigt, an welchen Stellen eine KI bei Umfragen überhaupt mit Daten in Berührung kommt, was DSGVO, Betriebsverfassung und AI Act dazu sagen, was die großen KI-Anbieter zusagen und wie sich eine Befragung so bauen lässt, dass die KI möglichst wenig zu sehen bekommt. Er gibt den Stand Oktober 2026 wieder und ersetzt keine Rechtsberatung im Einzelfall.

Drei Stellen, an denen die KI Daten bekommt

Wie heikel KI bei einer Umfrage ist, hängt davon ab, wofür sie eingesetzt wird. Drei Stellen lassen sich unterscheiden.

Beim Bauen

Die KI entwirft Fragen, baut die Oberfläche der Befragung, das Dashboard und den Bericht. Dafür braucht sie das Ziel der Befragung, die Themen, vielleicht einen bestehenden Fragebogen. Personenbezogene Daten braucht sie dafür in aller Regel nicht. Um Dashboard und Bericht zu prüfen, reichen erfundene Testdaten. Diese Stelle ist am leichtesten datensparsam zu gestalten.

Beim Auswerten

Die meisten Auswertungen brauchen gar keine KI. Welche Kennzahlen, Grafiken und Vergleiche ein Dashboard oder Bericht zeigt, lässt sich vorher festlegen. Die Statistik rechnet sie dann nach festen Regeln aus, jedes Mal gleich und nachvollziehbar. Auch wenn eine KI das Dashboard gebaut hat: Im Betrieb rechnet es ohne KI. Offene Antworten lassen sich ebenfalls einfach anzeigen, etwa als Liste von Kommentaren im Bericht, sofern die Teilnehmenden vorher klar darauf hingewiesen wurden, dass ihre Kommentare im Wortlaut weitergegeben werden.

Wirklich stark ist KI bei den offenen Antworten: Hunderte Kommentare zusammenfassen, Themen zuordnen, Stimmungen und Muster erkennen, in Minuten statt in Tagen. Das ist längst verbreitete Praxis; spezialisierte Anbieter werten auf diese Weise die Kommentare aus Mitarbeiter- und Kundenbefragungen auch für große Unternehmen aus. Datenschutzrechtlich ist das gut machbar, wenn es sauber aufgesetzt ist. Man muss nur wissen, dass Freitexte personenbezogene Daten sind, auch ohne Namen: Der Europäische Gerichtshof hat 2025 festgehalten, dass persönliche Meinungen zwangsläufig eng mit der Person verknüpft sind, die sie äußert. Und die Datenschutzkonferenz von Bund und Ländern (DSK) weist in ihrer Orientierungshilfe zu KI darauf hin, dass es regelmäßig nicht reicht, Namen und Anschriften zu entfernen, weil sich Personen auch aus dem Zusammenhang erkennen lassen.

Die übliche Lösung besteht aus wenigen Bausteinen: Identifizierende Angaben wie Namen, E-Mail-Adressen oder Orte werden automatisch entfernt, bevor die Kommentare an die KI gehen. Der KI-Dienst arbeitet mit Auftragsverarbeitungsvertrag, ohne Training mit den Daten und am besten in der EU. Und die Ergebnisse gehen als Themen und Zusammenfassungen an die Empfänger, nicht als Rohtext. Gerade das ist ein Gewinn für die Anonymität: Eine gute Zusammenfassung verrät weniger über einzelne Personen als eine Liste von Kommentaren im Wortlaut.

In der Befragung selbst

Die KI ist Teil der Befragung, etwa als Gesprächspartner, der nachfragt, oder als Sprachassistent. Dann fließen die Antworten während der Befragung an einen KI-Dienst. Das ist möglich, aber es ist die Stelle mit dem meisten Klärungsbedarf: Die Teilnehmenden müssen es wissen, und der Dienst muss die gleichen Anforderungen erfüllen wie jeder andere Auftragsverarbeiter.

Was die DSGVO verlangt, sobald Antworten an eine KI gehen

Sobald Antworten an eine KI gehen, gelten die üblichen Regeln der DSGVO. Die KI ist datenschutzrechtlich kein Sonderfall, nur ein weiterer Empfänger. Fünf Punkte sind entscheidend.

Anonym oder nur pseudonym?

Anonyme Daten fallen nicht unter die DSGVO, pseudonymisierte schon (Erwägungsgrund 26). Bei Befragungen lohnt es sich, drei Begriffe auseinanderzuhalten, die wir im Beitrag zur anonymen Mitarbeiterbefragung ausführlich erklären:

  • Anonym: Eine Antwort lässt sich keiner Person zuordnen, auch nicht von denen, die das System betreiben.
  • Pseudonym: Die Antworten hängen an einem Code statt an einem Namen. Wer den Schlüssel hat, kann zuordnen.
  • Vertraulich: Die Identität ist bekannt, wird aber nicht weitergegeben. Das ist ein Versprechen, keine technische Eigenschaft.

Eine Umfrage ohne Namen ist deshalb nicht automatisch anonym. Maßstab ist, ob sich eine Person mit Mitteln identifizieren lässt, die nach allgemeinem Ermessen wahrscheinlich genutzt werden. Die europäischen Datenschutzbehörden haben schon 2014 festgehalten, dass Pseudonymisierung keine Anonymisierungsmethode ist. In einer Abteilung mit acht Personen reichen oft Altersgruppe und Betriebszugehörigkeit, um eine Antwort zuzuordnen.

Für den KI-Einsatz ist das entscheidend: Was an eine KI geht, ist nur dann unkritisch, wenn es wirklich anonym ist. Bei Survkit lässt sich das je Projekt einstellen. Antworten können beim Abschluss des Fragebogens dauerhaft von der Person getrennt werden, Zeitstempel werden dabei gerundet; alternativ lassen sich Namen und E-Mail-Adressen nach Abschluss löschen. In der Auswertung setzt der Statistikkern eine Mindestgruppengröße durch, unterdrückt zu kleine Zellen und verhindert, dass sich kleine Gruppen über Filter zurückrechnen lassen. Welche Werte ein Projekt wählt, legt es selbst fest.

Rechtsgrundlage, Zweck und Datenminimierung

Jede Verarbeitung braucht eine Rechtsgrundlage, und nach der DSK gilt das für die Verarbeitung durch die KI und für die Übermittlung an den KI-Anbieter jeweils gesondert. Dazu kommen Zweckbindung und Datenminimierung (Art. 5 DSGVO): Wer Freitexte kategorisieren lassen will, schickt der KI die Freitexte, nicht die ganze Teilnehmerliste.

Auftragsverarbeitung und Training

Ein KI-Dienst in der Cloud ist nach Einschätzung der DSK oft ein Auftragsverarbeiter. Dann braucht es einen Vertrag nach Art. 28 DSGVO. Außerdem ist zu prüfen, ob der Anbieter Eingaben zum Training seiner Modelle nutzt. Die DSK hält Systeme, die Eingaben nicht zum Training verwenden, und geschlossene Systeme in einer kontrollierten Umgebung für vorzugswürdig. Wo Training möglich ist, sollte es standardmäßig ausgeschaltet sein.

Übermittlung in Drittländer

Verarbeitet der Anbieter Daten außerhalb der EU, gelten die Art. 44 ff. DSGVO. Für die USA gibt es seit 2023 einen Angemessenheitsbeschluss (Data Privacy Framework). Das Gericht der EU hat eine Klage dagegen im September 2025 abgewiesen; ein Rechtsmittel beim Gerichtshof ist nach unserer Kenntnis noch anhängig. Wer auf Nummer sicher gehen will, wählt eine Verarbeitung in der EU oder ein selbst betriebenes Modell.

Gesundheitsdaten und Datenschutz-Folgenabschätzung

Manche Befragungen berühren Gesundheitsdaten, zu denen nach Art. 4 Nr. 15 DSGVO auch die psychische Gesundheit gehört. Ein typisches Beispiel ist die Befragung zur psychischen Belastung im Rahmen der Gefährdungsbeurteilung. Ob die Antworten dort Gesundheitsdaten im Sinne von Art. 9 DSGVO sind, hängt von den Fragen ab. Werden solche Daten umfangreich verarbeitet, ist eine Datenschutz-Folgenabschätzung Pflicht (Art. 35 DSGVO). Die DSK geht davon aus, dass eine Folgenabschätzung beim KI-Einsatz vielfach erforderlich sein wird.

Mitarbeiterbefragungen: Betriebsrat und Beschäftigtendaten

Bei Befragungen von Beschäftigten kommt das Arbeitsrecht dazu. Der Betriebsrat bestimmt nach § 87 Abs. 1 Nr. 6 BetrVG mit, wenn technische Einrichtungen dazu bestimmt sind, Verhalten oder Leistung zu überwachen. Eine KI, die Antworten von Beschäftigten auswertet, wird diese Frage fast immer aufwerfen. Muss der Betriebsrat eine Einführung oder Anwendung von KI beurteilen, gilt die Hinzuziehung eines Sachverständigen nach § 80 Abs. 3 BetrVG als erforderlich. Mehr zur Rolle des Betriebsrats steht in unserem Beitrag Mitarbeiterbefragung und Betriebsrat.

Bei der Rechtsgrundlage für Beschäftigtendaten ist seit einem Urteil des EuGH von 2023 vieles in Bewegung; ein eigenes Beschäftigtendatenschutzgesetz gibt es bisher nicht. Für die Praxis heißt das: Die Rechtsgrundlage mit der Datenschutzbeauftragten klären und den KI-Einsatz in der Betriebsvereinbarung zur Befragung ausdrücklich regeln. Die DSK empfiehlt außerdem, für dienstliche KI-Nutzung dienstliche Konten bereitzustellen statt private. Am einfachsten bleibt aber der Weg vom Anfang dieses Beitrags: Wer die KI nur zum Bauen einsetzt und ihr vor dem Start den Zugang entzieht, gibt ihr keine Daten von Beschäftigten. Dann stellt sich die KI-Frage für Betriebsrat und Datenschutz gar nicht erst; zu regeln bleibt nur die Befragung selbst, wie bei jeder Mitarbeiterbefragung.

Und der AI Act?

Die europäische KI-Verordnung ist mit dem sogenannten Digital-Omnibus geändert worden; die Änderungsverordnung ist seit dem 27. Juli 2026 in Kraft. Die Pflichten für Hochrisiko-Systeme nach Anhang III gelten danach erst ab dem 2. Dezember 2027.

Zu den Hochrisiko-Bereichen gehört KI, die bestimmungsgemäß die Leistung und das Verhalten von Beschäftigten beobachten und bewerten soll. Nach unserer Einschätzung fällt eine KI, die einen Fragebogen entwirft oder anonyme, zusammengefasste Freitexte nach Themen ordnet, nicht darunter. Anders kann es aussehen, wenn eine KI die Antworten einzelner Beschäftigter nutzt, um diese Personen zu bewerten. Das sollte eine Mitarbeiterbefragung ohnehin nie tun.

Schon jetzt gilt Art. 4 der Verordnung: Wer KI einsetzt, soll die KI-Kompetenz der Beschäftigten unterstützen, die damit arbeiten. Für Umfragen heißt das vor allem: Wer mit KI Befragungen baut oder auswertet, sollte wissen, welche Daten wohin gehen.

Was die großen KI-Anbieter zusagen

Die Bedingungen der Anbieter unterscheiden sich vor allem zwischen Verbraucher- und Geschäftsangeboten. Die folgende Übersicht gibt die Angaben der Anbieter auf ihren eigenen Seiten wieder (Stand Oktober 2026); sie ersetzt nicht den Blick in den konkreten Vertrag.

Angebot Training mit Ihren Eingaben Verarbeitung in der EU
OpenAI API nein, außer Sie stimmen zu über einen eigenen europäischen Endpunkt, mit zusätzlichen Voraussetzungen
Anthropic, Geschäftsangebote und API standardmäßig nein keine allgemeine Zusage auf dieser Seite
Anthropic, Verbraucherangebote nach Wahl der Nutzenden keine Zusage
Microsoft 365 Copilot keine Nutzung für das Training der Basismodelle EU Data Boundary, Modelle von Anthropic derzeit ausgenommen
Azure OpenAI nein mit einer Bereitstellung in der EU-Datenzone
Gemini in Google Workspace nicht ohne vorherige Erlaubnis keine Zusage auf dieser Seite

Eine dritte Möglichkeit fehlt in dieser Tabelle, weil sie kein einzelner Anbieter ist: offene Modelle, die Sie selbst betreiben oder bei einem Rechenzentrumsbetreiber in Deutschland laufen lassen. Dann bleiben die Daten in einer Umgebung, die Sie kennen, und die Fragen nach Training und Drittland stellen sich nicht oder nur so, wie Sie es vertraglich regeln.

Anonymität: Worauf es bei kleinen Gruppen und Freitexten ankommt

Anonymität entscheidet sich nicht beim Ausfüllen, sondern bei der Auswertung. Auf zwei Dinge kommt es dabei an:

  • Kleine Gruppen. Wie viel ein Ergebnis über Einzelne verrät, hängt von der Gruppengröße ab und davon, welche Statistik gezeigt wird. Ein Mittelwert aus fünf Antworten lässt meist nur grobe Schlüsse zu. Eine Häufigkeitsverteilung aus fünf Antworten kann dagegen schon alles zeigen: Steht dort „100 % trifft nicht zu“, kennt man jede einzelne Antwort. Und wer selbst zur Gruppe gehört, weiß mehr als Außenstehende: Bei drei Personen und einem bekannten Mittelwert lassen sich mit der eigenen Antwort die beiden anderen schon stark eingrenzen. Deshalb braucht jede Auswertung eine Mindestgruppengröße, und sie sollte zu den gezeigten Statistiken passen: für Verteilungen und Prozentwerte eher höher als für Mittelwerte. Dazu kommt der Schutz vor dem Rückrechnen, wenn sich aus zwei zulässigen Zahlen eine kleinere Gruppe ableiten lässt.
  • Freitexte. Ein einzelner Satz kann eine Person verraten, auch in einer großen Gruppe, weil Kolleginnen und Kollegen Zusammenhänge kennen, die Außenstehenden fehlen. Freitexte verdienen deshalb einen genauen Blick, bevor sie im Wortlaut gezeigt werden.

Für KI heißt das zweierlei. Erstens beim Hineingeben: Die KI sollte die Kommentare so bekommen, dass sie möglichst wenig über die Personen dahinter erfährt. Also Namen, E-Mail-Adressen und auffällige Details vorher entfernen und nur den Text schicken, ohne Teilnehmerkennung und ohne die übrigen Antworten derselben Person. Merkmale wie Abteilung oder Altersgruppe gehören nur dazu, wenn die Auswertung sie wirklich braucht, und dann nur für Gruppen über der Mindestgröße. Auch so bereinigte Kommentare bleiben in der Regel personenbezogen; für den KI-Dienst gelten deshalb die Anforderungen aus dem Abschnitt zur DSGVO.

Zweitens beim Herausgeben: Die KI kann die Anonymität bei Freitexten stärken oder schwächen, je nachdem, wie sie eingesetzt wird. Richtig eingesetzt findet sie Namen, Orte und auffällige Details in vielen Kommentaren zuverlässig, schwärzt sie und fasst Aussagen so zusammen, dass das Thema ankommt, ohne dass die Person dahinter erkennbar ist. Unbedacht eingesetzt zitiert sie einen verräterischen Satz wörtlich oder fasst die Kommentare einer Gruppe zusammen, die unter der Mindestgröße liegt. Deshalb gelten für Zusammenfassungen dieselben Regeln wie für Zahlen. Und eine automatische Schwärzung erkennt nicht alles: Wer im Team als einzige Person eine bestimmte Aufgabe hat, verrät sich auch ohne Namen. Wo Kommentare im Wortlaut weitergegeben werden, lohnt deshalb zusätzlich der Blick eines Menschen. Wie die Mindestgruppengröße in der Praxis funktioniert, zeigt unser Beitrag zur Auswertung kleiner Einheiten.

Und eine Einschränkung gilt immer, mit oder ohne KI: Wer eine Befragung administriert oder bauen darf, kann grundsätzlich an die Daten kommen. Die Garantien einer Mindestgruppengröße gelten für die Empfängerinnen und Empfänger von Ergebnissen, nicht für die Administration. Halten Sie diesen Kreis klein und sagen Sie offen, wer dazugehört. Mehr dazu im Beitrag zur anonymen Mitarbeiterbefragung.

Sieben Regeln für datensparsame KI-Umfragen

  1. Mit Testdaten bauen. Fragebogen, Oberfläche, Dashboard und Bericht lassen sich vollständig mit erfundenen Daten bauen und prüfen. Echte Antworten braucht die KI dafür nicht.
  2. Der KI vor dem Start den Zugang entziehen. Wenn die Befragung abgenommen ist, wird der Zugang der KI widerrufen. Dann läuft die Befragung ohne KI, und niemand muss sich fragen, was sie während der Feldphase sehen könnte.
  3. KI im Betrieb nur für eine benannte Aufgabe. Sollen offene Antworten kategorisiert werden, bekommt die KI genau dafür Rechte, für genau diese Daten, für genau diesen Zeitraum.
  4. Den Anbieter bewusst wählen. Auftragsverarbeitungsvertrag, kein Training mit Ihren Daten, Verarbeitung in der EU oder ein selbst betriebenes Modell. Keine privaten Konten.
  5. Freitexte automatisch anonymisieren. Namen, Orte und auffällige Details werden entfernt, bevor Kommentare an die KI oder an Empfänger gehen. Wo ein Zitat zu viel verrät, ist eine Zusammenfassung oder ein umschriebenes Beispiel die bessere Wahl.
  6. Eine Mindestgruppengröße festlegen. Ergebnisse für Gruppen unterhalb der Schwelle werden nicht gezeigt, auch nicht in Zusammenfassungen einer KI.
  7. Betriebsrat und Datenschutz früh einbinden. Den KI-Einsatz in der Betriebsvereinbarung regeln, das Verzeichnis der Verarbeitungstätigkeiten ergänzen, die Notwendigkeit einer Folgenabschätzung prüfen und die Teilnehmenden informieren.

Wie Survkit das umsetzt

Survkit ist eine KI-native Umfrageplattform: Die KI baut die Befragung, die Plattform stellt Teilnehmerverwaltung, Rechte und Statistik. Was das bedeutet, erklärt unser Beitrag zur KI-nativen Umfrageplattform. Für den Datenschutz heißt es konkret:

  • KI Ihrer Wahl. Sie bauen mit dem Survkit Agent oder bringen Ihre eigene KI mit, auch ein selbst gehostetes Modell oder eines bei einem deutschen Anbieter. Sie arbeitet über die Programmierschnittstelle, über MCP oder im Chat auf der Plattform. Den Survkit Agent müssen Sie nie nutzen.
  • Feingranulare Zugänge. Jeder KI-Zugang gilt für genau ein Projekt und bekommt nur die Rechte, die Sie freigeben. Einzelne Antworten und offene Kommentare sind eigene Rechte, die in der empfohlenen Voreinstellung nicht enthalten sind. Ein widerrufener Zugang ist ab der nächsten Anfrage gesperrt.
  • Testdaten statt echter Antworten. Die Plattform erzeugt realistische Beispieldaten, getrennt von echten Teilnehmenden, damit Dashboard und Bericht vor dem Start geprüft werden können.
  • Mindestgruppe im Statistikkern. Die Mindestgruppengröße legt jedes Projekt selbst fest, durchgesetzt wird sie in der Statistik-Engine. Jedes Dashboard und jeder Bericht bekommt nur Ergebnisse, die diese Prüfung bestanden haben.
  • Offene Antworten mit Anonymitätsprüfung. Kommentare lassen sich Themen zuordnen, auf identifizierende Inhalte prüfen, geschwärzt ausspielen oder durch umschriebene Beispiele ersetzen.
  • Kontrollierte Verbindungen. Eine Befragung, die einen KI-Dienst nutzt, etwa für einen Sprachassistenten, erreicht nur Adressen, die für das Projekt freigegeben sind. Den Zugangsschlüssel hinterlegt die Administration auf dem Server; die Befragung selbst bekommt ihn nie zu sehen.
  • Hosting in Deutschland. Server in ISO/IEC-27001-zertifizierten Rechenzentren, Auftragsverarbeitungsvertrag, Self-Hosting möglich.

Häufige Fragen

Darf ich Umfrageantworten in ChatGPT kopieren?

Nicht ohne Weiteres. Antworten, vor allem Freitexte, sind personenbezogene Daten. Es braucht eine Rechtsgrundlage, in der Regel einen Auftragsverarbeitungsvertrag mit dem Anbieter, und Sie sollten sicher sein, dass Ihre Eingaben nicht zum Training genutzt werden. Mit einem privaten Konto fehlt in aller Regel schon der Vertrag.

Ist eine anonyme Umfrage automatisch DSGVO-frei?

Nur, wenn sie wirklich anonym ist. Eine Umfrage ohne Namen ist es nicht automatisch: Kleine Gruppen, Merkmale wie Abteilung und Alter oder ein verräterischer Freitext können eine Person identifizierbar machen. Dann sind die Antworten personenbezogene Daten, und die DSGVO gilt.

Braucht es einen AV-Vertrag mit dem KI-Anbieter?

Wenn der Anbieter personenbezogene Daten in Ihrem Auftrag verarbeitet, ja. Die Datenschutzkonferenz sieht Cloud-KI-Anbieter häufig in dieser Rolle. Bauen Sie die Befragung nur mit Testdaten und entziehen der KI vor dem Start den Zugang, gehen an die KI keine Antworten.

Muss der Betriebsrat zustimmen?

Bei Befragungen von Beschäftigten hat der Betriebsrat in der Regel mitzubestimmen, sobald die eingesetzte Technik dazu bestimmt sein kann, Verhalten oder Leistung zu überwachen. Am einfachsten ist es, den KI-Einsatz in der Betriebsvereinbarung zur Befragung ausdrücklich zu regeln: wofür KI eingesetzt wird, welche Daten sie sieht und welche nicht.

Ist die KI-Auswertung einer Mitarbeiterbefragung Hochrisiko-KI nach dem AI Act?

Nach unserer Einschätzung nicht, solange die KI zusammengefasste, anonyme Ergebnisse ordnet und keine einzelnen Beschäftigten bewertet. Die Pflichten für Hochrisiko-Systeme im Beschäftigungsbereich gelten ohnehin erst ab Dezember 2027. Im Zweifel lohnt die Prüfung im Einzelfall.