Anonymisierung
KI-Glossar
Der Prozess, personenbezogene Daten so zu verändern, dass eine Zuordnung zu einer natürlichen Person dauerhaft und unwiderruflich ausgeschlossen ist.
Kurzdefinition
Anonymisierung bezeichnet Verfahren, durch die personenbezogene Daten so verändert werden, dass die betroffene Person weder direkt noch indirekt identifiziert werden kann – auch nicht mit zusätzlichen Informationen. Vollständig anonymisierte Daten gelten nach der DSGVO nicht mehr als personenbezogen und unterliegen damit nicht mehr den datenschutzrechtlichen Anforderungen.
Einfach erklärt
Anonymisierung bedeutet, Daten dauerhaft von ihrer Quelle zu trennen: Ein anonymisierter Datensatz lässt keine Rückschlüsse mehr auf einzelne Personen zu – weder direkt durch Namen oder Adresse, noch indirekt durch Kombination anderer Merkmale. Das unterscheidet sie von Pseudonymisierung, bei der eine Re-Identifikation mit Zusatzwissen prinzipiell möglich bleibt.
Echte Anonymisierung ist technisch anspruchsvoll. In der Praxis werden oft Verfahren wie Datenaggregation, Rauschen (Noise-Hinzufügen) oder Generalisierung eingesetzt. Ob eine Anonymisierung tatsächlich irreversibel ist, hängt von der verfügbaren Zusatzinformation und der Qualität des Verfahrens ab. Die Beurteilung, ob eine Anonymisierung im datenschutzrechtlichen Sinne vorliegt, sollte im Zweifel fachlich und rechtlich geprüft werden.
Beispiel aus dem Arbeitsalltag
Ein Forschungsinstitut möchte KI-Modelle auf Gesundheitsdaten trainieren. Um den Datenschutz zu wahren, werden die Datensätze anonymisiert: Namen und Geburtsdaten werden entfernt, Wohnorte auf Kreisebene verallgemeinert und seltene Merkmalskombinationen, die auf Einzelpersonen schließen lassen könnten, aggregiert. Das Ergebnis wird vor der Weitergabe auf Re-Identifikationsrisiken geprüft.
Warum ist der Begriff wichtig?
Vollständig anonymisierte Daten unterliegen nach aktuellem Verständnis nicht mehr der DSGVO. Das kann für KI-Projekte erhebliche Erleichterungen bedeuten – sofern die Anonymisierung tatsächlich irreversibel ist.
Die Einschätzung, ob Daten wirklich anonym sind, ist anspruchsvoll und fehleranfällig. Organisationen sollten bei der Nutzung vermeintlich anonymisierter Daten für KI-Projekte besondere Sorgfalt walten lassen.
Chancen
- Anonym gewordene Daten können für KI-Training und Forschung genutzt werden
- Datenschutzrisiken werden dauerhaft eliminiert
- Datennutzung in Kontexten möglich, in denen Personenbezug ausgeschlossen sein muss
Risiken und typische Fehler
- Scheinbar anonymisierte Daten können durch Kombination re-identifizierbar sein
- Technisch anspruchsvolle Verfahren sind nicht immer zugänglich
- Zu starke Anonymisierung kann Nutzwert der Daten für KI-Training verringern
- Rechtliche Beurteilung, ob echte Anonymität vorliegt, ist im Einzelfall komplex
Verwandte Begriffe
Passende Inhalte im KI College
Lernen Sie Schritt für Schritt, wie Sie KI im Arbeitsalltag sinnvoll nutzen.
Use CasesKI im Arbeitsalltag anwenden
Entdecken Sie praktische Beispiele für typische Aufgaben im Beruf.
ToolsKI-Tools im Überblick
Finden Sie heraus, welche Tools zu welchen Aufgaben passen.
