Eines Tages googeln Sie Ihre Marke, und alles sieht gut aus. Dann fragen Sie ChatGPT danach und bekommen eine Antwort, die teils falsch, teils veraltet und teils auf Inhalten aufgebaut ist, deren Weitergabe Sie nie zugestimmt haben. Jetzt wollen Sie diese KI-Daten löschen lassen, gestützt auf die DSGVO. Oder sie zumindest korrigieren.
Willkommen an einer der chaotischsten Schnittstellen der Tech-Welt: Ihre Daten, KI-Modelle und die Gesetze, die Sie eigentlich schützen sollen.
Was die DSGVO tatsächlich über KI-Trainingsdaten sagt
Art. 17 DSGVO, das „Recht auf Löschung" oder „Recht auf Vergessenwerden", gibt Personen in der EU das Recht, die Löschung ihrer personenbezogenen Daten zu verlangen. Art. 16 regelt das Recht auf Berichtigung unrichtiger Daten. Beide gelten für KI-Unternehmen, die personenbezogene Daten von Personen in der EU verarbeiten.
Der Haken ist praktischer, nicht rechtlicher Natur. Wenn Ihre Daten zum Training eines großen Sprachmodells verwendet werden, liegen sie nicht in einer Datenbankzeile, die man löschen kann. Sie stecken in Milliarden von Modellparametern. Sie aus einem trainierten Modell zu „löschen" ist technisch etwas anderes, als einen Datensatz aus einer klassischen Datenbank zu entfernen, und die Branche arbeitet noch daran, wie Compliance hier tatsächlich aussieht.
Die rechtliche Pflicht besteht trotzdem. KI-Unternehmen müssen auf DSGVO-Anträge reagieren, und Aufsichtsbehörden in ganz Europa haben klargemacht, dass sie das ernst nehmen. Italien hat ChatGPT 2023 wegen DSGVO-Bedenken vorübergehend gesperrt. Die französische CNIL hat eigene Leitlinien speziell zu KI und personenbezogenen Daten veröffentlicht.
So beantragen Sie die Löschung, Anbieter für Anbieter
Jedes große KI-Unternehmen hat sein eigenes Verfahren. Hier ist der aktuelle Stand.
OpenAI (ChatGPT, DALL-E, GPT-API)
Stellen Sie Anträge über privacy.openai.com. Sie können Auskunft über Ihre Daten, die Löschung Ihrer Kontodaten und die Berichtigung unrichtiger Ausgaben verlangen. OpenAI lässt Nutzer außerdem in den Kontoeinstellungen widersprechen, dass ihre Unterhaltungen fürs Training verwendet werden. Als Website-Betreiber verhindern Sie künftiges Crawling, indem Sie GPTBot in der robots.txt sperren.
Google (Trainingsdaten von Gemini)
Die Datenschutz-Tools von Google unter myaccount.google.com bearbeiten Löschanträge für Gemini-Unterhaltungen. Damit Ihre Website nicht für KI-Training verwendet wird, sperren Sie den User Agent Google-Extended in der robots.txt. Er ist unabhängig vom Googlebot, der für die normale Suchindexierung zuständig ist.
Meta (LLaMA-Modelle)
Meta nimmt Löschanträge über sein reguläres Datenschutzportal entgegen. Für Inhalte auf Facebook und Instagram können Sie in den Plattformeinstellungen widersprechen, dass Ihre Daten fürs KI-Training genutzt werden. Meta hat seine DSGVO-Dokumentation für das LLaMA-Training 2024 auf Druck europäischer Aufsichtsbehörden veröffentlicht.
Stability AI (Stable Diffusion)
Bei Bildinhalten prüfen Sie mit haveibeentrained.com, ob Ihre Bilder im Datensatz LAION-5B vorkommen, mit dem Stable Diffusion trainiert wurde. Über das Do-Not-Train-Register von Spawning AI können Sie formell widersprechen. Stability AI hat zugesagt, diese Widersprüche in künftigen Modellversionen zu respektieren.
Proaktive Opt-out-Mechanismen
Die Löschung im Nachhinein zu beantragen ist ein Ansatz. Die Aufnahme von vornherein zu verhindern ist ein anderer.
robots.txt bleibt der universellste Mechanismus. Ergänzen Sie gezielte Anweisungen für KI-Crawler:
User-agent: GPTBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: CCBot
Disallow: /
User-agent: anthropic-ai
Disallow: /
Das sperrt künftiges Crawling, wirkt sich aber nicht auf bereits erhobene Daten aus.
ai.txt ist ein Protokoll von Spawning AI, das eine feinere Steuerung als die robots.txt erlaubt. Sie können damit unterschiedliche Berechtigungen für unterschiedliche Arten der KI-Nutzung festlegen (Training, Inferenz, Indexierung).
Einstellungen auf Plattformebene bei Seiten wie DeviantArt, ArtStation und anderen erlauben es Kreativen, einzelne Werke als nicht verfügbar für KI-Training zu markieren. Das unterscheidet sich je nach Plattform.
Der TDM-Vorbehalt (Text und Data Mining) im EU-Urheberrecht erlaubt Rechteinhabern, sich ihre Rechte gegen Text und Data Mining ausdrücklich vorzubehalten, KI-Training eingeschlossen. Seit der DSM-Richtlinie ist das in der EU rechtlich bindend.
Der EU AI Act fügt eine neue Ebene hinzu
Der EU AI Act, dessen Bestimmungen 2025 bis 2026 schrittweise in Kraft treten, erlegt Anbietern von KI-Modellen mit allgemeinem Verwendungszweck zusätzliche Pflichten auf:
- Hinreichend detaillierte Zusammenfassungen der Trainingsdaten veröffentlichen
- Das EU-Urheberrecht einhalten, einschließlich TDM-Vorbehalten
- Technische Maßnahmen umsetzen, die robots.txt und ähnliche Signale respektieren
Das gibt Ihnen keinen magischen Knopf „Meine Daten löschen", aber es erhöht die Transparenz und stärkt die rechtliche Grundlage für Opt-out-Mechanismen.
Datenlöschung vs Sichtbarkeits-Monitoring: zwei verschiedene Probleme
Hier geraten die meisten Marken durcheinander. Sie vermischen zwei getrennte Themen.
Datenlöschung betrifft geistiges Eigentum und Datenschutz. Hat ein KI-Unternehmen Ihre Inhalte ohne Erlaubnis zum Training seines Modells verwendet? Das ist wichtig für Kreative, Verlage und alle, die eigene Inhalte produzieren.
KI-Sichtbarkeit betrifft Geschäftsergebnisse. Wenn ein potenzieller Kunde ChatGPT fragt: „Was ist das beste Tool für [Ihre Kategorie]?", taucht Ihre Marke dann in der Antwort auf? Das ist wichtig für jedes Unternehmen, das Kunden über Suche gewinnt.
Diese beiden Themen können sogar in entgegengesetzte Richtungen ziehen. Wer alle KI-Crawler sperrt, schützt seine Inhalte vor dem Auslesen, verringert aber womöglich auch die Signale, die KI-Plattformen helfen, ihn zu empfehlen. Eine Marke, die konsequent überall widerspricht, schützt vielleicht ihr geistiges Eigentum und wird dabei in der KI-gestützten Suche unsichtbar.
Der pragmatische Ansatz für die meisten Unternehmen: robots.txt gezielt einsetzen (wo möglich Trainings-Crawler sperren, aber keine Crawler, die für Antworten zuständig sind), die eigene KI-Sichtbarkeit aktiv überwachen und Berichtigungsanträge stellen, wenn KI-Plattformen falsche Informationen über Sie verbreiten.
Was wirklich etwas bewegt
Wenn Ihr Ziel eine korrekte Darstellung in der KI und eine starke KI-Sichtbarkeit ist, sind Löschanträge ein Notbehelf, keine Strategie. Die Strategie lautet:
- Machen Sie korrekte Informationen leicht auffindbar. Klare „Über uns"-Seiten, strukturierte Daten, aktuelle Produktinformationen.
- Bauen Sie Signale von Dritten auf. Bewertungen auf G2 und Trustpilot, Erwähnungen auf Reddit, Berichte in Fachmedien Ihrer Branche.
- Überwachen Sie kontinuierlich. Verfolgen Sie täglich, was KI-Plattformen über Sie sagen, nicht einmal im Quartal. Tools wie Mentionable automatisieren das für ChatGPT, Claude, Perplexity, Gemini, Copilot, Google AI Mode und Google AI Overview.
- Korrigieren Sie bei Bedarf. Stellen Sie Berichtigungsanträge bei sachlichen Fehlern. Optimieren Sie Ihre Inhalte, um bessere Signale zu liefern.
Die DSGVO gibt Ihnen Rechte. Nutzen Sie sie, wenn Sie sie brauchen. Verwechseln Sie defensive Datenlöschung aber nicht mit einer Wachstumsstrategie. Die Marken, die bei der KI-Sichtbarkeit gewinnen, gestalten aktiv, wie KI sie darstellt, statt nur zu versuchen, ihre Daten wieder aus der Maschine zu ziehen.
