Wer ChatGPT, Claude oder Gemini nutzt, gibt den Systemen häufig mehr Informationen, als ihm bewusst ist. Dazu können interne Dokumente, Geschäftsideen, Quellcode oder unveröffentlichte Forschung gehören. Ein aktueller Streit aus der Mathematik zeigt, warum man sich mit den Trainingseinstellungen der KI-Dienste beschäftigen sollte.

Ein aktueller Fall zeigt das Problem
Andreas Thom, Professor für Geometrie an der TU Dresden, hatte über mehrere Monate gemeinsam mit einem Kollegen ChatGPT bei der Arbeit an laufenden mathematischen Forschungsfragen genutzt. Teile dieser Forschung waren noch nicht veröffentlicht.
Am 29. Juni 2026 deaktivierte er nach eigenen Angaben die Verwendung seiner ChatGPT-Inhalte zur Verbesserung der Modelle.
Anfang August stellte OpenAI einen KI-gestützten mathematischen Durchbruch aus der Gruppentheorie vor. Eine interne Version von Astra hatte eine zentrale Frage zu sogenannten nicht sofischen Gruppen beantwortet. Der Lösungsweg baute wesentlich auf Arbeiten des Mathematikers Gábor Kun sowie gemeinsamen Arbeiten von Kun und Thom auf.
Der Wissenschaftler fragte daraufhin OpenAI, ob seine früheren ChatGPT-Gespräche dabei eine Rolle gespielt haben könnten. Einen Beleg dafür gibt es bislang nicht. OpenAI bestreitet einen direkten Zugriff auf die betreffenden Unterhaltungen.
Der Fall macht allerdings einen wichtigen Unterschied sichtbar: Ein direkter Zugriff auf einen Chat und die vorherige Verwendung von Chat-Inhalten zur Verbesserung eines KI-Modells sind zwei verschiedene Vorgänge.
Genau deshalb lohnt sich ein Blick auf die Einstellungen der großen KI-Dienste.
Welche Informationen können überhaupt problematisch sein?
Bei KI und Datenschutz liegt der Fokus häufig auf personenbezogenen Daten. Im beruflichen Alltag können jedoch auch Informationen relevant sein, die überhaupt keinen Personenbezug enthalten.
Dazu gehören beispielsweise:
- unveröffentlichte Forschungsergebnisse
- Produktideen
- Geschäftsstrategien
- interne Marktanalysen
- noch nicht angemeldete Patente
- Quellcode
- Preisstrategien
- Kampagnenkonzepte
- Geschäftsgeheimnisse
Eine Anonymisierung oder De-Identifizierung hilft bei solchen Informationen nur begrenzt. Bei einer neuen mathematischen Methode, einer Produktidee oder einer Strategie kann gerade der Inhalt selbst wertvoll sein.
Wer regelmäßig mit generativer KI arbeitet, sollte deshalb prüfen, ob seine Unterhaltungen zur Verbesserung der jeweiligen Modelle verwendet werden dürfen.
ChatGPT: Modelltraining deaktivieren
Bei privaten ChatGPT-Konten lässt sich die Verwendung neuer Unterhaltungen zur Modellverbesserung deaktivieren. Der Weg führt über:
Einstellungen → Datenkontrollen → „Das Modell für alle verbessern“ → AUS
Die Unterhaltungen können weiterhin im Chatverlauf gespeichert werden. OpenAI erklärt jedoch, dass neue Gespräche nach dem Abschalten nicht zum Training seiner Modelle verwendet werden.
OpenAI: FAQ zu den Datenkontrollen in ChatGPT
Temporäre Chats für sensiblere Inhalte
ChatGPT bietet zusätzlich Temporäre Chats. Diese Unterhaltungen werden laut OpenAI nicht zum Training verwendet, erscheinen nicht im normalen Chatverlauf und erzeugen keine Erinnerungen. Aus Sicherheitsgründen kann OpenAI eine Kopie bis zu 30 Tage aufbewahren.
OpenAI: FAQ zum temporären Chat
Für ChatGPT Business, Enterprise, Edu und die API gelten andere Bedingungen. OpenAI verwendet Inputs und Outputs dieser Angebote standardmäßig nicht zum Training seiner Modelle.
OpenAI: Verwendung von Daten zur Verbesserung der Modelle
Wichtig bei älteren ChatGPT-Unterhaltungen
Das spätere Ausschalten der Modellverbesserung bedeutet nicht automatisch, dass frühere Unterhaltungen niemals für Trainingsprozesse verwendet worden sein können.
Genau deshalb ist der Zeitpunkt der Einstellung relevant. Wer ChatGPT beruflich nutzt, sollte die Modellverbesserung möglichst vor der Verarbeitung vertraulicher Informationen deaktivieren.
Claude: Verwendung für zukünftiges Training ausschalten
Auch Anthropic bietet bei Claude eine entsprechende Einstellung. Sie findet sich unter:
Einstellungen → Datenschutz → „Helfen Sie uns, unsere KI-Modelle zu verbessern“ → AUS
Anthropic erklärt, dass neue Chats und Coding-Sessions anschließend nicht für zukünftiges Modelltraining verwendet werden.
Bei Claude ist ein Detail interessant: Nach dem Abschalten sollen auch zuvor gespeicherte Chats nicht mehr für zukünftige Trainingsläufe verwendet werden. Bereits laufende Trainingsprozesse oder bereits trainierte Modelle lassen sich dadurch allerdings nicht rückwirkend verändern.
Anthropic: Datenschutzeinstellungen zur Modellverbesserung
Inkognito-Chats bei Claude
Für Unterhaltungen, die nicht zur Modellverbesserung verwendet werden sollen, bietet Claude außerdem Inkognito-Chats. Diese werden unabhängig von der allgemeinen Trainingseinstellung nicht zur Verbesserung der Modelle verwendet.
Anthropic: Werden meine Daten für das Modelltraining verwendet?
Gemini: Aktivitäten speichern deaktivieren
Google organisiert die entsprechenden Einstellungen bei Gemini etwas anders. Bei privaten Google-Konten findet sich die relevante Option unter:
Gemini → Einstellungen & Hilfe → Aktivitäten → „Aktivitäten speichern“ → AUS
Google bietet dort außerdem die Möglichkeit „Deaktivieren und Aktivitäten löschen“.
Google erklärt, dass zukünftige Chats bei deaktivierter Speicherung nicht zur Verbesserung seiner generativen KI-Modelle verwendet werden.
Google: Aktivitäten in Gemini Apps verwalten und löschen
Bestimmte Daten können trotzdem für einen begrenzten Zeitraum vorgehalten werden, unter anderem zur Bereitstellung und Sicherheit des Dienstes. Weitere Informationen zur Verwendung von Gemini-Daten für generative KI stellt Google hier bereit:
Google: Gemini-Daten und Verbesserung generativer KI
Bei Google-Workspace-Konten können abweichende Bedingungen und durch Administratoren festgelegte Einstellungen gelten.
Die wichtigsten Einstellungen im Überblick
| KI-Dienst | Einstellung | Zusätzliche Option |
|---|---|---|
| ChatGPT | Datenkontrollen → „Das Modell für alle verbessern“ AUS | Temporärer Chat |
| Claude | Datenschutz → „KI-Modelle verbessern“ AUS | Inkognito-Chat |
| Gemini | Aktivitäten → „Aktivitäten speichern“ AUS | Aktivitäten löschen |
Die Bezeichnungen können sich durch Updates der Benutzeroberflächen ändern. Vor allem bei beruflichen Accounts sollte zusätzlich geprüft werden, welche Bedingungen für den verwendeten Tarif gelten.
Reicht das Ausschalten des Trainings?
Für viele private Anwendungen ist es eine sinnvolle Grundeinstellung. Im professionellen Umfeld sollte man sich darauf allein nicht verlassen.
Auch wenn ein Anbieter einen Chat nicht für das Modelltraining verwendet, werden die eingegebenen Informationen zunächst von einem externen Dienst verarbeitet. Je nach Anbieter, Tarif und Funktion können außerdem unterschiedliche Speicherfristen und weitere Datenverarbeitungen gelten.
Bei besonders sensiblen Informationen sollte deshalb geprüft werden, ob ein Consumer Account überhaupt das geeignete Werkzeug ist.
Business-, Enterprise- und API-Angebote können hier deutlich bessere Voraussetzungen bieten, weil die Verwendung von Eingaben vertraglich geregelt werden kann und die Anbieter teilweise zusätzliche Datenschutz- und Administrationsfunktionen bereitstellen.
Das gehört zur praktischen KI-Kompetenz
Die Trainingseinstellungen von ChatGPT, Claude und Gemini gehören aus meiner Sicht zu den Grundlagen, die Beschäftigte kennen sollten, wenn sie generative KI beruflich einsetzen.
Dabei geht es auch um die Einordnung der verwendeten Informationen. Ein Marketingmitarbeiter arbeitet mit anderen vertraulichen Daten als ein Entwickler, eine Personalabteilung oder ein Wissenschaftler.
Das passt unmittelbar zum Ansatz der KI-Kompetenz nach Artikel 4 des EU AI Act. Welche Kenntnisse Beschäftigte benötigen, hängt vom konkreten Einsatzkontext der KI-Systeme und den damit verbundenen Risiken ab.
Eine allgemeine Einführung in ChatGPT kann dafür eine Grundlage schaffen. Für den professionellen Einsatz braucht es zusätzlich klare Regeln, welche Informationen in welchen KI-Diensten verarbeitet werden dürfen und welche Einstellungen dafür erforderlich sind.
Der aktuelle Streit aus der Mathematik liefert dafür ein anschauliches Beispiel. Die Datenschutzeinstellungen eines KI-Dienstes sollte man kennen, bevor vertrauliche Informationen im Chat landen.
Quellen und weiterführende Informationen
Aktueller Fall:
Heise Online, 10. September 2026: „Streit um KI-Beweise: Ein weiterer Mathematiker erhebt Vorwürfe gegen OpenAI“:
https://www.heise.de/news/Streit-um-KI-Beweise-Ein-weiterer-Mathematiker-erhebt-Vorwuerfe-gegen-OpenAI-11449347.html
OpenAI:
FAQ zu Datenkontrollen in ChatGPT
FAQ zum temporären Chat
Verwendung von Daten zur Verbesserung der Modelle
Anthropic:
Datenschutzeinstellungen zur Modellverbesserung bei Claude
Verwendung von Claude-Daten für das Modelltraining
Google:
Gemini Apps Aktivitäten verwalten und löschen
Gemini-Daten und Verbesserung generativer KI
Stand: 12. September 2026. Einstellungen, Bezeichnungen und Nutzungsbedingungen können sich ändern.
Datenschutz gehört für mich zum Einstieg in KI dazu, nicht in ein Sonderkapitel am Ende. Einen praktischen Lernpfad dafür findest du auf KI lernen.