Innerhalb von acht Wochen gab es drei Meldungen, die auf den ersten Blick nichts miteinander zu tun haben. Ende Juli lizenziert Yelp seine Bewertungen an OpenAI. Mitte August ersteigert Google für zehn Millionen Dollar die internen E-Mails und Teams-Chats der insolventen US-Billigairline Spirit Airlines. Und Mitte September erklärt der Chef von Idealo im Handelsblatt, sein Preisvergleich solle künftig Datenlieferant für KI-Agenten werden.

Eine Bewertungsplattform, eine pleitegegangene Fluglinie und ein deutscher Preisvergleich. Gemeinsam haben sie etwas, das die großen Sprachmodelle nicht einfach aus dem offenen Netz kopieren können: Daten, die nur ihnen gehören. Das öffentliche Web gilt als weitgehend ausgelesen. Was jetzt einen Preis hat, liegt hinter Logins, in Datenbanken und in Postfächern.

Was sind proprietäre Daten?

Proprietäre Daten sind Daten, die einem Unternehmen gehören und nicht frei zugänglich sind: Kundenbewertungen auf der eigenen Plattform, aktuelle Preis- und Produktdaten, interne E-Mails, Chatverläufe, Dokumente, Quellcode oder Transaktionsdaten. Für KI-Anbieter sind sie aus zwei Gründen wertvoll. Als Trainingsdaten zeigen sie, wie Arbeit in einem bestimmten Umfeld tatsächlich abläuft. Als Live-Daten machen sie Antworten aktueller und belastbarer, etwa bei der Frage, wo ein Produkt gerade am günstigsten ist.

Yelp: Bewertungen gegen Sichtbarkeit in ChatGPT

Am 23. Juli 2026 meldete Axios die Partnerschaft: Yelp lizenziert Bewertungen, Fotos und Geschäftsinformationen an OpenAI. ChatGPT zeigt diese Inhalte künftig direkt in Antworten an, mit Yelp-Branding und Links. Dazu kommt eine Funktion „Request a Quote“, über die Nutzer lokale Dienstleister direkt aus ChatGPT heraus anfragen können. Finanzielle Details wurden nicht genannt, exklusiv ist der Deal nicht.

Yelp-Chef Jeremy Stoppelman begründet das selbstbewusst: „If you want to answer local queries, you really need Yelp.“ Der Satz stimmt, solange niemand anderes über ähnlich viele Bewertungen zu Handwerkern in amerikanischen Kleinstädten verfügt. Yelp hat solche Lizenzen schon an Google und Apple Maps verkauft. Neu ist, dass der Abnehmer ein Chatbot ist, der den Nutzer im besten Fall gar nicht mehr zu Yelp schickt.

Idealo: Vom Google-Gegner zum Datenlieferanten

Bei Idealo liegt die Sache ähnlich, nur mit mehr Risiko. Seit März 2026 gibt es eine eigene Idealo-App in ChatGPT, die Preis- und Produktdaten in die Unterhaltung einspielt. Co-CEO Jovan Protić sagte damals sinngemäß, Idealo werde damit zum KI-Unternehmen. Im Handelsblatt legte er am 16. September nach: Idealo verfüge über genau die vertrauenswürdigen E-Commerce-Daten, die KI-Agenten brauchen, und wer kauft, wolle geprüfte Quellen.

Die Zahlen im selben Artikel geben ihm einen Teil recht. Die Nutzung der Website stieg im ersten Halbjahr 2026 um 33 Prozent. Gleichzeitig nutzt laut einer Studie des ECC Köln rund ein Drittel der Verbraucher Chatbots wie ChatGPT oder Gemini schon für die Kaufberatung, fast die Hälfte davon glaubt, so bessere Preise zu finden.

Pikant ist, wer hier den Schulterschluss mit den KI-Plattformen sucht. Idealo, 2000 in Berlin gegründet, ist seit Jahren einer der hartnäckigsten Gegner von Google. Die Geschäftsmodelle überschneiden sich direkt: Wer bei Google Shopping Preise vergleicht, braucht Idealo nicht mehr. 2017 stellte die EU-Kommission fest, dass Google seinen eigenen Preisvergleich in der Suche gegenüber konkurrierenden Diensten bevorzugt hatte, und verhängte eine Strafe von 2,4 Milliarden Euro. Der Europäische Gerichtshof bestätigte die Entscheidung 2024. Idealo klagte schon 2019 auf Schadensersatz und erhöhte die Forderung 2025 auf mindestens 3,3 Milliarden Euro. Im November 2025 sprach das Landgericht Berlin Idealo mehr als 465 Millionen Euro inklusive Zinsen zu. Idealo will den Rechtsstreit fortsetzen, Google hat ebenfalls Rechtsmittel angekündigt.

Zeitleiste Idealo: 2000 Gründung, 2017 EU-Entscheidung zu Google Shopping, 2019 Klage gegen Google, 2024 EuGH bestätigt, November 2025 LG Berlin spricht 465 Mio. Euro Schadensersatz zu, März 2026 Idealo-App in ChatGPT, September 2026 Ziel Datenlieferant für KI-Agenten

Kaum ein Unternehmen weiß also besser, was es heißt, wenn eine Plattform den Zugang zum Kunden kontrolliert. Mit ChatGPT, Gemini und den kommenden Einkaufsagenten droht genau diese Abhängigkeit von Neuem: Der Assistent entscheidet, welche Preisquelle er heranzieht und ob der Nutzer jemals auf idealo.de landet. Gegen Google hat Idealo vor Gericht gekämpft, seit 2019 und bis heute ohne rechtskräftiges Ende. Diesmal setzt sich das Unternehmen früh mit an den Tisch und liefert, solange die eigenen Daten gebraucht werden.

Wer lange im E-Commerce gearbeitet hat, kennt Preisvergleiche vor allem als Traffic-Quelle, für die Händler pro Klick bezahlen. Das Geschäftsmodell hängt daran, dass Menschen auf der Vergleichsseite landen. Als Datenlieferant verdient Idealo an einer Stelle, an der der Kunde die Marke Idealo womöglich nie sieht. Das ist ein kluger Zug, solange die eigenen Daten schwer zu ersetzen sind. Ob sie das in fünf Jahren noch sind, weiß niemand, auch Idealo nicht. Was Agentic Commerce für Händler bedeutet, habe ich an anderer Stelle ausführlicher beschrieben.

Spirit Airlines: Wenn die Insolvenzmasse aus E-Mails besteht

Der dritte Fall ist der ungewöhnlichste. Im Insolvenzverfahren von Spirit Airlines hat Google eine Auktion für die Unternehmensdaten gewonnen: rund 100 Millionen E-Mails, etwa 500 Millionen Teams-Nachrichten, dazu Marketingunterlagen, Personal- und Finanzdokumente, Präsentationen, Dienstpläne und laut TIME rund 30 Millionen Zeilen Quellcode. Preis: zehn Millionen Dollar. Das nächstbeste Gebot kam von Mercor, einem Anbieter für KI-Trainingsdaten, mit 7,5 Millionen.

1,7 Cent pro interner Nachricht: Googles Gebot von 10 Mio. Dollar für rund 600 Mio. E-Mails und Teams-Nachrichten von Spirit Airlines

Warum zahlt Google für die Korrespondenz einer Fluggesellschaft, die es nicht mehr schafft? TIME ordnet das so ein: Coding-Agenten konnten aus Unmengen öffentlich verfügbarem Code lernen. Für Büroarbeit gibt es so etwas nicht. Wie ein Unternehmen Dienstpläne abstimmt, Beschwerden eskaliert oder ein Budget verteidigt, steht in keinem öffentlichen Datensatz. Genau das braucht man aber, um KI-Agenten per Reinforcement Learning auf echte Unternehmensabläufe zu trainieren. Sogar die schlechten Entscheidungen eines gescheiterten Unternehmens sind dabei brauchbares Material.

Google hat zugesichert, dass ein Dienstleister alle personenbezogenen Daten entfernt, bevor die Daten übergeben werden. Der Gewerkschaft der Flugbegleiter reicht das nicht. Sie hat Einspruch eingelegt, weil auch ohne Namen Details über Abmahnungen, Krankheitsfälle, Gewerkschaftsarbeit oder interne Beschwerden in den Daten stecken, und bei 5.500 Flugbegleiterinnen und Flugbegleitern lässt sich aus solchen Details schnell wieder eine Person rekonstruieren. Die Anhörung vor dem Insolvenzgericht wurde deshalb auf den 9. September verschoben. Genehmigt war der Verkauf bis zum 25. September noch nicht.

Spirit bleibt kein Einzelfall. Laut Bloomberg hat SpaceX, zu dem inzwischen auch Musks KI-Firma xAI gehört, intern darüber gesprochen, Kunden- und Betriebsdaten gescheiterter Start-ups für das KI-Training zu kaufen. Konkrete Käufe sind nicht bekannt, die Richtung ist es.

Zwei Datenmärkte, die gerade entstehen

Die drei Fälle beschreiben zwei verschiedene Geschäfte.

Schema: Live-Daten für KI-Antworten (Yelp, Idealo, Reddit, laufender Zugriff) und Trainingsdaten aus der Arbeit (Spirit Airlines, Codex Record & Replay von OpenAI, Microsoft Recall) fließen in KI-Plattformen wie ChatGPT, Gemini und Agenten

Das erste ist der Markt für Live-Daten in KI-Antworten. Yelp und Idealo verkaufen keinen einmaligen Datensatz, sondern laufenden Zugriff. ChatGPT soll wissen, welches Restaurant gerade gut bewertet ist und was ein Staubsauger heute kostet. Reddit ist das bekannteste Beispiel dafür: Das Lizenzgeschäft mit Google und OpenAI brachte im zweiten Quartal 2026 rund 43 Millionen Dollar, 24 Prozent mehr als im Vorjahr. Das sind allerdings nur etwa fünf Prozent vom Gesamtumsatz. Mit Datenlizenzen verdient man gut, aber selten so gut, dass man sein Hauptgeschäft dafür aufgeben sollte.

Das zweite ist der Markt für Trainingsdaten aus dem Arbeitsalltag. Hier zählt, wie Arbeit abläuft, Aktualität spielt kaum eine Rolle. Diese Daten liegen in jedem Unternehmen, in Postfächern, Ticketsystemen und Teams-Kanälen. Bisher hat sie niemand als Vermögenswert betrachtet. Die Spirit-Auktion hat ihnen einen Preis gegeben.

Den zweiten Markt bedienen längst nicht nur Insolvenzverwalter. Die KI-Werkzeuge selbst bekommen Funktionen, die Menschen bei der Arbeit zusehen. Seit Juni 2026 hat Codex, der KI-Agent von OpenAI, eine Funktion namens Record & Replay: Man führt einen Arbeitsablauf am Mac einmal vor, Codex beobachtet dabei Aktionen und Fensterinhalte und schreibt daraus eine wiederverwendbare Anleitung. Was Google bei Spirit für zehn Millionen Dollar ersteigert hat, das Wissen, wie Arbeit konkret abläuft, liefern Nutzer hier selbst. Ob die Aufzeichnungen ins Training einfließen, sagt die Dokumentation nicht ausdrücklich. OpenAIs allgemeine Regel lautet: Bei Diensten für Einzelpersonen wie ChatGPT und Codex dürfen Inhalte zum Training genutzt werden, solange man nicht widerspricht. Für Business-, Enterprise- und Edu-Konten gilt das standardmäßig nicht. In der EU ist Record & Replay bisher ohnehin nicht verfügbar.

Microsoft Recall geht noch weiter. Die Funktion speichert auf Copilot+-PCs, wenn man sie einschaltet, alle paar Sekunden ein Bildschirmfoto, damit sich später alles durchsuchen lässt, was einmal zu sehen war. Microsoft betont, dass die Snapshots auf dem Gerät bleiben und weder Microsoft noch Dritte sie zu sehen bekommen. Eine Quelle für Trainingsdaten ist Recall nach heutigem Stand also nicht. Die Funktion zeigt aber, wie selbstverständlich es geworden ist, ein lückenloses Protokoll der eigenen Arbeit anzulegen. Ob es auf dem Rechner bleibt, hängt an Einstellungen, Nutzungsbedingungen und Firmenrichtlinien, und die können sich ändern. Bei Spirit hat auch niemand damit gerechnet, dass die Teams-Chats einmal versteigert werden.

Was das für Unternehmen bedeutet

Die eigenen Daten sind mehr wert als die eigenen KI-Tools. ChatGPT, Claude und Gemini kann jeder abonnieren. Was ein Unternehmen unterscheidet, sind Wissen, Prozesse und Daten, die sonst niemand hat. Das habe ich im Beitrag über KI im Mittelstand aus der Innensicht beschrieben. Yelp und Idealo zeigen die Außensicht: Dieselben Daten lassen sich auch verkaufen oder als Eintrittskarte in KI-Antworten nutzen.

Sichtbarkeit in KI-Antworten wird zum Teil verhandelt. Wer in ChatGPT als Quelle erscheint, muss nicht mehr nur gut auffindbar sein. Er kann auch Vertragspartner sein. Für GEO heißt das: Gute Inhalte bleiben die Grundlage, aber große Plattformen kaufen sich zusätzlich einen festen Platz in den Antworten. Warum die eigene Marke im Zeitalter von ChatGPT und Google AI dadurch eher wichtiger wird, steht in einem älteren Beitrag.

Interne Kommunikation ist nicht so intern, wie sie sich anfühlt. Die Mitarbeitenden von Spirit haben ihre Teams-Nachrichten nicht für ein Google-Modell geschrieben. Ob Datenschutzerklärungen und Arbeitsverträge so einen Weiterverkauf abdecken, klären in den USA gerade Gerichte. In Europa setzt die DSGVO engere Grenzen, aber die Frage stellt sich auch hier, spätestens bei der nächsten großen Insolvenz. Wer Daten sicher für KI vorbereiten will, sollte die eigenen Postfächer und Chatkanäle mitdenken. Und wer privat wissen will, ob seine Chats ins Training wandern: So schaltest du das Training bei ChatGPT, Claude und Gemini ab.

Meine Einschätzung

Zehn Millionen Dollar für eine halbe Milliarde Chatnachrichten sind für Google ein Kleinbetrag. Für Spirits Gläubiger war es vermutlich einer der wenigen Posten der Insolvenzmasse, für den mehrere Bieter Schlange standen. Dieses Verhältnis wird sich nicht halten. Wenn Unternehmensdaten einen Marktpreis haben, werden sie in Bilanzen, Verkaufsverhandlungen und Insolvenzplänen auftauchen, und Unternehmen werden sich überlegen, ob sie ihre Daten verkaufen, lizenzieren oder lieber selbst nutzen.

Idealos Weg zeigt, wie schmal der Grat ist. Wer Daten liefert, macht sich für KI-Agenten unverzichtbar und gibt gleichzeitig den direkten Kontakt zum Kunden ab. Das funktioniert, solange die Daten besser sind als alles, was ein KI-Anbieter selbst zusammentragen kann. Für die meisten Unternehmen ist die nützlichere Frage deshalb eine praktische: Welche Daten haben wir, die sonst niemand hat, und wissen wir überhaupt, wo sie liegen?

Genau diese Fragen, also Datenschutz, Datenqualität und den Einsatz von KI mit eigenen Daten, behandle ich auch in meiner KI-Weiterbildung. Mehr zu den Anwendungen im Marketing steht auf der Seite KI im Marketing.

Quellen

  • Florian Kolf, Anna Westkämper: Preisvergleich: Idealo will zum Datenlieferanten für KI-Agenten werden. Handelsblatt, 16.09.2026. handelsblatt.com
  • EU-Kommission: Kartellrecht: Kommission verhängt Geldbuße in Höhe von 2,42 Mrd. EUR gegen Google (Google Shopping), 27.06.2017. ec.europa.eu
  • EuGH, Urteil vom 10.09.2024, Rechtssache C-48/22 P (Google und Alphabet/Kommission, Google Shopping). curia.europa.eu
  • LTO: LG Berlin II zum unfairen Wettbewerb: Google muss 465 Millionen zahlen, 14.11.2025 (Az. 16 O 195/19 Kart). lto.de
  • beck-aktuell: Unfairer Wettbewerb: Google muss Idealo 465 Millionen Schadensersatz zahlen, 14.11.2025. beck-aktuell.de
  • Meedia: idealo integriert Preisvergleich in ChatGPT, 18.03.2026. meedia.de
  • Madison Mills: Yelp reviews come to ChatGPT. Axios, 23.07.2026. axios.com
  • Axios: Google buys Spirit Airlines emails, chats, documents out of bankruptcy, 17.08.2026. axios.com
  • Spiegel: Spirit Airlines: Google kauft interne Daten von insolventer US-Airline, um KI zu trainieren. spiegel.de
  • Suzanne Rowan Kelleher: Google Paying $10 Million For Spirit Airlines’ Data To Train AI. Forbes, 18.08.2026. forbes.com
  • TIME: Google’s $10 Million Bid for Spirit Airlines‘ Data Reveals AI’s Next Frontier, 25.08.2026. time.com
  • Bloomberg: SpaceX Discusses Buying Data for AI Models From Failed Startups, 17.09.2026. bloomberg.com
  • OpenAI: Record & Replay, Dokumentation für Codex und ChatGPT. learn.chatgpt.com
  • Tech Times: OpenAI Codex Automation Gains Record and Replay, 20.06.2026. techtimes.com
  • OpenAI Help Center: How your data is used to improve model performance. help.openai.com
  • Microsoft Support: Privacy and control over your Recall experience. support.microsoft.com
  • The Motley Fool: Reddit’s Data Licensing Revenue Grew 24% to $43 Million, 17.08.2026. fool.com