Meta steht erneut im Kreuzfeuer der Kritik – und diesmal geht es um den Kern dessen, was moderne KI-Systeme überhaupt möglich macht: die Trainingsdaten. Eine Klage wirft dem Konzern vor, Millionen von Fotos ohne Einwilligung der Urheber für das Training seiner KI-Modelle verwendet zu haben. Der Fall reiht sich ein in eine wachsende Welle von Rechtsstreitigkeiten rund um die Frage, wem die Daten gehören, die generative KI erst intelligent machen. Für Kreative, Fotografen und Content-Creator im DACH-Raum ist das Thema hochrelevant – denn es geht um nichts weniger als die Frage, ob ihre Arbeit ungefragt zur Ressource für Tech-Konzerne wird. Die Debatte um legales KI-Training ist damit endgültig im juristischen Mainstream angekommen.
Hintergrund: Das Daten-Dilemma der KI-Industrie
Generative KI-Modelle – ob für Bilder, Texte oder Videos – benötigen gigantische Mengen an Trainingsdaten. Je mehr hochwertige Daten ein Modell verarbeitet, desto besser werden seine Ergebnisse. Für Unternehmen wie Meta, OpenAI oder Google entsteht daraus ein enormer Anreiz, so viele Daten wie möglich zu sammeln und zu nutzen. In der Praxis bedeutet das: Fotos, Texte, Kunstwerke und andere kreative Inhalte werden aus dem Internet zusammengetragen – häufig ohne explizite Zustimmung der Urheber.
Meta betreibt mit seinen Llama-Modellen eine der größten Open-Source-KI-Initiativen weltweit und hat mit Meta AI einen eigenen KI-Assistenten in seine Plattformen Facebook, Instagram und WhatsApp integriert. Gleichzeitig verfügt der Konzern über einen beispiellosen Zugang zu nutzergenerierten Inhalten: Milliarden von Fotos, die Menschen täglich auf Facebook und Instagram hochladen. Genau hier setzt die Klage an.
Bereits in der Vergangenheit gab es Kontroversen um Metas Umgang mit Nutzerdaten für KI-Zwecke. In der EU musste Meta im vergangenen Jahr Pläne verschieben, europäische Nutzerdaten für das KI-Training zu verwenden, nachdem Datenschutzbehörden – allen voran die irische DPC – Bedenken angemeldet hatten. Die grundsätzliche Problematik ist aber keineswegs gelöst.
Die Details: Was Meta konkret vorgeworfen wird
Die aktuelle Klage richtet sich gegen Metas Praxis, Millionen urheberrechtlich geschützter Fotos ohne Einwilligung der Rechteinhaber als Trainingsmaterial für seine KI-Modelle zu verwenden. Der Vorwurf: Meta habe Bilder, die Nutzer auf seinen Plattformen hochgeladen haben, systematisch für das Training generativer KI-Systeme eingesetzt – ohne die Fotografen, Künstler oder sonstigen Urheber um Erlaubnis zu fragen und ohne sie dafür zu entschädigen.
Das ist deshalb brisant, weil die Nutzungsbedingungen von Plattformen wie Facebook und Instagram den Nutzern zwar eine Lizenz zur Nutzung ihrer Inhalte einräumen – aber traditionell für den Zweck der Darstellung auf der Plattform selbst. Ob diese Lizenz auch das Training von KI-Modellen abdeckt, ist juristisches Neuland und wird von Rechtsexperten kontrovers diskutiert.
Die Klage reiht sich in eine Serie ähnlicher Verfahren ein. Auch OpenAI, Stability AI und Google sehen sich mit Klagen von Künstlern, Autoren und Medienunternehmen konfrontiert, die ihre Werke ungefragt in Trainingsdatensätzen wiederfinden. Der Unterschied bei Meta: Der Konzern hat durch seine sozialen Netzwerke einen direkten, proprietären Zugang zu den Inhalten seiner Nutzer – es geht also nicht um das Scraping fremder Websites, sondern um Daten, die Menschen der Plattform anvertraut haben.
Einordnung: Was das für dich als Creator im DACH-Raum bedeutet
Wenn du als Fotograf, Designer, Content-Creator oder Solopreneur im deutschsprachigen Raum arbeitest, solltest du diesen Fall genau verfolgen. Die zentrale Frage lautet: Wer profitiert von deiner kreativen Arbeit – und wer sollte dafür bezahlen?
Im europäischen Kontext ist die Lage dabei durchaus anders als in den USA. Die DSGVO und das europäische Urheberrecht setzen strengere Maßstäbe als das US-amerikanische Fair-Use-Prinzip. Der EU AI Act, der schrittweise in Kraft tritt, verlangt von Anbietern generativer KI-Systeme zudem eine Zusammenfassung der verwendeten Trainingsdaten – ein Transparenzgebot, das es in den USA so nicht gibt. Gleichzeitig hat die EU mit Artikel 4 der DSM-Richtlinie ein Text- und Data-Mining-Privileg geschaffen, das Unternehmen unter bestimmten Bedingungen erlaubt, öffentlich zugängliche Inhalte zu analysieren – es sei denn, Rechteinhaber widersprechen ausdrücklich (Opt-out).
Für Marketer und Solopreneure ergibt sich daraus eine doppelte Perspektive:
- Als Nutzer von KI-Tools profitierst du von leistungsfähigen Modellen, die mit genau diesen Daten trainiert wurden. Metas Llama-Modelle sind kostenlos verfügbar und bilden die Grundlage vieler Anwendungen.
- Als Content-Ersteller musst du dir die Frage stellen, ob deine auf Social Media veröffentlichten Inhalte ungewollt zum Trainingsmaterial werden. Ein Blick in die aktuellen Datenschutzeinstellungen von Instagram und Facebook lohnt sich – Meta hat dort inzwischen Optionen zum Widerspruch gegen die KI-Nutzung eingebaut, die allerdings nicht immer leicht zu finden sind.
Meine persönliche Einordnung: Der Fall zeigt ein systemisches Problem der KI-Industrie. Die Wertschöpfung generativer KI basiert auf der kreativen Arbeit von Millionen Menschen, die dafür weder gefragt noch entschädigt werden. Dass ausgerechnet Meta – ein Unternehmen, das seinen Nutzern eine Plattform zum Teilen bietet – diese Vertrauensposition für KI-Training ausnutzt, hat eine besondere Brisanz. Es ist der Unterschied zwischen „Ich teile mein Foto mit Freunden“ und „Mein Foto trainiert einen Algorithmus, der meinen Job ersetzen könnte“.
Was kommt als nächstes
Der Ausgang dieses Verfahrens könnte Präzedenzcharakter haben – nicht nur für Meta, sondern für die gesamte KI-Branche. Sollte ein Gericht feststellen, dass die Nutzung von Plattform-Uploads für KI-Training ohne explizite Einwilligung rechtswidrig ist, müssten Unternehmen weltweit ihre Trainingspraktiken überdenken.
Parallel dazu wird die Debatte auf regulatorischer Ebene weitergehen. In der EU stehen wichtige Durchführungsbestimmungen des AI Acts an, die konkretisieren werden, welche Transparenzpflichten für Trainingsdaten gelten. Die Frage, ob europäische Urheber einen Vergütungsanspruch gegenüber KI-Unternehmen haben, wird ebenfalls diskutiert – ähnlich wie es bei der Leistungsschutzrecht-Debatte mit Verlagen und Google der Fall war.
Für dich als Nutzer und Creator bedeutet das: Behalte die Entwicklung im Auge, prüfe deine Datenschutzeinstellungen auf den großen Plattformen und überlege dir, welche Inhalte du wo veröffentlichst. Die Ära, in der wir bedenkenlos alles ins Netz stellen konnten, ohne an die Konsequenzen zu denken, ist spätestens jetzt vorbei. Die KI-Industrie braucht deine Daten – und es ist an der Zeit, dass du mitbestimmst, zu welchen Bedingungen.