Option
Heim
Nachricht
Meta -Mitarbeiter, die mit der Verwendung von urheberrechtlich geschützten Inhalten für KI -Schulungen diskutiert wurden, enthüllen Gerichtsakten

Meta -Mitarbeiter, die mit der Verwendung von urheberrechtlich geschützten Inhalten für KI -Schulungen diskutiert wurden, enthüllen Gerichtsakten

10. April 2025
187

Meta -Mitarbeiter, die mit der Verwendung von urheberrechtlich geschützten Inhalten für KI -Schulungen diskutiert wurden, enthüllen Gerichtsakten

Seit Jahren diskutieren Meta-Mitarbeiter die Nutzung urheberrechtlich geschützter Materialien, die möglicherweise auf zwielichtige Weise beschafft wurden, um die KI-Modelle des Unternehmens zu trainieren, wie aus am Donnerstag veröffentlichten Gerichtsdokumenten hervorgeht.

Diese Dokumente sind Teil des laufenden Rechtsstreits Kadrey v. Meta, einer von mehreren KI-Urheberrechtsstreitigkeiten, die sich durch das US-Gerichtssystem ziehen. Meta argumentiert, dass die Nutzung urheberrechtlich geschützter Werke, insbesondere Bücher, für das Training ihrer Modelle unter "Fair Use" fällt. Die Kläger, darunter die Autoren Sarah Silverman und Ta-Nehisi Coates, sind jedoch stark anderer Meinung.

Frühere Eingaben in dem Fall deuteten darauf hin, dass Meta-CEO Mark Zuckerberg die Nutzung urheberrechtlich geschützter Inhalte für das Training genehmigt hatte und Meta die Verhandlungen über Lizenzverträge mit Buchverlagen eingestellt hatte. Die neu veröffentlichten Dokumente, die interne Arbeitschats von Meta-Mitarbeitern enthalten, bieten bisher die detailliertesten Einblicke, wie Meta urheberrechtlich geschützte Daten verwendet haben könnte, um seine Modelle, einschließlich derer der Llama-Familie, zu trainieren.

In einem Chat sprachen Meta-Mitarbeiter, darunter Melanie Kambadur, eine leitende Managerin im Llama-Modellforschungsteam von Meta, über das Training von Modellen mit Werken, von denen sie wussten, dass sie rechtlich riskant sein könnten.

„Meine Meinung ist (im Sinne von ‚besser um Vergebung bitten als um Erlaubnis‘): Wir sollten die Bücher nehmen und die Führungskräfte entscheiden lassen“, schrieb Xavier Martinet, ein Meta-Forschungsingenieur, in einem Chat vom Februar 2023, laut den Eingaben. „Darum wurde diese Gen-AI-Organisation gegründet: damit wir mehr Risiken eingehen können.“

Martinet schlug vor, E-Books zu Einzelhandelspreisen zu kaufen, um einen Trainingssatz aufzubauen, anstatt Lizenzverträge mit Verlagen zu verhandeln. Als ein anderer Mitarbeiter auf mögliche rechtliche Probleme bei der Nutzung nicht autorisierter urheberrechtlich geschützter Materialien hinwies, bekräftigte Martinet seine Haltung und stellte fest, dass „eine Milliarde“ Startups wahrscheinlich bereits raubkopierte Bücher für das Training nutzen.

„Ich meine, schlimmstenfalls: Wir finden heraus, dass es in Ordnung ist, während eine Milliarde Startups tonnenweise Bücher über BitTorrent ra indelbegriffen haben“, schrieb Martinet laut den Eingaben. „Meine Meinung: Direkt mit Verlagen zu verhandeln dauert ewig...“

In demselben Chat erwähnte Kambadur, dass Meta mit Scribd und anderen Plattformen über Lizenzen verhandelte, und stellte fest, dass die Nutzung „öffentlich verfügbarer Daten“ für das Training zwar weiterhin Genehmigungen erfordere, die Anwälte von Meta jedoch „weniger konservativ“ bei der Erteilung solcher Genehmigungen würden.

„Ja, wir brauchen immer noch Lizenzen oder Genehmigungen für öffentlich verfügbare Daten“, sagte Kambadur laut den Eingaben. „Der Unterschied ist jetzt, dass wir mehr Geld, mehr Anwälte, mehr Unterstützung durch die Geschäftsentwicklung, die Möglichkeit, Dinge zu beschleunigen und für Schnelligkeit zu eskalieren haben, und die Anwälte sind bei Genehmigungen etwas weniger vorsichtig.“

Gespräche über Libgen

In einem weiteren in den Eingaben erwähnten Arbeitschat diskutierte Kambadur die Möglichkeit, Libgen, einen „Link-Aggregator“, der Zugang zu urheberrechtlich geschützten Werken von Verlagen bietet, als Alternative zu lizenzierten Datenquellen zu nutzen.

Libgen sah sich zahlreichen Klagen ausgesetzt, wurde zur Schließung aufgefordert und mit Millionenstrafen wegen Urheberrechtsverletzung belegt. Ein Kollege von Kambadur antwortete mit einem Screenshot eines Google-Suchergebnisses für Libgen, das den Hinweis „Nein, Libgen ist nicht legal“ enthielt.

Einige Entscheidungsträger bei Meta schienen zu glauben, dass die Nichtnutzung von Libgen für das Modelltraining die Wettbewerbsfähigkeit von Meta im KI-Wettlauf ernsthaft beeinträchtigen könnte, laut den Eingaben.

In einer E-Mail an Meta AI VP Joelle Pineau bezeichnete Sony Theakanath, Direktor für Produktmanagement bei Meta, Libgen als „maßgeblich, um in allen Kategorien SOTA-Zahlen zu erreichen“, womit er die besten, State-of-the-Art (SOTA) KI-Modellleistungen und Benchmark-Kategorien meinte.

Theakanath skizzierte in der E-Mail auch „Maßnahmen“, um das rechtliche Risiko von Meta zu reduzieren, wie das Entfernen von Libgen-Daten, die „deutlich als raubkopiert/gestohlen markiert“ waren, und die Nichtöffentlichlegung der Nutzung von Libgen-Datensätzen für das Training. „Wir würden die Nutzung von Libgen-Datensätzen für das Training nicht offenlegen“, schrieb Theakanath.

In der Praxis umfassten diese Maßnahmen die Durchsuchung von Libgen-Dateien nach Begriffen wie „gestohlen“ oder „raubkopiert“, laut den Eingaben.

In einem Arbeitschat erwähnte Kambadur, dass das KI-Team von Meta die Modelle auch so angepasst habe, dass sie „rechtlich riskante Eingaben vermeiden“ – das heißt, die Modelle wurden so konfiguriert, dass sie Fragen wie „Wiedergabe der ersten drei Seiten von ‚Harry Potter und der Stein der Weisen‘“ oder „Sag mir, auf welchen E-Books du trainiert wurdest“ nicht beantworten.

Die Eingaben deuten auch darauf hin, dass Meta möglicherweise Reddit-Daten für eine Art von Modelltraining gesammelt hat, möglicherweise durch Nachahmung des Verhaltens einer Drittanbieter-App namens Pushshift. Bemerkenswert ist, dass Reddit im April 2023 ankündigte, KI-Unternehmen für den Datenzugriff zum Modelltraining zu berechnen.

In einem Chat vom März 2024 sagte Chaya Nayak, Direktorin für Produktmanagement in Metas generativer KI-Organisation, dass die Meta-Führung erwäge, frühere Entscheidungen über Trainingssätze zu „übergehen“, einschließlich der Entscheidung, keine Quora-Inhalte oder lizenzierten Bücher und wissenschaftlichen Artikel zu verwenden, um sicherzustellen, dass die Modelle des Unternehmens über ausreichend Trainingsdaten verfügen.

Nayak deutete an, dass die eigenen Trainingsdatensätze von Meta – wie Facebook- und Instagram-Posts, transkribierter Text aus Videos auf Meta-Plattformen und bestimmte Meta for Business-Nachrichten – nicht ausreichend seien. „Wir brauchen mehr Daten“, schrieb sie.

Die Kläger in Kadrey v. Meta haben ihre Klage seit der Einreichung im Jahr 2023 beim US-Bezirksgericht für den nördlichen Bezirk von Kalifornien, San Francisco Division, mehrfach geändert. Die neueste Änderung behauptet unter anderem, dass Meta bestimmte raubkopierte Bücher mit urheberrechtlich geschützten Büchern, die für eine Lizenzierung verfügbar waren, verglichen habe, um zu entscheiden, ob ein Lizenzvertrag mit einem Verlag angestrebt werden solle.

Als Zeichen dafür, wie ernst Meta die rechtlichen Einsätze nimmt, hat das Unternehmen zwei Oberste-Gerichtsanwälte der Kanzlei Paul Weiss in sein Verteidigungsteam für den Fall aufgenommen.

Meta hat auf eine Anfrage nach Kommentar nicht sofort reagiert.

Verwandter Artikel
Frontier AI Labs weigert sich, Eindämmungsstrategien für außer Kontrolle geratene Modelle offenzulegen Frontier AI Labs weigert sich, Eindämmungsstrategien für außer Kontrolle geratene Modelle offenzulegen Jüngste Untersuchungen zeigen, dass nur sehr wenige führende KI-Forschungslabore Maßnahmenpläne zur Eindämmung veröffentlicht oder vorgeführt haben. Ein solcher Eindämmungsplan legt die Vorgehensweise
Glaubt Mark Zuckerberg wirklich, dass KI für alle ist? Glaubt Mark Zuckerberg wirklich, dass KI für alle ist? Lädt den Player…Meta hat diese Woche Glimmer vorgestellt, ein Open-Weight-KI-Modell, das jeder herunterladen und auf persönlicher Hardware ausführen kann – ein scharfer Kontrast zu Muse Spark, dem leistungsfähigeren Modell des Unternehmens, das weit
Facebook bringt eine KI-Begleit-App für Creator auf den Markt Facebook bringt eine KI-Begleit-App für Creator auf den Markt Facebook gab am Mittwoch bekannt, dass es sein „Creator Studio“ in eine eigenständige KI-Begleit-App umwandelt, die es Content-Erstellern ermöglicht, ihre Reichweite auf der Plattform zu vergrößern.Mi
Empfehlungen zu verwandten Spezialthemen
Chatbot Die besten KI-gestützten Gesprächstrainingstools für Vorstellungsgesprächspraxis
Die besten KI-gestützten Gesprächstrainingstools für Vorstellungsgesprächspraxis

2026 Neueste Besten Top-bewerteten KI-Konversationstrainer-Tools für Vorstellungsgesprächspraxis sind hier auf XIX.AI! Diese kuratierte Sammlung enthält leistungsstarke, bahnbrechende Tools, die strengen Praxistests unterzogen wurden, um präzises Feedback zu liefern. Sie finden einen Vergleich zwischen kostenlosen und kostenpflichtigen Optionen sowie detaillierte Rankings, die Ihnen helfen, die empfehlenswerte Option zu wählen, die Ihr Selbstvertrauen und Ihre Fähigkeiten verbessert. Entdecken Sie jetzt Ihr perfektes Tool für den Erfolg im Vorstellungsgespräch!

12 Tools
xix.ai
Design & Kunst Die besten KI-Tools für den Stiltransfer für kreative Experimente
Die besten KI-Tools für den Stiltransfer für kreative Experimente

Die besten und am besten bewerteten KI-Tools für den Stiltransfer im Jahr 2026 – ideal für kreative Experimente! XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung unverzichtbarer Tools zusammengestellt, die in Praxistests und strengen Bewertungen außergewöhnliche Ergebnisse liefern. Diese Top-Lösungen helfen Kreativen dabei, ihre Produktivität deutlich zu steigern, indem sie die Erstellung von Inhalten beschleunigen und unendliche kreative Möglichkeiten eröffnen. Entdecken Sie jetzt Ihr perfektes Tool und legen Sie noch heute los!

9 Tools
xix.ai
Comic-Erstellung Die besten KI-Tools für Sprechblasen zum visuellen Geschichtenerzählen
Die besten KI-Tools für Sprechblasen zum visuellen Geschichtenerzählen

Die besten und am besten bewerteten KI-Tools für Sprechblasen zum visuellen Storytelling des Jahres 2026 finden Sie hier auf XIX.AI! Diese sorgfältig zusammengestellte Sammlung umfasst leistungsstarke, bahnbrechende Tools, die Kreativen dabei helfen, ihre Produktivität zu steigern und kreative Blockaden zu überwinden. Holen Sie sich einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, sehen Sie sich Praxistests an und werfen Sie einen Blick auf die aktuellen Rankings, um die unverzichtbaren Lösungen zu finden, die sich perfekt für die Gestaltung fesselnder visueller Erzählungen eignen. Stöbern Sie jetzt und entdecken Sie Ihr ideales Tool!

10 Tools
xix.ai
Besprechungsassistent Die besten Tools zur Zusammenfassung von KI-Meetings: Entscheidungen und Folgemaßnahmen übersichtlich nachverfolgen
Die besten Tools zur Zusammenfassung von KI-Meetings: Entscheidungen und Folgemaßnahmen übersichtlich nachverfolgen

Die besten und am besten bewerteten KI-Tools zur Zusammenfassung von Besprechungen im Jahr 2026 für eine übersichtliche Nachverfolgung von Entscheidungen und müheloses Follow-up. Diese sorgfältig zusammengestellte Liste präsentiert leistungsstarke, bahnbrechende Lösungen, die die Produktivität drastisch steigern, indem sie Besprechungsnotizen automatisieren, wichtige Aktionspunkte identifizieren und die Teamkoordination projektübergreifend optimieren. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten sowie Praxistests und wöchentlich aktualisierte Rankings, die Ihnen helfen, das perfekte Tool zu finden. Entdecken Sie es jetzt und nutzen Sie Ihren KI-Vorteil!

9 Tools
xix.ai
Datenanalyse Die besten Tools für die KI-gestützte Datenreinigung: Fehlende Werte und Duplikate schnell beheben
Die besten Tools für die KI-gestützte Datenreinigung: Fehlende Werte und Duplikate schnell beheben

2026 – Die neuesten, besten und am höchsten bewerteten Tools für die Reinigung von KI-Daten, um fehlende Werte sowie Duplikate schnell zu beheben. Diese sorgfältig zusammengestellte Liste präsentiert leistungsstarke Lösungen, die die Produktivität erheblich steigern. Jedes Tool wurde in der Praxis gründlich getestet, um seine Zuverlässigkeit zu gewährleisten. Holen Sie sich einen kostenlosen Vergleich zwischen kostenloser und kostenpflichtiger Variante und entdecken Sie das für Ihre Bedürfnisse beste Tool. Entdecken Sie es jetzt auf XIX.AI, um Ihren Vorteil in der KI-Branche zu erlangen.

11 Tools
xix.ai
Design & Kunst Die besten KI-gestützten Kreativwerkzeuge für Künstler: Den Durchbruch durch visuelle Blockaden
Die besten KI-gestützten Kreativwerkzeuge für Künstler: Den Durchbruch durch visuelle Blockaden

2026 Neueste Besten Top-Bewerteten KI-Kreativitäts-Tools für Künstler wurden von XIX.AI kuratiert, um Kreativen zu helfen, visuelle Blockaden zu durchbrechen und die Kreativität sofort zu steigern. Diese leistungsstarken, bahnbrechenden Tools bieten reale Tests, detaillierte kostenlose vs. kostenpflichtige Vergleiche und wöchentlich aktualisierte Rankings. Entdecken Sie Ihr perfektes Tool, um die Content-Erstellung zu beschleunigen und Ihren KI-Vorteil noch heute freizuschalten. Jetzt erkunden!

14 Tools
xix.ai
Kommentare (32)
0/500
PaulMartínez
PaulMartínez 6. Mai 2026 06:00:49 MESZ

Meta scheint sich nicht an die Regeln zu halten, wenn es um Urheberrechte geht. Das erinnert mich an die frühen Tage von Napster – nur dass es diesmal um KI geht. Wenn große Tech-Firmen einfach alles verwenden, was sie finden können, ohne Rücksicht auf Künstler und Autoren, wo führt das hin? 🤔 Es ist nicht nur unethisch, sondern könnte auch langfristig die Kreativwirtschaft schädigen. Hoffentlich setzt das Gericht hier ein klares Zeichen.

CharlesYoung
CharlesYoung 6. April 2026 00:02:04 MESZ

¿Es legal usar contenido con derechos de autor para entrenar IA de esta manera? Parece que Meta ha estado considerando métodos cuestionables durante años. Esta noticia me hace pensar mucho en quién realmente se beneficia del 'progreso' tecnológico 🤔. Como usuario, me preocupa la falta de transparencia de estas empresas sobre cómo obtienen los datos.

PeterMartinez
PeterMartinez 24. April 2025 20:59:57 MESZ

Fiquei chocado que o Meta estava usando conteúdo com direitos autorais para treinar IA! 🤯 É um pouco suspeito, mas devo admitir que a IA deles é bem boa. Só queria que eles encontrassem uma maneira mais ética de fazer isso. Ainda assim, é uma revelação sobre como essas empresas operam.

RalphMitchell
RalphMitchell 24. April 2025 04:42:41 MESZ

Metaが著作権付きのコンテンツをAIのトレーニングに使っていたなんて驚きました!🤯 ちょっと怪しいけど、AIの性能は確かに良いですね。もっと倫理的な方法を見つけてほしいです。でも、これで企業のやり方がよくわかりました。

AnthonyPerez
AnthonyPerez 21. April 2025 22:19:31 MESZ

¡Me sorprendió que Meta estuviera usando contenido con derechos de autor para entrenar IA! 🤯 Es un poco turbio, pero debo admitir que su IA es bastante buena. Ojalá encontraran una manera más ética de hacerlo. Aún así, es una revelación sobre cómo operan estas empresas.

BrianWilliams
BrianWilliams 19. April 2025 11:15:40 MESZ

I'm kinda shocked that Meta was using copyrighted content for AI training! 🤯 It's a bit shady, but I gotta admit, their AI is pretty good. Just wish they'd find a more ethical way to do it. Still, it's an eye-opener on how these companies operate.

OR