Heim
Reddit erhebt Klage gegen Anthropic wegen des Auslesens von Nutzerdaten für KI-Training
Reddit geht gerichtlich gegen Anthropic vor. Das KI-Unternehmen soll ohne Erlaubnis Nutzerinhalte von seiner Plattform abgegriffen haben, um seine KI-Modelle Claude zu trainieren. In der Klage, die bei einem kalifornischen Gericht eingereicht wurde, heißt es, dass Anthropic über 100.000 unerlaubte Anfragen an die Server von Reddit gestellt hat, selbst nachdem es öffentlich behauptet hatte, damit aufgehört zu haben.
In der Klage wird behauptet, dass Anthropic sowohl die technischen Sicherheitsvorkehrungen als auch die Nutzungsbedingungen missachtet hat. Nach Angaben von Reddit umging Anthropic Schutzmaßnahmen wie die robots.txt-Datei, die automatisches Scraping verhindern soll. Die Plattform behauptet außerdem, Anthropic habe die Privatsphäre der Nutzer verletzt, indem es persönliche Beiträge - einschließlich gelöschter Beiträge - gesammelt und zu kommerziellen Zwecken verwendet habe.
Reddit weist darauf hin, dass es strukturierten Datenzugang durch offizielle Lizenzpartnerschaften mit Unternehmen wie OpenAI und Google bietet. Diese Vereinbarungen enthalten Klauseln, die die Nutzung von Inhalten, den Schutz der Privatsphäre und die Entfernung von Daten regeln. Reddit behauptet, dass Anthropic es abgelehnt hat, eine formale Lizenzvereinbarung einzugehen und stattdessen Inhalte direkt abgreift, um Gebühren zu vermeiden und den Schutz der Nutzer zu umgehen.
In der Klageschrift wird ein Forschungspapier aus dem Jahr 2021 zitiert, das von Anthropic-CEO Dario Amodei mitverfasst wurde und in dem Reddit als wertvolle Quelle für Trainingsdaten für Sprachmodelle genannt wird. Reddit präsentierte auch Fälle, in denen Claude Reddit-Beiträge fast wortwörtlich zu reproduzieren schien - einschließlich der Inhalte, die Nutzer gelöscht hatten. Laut Reddit ist dies ein Beweis dafür, dass Anthropic es versäumt hat, Sicherheitsvorkehrungen zu treffen, die die Privatsphäre der Nutzer oder die Aufforderung zur Entfernung von Inhalten berücksichtigen.
Reddit fordert Schadensersatz und eine gerichtliche Verfügung, die es Anthropic untersagt, Reddit-Inhalte in zukünftigen Versionen seiner Modelle zu verwenden.
Anthropic hat geantwortet und erklärt, dass es die Anschuldigungen bestreitet und sich zu verteidigen gedenkt. Dies ist jedoch nicht die erste rechtliche Anfechtung, mit der sich das Unternehmen wegen seiner Praktiken zur Erhebung von Trainingsdaten konfrontiert sieht.
Im August 2024 reichte eine Gruppe von Autoren eine Sammelklage gegen Anthropic ein und behauptete, das Unternehmen habe ihre urheberrechtlich geschützten Werke ohne Zustimmung verwendet. Sie behaupteten, das Unternehmen habe seine Modelle ohne Erlaubnis auf Bücher und andere Schriften trainiert und verlangte dann eine Entschädigung für die Nutzung der Inhalte.
Eine ähnliche Klage vom Oktober 2023 betraf die Universal Music Group und andere Verleger, die Anthropic verklagten, weil es angeblich urheberrechtlich geschützte Liedtexte durch seinen Claude-Chatbot reproduzierte. Die Musikunternehmen argumentierten, dass dies ihre geistigen Eigentumsrechte verletze, und beantragten eine einstweilige Verfügung gegen die weitere Verwendung von Liedtexten.
Im Gegensatz zu diesen Fällen geht es in der Klage von Reddit nicht um das Urheberrecht. Stattdessen geht es um Vertragsbruch und unlauteren Wettbewerb. Reddit macht geltend, dass die Daten auf seiner Website nicht nur öffentlich sind, sondern auch Bedingungen unterliegen, die Anthropic wissentlich ignoriert hat. Diese Unterscheidung könnte einen wichtigen Präzedenzfall für Plattformen schaffen, die nutzergenerierte Inhalte hosten, deren Verwendung in kommerziellen KI-Systemen aber zu regulieren versuchen.
Reddit wirft Anthropic außerdem vor, die Öffentlichkeit in die Irre zu führen. In der Klage wird auf die öffentlichen Erklärungen von Anthropic verwiesen, in denen behauptet wird, dass das Unternehmen die Regeln für Scraping einhält und die Privatsphäre der Nutzer respektiert - Behauptungen, die laut Reddit durch das tatsächliche Verhalten des Unternehmens widerlegt werden.
"Trotz der Aussagen in seinem Marketingmaterial schert sich Anthropic nicht um die Regeln von Reddit oder die Nutzer", heißt es in der Klage. "Es glaubt, dass es das Recht hat, ungestraft jeden beliebigen Inhalt zu nehmen und ihn zu verwenden, wie es will.
Nach Bekanntgabe der Klage stiegen die Aktien von Reddit um fast 67 %, was darauf hindeutet, dass die Investoren die Klage unterstützen. Das Ergebnis könnte einen rechtlichen Maßstab für die Abwägung zwischen offenen Internetinhalten und den Rechten von Nutzern und Inhaltseigentümern setzen.
Da immer mehr KI-Unternehmen von großen Mengen an Online-Daten abhängig sind, werden die rechtlichen und ethischen Auswirkungen des Web Scraping immer dringlicher. Der Fall Reddit reiht sich ein in eine wachsende Zahl von Gerichtsverfahren, die die nächste Phase der KI-Entwicklung beeinflussen werden.
Siehe auch: Ethik in der Automatisierung: Voreingenommenheit und Compliance in der KI
Möchten Sie mehr über KI und Big Data von Branchenführern erfahren? Besuchen Sie die AI & Big Data Expo, die in Amsterdam, Kalifornien und London stattfindet. Die umfassende Veranstaltung findet gemeinsam mit anderen führenden Events statt, darunter die Intelligent Automation Conference, BlockX, Digital Transformation Week und Cyber Security & Cloud Expo.
Hier finden Sie weitere Veranstaltungen und Webinare zu Unternehmenstechnologien, die von TechForge unterstützt werden.
Verwandter Artikel
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Amazon führt Alexa für den Einkauf ein und schiebt Rufus in den Hintergrund
Amazon hat Alexa for Shopping eingeführt, indem es den Rufus-Shopping-Chatbot mit Alexa+ in der App, auf der Website und auf Echo Show-Geräten zusammenführt.Der Assistent beantwortet Produktanfragen, vergleicht Artikel, verfolgt Preise und unterstüt
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
Empfehlungen zu verwandten Spezialthemen
Kommentare (2)
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.
Reddit geht gerichtlich gegen Anthropic vor. Das KI-Unternehmen soll ohne Erlaubnis Nutzerinhalte von seiner Plattform abgegriffen haben, um seine KI-Modelle Claude zu trainieren. In der Klage, die bei einem kalifornischen Gericht eingereicht wurde, heißt es, dass Anthropic über 100.000 unerlaubte Anfragen an die Server von Reddit gestellt hat, selbst nachdem es öffentlich behauptet hatte, damit aufgehört zu haben.
In der Klage wird behauptet, dass Anthropic sowohl die technischen Sicherheitsvorkehrungen als auch die Nutzungsbedingungen missachtet hat. Nach Angaben von Reddit umging Anthropic Schutzmaßnahmen wie die robots.txt-Datei, die automatisches Scraping verhindern soll. Die Plattform behauptet außerdem, Anthropic habe die Privatsphäre der Nutzer verletzt, indem es persönliche Beiträge - einschließlich gelöschter Beiträge - gesammelt und zu kommerziellen Zwecken verwendet habe.
Reddit weist darauf hin, dass es strukturierten Datenzugang durch offizielle Lizenzpartnerschaften mit Unternehmen wie OpenAI und Google bietet. Diese Vereinbarungen enthalten Klauseln, die die Nutzung von Inhalten, den Schutz der Privatsphäre und die Entfernung von Daten regeln. Reddit behauptet, dass Anthropic es abgelehnt hat, eine formale Lizenzvereinbarung einzugehen und stattdessen Inhalte direkt abgreift, um Gebühren zu vermeiden und den Schutz der Nutzer zu umgehen.
In der Klageschrift wird ein Forschungspapier aus dem Jahr 2021 zitiert, das von Anthropic-CEO Dario Amodei mitverfasst wurde und in dem Reddit als wertvolle Quelle für Trainingsdaten für Sprachmodelle genannt wird. Reddit präsentierte auch Fälle, in denen Claude Reddit-Beiträge fast wortwörtlich zu reproduzieren schien - einschließlich der Inhalte, die Nutzer gelöscht hatten. Laut Reddit ist dies ein Beweis dafür, dass Anthropic es versäumt hat, Sicherheitsvorkehrungen zu treffen, die die Privatsphäre der Nutzer oder die Aufforderung zur Entfernung von Inhalten berücksichtigen.
Reddit fordert Schadensersatz und eine gerichtliche Verfügung, die es Anthropic untersagt, Reddit-Inhalte in zukünftigen Versionen seiner Modelle zu verwenden.
Anthropic hat geantwortet und erklärt, dass es die Anschuldigungen bestreitet und sich zu verteidigen gedenkt. Dies ist jedoch nicht die erste rechtliche Anfechtung, mit der sich das Unternehmen wegen seiner Praktiken zur Erhebung von Trainingsdaten konfrontiert sieht.
Im August 2024 reichte eine Gruppe von Autoren eine Sammelklage gegen Anthropic ein und behauptete, das Unternehmen habe ihre urheberrechtlich geschützten Werke ohne Zustimmung verwendet. Sie behaupteten, das Unternehmen habe seine Modelle ohne Erlaubnis auf Bücher und andere Schriften trainiert und verlangte dann eine Entschädigung für die Nutzung der Inhalte.
Eine ähnliche Klage vom Oktober 2023 betraf die Universal Music Group und andere Verleger, die Anthropic verklagten, weil es angeblich urheberrechtlich geschützte Liedtexte durch seinen Claude-Chatbot reproduzierte. Die Musikunternehmen argumentierten, dass dies ihre geistigen Eigentumsrechte verletze, und beantragten eine einstweilige Verfügung gegen die weitere Verwendung von Liedtexten.
Im Gegensatz zu diesen Fällen geht es in der Klage von Reddit nicht um das Urheberrecht. Stattdessen geht es um Vertragsbruch und unlauteren Wettbewerb. Reddit macht geltend, dass die Daten auf seiner Website nicht nur öffentlich sind, sondern auch Bedingungen unterliegen, die Anthropic wissentlich ignoriert hat. Diese Unterscheidung könnte einen wichtigen Präzedenzfall für Plattformen schaffen, die nutzergenerierte Inhalte hosten, deren Verwendung in kommerziellen KI-Systemen aber zu regulieren versuchen.
Reddit wirft Anthropic außerdem vor, die Öffentlichkeit in die Irre zu führen. In der Klage wird auf die öffentlichen Erklärungen von Anthropic verwiesen, in denen behauptet wird, dass das Unternehmen die Regeln für Scraping einhält und die Privatsphäre der Nutzer respektiert - Behauptungen, die laut Reddit durch das tatsächliche Verhalten des Unternehmens widerlegt werden.
"Trotz der Aussagen in seinem Marketingmaterial schert sich Anthropic nicht um die Regeln von Reddit oder die Nutzer", heißt es in der Klage. "Es glaubt, dass es das Recht hat, ungestraft jeden beliebigen Inhalt zu nehmen und ihn zu verwenden, wie es will.
Nach Bekanntgabe der Klage stiegen die Aktien von Reddit um fast 67 %, was darauf hindeutet, dass die Investoren die Klage unterstützen. Das Ergebnis könnte einen rechtlichen Maßstab für die Abwägung zwischen offenen Internetinhalten und den Rechten von Nutzern und Inhaltseigentümern setzen.
Da immer mehr KI-Unternehmen von großen Mengen an Online-Daten abhängig sind, werden die rechtlichen und ethischen Auswirkungen des Web Scraping immer dringlicher. Der Fall Reddit reiht sich ein in eine wachsende Zahl von Gerichtsverfahren, die die nächste Phase der KI-Entwicklung beeinflussen werden.
Siehe auch: Ethik in der Automatisierung: Voreingenommenheit und Compliance in der KI
Möchten Sie mehr über KI und Big Data von Branchenführern erfahren? Besuchen Sie die AI & Big Data Expo, die in Amsterdam, Kalifornien und London stattfindet. Die umfassende Veranstaltung findet gemeinsam mit anderen führenden Events statt, darunter die Intelligent Automation Conference, BlockX, Digital Transformation Week und Cyber Security & Cloud Expo.
Hier finden Sie weitere Veranstaltungen und Webinare zu Unternehmenstechnologien, die von TechForge unterstützt werden.
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.











