Lar
Reddit abre processo contra a Anthropic por causa da coleta de dados de usuários para treinamento de IA
O Reddit está tomando medidas legais contra a Anthropic, alegando que a empresa de IA coletou conteúdo de usuários de sua plataforma sem permissão para treinar seus modelos de IA da Claude. A queixa, apresentada em um tribunal do estado da Califórnia, afirma que a Anthropic fez mais de 100.000 solicitações não autorizadas aos servidores do Reddit, mesmo depois de afirmar publicamente que havia parado.
O processo alega que a Anthropic desconsiderou tanto as proteções técnicas quanto seus termos de serviço. De acordo com o Reddit, a Anthropic contornou proteções como o arquivo robots.txt, que foi projetado para bloquear a raspagem automatizada. A plataforma também alega que a Anthropic violou a privacidade do usuário ao coletar e usar postagens pessoais - incluindo material excluído - para ganho comercial.
O Reddit observa que fornece acesso a dados estruturados por meio de parcerias oficiais de licenciamento com empresas como OpenAI e Google. Esses acordos incluem cláusulas que regem o uso do conteúdo, a proteção da privacidade e a remoção de dados. O Reddit afirma que a Anthropic rejeitou entrar em um acordo formal de licenciamento, optando por raspar o conteúdo diretamente para evitar taxas e contornar as proteções do usuário.
O processo cita um artigo de pesquisa de 2021 de coautoria do CEO da Anthropic, Dario Amodei, que identificou o Reddit como uma fonte valiosa de dados de treinamento para modelos de linguagem. O Reddit também apresentou casos em que Claude parecia reproduzir postagens do Reddit quase literalmente - incluindo conteúdo que os usuários haviam excluído. Isso, de acordo com o Reddit, demonstra a falha da Anthropic em implementar salvaguardas que respeitem a privacidade do usuário ou as solicitações de remoção de conteúdo.
O Reddit está buscando indenização monetária e uma ordem judicial proibindo a Anthropic de usar o conteúdo do Reddit em futuras iterações de seus modelos.
A Anthropic respondeu, afirmando que contesta as alegações e pretende se defender. No entanto, esse não é o primeiro desafio legal que a empresa enfrenta em relação às suas práticas de coleta de dados de treinamento.
Em agosto de 2024, um grupo de autores entrou com uma ação coletiva contra a Anthropic, alegando que ela usou seus trabalhos protegidos por direitos autorais sem consentimento. Eles alegaram que a empresa treinou seus modelos em livros e outros escritos sem permissão e, em seguida, solicitou uma compensação pelo uso do conteúdo.
Uma ação judicial semelhante, de outubro de 2023, envolveu o Universal Music Group e outras editoras, que processaram a Anthropic por supostamente reproduzir letras de músicas protegidas por direitos autorais por meio de seu chatbot Claude. As empresas de música argumentaram que isso infringia seus direitos de propriedade intelectual e pediram uma liminar contra o uso posterior das letras.
Diferentemente desses casos, o processo do Reddit não gira em torno de direitos autorais. Em vez disso, ele se concentra na quebra de contrato e na concorrência desleal. O Reddit alega que os dados de seu site não são meramente públicos - eles estão sujeitos a termos que a Anthropic ignorou conscientemente. Essa distinção pode estabelecer um precedente importante para plataformas que hospedam conteúdo gerado pelo usuário, mas buscam regular seu uso em sistemas comerciais de IA.
O Reddit também acusa a Anthropic de enganar o público. O processo aponta para as declarações públicas da Anthropic afirmando que ela segue as regras de raspagem e respeita a privacidade do usuário - afirmações que o Reddit diz serem contraditas pela conduta real da empresa.
"Apesar do que diz seu material de marketing, a Anthropic não se importa com as regras ou os usuários do Reddit", afirma a denúncia. "Ela acredita que tem o direito de pegar o conteúdo que quiser e usá-lo como quiser, com impunidade."
Depois que o processo foi anunciado, as ações do Reddit subiram quase 67%, indicando o apoio dos investidores ao desafio legal. O resultado pode estabelecer uma referência legal para equilibrar o conteúdo aberto da Internet com os direitos dos usuários e proprietários de conteúdo.
À medida que mais empresas de IA dependem de grandes quantidades de dados on-line, as implicações legais e éticas da raspagem da Web estão se tornando cada vez mais urgentes. O caso do Reddit contribui para um número crescente de ações judiciais que influenciarão a próxima fase do desenvolvimento da IA.
Veja também: Ética na automação: Abordando a parcialidade e a conformidade na IA
Quer saber mais sobre IA e Big Data com os líderes do setor? Confira a AI & Big Data Expo, que será realizada em Amsterdã, Califórnia e Londres. O evento abrangente é co-localizado com outros eventos importantes, incluindo a Intelligent Automation Conference, BlockX, Digital Transformation Week e Cyber Security & Cloud Expo.
Explore outros eventos de tecnologia corporativa e webinars futuros realizados pela TechForge aqui.
Artigo relacionado
A Warner Music adquire a startup de atribuição de IA Sureel AI
A Warner Music Group (WMG) confirmou na quarta-feira que está adquirindo a Sureel AI, uma startup de atribuição por inteligência artificial. A tecnologia proprietária da Sureel gera “DNA de IA” para faixas musicais, desconstruindo-as em elementos con
A Amazon apresenta a Alexa para Compras, enquanto coloca o Rufus em segundo plano
A Amazon lançou a Alexa para Compras, integrando seu chatbot de compras Rufus com o Alexa+ em todo o aplicativo, site e dispositivos Echo Show.O assistente responde a consultas sobre produtos, compara itens, rastreia preços e oferece suporte para le
A Microsoft, o Azure e a tecnologia de IA combatem os riscos de incêndios florestais na Califórnia
A Microsoft investe na detecção de incêndios florestais com tecnologia de IA, e Juan Lavista Ferres, vice-presidente corporativo e cientista-chefe de dados, discute estratégias para mitigar os danos a
Recomendações de tópicos especiais relacionados
Comentários (2)
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.
O Reddit está tomando medidas legais contra a Anthropic, alegando que a empresa de IA coletou conteúdo de usuários de sua plataforma sem permissão para treinar seus modelos de IA da Claude. A queixa, apresentada em um tribunal do estado da Califórnia, afirma que a Anthropic fez mais de 100.000 solicitações não autorizadas aos servidores do Reddit, mesmo depois de afirmar publicamente que havia parado.
O processo alega que a Anthropic desconsiderou tanto as proteções técnicas quanto seus termos de serviço. De acordo com o Reddit, a Anthropic contornou proteções como o arquivo robots.txt, que foi projetado para bloquear a raspagem automatizada. A plataforma também alega que a Anthropic violou a privacidade do usuário ao coletar e usar postagens pessoais - incluindo material excluído - para ganho comercial.
O Reddit observa que fornece acesso a dados estruturados por meio de parcerias oficiais de licenciamento com empresas como OpenAI e Google. Esses acordos incluem cláusulas que regem o uso do conteúdo, a proteção da privacidade e a remoção de dados. O Reddit afirma que a Anthropic rejeitou entrar em um acordo formal de licenciamento, optando por raspar o conteúdo diretamente para evitar taxas e contornar as proteções do usuário.
O processo cita um artigo de pesquisa de 2021 de coautoria do CEO da Anthropic, Dario Amodei, que identificou o Reddit como uma fonte valiosa de dados de treinamento para modelos de linguagem. O Reddit também apresentou casos em que Claude parecia reproduzir postagens do Reddit quase literalmente - incluindo conteúdo que os usuários haviam excluído. Isso, de acordo com o Reddit, demonstra a falha da Anthropic em implementar salvaguardas que respeitem a privacidade do usuário ou as solicitações de remoção de conteúdo.
O Reddit está buscando indenização monetária e uma ordem judicial proibindo a Anthropic de usar o conteúdo do Reddit em futuras iterações de seus modelos.
A Anthropic respondeu, afirmando que contesta as alegações e pretende se defender. No entanto, esse não é o primeiro desafio legal que a empresa enfrenta em relação às suas práticas de coleta de dados de treinamento.
Em agosto de 2024, um grupo de autores entrou com uma ação coletiva contra a Anthropic, alegando que ela usou seus trabalhos protegidos por direitos autorais sem consentimento. Eles alegaram que a empresa treinou seus modelos em livros e outros escritos sem permissão e, em seguida, solicitou uma compensação pelo uso do conteúdo.
Uma ação judicial semelhante, de outubro de 2023, envolveu o Universal Music Group e outras editoras, que processaram a Anthropic por supostamente reproduzir letras de músicas protegidas por direitos autorais por meio de seu chatbot Claude. As empresas de música argumentaram que isso infringia seus direitos de propriedade intelectual e pediram uma liminar contra o uso posterior das letras.
Diferentemente desses casos, o processo do Reddit não gira em torno de direitos autorais. Em vez disso, ele se concentra na quebra de contrato e na concorrência desleal. O Reddit alega que os dados de seu site não são meramente públicos - eles estão sujeitos a termos que a Anthropic ignorou conscientemente. Essa distinção pode estabelecer um precedente importante para plataformas que hospedam conteúdo gerado pelo usuário, mas buscam regular seu uso em sistemas comerciais de IA.
O Reddit também acusa a Anthropic de enganar o público. O processo aponta para as declarações públicas da Anthropic afirmando que ela segue as regras de raspagem e respeita a privacidade do usuário - afirmações que o Reddit diz serem contraditas pela conduta real da empresa.
"Apesar do que diz seu material de marketing, a Anthropic não se importa com as regras ou os usuários do Reddit", afirma a denúncia. "Ela acredita que tem o direito de pegar o conteúdo que quiser e usá-lo como quiser, com impunidade."
Depois que o processo foi anunciado, as ações do Reddit subiram quase 67%, indicando o apoio dos investidores ao desafio legal. O resultado pode estabelecer uma referência legal para equilibrar o conteúdo aberto da Internet com os direitos dos usuários e proprietários de conteúdo.
À medida que mais empresas de IA dependem de grandes quantidades de dados on-line, as implicações legais e éticas da raspagem da Web estão se tornando cada vez mais urgentes. O caso do Reddit contribui para um número crescente de ações judiciais que influenciarão a próxima fase do desenvolvimento da IA.
Veja também: Ética na automação: Abordando a parcialidade e a conformidade na IA
Quer saber mais sobre IA e Big Data com os líderes do setor? Confira a AI & Big Data Expo, que será realizada em Amsterdã, Califórnia e Londres. O evento abrangente é co-localizado com outros eventos importantes, incluindo a Intelligent Automation Conference, BlockX, Digital Transformation Week e Cyber Security & Cloud Expo.
Explore outros eventos de tecnologia corporativa e webinars futuros realizados pela TechForge aqui.
A Warner Music adquire a startup de atribuição de IA Sureel AI
A Warner Music Group (WMG) confirmou na quarta-feira que está adquirindo a Sureel AI, uma startup de atribuição por inteligência artificial. A tecnologia proprietária da Sureel gera “DNA de IA” para faixas musicais, desconstruindo-as em elementos con
A Microsoft, o Azure e a tecnologia de IA combatem os riscos de incêndios florestais na Califórnia
A Microsoft investe na detecção de incêndios florestais com tecnologia de IA, e Juan Lavista Ferres, vice-presidente corporativo e cientista-chefe de dados, discute estratégias para mitigar os danos a
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.











