저자는 저작권 침해 혐의로 Openai와 Meta를 고소합니다
사라 실버먼과 공동 저자들이 메타와 오픈AI를 상대로 법적 조치를 취하다
사라 실버먼과 작가 리처드 캐드프리, 크리스토퍼 골든은 메타와 오픈AI를 상대로 저작권 침해 혐의로 법적 소송을 시작했다. 이들 작가는 자신들의 저작권이 있는 책이 동의 없이 오픈AI의 ChatGPT와 메타의 LLaMa를 구동하는 대규모 언어 모델(LLM) 훈련에 사용되었다고 주장한다.
소송은 각각의 회사를 대상으로 별도로 진행된다. 그들의 주장의 핵심은 그들의 작품이 이러한 LLM의 훈련 데이터셋에 포함되어 무단으로 사용된 것이라고 본다.
대규모 언어 모델 이해하기
LLM은 책과 인터넷 콘텐츠를 포함한 방대한 텍스트 데이터로부터 학습하는 고급 AI 알고리즘이다. 이 훈련을 통해 모델은 언어 패턴, 문법, 맥락을 이해할 수 있게 되며, 결국 인간의 글쓰기를 모방한 텍스트를 생성하고 사용자와 대화형 상호작용을 할 수 있게 된다.
소송은 이러한 모델이 수천 명의 작가의 저작권 자료를 허가, 보상, 또는 인정 없이 본질적으로 "리믹스"한다고 주장한다.
AI와 저작권의 더 넓은 맥락
ChatGPT의 등장 이후 저작권 침해 문제는 생성 AI 기술의 급증을 촉발하며 중요한 관심사로 떠올랐다. 이는 AI가 창의성과 저작권 프로세스에 미치는 영향에 대한 질문을 제기했다.
소송은 LLM이 "그림자 도서관" 웹사이트에서 불법적으로 얻은 자료를 사용하여 훈련되었다고 주장한다. 오픈AI 소송은 특히 "OpenAI Books2 데이터셋"을 언급하며, 이는 Library Genesis, Z-Library, Sci-Hub, Bibliotik과 같은 악명 높은 사이트에서 약 294,000개의 제목을 포함한 것으로 알려져 있으며, 토렌트 시스템을 통해 접근 가능하다.
마찬가지로, 메타 소송은 그들의 훈련 데이터의 두 가지 출처를 지적한다: 저작권이 만료된 책의 아카이브인 Project Gutenberg와 Hugging Face의 "ThePile의 Books3 섹션" 데이터셋으로, 이는 전체 Bibliotik 컬렉션을 포함하는 것으로 보인다.
법적 대리 및 관련 사례
사라 실버먼과 동료 원고들은 변호사 조셉 세이버리와 매튜 버터릭이 대리한다. 이 변호사들은 또한 모나 아와드와 폴 트렘블레이 작가가 오픈AI를 상대로 제기한 별도의 소송을 6월에 처리하고 있으며, 이 역시 저작권 침해 혐의와 관련이 있다.

진행 중인 법적 다툼은 AI 개발과 콘텐츠 창작자의 권리 사이의 긴장을 강조하며, AI 기술이 발전함에 따라 계속 진화하는 주제이다.
관련 기사
iFLYTEK, Spark X2.5 범용 대형 모델을 공개하다
9월 1일, iFlytek은 최신 공식 발표에 따라 에지 중심의 대형 언어 모델인 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B를 오픈소스로 공개합니다. 두 모델은 모두 최대 100만 토큰의 컨텍스트 창을 네이티브로 지원합니다. 이들은 지능형 에이전트 상호작용, 수학적 추론, 일반 이해력 등 주요 영역에서 상당한 개선을 제공하며, 차량 내 시스템, 스마트 기기, IoT 생태계와 같은 에지 애플리케이션에 견고한 지원을 제공합니다.
사용자 반발 이후 메타, AI 사진 편집 기능 제거
Meta, the social media giant, is once again embroiled in a public debate regarding the delicate balance between artificial intelligence and user privacy. According to TechCrunch, Meta’s Superintelligence Labs introduced a new AI image generator, Muse
딥마인드 CEO 하사비스: 하루 6시간 수면, 보통 오후 1시경에 활력을 느낍니다
Fortune는 최근 Google DeepMind의 CEO인 데미스 하사비스와의 인터뷰를 소개하며, 그의 비전통적인 휴식 및 생산성 접근 방식을 공개했다. 하사비스는 자신이 매우 적게 잠을 자며, 깨어 있는 시간을 두 개의 명확한 업무 블록으로 구조화한다고 밝혔다.그의 수면 습관에 대해 하사비스는 "6시간을 목표로 하지만, 제 습관은 비정형적입니다. 하루 종일 효과적으로 기능할 수 있습니다."라고 언급했다. 그는 6시간 미만의 수면이 뇌 건강
관련 특별 주제 추천
의견 (20)
0/500
Sarah Silverman mit einem Rechtsstreit gegen Tech-Giganten ist eine mutige, aber vielleicht aussichtslose Sache. KI-Trainingsdaten und Urheberrecht — das wird noch jahrelang juristische Diskussionen füttern. Irgendwie wirkt es wie David gegen Goliath, aber dieses Mal haben die Goliaths Zugriff auf nahezu alle digitalisierten Bücher der Welt. Vielleicht braucht es solche Klagen, um überhaupt einen gesetzlichen Rahmen zu schaffen. 🤔
이 뉴스 보니까 생각이 좀 복잡해지네요. AI가 학습하는 과정에서 저작권 문제가 계속 불거지는군요. 실버먼 작가분들 소송이 어떻게 될지 궁금하긴 한데, 결국 법원 판단에 달린 문제 같아요. AI 발전을 위해선 데이터 접근이 필요하지만 창작자의 권리도 분명히 보호돼야 하고... 🤔 앞으로 이런 논쟁이 더 많아질 텐데, 관련 법이 빨리 정립됐으면 좋겠어요.
GPTの学習データってやっぱり著作権が問題になるよねー。この訴訟、どう転ぶか気になります。AI進化には大量のデータが必須だけど、クリエイターの権利もきちんと守れる仕組みが必要だな。勝敗が今後の生成AIビジネスに大きな影響を与えそう。
This lawsuit is wild! 😮 I mean, authors like Sarah Silverman going after Meta and OpenAI for copyright? That’s a bold move. Makes me wonder if AI’s just gobbling up books like a kid with candy. Hope this sparks a bigger chat about ethics in tech!
This lawsuit is wild! 😮 Silverman and others taking on Meta and OpenAI for copyright issues? I’m curious how this plays out—could set a big precedent for AI and creativity!
사라 실버먼과 공동 저자들이 메타와 오픈AI를 상대로 법적 조치를 취하다
사라 실버먼과 작가 리처드 캐드프리, 크리스토퍼 골든은 메타와 오픈AI를 상대로 저작권 침해 혐의로 법적 소송을 시작했다. 이들 작가는 자신들의 저작권이 있는 책이 동의 없이 오픈AI의 ChatGPT와 메타의 LLaMa를 구동하는 대규모 언어 모델(LLM) 훈련에 사용되었다고 주장한다.
소송은 각각의 회사를 대상으로 별도로 진행된다. 그들의 주장의 핵심은 그들의 작품이 이러한 LLM의 훈련 데이터셋에 포함되어 무단으로 사용된 것이라고 본다.
대규모 언어 모델 이해하기
LLM은 책과 인터넷 콘텐츠를 포함한 방대한 텍스트 데이터로부터 학습하는 고급 AI 알고리즘이다. 이 훈련을 통해 모델은 언어 패턴, 문법, 맥락을 이해할 수 있게 되며, 결국 인간의 글쓰기를 모방한 텍스트를 생성하고 사용자와 대화형 상호작용을 할 수 있게 된다.
소송은 이러한 모델이 수천 명의 작가의 저작권 자료를 허가, 보상, 또는 인정 없이 본질적으로 "리믹스"한다고 주장한다.
AI와 저작권의 더 넓은 맥락
ChatGPT의 등장 이후 저작권 침해 문제는 생성 AI 기술의 급증을 촉발하며 중요한 관심사로 떠올랐다. 이는 AI가 창의성과 저작권 프로세스에 미치는 영향에 대한 질문을 제기했다.
소송은 LLM이 "그림자 도서관" 웹사이트에서 불법적으로 얻은 자료를 사용하여 훈련되었다고 주장한다. 오픈AI 소송은 특히 "OpenAI Books2 데이터셋"을 언급하며, 이는 Library Genesis, Z-Library, Sci-Hub, Bibliotik과 같은 악명 높은 사이트에서 약 294,000개의 제목을 포함한 것으로 알려져 있으며, 토렌트 시스템을 통해 접근 가능하다.
마찬가지로, 메타 소송은 그들의 훈련 데이터의 두 가지 출처를 지적한다: 저작권이 만료된 책의 아카이브인 Project Gutenberg와 Hugging Face의 "ThePile의 Books3 섹션" 데이터셋으로, 이는 전체 Bibliotik 컬렉션을 포함하는 것으로 보인다.
법적 대리 및 관련 사례
사라 실버먼과 동료 원고들은 변호사 조셉 세이버리와 매튜 버터릭이 대리한다. 이 변호사들은 또한 모나 아와드와 폴 트렘블레이 작가가 오픈AI를 상대로 제기한 별도의 소송을 6월에 처리하고 있으며, 이 역시 저작권 침해 혐의와 관련이 있다.
진행 중인 법적 다툼은 AI 개발과 콘텐츠 창작자의 권리 사이의 긴장을 강조하며, AI 기술이 발전함에 따라 계속 진화하는 주제이다.
iFLYTEK, Spark X2.5 범용 대형 모델을 공개하다
9월 1일, iFlytek은 최신 공식 발표에 따라 에지 중심의 대형 언어 모델인 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B를 오픈소스로 공개합니다. 두 모델은 모두 최대 100만 토큰의 컨텍스트 창을 네이티브로 지원합니다. 이들은 지능형 에이전트 상호작용, 수학적 추론, 일반 이해력 등 주요 영역에서 상당한 개선을 제공하며, 차량 내 시스템, 스마트 기기, IoT 생태계와 같은 에지 애플리케이션에 견고한 지원을 제공합니다.
사용자 반발 이후 메타, AI 사진 편집 기능 제거
Meta, the social media giant, is once again embroiled in a public debate regarding the delicate balance between artificial intelligence and user privacy. According to TechCrunch, Meta’s Superintelligence Labs introduced a new AI image generator, Muse
딥마인드 CEO 하사비스: 하루 6시간 수면, 보통 오후 1시경에 활력을 느낍니다
Fortune는 최근 Google DeepMind의 CEO인 데미스 하사비스와의 인터뷰를 소개하며, 그의 비전통적인 휴식 및 생산성 접근 방식을 공개했다. 하사비스는 자신이 매우 적게 잠을 자며, 깨어 있는 시간을 두 개의 명확한 업무 블록으로 구조화한다고 밝혔다.그의 수면 습관에 대해 하사비스는 "6시간을 목표로 하지만, 제 습관은 비정형적입니다. 하루 종일 효과적으로 기능할 수 있습니다."라고 언급했다. 그는 6시간 미만의 수면이 뇌 건강
Sarah Silverman mit einem Rechtsstreit gegen Tech-Giganten ist eine mutige, aber vielleicht aussichtslose Sache. KI-Trainingsdaten und Urheberrecht — das wird noch jahrelang juristische Diskussionen füttern. Irgendwie wirkt es wie David gegen Goliath, aber dieses Mal haben die Goliaths Zugriff auf nahezu alle digitalisierten Bücher der Welt. Vielleicht braucht es solche Klagen, um überhaupt einen gesetzlichen Rahmen zu schaffen. 🤔
이 뉴스 보니까 생각이 좀 복잡해지네요. AI가 학습하는 과정에서 저작권 문제가 계속 불거지는군요. 실버먼 작가분들 소송이 어떻게 될지 궁금하긴 한데, 결국 법원 판단에 달린 문제 같아요. AI 발전을 위해선 데이터 접근이 필요하지만 창작자의 권리도 분명히 보호돼야 하고... 🤔 앞으로 이런 논쟁이 더 많아질 텐데, 관련 법이 빨리 정립됐으면 좋겠어요.
GPTの学習データってやっぱり著作権が問題になるよねー。この訴訟、どう転ぶか気になります。AI進化には大量のデータが必須だけど、クリエイターの権利もきちんと守れる仕組みが必要だな。勝敗が今後の生成AIビジネスに大きな影響を与えそう。
This lawsuit is wild! 😮 I mean, authors like Sarah Silverman going after Meta and OpenAI for copyright? That’s a bold move. Makes me wonder if AI’s just gobbling up books like a kid with candy. Hope this sparks a bigger chat about ethics in tech!
This lawsuit is wild! 😮 Silverman and others taking on Meta and OpenAI for copyright issues? I’m curious how this plays out—could set a big precedent for AI and creativity!





집






