일본의 거대 AI 모델, DeepSeek 표절 의혹 받아

일본 기술계의 이 같은 화제성 있는 출시 소식은 기술 투명성에 대한 공론화를 촉발시켰다. 라쿠텐 그룹은 최근 자사가 개발한 “가장 크고 강력한” 대규모 언어 모델을 공개했다. 이 700억 파라미터 규모의 모델은 일본 경제산업성(METI)이 ‘GENIAC’ 이니셔티브의 일환으로 지원한 프로젝트의 주요 성과물이다. 그러나 출시 직후 오픈소스 커뮤니티에서는 이 모델이 기존 모델을 단순히 재포장한 것에 불과한 것이 아니냐는 의문을 제기하기 시작했다.
개발자들은 이 모델의 핵심 아키텍처와 구성 파일이 중국 팀이 만든 모델을 명백히 가리키고 있음을 발견했다. 증거에 따르면 라쿠텐의 모델은 원래 식별자인 "DeepseekV3ForCausalLM"을 그대로 유지했을 뿐만 아니라, 완전히 새로 개발한 것이 아니라 일본 데이터를 사용해 미세 조정한 변형 모델인 것으로 나타났다.
이 논란은 많은 이들이 라쿠텐의 커뮤니케이션 및 라이선스 관리에서 "회색 지대"로 보는 부분을 둘러싸고 벌어지고 있다:
부적절한 공개: 공식 보도자료는 "오픈소스 커뮤니티의 정수를 통합했다"고만 언급했을 뿐, 기초 모델의 출처를 밝히지 않았습니다.
라이선스 관리 문제: 커뮤니티는 라쿠텐의 초기 릴리스에서 필수 MIT 라이선스 파일이 누락되었을 가능성을 지적했습니다. 법적 조건을 준수하기 위해 나중에 NOTICE 파일이 추가되었지만, 이러한 사후 수정은 개방성과 진정성이 부족하다는 비판을 받았습니다.
현재까지 라쿠텐 그룹은 라이선스 파일 삭제 문제나 눈에 띄는 아키텍처 유사성에 대해 직접적인 입장을 밝히지 않고 있다.
관련 기사
초지능의 등장: 우리가 이를 받아들일 것인가?
플레이어 로딩 중…AI 기업들은 초지능 AI가 필연적인 것처럼 이야기해 왔지만, 최근 OpenAI의 Hugging Face 침해 사건과 같은 안전 사고들은 인간보다 더 유능한 AI 시스템을 배포하는 잠재적 위험을 드러내고 있습니다. 그렇다면 우리가 이러한 시스템의 행동을 신뢰성 있게 제어할 수 없을 때 어떤 일이 발생할까요?이 TechCrunch의 Equity 에피소드에서 Rebecca Bellan은 AI 연구자이자 기업가이며 현재 비영리
iFLYTEK, Spark X2.5 범용 대형 모델을 공개하다
9월 1일, iFlytek은 최신 공식 발표에 따라 에지 중심의 대형 언어 모델인 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B를 오픈소스로 공개합니다. 두 모델은 모두 최대 100만 토큰의 컨텍스트 창을 네이티브로 지원합니다. 이들은 지능형 에이전트 상호작용, 수학적 추론, 일반 이해력 등 주요 영역에서 상당한 개선을 제공하며, 차량 내 시스템, 스마트 기기, IoT 생태계와 같은 에지 애플리케이션에 견고한 지원을 제공합니다.
사용자 반발 이후 메타, AI 사진 편집 기능 제거
Meta, the social media giant, is once again embroiled in a public debate regarding the delicate balance between artificial intelligence and user privacy. According to TechCrunch, Meta’s Superintelligence Labs introduced a new AI image generator, Muse
관련 특별 주제 추천
의견 (0)
0/500

일본 기술계의 이 같은 화제성 있는 출시 소식은 기술 투명성에 대한 공론화를 촉발시켰다. 라쿠텐 그룹은 최근 자사가 개발한 “가장 크고 강력한” 대규모 언어 모델을 공개했다. 이 700억 파라미터 규모의 모델은 일본 경제산업성(METI)이 ‘GENIAC’ 이니셔티브의 일환으로 지원한 프로젝트의 주요 성과물이다. 그러나 출시 직후 오픈소스 커뮤니티에서는 이 모델이 기존 모델을 단순히 재포장한 것에 불과한 것이 아니냐는 의문을 제기하기 시작했다.
개발자들은 이 모델의 핵심 아키텍처와 구성 파일이 중국 팀이 만든 모델을 명백히 가리키고 있음을 발견했다. 증거에 따르면 라쿠텐의 모델은 원래 식별자인 "DeepseekV3ForCausalLM"을 그대로 유지했을 뿐만 아니라, 완전히 새로 개발한 것이 아니라 일본 데이터를 사용해 미세 조정한 변형 모델인 것으로 나타났다.
이 논란은 많은 이들이 라쿠텐의 커뮤니케이션 및 라이선스 관리에서 "회색 지대"로 보는 부분을 둘러싸고 벌어지고 있다:
부적절한 공개: 공식 보도자료는 "오픈소스 커뮤니티의 정수를 통합했다"고만 언급했을 뿐, 기초 모델의 출처를 밝히지 않았습니다.
라이선스 관리 문제: 커뮤니티는 라쿠텐의 초기 릴리스에서 필수 MIT 라이선스 파일이 누락되었을 가능성을 지적했습니다. 법적 조건을 준수하기 위해 나중에 NOTICE 파일이 추가되었지만, 이러한 사후 수정은 개방성과 진정성이 부족하다는 비판을 받았습니다.
현재까지 라쿠텐 그룹은 라이선스 파일 삭제 문제나 눈에 띄는 아키텍처 유사성에 대해 직접적인 입장을 밝히지 않고 있다.
초지능의 등장: 우리가 이를 받아들일 것인가?
플레이어 로딩 중…AI 기업들은 초지능 AI가 필연적인 것처럼 이야기해 왔지만, 최근 OpenAI의 Hugging Face 침해 사건과 같은 안전 사고들은 인간보다 더 유능한 AI 시스템을 배포하는 잠재적 위험을 드러내고 있습니다. 그렇다면 우리가 이러한 시스템의 행동을 신뢰성 있게 제어할 수 없을 때 어떤 일이 발생할까요?이 TechCrunch의 Equity 에피소드에서 Rebecca Bellan은 AI 연구자이자 기업가이며 현재 비영리
iFLYTEK, Spark X2.5 범용 대형 모델을 공개하다
9월 1일, iFlytek은 최신 공식 발표에 따라 에지 중심의 대형 언어 모델인 Xinghuo X2.5-4B와 Xinghuo X2.5-1.7B를 오픈소스로 공개합니다. 두 모델은 모두 최대 100만 토큰의 컨텍스트 창을 네이티브로 지원합니다. 이들은 지능형 에이전트 상호작용, 수학적 추론, 일반 이해력 등 주요 영역에서 상당한 개선을 제공하며, 차량 내 시스템, 스마트 기기, IoT 생태계와 같은 에지 애플리케이션에 견고한 지원을 제공합니다.
사용자 반발 이후 메타, AI 사진 편집 기능 제거
Meta, the social media giant, is once again embroiled in a public debate regarding the delicate balance between artificial intelligence and user privacy. According to TechCrunch, Meta’s Superintelligence Labs introduced a new AI image generator, Muse





집






