딥시크, 프론티어 시스템즈에 필적하는 AI 모델 공개

중국의 AI 연구소 DeepSeek은 AI 커뮤니티에 큰 반향을 일으켰던 작년 V3.2 모델과 이에 수반된 R1 추론 모델의 대대적인 업데이트인 최신 대규모 언어 모델 ‘DeepSeek V4’의 두 가지 프리뷰 버전을 공개했다.
이 회사는 'DeepSeek V4 Flash'와 'V4 Pro' 모두 전문가 혼합(Mixture-of-Experts) 모델이며, 각각 100만 토큰 규모의 컨텍스트 윈도우를 갖추고 있어 프롬프트 내의 방대한 코드베이스나 문서를 처리하기에 충분하다고 밝혔습니다. 이 전문가 혼합 방식은 작업별로 특정 매개변수 하위 집합만 활성화하여 추론 비용을 절감합니다.
Pro 모델은 총 1.6조 개의 파라미터(활성 파라미터 490억 개)를 자랑하며, 이는 현재 공개된 모델 중 가장 큰 규모입니다. 이는 Moonshot AI의 Kimi K 2.6(1.1조 개), MiniMax의 M1(4,560억 개)과 같은 경쟁사 모델들을 능가하며, DeepSeek V3.2(6,710억 개)의 두 배가 넘는 규모입니다. 더 작은 규모의 V4 Flash 모델은 2,840억 개의 파라미터(활성 파라미터 130억 개)를 포함합니다.
DeepSeek은 아키텍처 개선을 통해 두 신규 모델이 DeepSeek V3.2보다 더 효율적이고 성능이 우수해졌으며, 추론 벤치마크에서 오픈소스 및 비오픈소스 현 주류 모델들과의 "격차를 거의 좁혔다"고 주장합니다.
이 연구소는 새로운 V4-Pro-Max 모델이 추론 벤치마크 전반에서 오픈소스 경쟁 모델들을 능가하며, 특정 작업에서는 OpenAI의 GPT-5.2 및 Gemini 3.0 Pro의 성능을 뛰어넘는다고 보고했다. 코딩 경진대회 벤치마크에서 DeepSeek은 두 V4 모델의 성능이 "GPT-5.4와 비교할 수 있는 수준"이라고 밝혔다.
그러나 지식 기반 평가에서는, 특히 OpenAI의 GPT-5.4 및 최신 Google Gemini 3.1 Pro와 비교했을 때, 이 모델들이 최첨단 모델들에 비해 다소 뒤처지는 것으로 보인다. 연구소에 따르면 이러한 격차는 "최첨단 모델들보다 약 3~6개월 정도 뒤처진 개발 궤적"을 나타낸다고 한다.
오디오, 비디오, 이미지 생성을 지원하는 많은 비공개 소스 경쟁 모델들과 달리, V4 Flash와 V4 Pro는 모두 텍스트 전용 모델입니다.
주요 장점은 DeepSeek V4가 현재의 최첨단 모델들보다 비용 효율성이 훨씬 높다는 점이다. 더 작은 규모의 V4 Flash는 입력 토큰 100만 개당 0.14달러, 출력 토큰 100만 개당 0.28달러로 책정되어 GPT-5.4 Nano, Gemini 3.1 Flash, GPT-5.4 Mini, Claude Haiku 4.5보다 저렴한 가격을 제시한다. 더 큰 규모의 V4 Pro 모델은 입력 토큰 100만 개당 0.145달러, 출력 토큰 100만 개당 3.48달러로, Gemini 3.1 Pro, GPT-5.5, Claude Opus 4.7, GPT-5.4보다도 저렴한 요금을 제공합니다.
이번 출시 소식은 미국이 중국이 수천 개의 프록시 계정을 이용해 미국 AI 연구소로부터 산업 규모로 지적 재산권을 도용하고 있다고 주장한 지 하루 만에 전해졌다. 딥시크(DeepSeek)는 앤트로픽(Anthropic)과 오픈AI(OpenAI)로부터 자사의 AI 모델을 "정제(distilling)"하거나 사실상 복제했다는 비난을 받아온 바 있다.
관련 기사
미국의 중국 AI 기업에 대한 지적재산권 우려로 인한 제재 신호
화요일, 스콧 베센트 미국 재무장관은 중국산 오픈소스 모델에 대한 지적재산권 도용 가능성을 검토하겠다고 발표하며, 이러한 위반 사실이 확인될 경우 중국 AI 기업에 대한 제재를 경고했다.“우리는 미국 내 대형 언어 모델을 위협하는 오픈소스 모델에 대한 많은 논의를 목격했다,”라고 베센트 장관은 화요일 폭스 비즈니스에서 말했다. “이번 행정부는 오픈소스 모델을 지지하지만, 우리가 지지하지 않는 것은 지적재산권 도용이다. 특히 해외 모델이 우리의
왜 나는 작은 오픈소스 AI 개발사 ‘아르시(Arcee)’를 응원하지 않을 수 없는가
26명의 소규모 인원으로 구성된 미국 스타트업 아르시(Arcee)는, 2,000만 달러라는 비교적 적은 예산으로 개발된 4,000억 매개변수를 자랑하는 대규모 오픈소스 대규모 언어 모델(LLM)인 최신 추론 모델 ‘트리니티 라지 싱킹(Trinity Large Thinking)’을 공개했다. 마크 맥퀘이드(Mark McQuade) CEO는 테크크런치(Tech
사티아 나델라, AI를 활용하는 기업들에 엄중한 경고를 보내다
AI의 잠재적 단점을 둘러싼 수많은 논쟁 중에서도, 실리콘밸리의 AI 열성 지지자들을 특히 불안하게 만드는 우려가 하나 있습니다. 바로 독자적인 모델을 판매하는 주요 AI 연구소들이 ‘트로이 목마’처럼 활동하고 있을지도 모른다는 점입니다.스타트업과 기업들이 OpenAI나 Anthropic 같은 연구소의 AI 모델을 도입함에 따라, 해당 연구소들이 기업의 가
관련 특별 주제 추천
의견 (0)
0/500

중국의 AI 연구소 DeepSeek은 AI 커뮤니티에 큰 반향을 일으켰던 작년 V3.2 모델과 이에 수반된 R1 추론 모델의 대대적인 업데이트인 최신 대규모 언어 모델 ‘DeepSeek V4’의 두 가지 프리뷰 버전을 공개했다.
이 회사는 'DeepSeek V4 Flash'와 'V4 Pro' 모두 전문가 혼합(Mixture-of-Experts) 모델이며, 각각 100만 토큰 규모의 컨텍스트 윈도우를 갖추고 있어 프롬프트 내의 방대한 코드베이스나 문서를 처리하기에 충분하다고 밝혔습니다. 이 전문가 혼합 방식은 작업별로 특정 매개변수 하위 집합만 활성화하여 추론 비용을 절감합니다.
Pro 모델은 총 1.6조 개의 파라미터(활성 파라미터 490억 개)를 자랑하며, 이는 현재 공개된 모델 중 가장 큰 규모입니다. 이는 Moonshot AI의 Kimi K 2.6(1.1조 개), MiniMax의 M1(4,560억 개)과 같은 경쟁사 모델들을 능가하며, DeepSeek V3.2(6,710억 개)의 두 배가 넘는 규모입니다. 더 작은 규모의 V4 Flash 모델은 2,840억 개의 파라미터(활성 파라미터 130억 개)를 포함합니다.
DeepSeek은 아키텍처 개선을 통해 두 신규 모델이 DeepSeek V3.2보다 더 효율적이고 성능이 우수해졌으며, 추론 벤치마크에서 오픈소스 및 비오픈소스 현 주류 모델들과의 "격차를 거의 좁혔다"고 주장합니다.
이 연구소는 새로운 V4-Pro-Max 모델이 추론 벤치마크 전반에서 오픈소스 경쟁 모델들을 능가하며, 특정 작업에서는 OpenAI의 GPT-5.2 및 Gemini 3.0 Pro의 성능을 뛰어넘는다고 보고했다. 코딩 경진대회 벤치마크에서 DeepSeek은 두 V4 모델의 성능이 "GPT-5.4와 비교할 수 있는 수준"이라고 밝혔다.
그러나 지식 기반 평가에서는, 특히 OpenAI의 GPT-5.4 및 최신 Google Gemini 3.1 Pro와 비교했을 때, 이 모델들이 최첨단 모델들에 비해 다소 뒤처지는 것으로 보인다. 연구소에 따르면 이러한 격차는 "최첨단 모델들보다 약 3~6개월 정도 뒤처진 개발 궤적"을 나타낸다고 한다.
오디오, 비디오, 이미지 생성을 지원하는 많은 비공개 소스 경쟁 모델들과 달리, V4 Flash와 V4 Pro는 모두 텍스트 전용 모델입니다.
주요 장점은 DeepSeek V4가 현재의 최첨단 모델들보다 비용 효율성이 훨씬 높다는 점이다. 더 작은 규모의 V4 Flash는 입력 토큰 100만 개당 0.14달러, 출력 토큰 100만 개당 0.28달러로 책정되어 GPT-5.4 Nano, Gemini 3.1 Flash, GPT-5.4 Mini, Claude Haiku 4.5보다 저렴한 가격을 제시한다. 더 큰 규모의 V4 Pro 모델은 입력 토큰 100만 개당 0.145달러, 출력 토큰 100만 개당 3.48달러로, Gemini 3.1 Pro, GPT-5.5, Claude Opus 4.7, GPT-5.4보다도 저렴한 요금을 제공합니다.
이번 출시 소식은 미국이 중국이 수천 개의 프록시 계정을 이용해 미국 AI 연구소로부터 산업 규모로 지적 재산권을 도용하고 있다고 주장한 지 하루 만에 전해졌다. 딥시크(DeepSeek)는 앤트로픽(Anthropic)과 오픈AI(OpenAI)로부터 자사의 AI 모델을 "정제(distilling)"하거나 사실상 복제했다는 비난을 받아온 바 있다.
미국의 중국 AI 기업에 대한 지적재산권 우려로 인한 제재 신호
화요일, 스콧 베센트 미국 재무장관은 중국산 오픈소스 모델에 대한 지적재산권 도용 가능성을 검토하겠다고 발표하며, 이러한 위반 사실이 확인될 경우 중국 AI 기업에 대한 제재를 경고했다.“우리는 미국 내 대형 언어 모델을 위협하는 오픈소스 모델에 대한 많은 논의를 목격했다,”라고 베센트 장관은 화요일 폭스 비즈니스에서 말했다. “이번 행정부는 오픈소스 모델을 지지하지만, 우리가 지지하지 않는 것은 지적재산권 도용이다. 특히 해외 모델이 우리의
왜 나는 작은 오픈소스 AI 개발사 ‘아르시(Arcee)’를 응원하지 않을 수 없는가
26명의 소규모 인원으로 구성된 미국 스타트업 아르시(Arcee)는, 2,000만 달러라는 비교적 적은 예산으로 개발된 4,000억 매개변수를 자랑하는 대규모 오픈소스 대규모 언어 모델(LLM)인 최신 추론 모델 ‘트리니티 라지 싱킹(Trinity Large Thinking)’을 공개했다. 마크 맥퀘이드(Mark McQuade) CEO는 테크크런치(Tech
사티아 나델라, AI를 활용하는 기업들에 엄중한 경고를 보내다
AI의 잠재적 단점을 둘러싼 수많은 논쟁 중에서도, 실리콘밸리의 AI 열성 지지자들을 특히 불안하게 만드는 우려가 하나 있습니다. 바로 독자적인 모델을 판매하는 주요 AI 연구소들이 ‘트로이 목마’처럼 활동하고 있을지도 모른다는 점입니다.스타트업과 기업들이 OpenAI나 Anthropic 같은 연구소의 AI 모델을 도입함에 따라, 해당 연구소들이 기업의 가





집






