DeepSeek, V4 미리보기 공개, 1M 긴 컨텍스트를 모든 사용자에게 제공
DeepSeek는 최신 모델 시리즈인 DeepSeek-V4 의 미리보기 버전을 공식 출시하고 오픈소스로 공개했습니다. 구조적 혁신을 통해 이 시리즈는 1M(백만 토큰)의 표준화된 초장문 컨텍스트 처리를 달성했으며, 에이전트 협업, 세계 지식, 논리적 추론 분야에서 국내 및 오픈소스 모델을 선도하고 있습니다.

두 가지 버전 구성: Pro는 우수성, Flash는 효율성
DeepSeek-V4 은 다양한 응용 요구에 맞춰 두 가지 사양을 제공합니다:
DeepSeek-V4-Pro (1.6T 파라미터, 49B 활성화): 성능은 최상위 폐쇄형 모델과 맞먹습니다. 에이전트 코딩 평가에서 최고의 오픈소스 결과를 달성하며, 출력 품질은 Opus4.6에 근접합니다. 수학, STEM, 경쟁적 코딩 테스트에서 모든 공개 평가된 오픈소스 모델을 능가하며 세계 수준의 추론 능력을 입증했습니다.
DeepSeek-V4-Flash (284B 파라미터, 13B 활성화): 극도의 비용 효율성을 우선시합니다. 세계 지식은 Pro 버전보다 약간 낮지만, 간단한 작업과 에이전트 성능에 있어 Pro 수준의 추론을 제공하며, 더 빠르고 경제적인 API 서비스를 제공합니다.
구조적 혁신: DSA 메커니즘으로 초장문 컨텍스트 접근성 확보
DeepSeek-V4 은 선구적인 **DSA 희소 어텐션 메커니즘**을 도입했습니다. 토큰 수준에서 압축함으로써 모델은 초장문 컨텍스트에 대한 계산 및 메모리 요구량을 크게 줄입니다. 이를 통해 1M 컨텍스트는 모든 DeepSeek 공식 서비스의 표준 기능이 되었으며, 긴 텍스트 처리의 높은 비용이라는 업계의 고질적 문제를 해결했습니다.
에이전트 생태계에 대한 심층 최적화
Claude Code 및 CodeBuddy와 같은 주요 에이전트 제품에 최적화된 DeepSeek-V4 은 생각하지 않는 모드와 생각하는 모드를 모두 지원합니다. API는 reasoning_effort 매개변수를 노출하여 사용자가 작업 복잡도에 따라 생각 강도(높음/최대)를 조정할 수 있게 하며, 코드 생성 및 문서 처리와 같은 복잡한 시나리오에서 성능을 크게 향상시킵니다.
접근 및 오픈소스 계획
사용자는 이제 공식 웹사이트 또는 공식 앱을 통해 최신 모델에 접근할 수 있으며, 해당 API 업데이트도 제공됩니다. 기존 모델 이름인 deepseek-chat과 deepseek-reasoner는 3개월 후(2026년 7월 24일까지) 중단될 예정임을 유의하시기 바랍니다.
오픈소스 링크: Hugging Face 및 Moba 커뮤니티 에서 이용 가능합니다.
기술 보고서: Hugging Face 저장소에 게시되었습니다.
이번 DeepSeek-V4 의 공개는 오픈소스 모델이 초장문 및 에이전트 능력 분야에서 최상위 폐쇄형 모델에追従하는 것이 실현 가능함을 입증했으며, 기술적 돌파구를 통해 AGI 대중화의 견고한 기반을 마련했습니다.
관련 기사
크롬과 엣지는 브라우저가 AI 추론 엔진으로 진화함에 따라 로컬 AI 모델의 저장 요구사항을 20GB로 조용히 상향 조정하고 있다
구글 크롬과 마이크로소프트 엣지는 로컬 AI 모델에 대한 디스크 공간 요구사항을 20GB로 높였습니다. 이 브라우저들은 백그라운드에서 모델을 자동으로 다운로드하여 온디바이스 AI 기능을 활성화합니다. 5월, 크롬이 모든 데이터를 구글 서버로 전송하는 대신 로컬에서 기능을 실행하기 위해 약 4GB의 AI 모델을 자동으로 다운로드하는 것이 발견되었습니다. 구글은 이후 공식 도움말 문서를 조용히 업데이트하여 필요한 여유 디스크 공간을 4GB에서 약
Zhipu AI, 5개월간 15배 성장 후 코딩에 집중하며 연수입 10억 달러 목표
여러 독립적인 정보원들은 지푸(Zhipu)의 연간 반복 수익(ARR)이 2026년 7월까지 10억 달러에 도달했음을 확인했다. 해당 보도에 대해 지푸는 아직 논평하지 않았다.AI 코딩과 비디오 생성은 생성형 AI의 가장 빠르게 성장하는 상업적 부문으로 부상했다. 국제 시장에서 앤트로픽(Anthropic)의 Claude Code는 출시 6개월 만에 10억 달러 ARR을 달성하며 기업 가치를 높였다. 지푸의 빠른 ARR 성장은 국내 대형 모델 기업
마이크로소프트, 첫 사이버보안 AI 모델 MAI-Cyber-1-Flash 공개 및 퍼셉션 보안 플랫폼 출시
Microsoft는 공식적으로 최초의 전용 사이버보안 모델인 MAI-Cyber-1-Flash과 새로운 AI 기반 보안 플랫폼인 Perception을 소개했습니다. 샌프란시스코 행사에서 공개된 이 혁신들은 Microsoft의 AI 보안 분야 입지를 강화하며, Anthropic, Google, OpenAI와 같은 업계 리더들과 직접 경쟁할 수 있는 위치를 점했습니다.사이버보안 워크플로우에 특화된 MAI-Cyber-1-Flash은 코드베이스 내의
관련 특별 주제 추천
의견 (0)
0/500
DeepSeek는 최신 모델 시리즈인

두 가지 버전 구성: Pro는 우수성, Flash는 효율성
DeepSeek-V4-Pro (1.6T 파라미터, 49B 활성화): 성능은 최상위 폐쇄형 모델과 맞먹습니다. 에이전트 코딩 평가에서 최고의 오픈소스 결과를 달성하며, 출력 품질은 Opus4.6에 근접합니다. 수학, STEM, 경쟁적 코딩 테스트에서 모든 공개 평가된 오픈소스 모델을 능가하며 세계 수준의 추론 능력을 입증했습니다.
DeepSeek-V4-Flash (284B 파라미터, 13B 활성화): 극도의 비용 효율성을 우선시합니다. 세계 지식은 Pro 버전보다 약간 낮지만, 간단한 작업과 에이전트 성능에 있어 Pro 수준의 추론을 제공하며, 더 빠르고 경제적인 API 서비스를 제공합니다.
구조적 혁신: DSA 메커니즘으로 초장문 컨텍스트 접근성 확보
에이전트 생태계에 대한 심층 최적화
Claude Code 및 CodeBuddy와 같은 주요 에이전트 제품에 최적화된 reasoning_effort 매개변수를 노출하여 사용자가 작업 복잡도에 따라 생각 강도(높음/최대)를 조정할 수 있게 하며, 코드 생성 및 문서 처리와 같은 복잡한 시나리오에서 성능을 크게 향상시킵니다.
접근 및 오픈소스 계획
사용자는 이제 deepseek-chat과 deepseek-reasoner는 3개월 후(2026년 7월 24일까지) 중단될 예정임을 유의하시기 바랍니다.
오픈소스 링크:
기술 보고서:
이번
크롬과 엣지는 브라우저가 AI 추론 엔진으로 진화함에 따라 로컬 AI 모델의 저장 요구사항을 20GB로 조용히 상향 조정하고 있다
구글 크롬과 마이크로소프트 엣지는 로컬 AI 모델에 대한 디스크 공간 요구사항을 20GB로 높였습니다. 이 브라우저들은 백그라운드에서 모델을 자동으로 다운로드하여 온디바이스 AI 기능을 활성화합니다. 5월, 크롬이 모든 데이터를 구글 서버로 전송하는 대신 로컬에서 기능을 실행하기 위해 약 4GB의 AI 모델을 자동으로 다운로드하는 것이 발견되었습니다. 구글은 이후 공식 도움말 문서를 조용히 업데이트하여 필요한 여유 디스크 공간을 4GB에서 약
Zhipu AI, 5개월간 15배 성장 후 코딩에 집중하며 연수입 10억 달러 목표
여러 독립적인 정보원들은 지푸(Zhipu)의 연간 반복 수익(ARR)이 2026년 7월까지 10억 달러에 도달했음을 확인했다. 해당 보도에 대해 지푸는 아직 논평하지 않았다.AI 코딩과 비디오 생성은 생성형 AI의 가장 빠르게 성장하는 상업적 부문으로 부상했다. 국제 시장에서 앤트로픽(Anthropic)의 Claude Code는 출시 6개월 만에 10억 달러 ARR을 달성하며 기업 가치를 높였다. 지푸의 빠른 ARR 성장은 국내 대형 모델 기업
마이크로소프트, 첫 사이버보안 AI 모델 MAI-Cyber-1-Flash 공개 및 퍼셉션 보안 플랫폼 출시
Microsoft는 공식적으로 최초의 전용 사이버보안 모델인 MAI-Cyber-1-Flash과 새로운 AI 기반 보안 플랫폼인 Perception을 소개했습니다. 샌프란시스코 행사에서 공개된 이 혁신들은 Microsoft의 AI 보안 분야 입지를 강화하며, Anthropic, Google, OpenAI와 같은 업계 리더들과 직접 경쟁할 수 있는 위치를 점했습니다.사이버보안 워크플로우에 특화된 MAI-Cyber-1-Flash은 코드베이스 내의





집






