MiniMax, GPT-5.5을 능가하는 국내 AI 대형 모델 M3 공개
중국의 AI 산업은 시위 기술(Xiyu Technology)의 최신 대규모 언어 모델인 MiniMax M3의 공식 출시를 통해 주요 기술적 도약을 목격했습니다. 이 고급 시스템은 최첨단의 코딩 숙련도와 최대 100만 토큰의 초장문 컨텍스트 창을 지원합니다. 특히, 이미지 및 비디오 처리를 포함한 멀티모달 입력과 컴퓨터 데스크톱 상호작용을 네이티브로 지원하여, 이 세 가지 핵심 기능을 통합한 중국 최초의 오픈소스 모델이 되었습니다.

표준 벤치마크에서의 탁월한 결과
엄격한 SWE-Bench Pro 프로그래밍 평가에서 MiniMax M3는 59.0%의 점수를 획득하여 GPT-5.5와 Gemini 3.1 Pro를 능가했으며, 최상위권인 Opus 4.7에 근접했습니다. 이 모델은 AI 에이전트 능력을 위한 Claw-Eval 테스트에서도 우수한 성능을 보였으며, 멀티모달 문서 이해를 위한 OmniDocBench 벤치마크에서 선도적인 점수를 달성했습니다.
효율성을 높이는 고급 아키텍처
이러한 성능을 뒷받침하는 것은 M3가 채택한 새로운 희소 주의(Sparse Attention) 아키텍처(MSA)입니다. 100만 토큰의 초장문 컨텍스트를 처리할 때, 이 설계는 이전 세대 대비 단일 토큰 계산을 절반으로 줄입니다. 결과적으로 이 모델은 이해 속도를 9배 이상 가속화하고 답변 생성 속도를 15배 이상 향상시킵니다. API가 이제 가동되었으며, 공식 팀은 전 세계 개발자를 위해 모델 가중치와 기술 보고서를 10일 이내에 출시할 것을 약속했습니다.
관련 기사
인도는 발신자 ID 앱을 통해 스팸 데이터를 통신사와 공유하도록 의무화함
인도는 발신자 ID 및 통화 관리 애플리케이션이 사용자의 스팸 보고를 통신 사업자와 공유하도록 의무화하는 스팸 방지 규정을 확대했으며, 이 조치는 대표적인 스팸 차단 앱 제공업체인 트루콜러(Truecaller)가 해당 정책을 반경쟁적이라고 규정하는 결과를 낳았습니다.금요일, 인도의 통신 규제 기관인 인도 통신 규제 위원회(TRAI)는 상업적 통신을 규율하는 규칙을 업데이트했습니다. 이 업데이트는 사용자가 통화를 스팸이나 잡음으로 표시할 수 있
Qwen AI 플랫폼이 GLM-5.3 및 DeepSeek-V4-Pro의 공식 출시를 통해 모델 행렬을 확장합니다
알리바바 클라우드의 Qwen AI 플랫폼(MaaS)은 최근 모델 서비스 매트릭스를 확장하여 지푸(Zhipu)의 플래그십 대형 모델 GLM-5.3과 딥시크(DeepSeek)-V4-Pro의 공식 출시를 통합했습니다. 해당 API 서비스는 이제 공개되어 개발자들이 이러한 모델 기능을 빠르게 접근하고 활용할 수 있도록 지원합니다.이렇게 새로 출시된 두 가지 모델은 프로그래밍 및 지능형 에이전트의 핵심 응용 시나리오를 위해 특별히 설계되었습니다. 최신
왜 에이전트는 긴 작업에서 기억을 잃고 방향을 잃을까: AWS, Claude Code, Manus가 네 가지 프레임워크를 해부하다
대규모 언어 모델은 긴 작업 수행 중 자주 집중력을 잃고 원래 목표에서 벗어나곤 하는데, 이는 지능형 에이전트 분야에서 지속적으로 존재하는 과제입니다. 이 문제는 종종 모델 자체보다 주변 실행 프레임워크에서 비롯됩니다. 최근 AWS가 제시한 클라우드 프로그래밍 에이전트 설계 가이드는 이를 명확히 지적합니다: 피상적인 에이전트는 컨텍스트 오버플로우로 인해 집중력을 잃고, 긴 사이클 동안 상태를 유지하지 못합니다. 이를 해결하려면 핵심 모델 외부의
관련 특별 주제 추천
의견 (0)
0/500
중국의 AI 산업은 시위 기술(Xiyu Technology)의 최신 대규모 언어 모델인 MiniMax M3의 공식 출시를 통해 주요 기술적 도약을 목격했습니다. 이 고급 시스템은 최첨단의 코딩 숙련도와 최대 100만 토큰의 초장문 컨텍스트 창을 지원합니다. 특히, 이미지 및 비디오 처리를 포함한 멀티모달 입력과 컴퓨터 데스크톱 상호작용을 네이티브로 지원하여, 이 세 가지 핵심 기능을 통합한 중국 최초의 오픈소스 모델이 되었습니다.

표준 벤치마크에서의 탁월한 결과
엄격한 SWE-Bench Pro 프로그래밍 평가에서 MiniMax M3는 59.0%의 점수를 획득하여 GPT-5.5와 Gemini 3.1 Pro를 능가했으며, 최상위권인 Opus 4.7에 근접했습니다. 이 모델은 AI 에이전트 능력을 위한 Claw-Eval 테스트에서도 우수한 성능을 보였으며, 멀티모달 문서 이해를 위한 OmniDocBench 벤치마크에서 선도적인 점수를 달성했습니다.
효율성을 높이는 고급 아키텍처
이러한 성능을 뒷받침하는 것은 M3가 채택한 새로운 희소 주의(Sparse Attention) 아키텍처(MSA)입니다. 100만 토큰의 초장문 컨텍스트를 처리할 때, 이 설계는 이전 세대 대비 단일 토큰 계산을 절반으로 줄입니다. 결과적으로 이 모델은 이해 속도를 9배 이상 가속화하고 답변 생성 속도를 15배 이상 향상시킵니다. API가 이제 가동되었으며, 공식 팀은 전 세계 개발자를 위해 모델 가중치와 기술 보고서를 10일 이내에 출시할 것을 약속했습니다.
인도는 발신자 ID 앱을 통해 스팸 데이터를 통신사와 공유하도록 의무화함
인도는 발신자 ID 및 통화 관리 애플리케이션이 사용자의 스팸 보고를 통신 사업자와 공유하도록 의무화하는 스팸 방지 규정을 확대했으며, 이 조치는 대표적인 스팸 차단 앱 제공업체인 트루콜러(Truecaller)가 해당 정책을 반경쟁적이라고 규정하는 결과를 낳았습니다.금요일, 인도의 통신 규제 기관인 인도 통신 규제 위원회(TRAI)는 상업적 통신을 규율하는 규칙을 업데이트했습니다. 이 업데이트는 사용자가 통화를 스팸이나 잡음으로 표시할 수 있
Qwen AI 플랫폼이 GLM-5.3 및 DeepSeek-V4-Pro의 공식 출시를 통해 모델 행렬을 확장합니다
알리바바 클라우드의 Qwen AI 플랫폼(MaaS)은 최근 모델 서비스 매트릭스를 확장하여 지푸(Zhipu)의 플래그십 대형 모델 GLM-5.3과 딥시크(DeepSeek)-V4-Pro의 공식 출시를 통합했습니다. 해당 API 서비스는 이제 공개되어 개발자들이 이러한 모델 기능을 빠르게 접근하고 활용할 수 있도록 지원합니다.이렇게 새로 출시된 두 가지 모델은 프로그래밍 및 지능형 에이전트의 핵심 응용 시나리오를 위해 특별히 설계되었습니다. 최신
왜 에이전트는 긴 작업에서 기억을 잃고 방향을 잃을까: AWS, Claude Code, Manus가 네 가지 프레임워크를 해부하다
대규모 언어 모델은 긴 작업 수행 중 자주 집중력을 잃고 원래 목표에서 벗어나곤 하는데, 이는 지능형 에이전트 분야에서 지속적으로 존재하는 과제입니다. 이 문제는 종종 모델 자체보다 주변 실행 프레임워크에서 비롯됩니다. 최근 AWS가 제시한 클라우드 프로그래밍 에이전트 설계 가이드는 이를 명확히 지적합니다: 피상적인 에이전트는 컨텍스트 오버플로우로 인해 집중력을 잃고, 긴 사이클 동안 상태를 유지하지 못합니다. 이를 해결하려면 핵심 모델 외부의





집






