중국 모션샷, 새로운 오픈소스 모델 키미 K2.5 및 AI 코딩 에이전트 공개
알리바바와 홍산(구 시퀀시아 차이나)이 투자한 중국 기업 문샷 AI가 텍스트, 이미지, 동영상을 처리할 수 있는 새로운 오픈소스 모델 '키미 K2.5'를 공개했다.
이 모델은 15조 개의 혼합 시각·텍스트 토큰으로 훈련되어 본질적인 다중 모달리티를 구현한다고 회사 측은 밝혔다. 코딩 작업과 에이전트 군집 관리에 탁월한 성능을 보이며
—다수의 AI 에이전트가 협력하는 환경—에서 뛰어난 성능을 발휘한다. 벤치마크 테스트에서 키미 K2.5는 주요 독점 모델과 동등한 성능을 보였으며 특정 영역에서는 이를 능가하기도 했다.
예를 들어, SWE-Bench 검증 코딩 벤치마크에서 Kimi K2.5는 Gemini 3 Pro를 능가했습니다. 또한 SWE-Bench 다국어 테스트에서 GPT 5.2 및 Gemini 3 Pro보다 높은 점수를 기록했습니다. 동영상 이해력 측면에서는, 모델의 동영상 콘텐츠 추론 능력을 평가하는 벤치마크인 VideoMMMU(Video Massive Multi-discipline Multimodal Understanding)에서 GPT 5.2와 Claude Opus 4.5를 제쳤습니다.

이미지 출처: Moonshot AI Moonshot AI는 이 모델이 텍스트를 효과적으로 처리하는 동시에 사용자가 이미지나 동영상을 입력하여 해당 미디어를 기반으로 유사한 인터페이스를 생성하도록 요청할 수 있다고 밝혔습니다.
창립자 Zhilin Yang의 짧은 영상입니다.
(카메라 앞에서 이렇게 말하는 건 처음인데, Kimi K2.5를 꼭 여러분과 공유하고 싶어 했습니다!) pic.twitter.com/2uDSOjCjly—
Kimi.ai (@Kimi_Moonshot) 2026년 1월 27일
이러한 코딩 기능을 활용할 수 있도록, 회사는 Anthropic의 Claude Code 및 Google의 Gemini CLI와 경쟁하는 오픈소스 코딩 도구인 Kimi Code를 출시했습니다. 개발자는 터미널을 통해 Kimi Code를 사용하거나 VSCode, Cursor, Zed와 같은 IDE에 통합할 수 있습니다. 또한 이 스타트업은 Kimi Code가 이미지와 동영상을 입력으로 받아들인다는 점도 확인했습니다.
AI 코딩 도구는 빠르게 주목받으며 AI 기업들의 주요 수익원으로 자리 잡고 있다. Anthropic은 지난 11월 Claude Code의 연간 반복 매출(ARR)이 10억 달러에 달했다고 발표했다. 이달 초 Wired 보도에 따르면 해당 도구는 2025년 말까지 추가로 1억 달러를 더 창출할 전망이다. 한편 The Information에 따르면 Moonshot의 중국 경쟁사 Deepseek은 다음 달 고급 코딩 기능을 갖춘 새 모델 출시를 준비 중이다.
문샷은 구글과 메타의 전 AI 연구원 양즈린(楊志林)이 설립했다. 이 회사는 시리즈 B 투자 라운드에서 10억 달러를 유치하며 25억 달러의 기업 가치를 달성했다. 블룸버그 보도에 따르면 최근 43억 달러의 기업 가치로 추가 5억 달러를 조달했으며, 이미 50억 달러 가치 평가를 목표로 새로운 투자 라운드를 모색 중이다.
관련 기사
마이크로소프트, 16개 언어에서 동시에 듣고 말할 수 있는 자체 개발한 최초의 전이중 AI 음성 모델 공개
기술 전문 매체 TestingCatalog에 따르면, 마이크로소프트는 현재 자사의 첫 번째 네이티브 실시간 음성 모델인 ‘MAI Realtime’을 테스트 중입니다. 16개 언어와 두 가지 독특한 음성 스타일을 지원하는 이 시스템은 듣기와 말하기를 동시에 처리할 수 있어, 자동 언어 감지 및 대화 도중 언어 전환이 가능합니다. 이러한 발전 덕분에 사용자는
애플, 지역 기반 AI와 구글과의 제휴를 통해 시리 기능을 강화한 iOS 27 공개
최근 ‘더 인포메이션’은 애플이 곧 출시될 OS 27에 인공지능을 통합하기 위한 전략적 접근 방식을 집중 조명했다. 애플은 구글의 제미니(Gemini) 모델을 활용해 더 효율적이고 경량화된 AI를 훈련시킴으로써, 사용자 개인정보를 침해하지 않으면서도 강력한 로컬 엣지 AI 기능을 제공하고자 한다. 이러한 모델 정제 과정을 통해 더 작은 기기 기반 모델이 더
퍼플렉시티 컴퓨터, 개인정보 보호와 효율성의 균형을 맞추는 하이브리드 추론 기술 공개
인공지능 기업 퍼플렉시티(Perplexity)는 올여름 자사의 ‘퍼플렉시티 컴퓨터(Perplexity Computer)’ 에이전트에 대한 대대적인 개선 기능을 출시할 계획을 밝혔다. 이번 업데이트에서는 로컬 소형 모델과 첨단 클라우드 기반 시스템 간에 워크로드를 동적으로 할당하여, 작업의 복잡성과 데이터 민감도에 따라 성능을 최적화하는 ‘하이브리드 에이전트
관련 특별 주제 추천
의견 (1)
0/500
Klingt spannend! Ich finde vor allem den Multimodal-Ansatz (Text/Bild/Video) von Kimi K2.5 interessant – das sind genau die Fähigkeiten, die KI für reale Aufgaben braucht. Obwohl es viele Open-Source-Modelle gibt, heben sich 15 Billionen Tokens an Trainingsdaten schon hervor. Vielleicht sollte ich es mal mit meinem Codierprojekt testen... 👨💻
알리바바와 홍산(구 시퀀시아 차이나)이 투자한 중국 기업 문샷 AI가 텍스트, 이미지, 동영상을 처리할 수 있는 새로운 오픈소스 모델 '키미 K2.5'를 공개했다.
이 모델은 15조 개의 혼합 시각·텍스트 토큰으로 훈련되어 본질적인 다중 모달리티를 구현한다고 회사 측은 밝혔다. 코딩 작업과 에이전트 군집 관리에 탁월한 성능을 보이며
—다수의 AI 에이전트가 협력하는 환경—에서 뛰어난 성능을 발휘한다. 벤치마크 테스트에서 키미 K2.5는 주요 독점 모델과 동등한 성능을 보였으며 특정 영역에서는 이를 능가하기도 했다.
예를 들어, SWE-Bench 검증 코딩 벤치마크에서 Kimi K2.5는 Gemini 3 Pro를 능가했습니다. 또한 SWE-Bench 다국어 테스트에서 GPT 5.2 및 Gemini 3 Pro보다 높은 점수를 기록했습니다. 동영상 이해력 측면에서는, 모델의 동영상 콘텐츠 추론 능력을 평가하는 벤치마크인 VideoMMMU(Video Massive Multi-discipline Multimodal Understanding)에서 GPT 5.2와 Claude Opus 4.5를 제쳤습니다.

Moonshot AI는 이 모델이 텍스트를 효과적으로 처리하는 동시에 사용자가 이미지나 동영상을 입력하여 해당 미디어를 기반으로 유사한 인터페이스를 생성하도록 요청할 수 있다고 밝혔습니다.
창립자 Zhilin Yang의 짧은 영상입니다.
Kimi.ai (@Kimi_Moonshot) 2026년 1월 27일
(카메라 앞에서 이렇게 말하는 건 처음인데, Kimi K2.5를 꼭 여러분과 공유하고 싶어 했습니다!) pic.twitter.com/2uDSOjCjly—
이러한 코딩 기능을 활용할 수 있도록, 회사는 Anthropic의 Claude Code 및 Google의 Gemini CLI와 경쟁하는 오픈소스 코딩 도구인 Kimi Code를 출시했습니다. 개발자는 터미널을 통해 Kimi Code를 사용하거나 VSCode, Cursor, Zed와 같은 IDE에 통합할 수 있습니다. 또한 이 스타트업은 Kimi Code가 이미지와 동영상을 입력으로 받아들인다는 점도 확인했습니다.
AI 코딩 도구는 빠르게 주목받으며 AI 기업들의 주요 수익원으로 자리 잡고 있다. Anthropic은 지난 11월 Claude Code의 연간 반복 매출(ARR)이 10억 달러에 달했다고 발표했다. 이달 초 Wired 보도에 따르면 해당 도구는 2025년 말까지 추가로 1억 달러를 더 창출할 전망이다. 한편 The Information에 따르면 Moonshot의 중국 경쟁사 Deepseek은 다음 달 고급 코딩 기능을 갖춘 새 모델 출시를 준비 중이다.
문샷은 구글과 메타의 전 AI 연구원 양즈린(楊志林)이 설립했다. 이 회사는 시리즈 B 투자 라운드에서 10억 달러를 유치하며 25억 달러의 기업 가치를 달성했다. 블룸버그 보도에 따르면 최근 43억 달러의 기업 가치로 추가 5억 달러를 조달했으며, 이미 50억 달러 가치 평가를 목표로 새로운 투자 라운드를 모색 중이다.
마이크로소프트, 16개 언어에서 동시에 듣고 말할 수 있는 자체 개발한 최초의 전이중 AI 음성 모델 공개
기술 전문 매체 TestingCatalog에 따르면, 마이크로소프트는 현재 자사의 첫 번째 네이티브 실시간 음성 모델인 ‘MAI Realtime’을 테스트 중입니다. 16개 언어와 두 가지 독특한 음성 스타일을 지원하는 이 시스템은 듣기와 말하기를 동시에 처리할 수 있어, 자동 언어 감지 및 대화 도중 언어 전환이 가능합니다. 이러한 발전 덕분에 사용자는
애플, 지역 기반 AI와 구글과의 제휴를 통해 시리 기능을 강화한 iOS 27 공개
최근 ‘더 인포메이션’은 애플이 곧 출시될 OS 27에 인공지능을 통합하기 위한 전략적 접근 방식을 집중 조명했다. 애플은 구글의 제미니(Gemini) 모델을 활용해 더 효율적이고 경량화된 AI를 훈련시킴으로써, 사용자 개인정보를 침해하지 않으면서도 강력한 로컬 엣지 AI 기능을 제공하고자 한다. 이러한 모델 정제 과정을 통해 더 작은 기기 기반 모델이 더
퍼플렉시티 컴퓨터, 개인정보 보호와 효율성의 균형을 맞추는 하이브리드 추론 기술 공개
인공지능 기업 퍼플렉시티(Perplexity)는 올여름 자사의 ‘퍼플렉시티 컴퓨터(Perplexity Computer)’ 에이전트에 대한 대대적인 개선 기능을 출시할 계획을 밝혔다. 이번 업데이트에서는 로컬 소형 모델과 첨단 클라우드 기반 시스템 간에 워크로드를 동적으로 할당하여, 작업의 복잡성과 데이터 민감도에 따라 성능을 최적화하는 ‘하이브리드 에이전트
Klingt spannend! Ich finde vor allem den Multimodal-Ansatz (Text/Bild/Video) von Kimi K2.5 interessant – das sind genau die Fähigkeiten, die KI für reale Aufgaben braucht. Obwohl es viele Open-Source-Modelle gibt, heben sich 15 Billionen Tokens an Trainingsdaten schon hervor. Vielleicht sollte ich es mal mit meinem Codierprojekt testen... 👨💻





집






