Moonshot AIが「Kimi K2.6」をリリース、複数の評価指標で世界のトップクラスの大規模モデルを上回る
国内の大型モデル分野では、現在、大きな変化が進行中です。 4月21日、Moonshot AIは最新のフラッグシップモデル「Kimi K2.6」を正式にリリースし、オープンソース化しました。このモデルは、プログラミング、長期的なタスク処理、およびマルチエージェント(インテリジェントエージェント)間の連携において大幅な改善を実現しており、現在、公式サイト、アプリ、API、およびプログラミングアシスタント「Kimi Code」で利用可能です。
大規模モデルの総合的な性能を測定する複数の権威あるベンチマークにおいて、「Kimi K2.6」は強力な競争力を示しています。 「人類の最終試験」とも呼ばれる高難度の「Humanity’s Last Exam」であれ、実世界のソフトウェアエンジニアリングスキルを評価するSWE-Bench Proであれ、その成績は業界トップクラスに達しています。 モニタリングデータによると、K2.6はGPT-5.4やClaude Opus4.6といった、世界をリードするクローズドソースモデルと互角に戦えることが示されています。

本シリーズでこれまでで最強のコーディングモデルであるK2.6は、長時間のコーディングタスクにおいて驚異的な持続力を発揮します。 実環境でのテストでは、13時間にわたり中断することなくコーディング作業を継続でき、1つのタスクで4,000行以上のコードを記述または修正できるため、複雑なシステムの開発や反復作業に最適です。 視覚処理機能とコーディング機能の深い統合により、このモデルはプロフェッショナルなデザインのWebアプリケーションを自律的に提供することも可能です。内部評価データによると、そのコーディング能力は前世代と比較して約20%向上しています。

特に、K2.6は優れたローカライズ汎化能力を発揮します。Zig言語による推論プロセスの最適化により、Kimi K2.6はMacデバイスへのローカル展開に対応しました。 12時間の連続稼働テストでは、スループットが初期の15トークン/秒から193トークン/秒へと向上し、推論効率は業界標準ツールであるLM Studioよりも約20%高くなっており、開発者が高性能モデルを利用する際のハードルを大幅に引き下げています。
関連記事
ユーザーからの反発を受け、MetaはAI写真編集機能を削除
Meta、ソーシャルメディアの巨人は、人工知能とユーザープライバシーの微妙なバランスをめぐる公的な論争に再び巻き込まれている。TechCrunch によると、Meta の Superintelligence Labs は今週初めに新しい AI 画像ジェネレーター「Muse Image」を導入した。しかし、ユーザーが「@」記号でタグ付けすることで、公開されている Instagram アカウントから画像を修正・生成できるという、高い評価を受けた主要機能は、適切な通知メカニズムの欠如により、ユーザー
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン
関連特集おすすめ
コメント (1)
0/500
国内の大型モデル分野では、現在、大きな変化が進行中です。 4月21日、Moonshot AIは最新のフラッグシップモデル「Kimi K2.6」を正式にリリースし、オープンソース化しました。このモデルは、プログラミング、長期的なタスク処理、およびマルチエージェント(インテリジェントエージェント)間の連携において大幅な改善を実現しており、現在、公式サイト、アプリ、API、およびプログラミングアシスタント「Kimi Code」で利用可能です。
大規模モデルの総合的な性能を測定する複数の権威あるベンチマークにおいて、「Kimi K2.6」は強力な競争力を示しています。 「人類の最終試験」とも呼ばれる高難度の「Humanity’s Last Exam」であれ、実世界のソフトウェアエンジニアリングスキルを評価するSWE-Bench Proであれ、その成績は業界トップクラスに達しています。 モニタリングデータによると、K2.6はGPT-5.4やClaude Opus4.6といった、世界をリードするクローズドソースモデルと互角に戦えることが示されています。

本シリーズでこれまでで最強のコーディングモデルであるK2.6は、長時間のコーディングタスクにおいて驚異的な持続力を発揮します。 実環境でのテストでは、13時間にわたり中断することなくコーディング作業を継続でき、1つのタスクで4,000行以上のコードを記述または修正できるため、複雑なシステムの開発や反復作業に最適です。 視覚処理機能とコーディング機能の深い統合により、このモデルはプロフェッショナルなデザインのWebアプリケーションを自律的に提供することも可能です。内部評価データによると、そのコーディング能力は前世代と比較して約20%向上しています。

特に、K2.6は優れたローカライズ汎化能力を発揮します。Zig言語による推論プロセスの最適化により、Kimi K2.6はMacデバイスへのローカル展開に対応しました。 12時間の連続稼働テストでは、スループットが初期の15トークン/秒から193トークン/秒へと向上し、推論効率は業界標準ツールであるLM Studioよりも約20%高くなっており、開発者が高性能モデルを利用する際のハードルを大幅に引き下げています。
ユーザーからの反発を受け、MetaはAI写真編集機能を削除
Meta、ソーシャルメディアの巨人は、人工知能とユーザープライバシーの微妙なバランスをめぐる公的な論争に再び巻き込まれている。TechCrunch によると、Meta の Superintelligence Labs は今週初めに新しい AI 画像ジェネレーター「Muse Image」を導入した。しかし、ユーザーが「@」記号でタグ付けすることで、公開されている Instagram アカウントから画像を修正・生成できるという、高い評価を受けた主要機能は、適切な通知メカニズムの欠如により、ユーザー
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン





家






