MiniMax、GPT-5.5を上回る国内AI大規模モデル「M3」を発表
中国のAI分野は、西語科技(Xiyu Technology)の最新大規模言語モデル「MiniMax M3」の公式リリースにより、大きな技術的飛躍を遂げた。この高度なシステムは、最先端のコーディング能力と、最大100万トークンという超長文コンテキストウィンドウのサポートを融合している。特筆すべきは、画像や動画処理に加えてコンピュータデスクトップとのインタラクションもネイティブにサポートしており、これら3つの重要な機能を統合した中国初のオープンソースモデルとなっている。

標準ベンチマークにおける卓越した結果
厳格なSWE-Bench Proプログラミング評価において、MiniMax M3は59.0%のスコアを記録し、GPT-5.5やGemini 3.1 Proを上回り、トップティアのOpus 4.7に肉薄した。また、AIエージェント能力に関するClaw-Evalテストでも優れたパフォーマンスを示し、マルチモーダルドキュメント理解ベンチマーク「OmniDocBench」でも上位のスコアを達成した。
高度なアーキテクチャによる効率化の向上
このパフォーマンスを支えるのは、M3が採用した新規スパースアテンションアーキテクチャ(MSA)である。100万トークンという超長文コンテキストを処理する際、この設計により単一トークンの計算量を前モデルの半分まで削減している。その結果、理解速度は9倍以上に加速し、回答生成速度も15倍以上に向上した。APIは現在稼働中であり、公式チームは10日以内にモデルの重みと技術レポートをグローバルな開発者に公開する方針を示している。
関連記事
Meitun LongCat、LoHoSearchをリリース、BrowseCompのスコアが30%を下回る
過去1年間、検索エージェントの能力は主にBrowseCompによって定義されてきました。しかし、このベンチマークはその関連性を失いつつあります——わずか10ヶ月でモデルの性能を30%から90%へと引き上げましたが、その価値は急速に低下しています。7月17日、MeituanのLongCatは、検索エージェント開発における意味のある進捗を再点火するために設計された、より厳格な評価であるLoHoSearchを発表しました。LoHoSearchの課題は手動で作成されたものではなく、762万のエンティティ
インドは発信者IDアプリに対し、スパムデータを通信事業者に共有するよう義務付けている
インドは、発信者IDおよび通話管理アプリケーションがユーザーからのスパム報告を通信事業者に共有することを義務付ける、スパム対策規制を拡大した。この措置により、スパムブロックアプリの主要プロバイダーであるTruecallerは、同政策を「競争阻害的」と見なしている。金曜日、インドの通信規制機関である電信規制庁(TRAI)は、商業的通話に関する規則を更新した。これらの更新により、ユーザーが通話をスパムや迷惑電話としてフラグ付けできる発信者IDおよび通話管理アプリは、通信事業者が運営するブロックチェ
Qwen AIプラットフォーム、GLM-5.3およびDeepSeek-V4-Proの公式リリースによりモデルマトリックスを拡大
Alibaba CloudのQwen AIプラットフォーム(MaaS)は、最近モデルサービスマトリックスを拡大し、智譜のフラッグシップ大規模モデルGLM-5.3とDeepSeek-V4-Proの公式リリースを統合しました。対応するAPIサービスは現在一般公開されており、開発者はこれらのモデル機能を迅速にアクセスして利用することができます。この2つの新たにリリースされたモデルは、プログラミングおよびインテリジェントエージェントのコアアプリケーションシナリオに特化して設計されています。智譜の最新技術
関連特集おすすめ
コメント (0)
0/500
中国のAI分野は、西語科技(Xiyu Technology)の最新大規模言語モデル「MiniMax M3」の公式リリースにより、大きな技術的飛躍を遂げた。この高度なシステムは、最先端のコーディング能力と、最大100万トークンという超長文コンテキストウィンドウのサポートを融合している。特筆すべきは、画像や動画処理に加えてコンピュータデスクトップとのインタラクションもネイティブにサポートしており、これら3つの重要な機能を統合した中国初のオープンソースモデルとなっている。

標準ベンチマークにおける卓越した結果
厳格なSWE-Bench Proプログラミング評価において、MiniMax M3は59.0%のスコアを記録し、GPT-5.5やGemini 3.1 Proを上回り、トップティアのOpus 4.7に肉薄した。また、AIエージェント能力に関するClaw-Evalテストでも優れたパフォーマンスを示し、マルチモーダルドキュメント理解ベンチマーク「OmniDocBench」でも上位のスコアを達成した。
高度なアーキテクチャによる効率化の向上
このパフォーマンスを支えるのは、M3が採用した新規スパースアテンションアーキテクチャ(MSA)である。100万トークンという超長文コンテキストを処理する際、この設計により単一トークンの計算量を前モデルの半分まで削減している。その結果、理解速度は9倍以上に加速し、回答生成速度も15倍以上に向上した。APIは現在稼働中であり、公式チームは10日以内にモデルの重みと技術レポートをグローバルな開発者に公開する方針を示している。
Meitun LongCat、LoHoSearchをリリース、BrowseCompのスコアが30%を下回る
過去1年間、検索エージェントの能力は主にBrowseCompによって定義されてきました。しかし、このベンチマークはその関連性を失いつつあります——わずか10ヶ月でモデルの性能を30%から90%へと引き上げましたが、その価値は急速に低下しています。7月17日、MeituanのLongCatは、検索エージェント開発における意味のある進捗を再点火するために設計された、より厳格な評価であるLoHoSearchを発表しました。LoHoSearchの課題は手動で作成されたものではなく、762万のエンティティ
インドは発信者IDアプリに対し、スパムデータを通信事業者に共有するよう義務付けている
インドは、発信者IDおよび通話管理アプリケーションがユーザーからのスパム報告を通信事業者に共有することを義務付ける、スパム対策規制を拡大した。この措置により、スパムブロックアプリの主要プロバイダーであるTruecallerは、同政策を「競争阻害的」と見なしている。金曜日、インドの通信規制機関である電信規制庁(TRAI)は、商業的通話に関する規則を更新した。これらの更新により、ユーザーが通話をスパムや迷惑電話としてフラグ付けできる発信者IDおよび通話管理アプリは、通信事業者が運営するブロックチェ
Qwen AIプラットフォーム、GLM-5.3およびDeepSeek-V4-Proの公式リリースによりモデルマトリックスを拡大
Alibaba CloudのQwen AIプラットフォーム(MaaS)は、最近モデルサービスマトリックスを拡大し、智譜のフラッグシップ大規模モデルGLM-5.3とDeepSeek-V4-Proの公式リリースを統合しました。対応するAPIサービスは現在一般公開されており、開発者はこれらのモデル機能を迅速にアクセスして利用することができます。この2つの新たにリリースされたモデルは、プログラミングおよびインテリジェントエージェントのコアアプリケーションシナリオに特化して設計されています。智譜の最新技術





家






