MiniMax 將採用 MSA 架構、具備 100 萬上下文容量的 M3 大型模型開源,性能可與海外旗艦級產品一較高下
MiniMax 西宇科技於 2026 年 6 月 1 日正式發布其新一代大型模型——MiniMax M3。 作為中國首個結合頂尖級程式設計能力、100萬字元超長上下文視窗及原生多模態功能,並旨在全面挑戰海外領先閉源模型的開源模型,MiniMax M3 標誌著中國在該領域的重要突破。

為解決複雜代理任務中的上下文擴展瓶頸,M3 在基礎層引入了稀疏注意力架構(MSA)。相較於傳統方法,它提供了更精確的鍵值對(KV)分區與運算子層級的優化,運算速度達到同類開源解決方案的四倍。 憑藉 100 萬字元的上下文長度,每令牌的運算成本降至上一代模型的十分之一。其預填階段加速倍率超過 9 倍,解碼階段則提升 15 倍。

透過原生兆級交錯資料訓練,M3 的語義空間實現深度整合。在 SWE-Bench Pro 等權威性軟體工程與多模態評估中,其表現超越 GPT-5.5 及 Gemini 3.1 Pro。 在極端任務測試中,M3 展現出強健的長時序自主規劃能力:它在 12 小時內獨立重現了 ICLR 頂尖論文的實驗,並在未參考原始碼的情況下連續運行 24 小時,期間調用工具近 2,000 次, 將 Hopper 架構上的 FP8 矩陣乘法硬體利用率從 7.6% 提升至 71.3%,並在開放式 PostTrainBench 平台上自主協調了完整的「資料-訓練-迭代」流程。
相關文章
印度科技巨頭投資3000萬美元,打造微軟Office的AI競爭對手
連續創業者 Bhavin Turakhia 正投入 3000 萬美元自有資金,押注企業 AI 領域仍有新玩家的空間。他最新的創業專案 Neo 基於一個核心信念:傳統的職場軟體不能僅靠聊天機器人進行修補,而需要進行徹底的架構重構。46 歲的 Turakhia 有著支援雄心勃勃的企業科技專案的歷史。在過去二十年中,他聯合創立了 Directi、Radix、Titan 和 Zeta,在尋求外部投資之前,主要使用個人資本為這些專案提供資金。他正將同樣的自力更生策略應用於 Neo。Turakhia 向
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
相關專題推薦
評論 (0)
0/500

為解決複雜代理任務中的上下文擴展瓶頸,M3 在基礎層引入了稀疏注意力架構(MSA)。相較於傳統方法,它提供了更精確的鍵值對(KV)分區與運算子層級的優化,運算速度達到同類開源解決方案的四倍。 憑藉 100 萬字元的上下文長度,每令牌的運算成本降至上一代模型的十分之一。其預填階段加速倍率超過 9 倍,解碼階段則提升 15 倍。

透過原生兆級交錯資料訓練,M3 的語義空間實現深度整合。在 SWE-Bench Pro 等權威性軟體工程與多模態評估中,其表現超越 GPT-5.5 及 Gemini 3.1 Pro。 在極端任務測試中,M3 展現出強健的長時序自主規劃能力:它在 12 小時內獨立重現了 ICLR 頂尖論文的實驗,並在未參考原始碼的情況下連續運行 24 小時,期間調用工具近 2,000 次, 將 Hopper 架構上的 FP8 矩陣乘法硬體利用率從 7.6% 提升至 71.3%,並在開放式 PostTrainBench 平台上自主協調了完整的「資料-訓練-迭代」流程。
印度科技巨頭投資3000萬美元,打造微軟Office的AI競爭對手
連續創業者 Bhavin Turakhia 正投入 3000 萬美元自有資金,押注企業 AI 領域仍有新玩家的空間。他最新的創業專案 Neo 基於一個核心信念:傳統的職場軟體不能僅靠聊天機器人進行修補,而需要進行徹底的架構重構。46 歲的 Turakhia 有著支援雄心勃勃的企業科技專案的歷史。在過去二十年中,他聯合創立了 Directi、Radix、Titan 和 Zeta,在尋求外部投資之前,主要使用個人資本為這些專案提供資金。他正將同樣的自力更生策略應用於 Neo。Turakhia 向
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統





首頁






