MiniMax M3 開放原始碼,響應速度提升一倍
總部位於中國的知名人工智慧公司 MiniMax 今日宣布,將其原生多模態旗艦模型 MiniMax M3 開源釋出。在此之前,該團隊已向業界釋出該模型的權重,並發表了一篇關於稀疏注意力機制的高度技術性論文,引起了開源社群的廣泛關注。

卓越表現引領開源競賽
作為 MiniMax 的旗艦模型,M3 總參數達 4,280 億個,其中活躍參數為 230 億個。值得注意的是,這是首個從訓練過程一開始就進行多模態混合訓練的開源大型語言模型。
得益於其先進的架構,M3 在發布後兩週內便迅速登上全球領先智慧指數中開源模型的榜首。在初期流量激增導致延遲後,團隊將模型的輸出速度從 30 TPS 優化至 80 TPS,並計劃進行進一步的提升。
頂級的編碼與程式碼交付能力
在具挑戰性的程式碼編寫與代理能力基準測試中,MiniMax M3 展現了業界領先的表現。它能夠自主分解複雜任務,並巧妙運用外部工具進行多步驟推理。
相較於傳統模型,M3 的程式碼生成能力已實現質的飛躍。團隊表示,其生成的程式碼設計上已具備直接部署的準備狀態,而非僅是需要大量手動修改才能勉強運作的原型——這項轉變將顯著提升開發人員的生產力。
相關文章
Hello Robot 為矽谷推出家用機器人
加州馬丁內斯市坐落於舊金山灣區最東北端,與矽谷這座科技樞紐相距甚遠。這裡有一家名為「Hello Robot」的新創公司,它刻意與僅在南邊 45 英里處營運、那些大放厥詞的南方競爭對手劃清界線。上個月,Hello Robot 推出了其家用輔助機器人「Stretch」的第四代產品。若稱其為類人型機器人,未免有些牽強。儘管它擁有形似人類的軀幹和配備感測器的頭部,但其伸縮手臂末端裝有鉗爪,且依靠一個笨重的
為什麼醫生難以回覆你的電話
儘管關於醫療領域人工智慧的公眾討論主要集中在診斷、藥物發現和臨床諮詢上,但一個關鍵且常被忽視的瓶頸決定了患者是否最終能夠獲得護理。這一挑戰主要並非源於醫生短缺,而是源於連線初級保健轉診與專科預約之間令人不堪重負的行政負擔——這是一個手動且持續存在的缺口,如今正吸引大量風險投資的關注。Basata 由前 Lyft 和 Cruise 高管 Kaled Alhanafi 以及曾在美敦力(Medtronic)從事心臟裝置開發十年的 Chetan Patel 共同創立,兩人均曾 firsthand 遭遇
Anthropic 的 Sonnet 5.5 洩露:200 萬代幣的上下文挑戰促使 DeepSeek 重拾成本效益
Anthropic 已揭曉其最新的 Sonnet 5.5 模型,內部代號為「Fennec」(取自沙漠狐之名),預計將於下個月正式發布。 外流的細節顯示,該模型支援 200 萬個標記的上下文視窗,能提供更快的推理速度、更低的延遲,並顯著提升長上下文推理與多步驟規劃能力。此外,其針對瀏覽器和終端的工具調用能力亦有所提升。 儘管其性能可與旗艦級模型 Claude Fable 5 媲美,但定價仍將維持在
相關專題推薦
評論 (0)
0/500
總部位於中國的知名人工智慧公司 MiniMax 今日宣布,將其原生多模態旗艦模型 MiniMax M3 開源釋出。在此之前,該團隊已向業界釋出該模型的權重,並發表了一篇關於稀疏注意力機制的高度技術性論文,引起了開源社群的廣泛關注。

卓越表現引領開源競賽
作為 MiniMax 的旗艦模型,M3 總參數達 4,280 億個,其中活躍參數為 230 億個。值得注意的是,這是首個從訓練過程一開始就進行多模態混合訓練的開源大型語言模型。
得益於其先進的架構,M3 在發布後兩週內便迅速登上全球領先智慧指數中開源模型的榜首。在初期流量激增導致延遲後,團隊將模型的輸出速度從 30 TPS 優化至 80 TPS,並計劃進行進一步的提升。
頂級的編碼與程式碼交付能力
在具挑戰性的程式碼編寫與代理能力基準測試中,MiniMax M3 展現了業界領先的表現。它能夠自主分解複雜任務,並巧妙運用外部工具進行多步驟推理。
相較於傳統模型,M3 的程式碼生成能力已實現質的飛躍。團隊表示,其生成的程式碼設計上已具備直接部署的準備狀態,而非僅是需要大量手動修改才能勉強運作的原型——這項轉變將顯著提升開發人員的生產力。
Hello Robot 為矽谷推出家用機器人
加州馬丁內斯市坐落於舊金山灣區最東北端,與矽谷這座科技樞紐相距甚遠。這裡有一家名為「Hello Robot」的新創公司,它刻意與僅在南邊 45 英里處營運、那些大放厥詞的南方競爭對手劃清界線。上個月,Hello Robot 推出了其家用輔助機器人「Stretch」的第四代產品。若稱其為類人型機器人,未免有些牽強。儘管它擁有形似人類的軀幹和配備感測器的頭部,但其伸縮手臂末端裝有鉗爪,且依靠一個笨重的
為什麼醫生難以回覆你的電話
儘管關於醫療領域人工智慧的公眾討論主要集中在診斷、藥物發現和臨床諮詢上,但一個關鍵且常被忽視的瓶頸決定了患者是否最終能夠獲得護理。這一挑戰主要並非源於醫生短缺,而是源於連線初級保健轉診與專科預約之間令人不堪重負的行政負擔——這是一個手動且持續存在的缺口,如今正吸引大量風險投資的關注。Basata 由前 Lyft 和 Cruise 高管 Kaled Alhanafi 以及曾在美敦力(Medtronic)從事心臟裝置開發十年的 Chetan Patel 共同創立,兩人均曾 firsthand 遭遇
Anthropic 的 Sonnet 5.5 洩露:200 萬代幣的上下文挑戰促使 DeepSeek 重拾成本效益
Anthropic 已揭曉其最新的 Sonnet 5.5 模型,內部代號為「Fennec」(取自沙漠狐之名),預計將於下個月正式發布。 外流的細節顯示,該模型支援 200 萬個標記的上下文視窗,能提供更快的推理速度、更低的延遲,並顯著提升長上下文推理與多步驟規劃能力。此外,其針對瀏覽器和終端的工具調用能力亦有所提升。 儘管其性能可與旗艦級模型 Claude Fable 5 媲美,但定價仍將維持在





首頁






