阿里巴巴的「Qwen 3.5-Max」驚艷亮相,一舉躋身全球前五強
中國的大型語言模型再次在世界舞台上創下破紀錄的成績。3月20日,阿里巴巴Qwen系列推出了其新款旗艦模型——Qwen3.5-Max-Preview。該模型首度亮相於全球大型語言模型基準平台LM Arena,便以1464分的亮眼總分立即吸引了業界的關注。
這項卓越表現使阿里巴巴通一千文 在LM Arena 企業排行榜中躍居全球第五,鞏固了其作為中國領先大語言模型供應商的地位。這一里程碑意味著中國的大語言模型現已躋身全球前沿的核心競爭行列。

由國際開源研究組織 LMSYS 主辦的LM Arena, 因其「匿名對決與盲評」的評估機制,被廣泛視為業界最具價值的基準測試之一。在本次評估中,Qwen3.5-Max-Preview展現了強大且全面的能力:
數學推理:全球排名第五,展現出先進的邏輯推理能力。
整體表現:在未進行風格調整的情況下,於絕對勝率類別中位居全球第六。
專家級任務:在處理複雜文本處理方面亦躋身全球前十。

據雲端表示 ,自農曆新年以來,Qwen3.5 系列已發布八款 不同規模的模型,參數規模從 0.8B 至 397B 不等。旗艦級的Qwen3.5-Max-Preview代表了該系列的巔峰之作。它基於「小激活、大性能」的架構原則,在維持運算效率的同時,提供媲美甚至超越某些更大模型的能力。
該模型目前處於預覽階段。阿里雲 表示,將根據開發者社群的回饋持續進行迭代與優化,以提升Tongyi Qianwen 的表現。
相關文章
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
相關專題推薦
評論 (2)
0/500
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔
中國的大型語言模型再次在世界舞台上創下破紀錄的成績。3月20日,阿里巴巴Qwen系列推出了其新款旗艦模型——Qwen3.5-Max-Preview。該模型首度亮相於全球大型語言模型基準平台LM Arena,便以1464分的亮眼總分立即吸引了業界的關注。
這項卓越表現使

由國際開源研究組織 LMSYS 主辦的
數學推理:全球排名第五,展現出先進的邏輯推理能力。
整體表現:在未進行風格調整的情況下,於絕對勝率類別中位居全球第六。
專家級任務:在處理複雜文本處理方面亦躋身全球前十。

該模型目前處於預覽階段。
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔





首頁






