Qwen 3.7 預覽版模型現已推出:強化數學、程式設計及多模態功能
大型語言模型的快速演進持續突破界限。阿里巴巴已低調地在 Qwen Chat 和 Arena AI(前身為 LMArena)上推出了其 Tongyi Qwen 3.7 系列的兩款預覽版本——Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview。 預計這些版本將於 5 月 20 日舉行的「阿里雲峰會」上正式亮相。
這兩款新預覽版本各有其獨特用途:
Qwen3.7-Max-Preview 作為旗艦模型,專注於頂級的綜合性能表現。目前該模型僅支援「思考模式」,搜尋與程式碼解析等進階工具尚未啟用。
Qwen3.7-Plus-Preview 則提供均衡且高效能的使用體驗,著重於推理能力與邏輯清晰度。其全套工具將於未來的更新中逐步推出。

儘管仍處於預覽階段,這些模型已引起廣泛關注。在 Arena AI 的文本能力排行榜上,Qwen3.7-Max-Preview 總排名第 13 位,推動阿里巴巴的 Tongyi Qwen 在全球同類實驗室中躍居第 6 位。 在專業領域中,其表現更為亮眼:數學推理排名第 7 名、專家級應用排名第 9 名、軟體與 IT 領域排名第 9 名,以及程式設計能力排名第 10 名,展現出強大的多任務泛化能力。
在視覺能力方面,Qwen3.7-Plus-Preview 總排名第 16 名,助力 Tongyi Qwen 在所有實驗室的視覺基準測試中奪得第 5 名。 此外,在專為進階提示詞設計的獨家「專家競技場」中,Qwen3.7-Max-Preview 榮獲第 9 名,凸顯其在大難度任務中日益提升的穩定性與精準度。
相關文章
Meta 測試 AI 睡前故事應用程式 StoryKit,以解決家長在講故事時面臨的挑戰
為了協助忙碌的家長,Meta 正在測試一款名為「StoryKit」的 AI 驅動應用程式,該應用程式能為孩子生成包含客製化角色、場景和音樂的個人化睡前故事。家長只需上傳孩子最喜愛的玩具照片,即可創造生動的角色,無需親自動筆撰寫任何內容。該應用程式還融入了「勇敢」與「善良」等教育主題,透過引人入勝的故事幫助孩子吸收正向價值觀。安全至上:非社交體驗Meta 目前正在特定地區測試 StoryKit,以評
OpenAI 推出 GPT-5.3 Instant,將「幻覺」現象減少 27 %
就在 Google DeepMind 發表 Gemini 3.1 Flash-Lite 僅兩小時後,OpenAI 以史無前例的速度迅速跟進,正式推出迄今為止最精緻的對話模型:GPT-5.3Instant。有別於先前版本優先追求各項「最先進技術」(SOTA)基準的作法,OpenAI 此次採取了極具務實性的策略——捨棄排名競逐,轉而直接解決使用者互動中最頑固的痛點。1. 消除「說教」口吻:優先確保對話
智譜以數億元收購中科嘉禾,以加強人工智慧基礎設施和本土計算相容性
據報道,智譜投資數億元人民幣收購了AI基礎設施公司XCore Sigma,以加強其基礎模型工程、國產算力相容性和推理最佳化。XCore Sigma專注於AI異構計算軟體,其核心技術源於中國科學院計算技術研究所的編譯技術。該團隊曾參與龍芯、申威、寒武紀和華為昇騰晶片的編譯器開發,具備從虛擬指令集設計到國產AI模型最佳化部署的全鏈條能力。智譜此前曾投資吉路科技、五聞新瓊和矽基流動等AI基礎設施公司,以解決計算叢集和推理最佳化問題。然而,GLM-5釋出後模型使用量激增——每日Coding Agent呼叫
相關專題推薦
評論 (0)
0/500
大型語言模型的快速演進持續突破界限。阿里巴巴已低調地在 Qwen Chat 和 Arena AI(前身為 LMArena)上推出了其 Tongyi Qwen 3.7 系列的兩款預覽版本——Qwen3.7-Max-Preview 和 Qwen3.7-Plus-Preview。 預計這些版本將於 5 月 20 日舉行的「阿里雲峰會」上正式亮相。
這兩款新預覽版本各有其獨特用途:
Qwen3.7-Max-Preview 作為旗艦模型,專注於頂級的綜合性能表現。目前該模型僅支援「思考模式」,搜尋與程式碼解析等進階工具尚未啟用。
Qwen3.7-Plus-Preview 則提供均衡且高效能的使用體驗,著重於推理能力與邏輯清晰度。其全套工具將於未來的更新中逐步推出。

儘管仍處於預覽階段,這些模型已引起廣泛關注。在 Arena AI 的文本能力排行榜上,Qwen3.7-Max-Preview 總排名第 13 位,推動阿里巴巴的 Tongyi Qwen 在全球同類實驗室中躍居第 6 位。 在專業領域中,其表現更為亮眼:數學推理排名第 7 名、專家級應用排名第 9 名、軟體與 IT 領域排名第 9 名,以及程式設計能力排名第 10 名,展現出強大的多任務泛化能力。
在視覺能力方面,Qwen3.7-Plus-Preview 總排名第 16 名,助力 Tongyi Qwen 在所有實驗室的視覺基準測試中奪得第 5 名。 此外,在專為進階提示詞設計的獨家「專家競技場」中,Qwen3.7-Max-Preview 榮獲第 9 名,凸顯其在大難度任務中日益提升的穩定性與精準度。
Meta 測試 AI 睡前故事應用程式 StoryKit,以解決家長在講故事時面臨的挑戰
為了協助忙碌的家長,Meta 正在測試一款名為「StoryKit」的 AI 驅動應用程式,該應用程式能為孩子生成包含客製化角色、場景和音樂的個人化睡前故事。家長只需上傳孩子最喜愛的玩具照片,即可創造生動的角色,無需親自動筆撰寫任何內容。該應用程式還融入了「勇敢」與「善良」等教育主題,透過引人入勝的故事幫助孩子吸收正向價值觀。安全至上:非社交體驗Meta 目前正在特定地區測試 StoryKit,以評
OpenAI 推出 GPT-5.3 Instant,將「幻覺」現象減少 27 %
就在 Google DeepMind 發表 Gemini 3.1 Flash-Lite 僅兩小時後,OpenAI 以史無前例的速度迅速跟進,正式推出迄今為止最精緻的對話模型:GPT-5.3Instant。有別於先前版本優先追求各項「最先進技術」(SOTA)基準的作法,OpenAI 此次採取了極具務實性的策略——捨棄排名競逐,轉而直接解決使用者互動中最頑固的痛點。1. 消除「說教」口吻:優先確保對話
智譜以數億元收購中科嘉禾,以加強人工智慧基礎設施和本土計算相容性
據報道,智譜投資數億元人民幣收購了AI基礎設施公司XCore Sigma,以加強其基礎模型工程、國產算力相容性和推理最佳化。XCore Sigma專注於AI異構計算軟體,其核心技術源於中國科學院計算技術研究所的編譯技術。該團隊曾參與龍芯、申威、寒武紀和華為昇騰晶片的編譯器開發,具備從虛擬指令集設計到國產AI模型最佳化部署的全鏈條能力。智譜此前曾投資吉路科技、五聞新瓊和矽基流動等AI基礎設施公司,以解決計算叢集和推理最佳化問題。然而,GLM-5釋出後模型使用量激增——每日Coding Agent呼叫





首頁






