Doubao 在 AI 視覺性能方面領先全球,表現超越 Google 的模型
根據 SuperCLUE-VLM 於 2026 年 4 月發布的最新評估報告,中文多模態視覺語言模型領域已取得顯著進展。 經對全球17款頂尖大型模型進行全面評估後發現,國內人工智慧開發者正展現強勁的進步勢頭。這些模型不僅在解析中文內容方面表現優異,更在所有評估指標上均超越國際頂尖同類模型。
字節跳動位居榜首,多款國內模型躋身頂尖行列
評估結果顯示,字節跳動的「Doubao-Seed-2.0-Pro-260215」獲得90.66分,位居總排名首位。 此分數超越了此前被視為強勁競爭對手的 Google Gemini-3.1-Pro-Preview(89.35 分)。 此外,其他國內模型,如阿里巴巴的「Qwen 3.5」系列、商湯科技的「SenseNova」以及智普的「GLM」,表現同樣出色,穩居領先行列。 相較之下,OpenAI 的 GPT-5.4 和 X.AI 的 Grok 等知名海外模型,在這項中國多模態評估中則落入中游水準。

橫跨三大關鍵領域的深度評估,展現先進的基本認知能力
本次評估框架全面,涵蓋三大核心領域:基礎認知、視覺推理與視覺應用。評估內容包含 25 種不同情境,例如一般物件辨識、圖表分析及醫學影像等。 國產模型在基礎認知與數據分析類別中表現尤為出色,得分始終維持在90分以上,這反映出其技術成熟度高,且對中文語境具有強大的適應性。
專業領域仍面臨挑戰,工業與醫療推理被視為未來重點發展領域
儘管整體表現領先,評估數據也突顯出國內模型仍需改進的領域。在工業檢測和高精度醫學影像等高度專業化的視覺推理任務中,這些模型落後於全球領先者,部分特定情境的得分波動幅度頗大。
業界專家認為,近期排名的變化標誌著中國多模態人工智慧發展的重要轉折點。國內大型模型在深度理解與應用中文內容的能力上,現已確立了穩固的競爭優勢,這標誌著一個新時代的開始——這些模型不僅能與國際巨頭一較高下,甚至有望在該領域扮演領導角色。
相關文章
「靈光」App 透過熱門榜、追蹤功能及電腦版支援,為 Circle 社群注入新活力
7月16日,AIBase 發現螞蟻集團的全螢幕模式 AI 助理「靈光 App」已更新其即時應用社群「靈光圈」。 此最新版本新增了「熱門榜」、「編輯精選」及「追蹤創作者」等功能。此外,現在電腦用戶也能上傳多模態檔案(例如文件和圖片)來生成應用程式。 使用者可基於本機檔案建立智慧問答機器人或開發 AI 應用程式,這不僅大幅提升了發現 AI 工具的效率,更進一步強化了創作體驗。「靈光圈」是「靈光 App
Horizon 推出 Core i7 的白盒授權方案,加速 L3 和 L4 AI 模型的量產
Horizon Robotics 正從一家中國自動駕駛創新企業,轉型為全球汽車龍頭在中國市場的「智能駕駛大腦」。 據格隆匯報導,Horizon 與福斯集團於 7 月 22 日正式宣布,其合資企業 Coretech(CARIZON)將在 AI 基礎大模型領域,與 CARIAD 及 Horizon 深化技術合作。 此合作關係的核心在於其授權架構:Coretech 運用 Horizon 的先進 AI 基
xAI 聯合創始人辭職,原始團隊成員僅剩五人
xAI,埃隆·馬斯克的人工智慧企業,經歷了又一輪重大的人員流失。聯合創始人託比·波倫(Toby Pohlen)已正式宣佈離職。他在 X 平臺上分享了感言,回顧了自己三年的任職經歷,提到自己處理了數千個拉取請求,並與團隊分享了許多難忘的時刻。他讚揚了團隊不懈的工作精神,開玩笑說:“沒有人比你熬夜更晚。”他離職後的首要計劃是睡足八個小時以上,隨後花些時間思考接下來的步驟。波倫的離職標誌著 xAI 創始團隊的進一步分裂。在不到三年的時間裡,最初的十二位聯合創始人中有七人已離職,留存率低於 50%。xA
相關專題推薦
評論 (0)
0/500
根據 SuperCLUE-VLM 於 2026 年 4 月發布的最新評估報告,中文多模態視覺語言模型領域已取得顯著進展。 經對全球17款頂尖大型模型進行全面評估後發現,國內人工智慧開發者正展現強勁的進步勢頭。這些模型不僅在解析中文內容方面表現優異,更在所有評估指標上均超越國際頂尖同類模型。
字節跳動位居榜首,多款國內模型躋身頂尖行列
評估結果顯示,字節跳動的「Doubao-Seed-2.0-Pro-260215」獲得90.66分,位居總排名首位。 此分數超越了此前被視為強勁競爭對手的 Google Gemini-3.1-Pro-Preview(89.35 分)。 此外,其他國內模型,如阿里巴巴的「Qwen 3.5」系列、商湯科技的「SenseNova」以及智普的「GLM」,表現同樣出色,穩居領先行列。 相較之下,OpenAI 的 GPT-5.4 和 X.AI 的 Grok 等知名海外模型,在這項中國多模態評估中則落入中游水準。

橫跨三大關鍵領域的深度評估,展現先進的基本認知能力
本次評估框架全面,涵蓋三大核心領域:基礎認知、視覺推理與視覺應用。評估內容包含 25 種不同情境,例如一般物件辨識、圖表分析及醫學影像等。 國產模型在基礎認知與數據分析類別中表現尤為出色,得分始終維持在90分以上,這反映出其技術成熟度高,且對中文語境具有強大的適應性。
專業領域仍面臨挑戰,工業與醫療推理被視為未來重點發展領域
儘管整體表現領先,評估數據也突顯出國內模型仍需改進的領域。在工業檢測和高精度醫學影像等高度專業化的視覺推理任務中,這些模型落後於全球領先者,部分特定情境的得分波動幅度頗大。
業界專家認為,近期排名的變化標誌著中國多模態人工智慧發展的重要轉折點。國內大型模型在深度理解與應用中文內容的能力上,現已確立了穩固的競爭優勢,這標誌著一個新時代的開始——這些模型不僅能與國際巨頭一較高下,甚至有望在該領域扮演領導角色。
「靈光」App 透過熱門榜、追蹤功能及電腦版支援,為 Circle 社群注入新活力
7月16日,AIBase 發現螞蟻集團的全螢幕模式 AI 助理「靈光 App」已更新其即時應用社群「靈光圈」。 此最新版本新增了「熱門榜」、「編輯精選」及「追蹤創作者」等功能。此外,現在電腦用戶也能上傳多模態檔案(例如文件和圖片)來生成應用程式。 使用者可基於本機檔案建立智慧問答機器人或開發 AI 應用程式,這不僅大幅提升了發現 AI 工具的效率,更進一步強化了創作體驗。「靈光圈」是「靈光 App
Horizon 推出 Core i7 的白盒授權方案,加速 L3 和 L4 AI 模型的量產
Horizon Robotics 正從一家中國自動駕駛創新企業,轉型為全球汽車龍頭在中國市場的「智能駕駛大腦」。 據格隆匯報導,Horizon 與福斯集團於 7 月 22 日正式宣布,其合資企業 Coretech(CARIZON)將在 AI 基礎大模型領域,與 CARIAD 及 Horizon 深化技術合作。 此合作關係的核心在於其授權架構:Coretech 運用 Horizon 的先進 AI 基
xAI 聯合創始人辭職,原始團隊成員僅剩五人
xAI,埃隆·馬斯克的人工智慧企業,經歷了又一輪重大的人員流失。聯合創始人託比·波倫(Toby Pohlen)已正式宣佈離職。他在 X 平臺上分享了感言,回顧了自己三年的任職經歷,提到自己處理了數千個拉取請求,並與團隊分享了許多難忘的時刻。他讚揚了團隊不懈的工作精神,開玩笑說:“沒有人比你熬夜更晚。”他離職後的首要計劃是睡足八個小時以上,隨後花些時間思考接下來的步驟。波倫的離職標誌著 xAI 創始團隊的進一步分裂。在不到三年的時間裡,最初的十二位聯合創始人中有七人已離職,留存率低於 50%。xA





首頁






