選項
首頁
新聞
Google 推出 Gemini Deep Think AI,用於平行推理和想法測試

Google 推出 Gemini Deep Think AI,用於平行推理和想法測試

2025-11-12
123

Google DeepMind 推出 Gemini 2.5 Deep Think,這是他們迄今為止最精密的 AI 推理模型。這個創新的系統可以同時分析多個思考路徑,然後再選出最佳解決方案。

自本週五起,Google 每月 250 美元的 Ultra 高級方案訂閱者將可透過 Gemini 應用程式,獨享 Gemini 2.5 Deep Think 的使用權。

Gemini 2.5 Deep Think 於 2025 年 Google I/O 週年大會上首次亮相,代表 Google 首次公開多代理模式。該系統同時部署多個 AI 代理來處理複雜的查詢,需要更強大的運算能力,但卻能產生更優異的結果。

Gemini 2.5 Deep Think 的專用版本在今年的國際數學奧林匹克比賽中獲得金牌。

Google 在開發 Gemini 2.5 Deep Think 的同時,也與數學家和學者分享 IMO 獲獎模型。有別於傳統 AI 模型的即時反應,這個以研究為重點的版本需要數小時的推理時間。該公司的目標是透過這項計畫,精進學術應用的多重代理技術。

Google 強調 Gemini 2.5 Deep Think 自首次 I/O 公佈以來的重大進展,包括優化模型推理能力的新型強化學習技術。

"Google 在 TechCrunch 獨家部落格文章中表示:「Deep Think 擅於解決需要創意思維、策略規劃與迭代精進的問題。

科技與創投重量級人物加入 Disrupt 2025 議程

包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將成為 TechCrunch Disrupt 2025 的主角。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。

科技與創投重量級人物加入 Disrupt 2025 議程

包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將擔任 TechCrunch Disrupt 2025 的主講嘉賓。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。

Gemini 2.5 Deep Think 在人類最後一次考試 (Humanity's Last Exam, HLE) 中設立新標準,這是一項跨學科測試人工智能的綜合評估。Google 報告在不使用外部工具的情況下,準確率達 34.8%,超越競爭對手 Grok 4 (25.4%) 與 OpenAI 的 o3 (20.3%)。

在競爭激烈的程式設計任務中,該模型也以 87.6% 的優異成績稱霸 LiveCodeBench 6,超越 Grok 4 (79%) 和 OpenAI 的 o3 (72%)。

基準分數圖片來源:Google

Gemini 2.5 Deep Think 可與程式設計環境和搜尋工具無縫整合,同時產生比傳統 AI 系統更廣泛的輸出。

Google 的內部測試顯示,該模型能產生異常詳細的網頁開發解決方案,有可能加速科學突破。

由 Google 的 AII 製作的藝術場景圖片資料來源:Google

領先的人工智能研究人員越來越多地採用多代理體架構。

xAI 的 Grok 4 Heavy 和 OpenAI 未發佈的 IMO 模型都採用了多代理系統,Anthropic 的研究型 AI 也是如此。雖然這些系統展現出優異的效能,但其營運成本卻使其必須以較高的價格階層來訂價。

Google 計劃在未來幾週內限制 Gemini 2.5 Deep Think 的 API 存取權限,以探索企業與開發人員的應用。

相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍 Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍 Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
聊天機器人 最適合面試練習的 AI 對話訓練工具
最適合面試練習的 AI 對話訓練工具

2026 年最新、最受好評的 AI 面試對話訓練工具,盡在 XIX.AI!這份精心精選的清單收錄了多款功能強大、顛覆傳統的工具,這些工具均經過嚴格的實戰測試,能提供精準的回饋。 您將在此找到免費版與付費版的比較分析,以及詳細的排名榜單,助您挑選必試的選項,從而提升自信與技能。立即探索,發掘助您在面試中脫穎而出的完美工具!

12 個工具
xix.ai
設計與藝術 最適合進行創意實驗的 AI 風格轉移工具
最適合進行創意實驗的 AI 風格轉移工具

2026 年最新、最佳且評價最高的 AI 風格轉移工具,助您進行創意實驗!XIX.AI 精心精選了一系列強大且具革命性的必試工具,這些工具經實際測試與嚴格評比,能帶來卓越成果。這些頂尖解決方案能加速內容創作並開啟無盡的創意可能性,協助創作者顯著提升生產力。 立即探索,找出最適合您的工具,並從今天開始創作吧!

9 個工具
xix.ai
漫畫創作 最適合視覺敘事的 AI 對話氣泡工具
最適合視覺敘事的 AI 對話氣泡工具

2026 年最新、最受好評的視覺敘事 AI 對話氣泡工具,現已登陸 XIX.AI!這份精心挑選的合集收錄了強大且具顛覆性的工具,能協助創作者提升生產力並突破創作瓶頸。 查看免費版與付費版的比較、參考實際測試結果,並查閱最新排行榜,找出最適合打造引人入勝視覺敘事的必試解決方案。立即探索,發掘您的理想工具!

10 個工具
xix.ai
會議助理 頂尖 AI 會議摘要工具:清晰追蹤決策與後續行動
頂尖 AI 會議摘要工具:清晰追蹤決策與後續行動

2026 年最新高評價最佳 AI 會議摘要工具,助您清晰追蹤決策並輕鬆進行後續跟進。這份精選清單展示了一系列強大且具顛覆性的解決方案,透過自動化會議記錄、識別關鍵行動項目,以及簡化所有專案的團隊協作,大幅提升生產力。 獲取免費版與付費版的比較分析,搭配實際測試報告及每週更新的排行榜,助您找到最合適的工具。立即探索,釋放您的 AI 優勢!

9 個工具
xix.ai
數據分析 最佳人工智慧資料清洗工具:快速處理缺失值與重複資料
最佳人工智慧資料清洗工具:快速處理缺失值與重複資料

2026年最新、最優秀且評分最高的AI資料清洗工具,可快速處理缺失值與重複資料問題。這份精心挑選的清單展示了那些功能強大、能帶來顛覆性變革的解決方案,可顯著提升工作效率。所有候選工具都經過了嚴格的實際應用測試,以確保其穩定性。您可以獲取免費版與付費版的對比資訊,找出最符合您需求的必備工具。即刻訪問XIX.AI,開啟您的AI優勢之旅。

11 個工具
xix.ai
設計與藝術 最佳AI創意構思工具,助力藝術家突破視覺瓶頸
最佳AI創意構思工具,助力藝術家突破視覺瓶頸

2026 年最新最佳頂級評分 AI 創意構思工具由 XIX.AI 精心策劃,旨在幫助創作者突破視覺瓶頸並即時提升創造力。這些強大的變革性工具提供真實世界測試、詳細的免費與付費對比以及每週更新的排名。發現您的完美工具,加速內容創作,並立即釋放您的 AI 優勢。立即探索!

14 個工具
xix.ai
評論 (1)
0/500
FrankMartínez
FrankMartínez 2026-05-25 10:00:35

Interesting approach! Parallel reasoning could really speed up complex problem-solving, but I wonder how they ensure the 'optimal' solution isn't just the most predictable one? The testing feature sounds useful for prototyping ideas quickly. Hope it's accessible beyond just high-tier subscribers soon. 🤔

OR