Google 推出 Gemini Deep Think AI,用於平行推理和想法測試
Google DeepMind 推出 Gemini 2.5 Deep Think,這是他們迄今為止最精密的 AI 推理模型。這個創新的系統可以同時分析多個思考路徑,然後再選出最佳解決方案。
自本週五起,Google 每月 250 美元的 Ultra 高級方案訂閱者將可透過 Gemini 應用程式,獨享 Gemini 2.5 Deep Think 的使用權。
Gemini 2.5 Deep Think 於 2025 年 Google I/O 週年大會上首次亮相,代表 Google 首次公開多代理模式。該系統同時部署多個 AI 代理來處理複雜的查詢,需要更強大的運算能力,但卻能產生更優異的結果。
Gemini 2.5 Deep Think 的專用版本在今年的國際數學奧林匹克比賽中獲得金牌。
Google 在開發 Gemini 2.5 Deep Think 的同時,也與數學家和學者分享 IMO 獲獎模型。有別於傳統 AI 模型的即時反應,這個以研究為重點的版本需要數小時的推理時間。該公司的目標是透過這項計畫,精進學術應用的多重代理技術。
Google 強調 Gemini 2.5 Deep Think 自首次 I/O 公佈以來的重大進展,包括優化模型推理能力的新型強化學習技術。
"Google 在 TechCrunch 獨家部落格文章中表示:「Deep Think 擅於解決需要創意思維、策略規劃與迭代精進的問題。
科技與創投重量級人物加入 Disrupt 2025 議程
包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將成為 TechCrunch Disrupt 2025 的主角。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。
科技與創投重量級人物加入 Disrupt 2025 議程
包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將擔任 TechCrunch Disrupt 2025 的主講嘉賓。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。
Gemini 2.5 Deep Think 在人類最後一次考試 (Humanity's Last Exam, HLE) 中設立新標準,這是一項跨學科測試人工智能的綜合評估。Google 報告在不使用外部工具的情況下,準確率達 34.8%,超越競爭對手 Grok 4 (25.4%) 與 OpenAI 的 o3 (20.3%)。
在競爭激烈的程式設計任務中,該模型也以 87.6% 的優異成績稱霸 LiveCodeBench 6,超越 Grok 4 (79%) 和 OpenAI 的 o3 (72%)。

基準分數圖片來源:Google Gemini 2.5 Deep Think 可與程式設計環境和搜尋工具無縫整合,同時產生比傳統 AI 系統更廣泛的輸出。
Google 的內部測試顯示,該模型能產生異常詳細的網頁開發解決方案,有可能加速科學突破。

由 Google 的 AII 製作的藝術場景圖片資料來源:Google 領先的人工智能研究人員越來越多地採用多代理體架構。
xAI 的 Grok 4 Heavy 和 OpenAI 未發佈的 IMO 模型都採用了多代理系統,Anthropic 的研究型 AI 也是如此。雖然這些系統展現出優異的效能,但其營運成本卻使其必須以較高的價格階層來訂價。
Google 計劃在未來幾週內限制 Gemini 2.5 Deep Think 的 API 存取權限,以探索企業與開發人員的應用。
相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
評論 (1)
0/500
Interesting approach! Parallel reasoning could really speed up complex problem-solving, but I wonder how they ensure the 'optimal' solution isn't just the most predictable one? The testing feature sounds useful for prototyping ideas quickly. Hope it's accessible beyond just high-tier subscribers soon. 🤔
Google DeepMind 推出 Gemini 2.5 Deep Think,這是他們迄今為止最精密的 AI 推理模型。這個創新的系統可以同時分析多個思考路徑,然後再選出最佳解決方案。
自本週五起,Google 每月 250 美元的 Ultra 高級方案訂閱者將可透過 Gemini 應用程式,獨享 Gemini 2.5 Deep Think 的使用權。
Gemini 2.5 Deep Think 於 2025 年 Google I/O 週年大會上首次亮相,代表 Google 首次公開多代理模式。該系統同時部署多個 AI 代理來處理複雜的查詢,需要更強大的運算能力,但卻能產生更優異的結果。
Gemini 2.5 Deep Think 的專用版本在今年的國際數學奧林匹克比賽中獲得金牌。
Google 在開發 Gemini 2.5 Deep Think 的同時,也與數學家和學者分享 IMO 獲獎模型。有別於傳統 AI 模型的即時反應,這個以研究為重點的版本需要數小時的推理時間。該公司的目標是透過這項計畫,精進學術應用的多重代理技術。
Google 強調 Gemini 2.5 Deep Think 自首次 I/O 公佈以來的重大進展,包括優化模型推理能力的新型強化學習技術。
"Google 在 TechCrunch 獨家部落格文章中表示:「Deep Think 擅於解決需要創意思維、策略規劃與迭代精進的問題。
科技與創投重量級人物加入 Disrupt 2025 議程
包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將成為 TechCrunch Disrupt 2025 的主角。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。
科技與創投重量級人物加入 Disrupt 2025 議程
包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將擔任 TechCrunch Disrupt 2025 的主講嘉賓。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。
Gemini 2.5 Deep Think 在人類最後一次考試 (Humanity's Last Exam, HLE) 中設立新標準,這是一項跨學科測試人工智能的綜合評估。Google 報告在不使用外部工具的情況下,準確率達 34.8%,超越競爭對手 Grok 4 (25.4%) 與 OpenAI 的 o3 (20.3%)。
在競爭激烈的程式設計任務中,該模型也以 87.6% 的優異成績稱霸 LiveCodeBench 6,超越 Grok 4 (79%) 和 OpenAI 的 o3 (72%)。

Gemini 2.5 Deep Think 可與程式設計環境和搜尋工具無縫整合,同時產生比傳統 AI 系統更廣泛的輸出。
Google 的內部測試顯示,該模型能產生異常詳細的網頁開發解決方案,有可能加速科學突破。

領先的人工智能研究人員越來越多地採用多代理體架構。
xAI 的 Grok 4 Heavy 和 OpenAI 未發佈的 IMO 模型都採用了多代理系統,Anthropic 的研究型 AI 也是如此。雖然這些系統展現出優異的效能,但其營運成本卻使其必須以較高的價格階層來訂價。
Google 計劃在未來幾週內限制 Gemini 2.5 Deep Think 的 API 存取權限,以探索企業與開發人員的應用。
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
Interesting approach! Parallel reasoning could really speed up complex problem-solving, but I wonder how they ensure the 'optimal' solution isn't just the most predictable one? The testing feature sounds useful for prototyping ideas quickly. Hope it's accessible beyond just high-tier subscribers soon. 🤔





首頁






