Google啟動高級AI推理模型系列

週二,Google 推出了 Gemini 2.5,這是一組全新的 AI 模型,會在給出答案前「思考」片刻。就像它們在試圖模仿我們人類,對吧?
領銜的是 Gemini 2.5 Pro Experimental,Google 宣稱這是迄今為止他們最聰明的模型。這款強大的模型支援多模態,能輕鬆應對推理任務。你可以從週二開始在 Google AI Studio 上體驗它,或者如果你每月支付 20 美元訂閱 Gemini Advanced,就可透過 Gemini 應用程式使用它。
Google 對推理功能非常認真——他們計劃將其融入未來所有的 AI 模型中。
自從 OpenAI 在 2024 年 9 月推出了首個 AI 推理模型 o1 後,科技界一直在競相追趕。現在,Anthropic、DeepSeek、Google 和 xAI 都紛紛推出自己的推理模型。這些模型需要更多時間和計算能力來驗證事實並思考問題,然後才給出答案。
推理技術對 AI 來說是一大突破,特別是在數學和程式設計領域。許多科技界人士認為,這些推理模型對 AI 代理至關重要——那些無需人類監督就能自主完成任務的系統。不過,沒錯,它們的成本也更高。
Google 對此並不陌生——他們之前已經嘗試過推理模型,比如去年 12 月發布的 Gemini「思考」版本。但 Gemini 2.5?這是他們試圖超越 OpenAI「o」系列的大手筆。
Google 聲稱 Gemini 2.5 Pro 在多項基準測試中超越了他們的舊模型以及競爭對手的頂尖模型。他們針對視覺效果出色的網頁應用程式和可獨立運作的程式設計項目,特別優化了 Gemini 2.5。
在 Aider Polyglot 程式碼編輯測試中,Gemini 2.5 Pro 獲得了 68.6% 的優異成績,擊敗了 OpenAI、Anthropic 和 DeepSeek 的最佳表現。但在 SWE-bench Verified 軟體開發測試中,它達到了 63.8%——足以擊敗 OpenAI 的 o3-mini 和 DeepSeek 的 R1,但未能超越 Anthropic 的 Claude 3.7 Sonnet,後者得分 70.3%。
還有「人類的最後考試」,這是一項涵蓋數學、人文和科學的艱難多模態測試,包含數千道問題。Gemini 2.5 Pro 取得了 18.8% 的成績,優於大多數知名模型。
一推出,Gemini 2.5 Pro 就具備 100 萬 token 的上下文窗口——這就像能一口氣讀完整個《魔戒》系列。很快,他們還計劃將其擴展到 200 萬 token。
Google 目前尚未公開 API 定價,但他們承諾在未來幾週內會透露詳情。
相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
評論 (39)
0/500
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔

週二,Google 推出了 Gemini 2.5,這是一組全新的 AI 模型,會在給出答案前「思考」片刻。就像它們在試圖模仿我們人類,對吧?
領銜的是 Gemini 2.5 Pro Experimental,Google 宣稱這是迄今為止他們最聰明的模型。這款強大的模型支援多模態,能輕鬆應對推理任務。你可以從週二開始在 Google AI Studio 上體驗它,或者如果你每月支付 20 美元訂閱 Gemini Advanced,就可透過 Gemini 應用程式使用它。
Google 對推理功能非常認真——他們計劃將其融入未來所有的 AI 模型中。
自從 OpenAI 在 2024 年 9 月推出了首個 AI 推理模型 o1 後,科技界一直在競相追趕。現在,Anthropic、DeepSeek、Google 和 xAI 都紛紛推出自己的推理模型。這些模型需要更多時間和計算能力來驗證事實並思考問題,然後才給出答案。
推理技術對 AI 來說是一大突破,特別是在數學和程式設計領域。許多科技界人士認為,這些推理模型對 AI 代理至關重要——那些無需人類監督就能自主完成任務的系統。不過,沒錯,它們的成本也更高。
Google 對此並不陌生——他們之前已經嘗試過推理模型,比如去年 12 月發布的 Gemini「思考」版本。但 Gemini 2.5?這是他們試圖超越 OpenAI「o」系列的大手筆。
Google 聲稱 Gemini 2.5 Pro 在多項基準測試中超越了他們的舊模型以及競爭對手的頂尖模型。他們針對視覺效果出色的網頁應用程式和可獨立運作的程式設計項目,特別優化了 Gemini 2.5。
在 Aider Polyglot 程式碼編輯測試中,Gemini 2.5 Pro 獲得了 68.6% 的優異成績,擊敗了 OpenAI、Anthropic 和 DeepSeek 的最佳表現。但在 SWE-bench Verified 軟體開發測試中,它達到了 63.8%——足以擊敗 OpenAI 的 o3-mini 和 DeepSeek 的 R1,但未能超越 Anthropic 的 Claude 3.7 Sonnet,後者得分 70.3%。
還有「人類的最後考試」,這是一項涵蓋數學、人文和科學的艱難多模態測試,包含數千道問題。Gemini 2.5 Pro 取得了 18.8% 的成績,優於大多數知名模型。
一推出,Gemini 2.5 Pro 就具備 100 萬 token 的上下文窗口——這就像能一口氣讀完整個《魔戒》系列。很快,他們還計劃將其擴展到 200 萬 token。
Google 目前尚未公開 API 定價,但他們承諾在未來幾週內會透露詳情。
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔





首頁






