Google启动高级AI推理模型系列

周二,Google推出了Gemini 2.5,一套全新的AI模型,这些模型在给出答案前会真正“思考”片刻。就像它们在试图模仿我们人类,对吧?
领头的是Gemini 2.5 Pro Experimental,Google宣称这是他们迄今最智能的模型。这个厉害的家伙是多模态的,能像冠军一样处理推理任务。从周二开始,你可以在Google AI Studio上体验它,或者如果你每月支付20美元订阅Gemini Advanced,你可以通过Gemini应用访问它。
Google对推理功能非常重视——他们计划将其融入未来所有的AI模型中。
自从OpenAI在2024年9月发布了首个AI推理模型o1以来,科技界一直在奋力追赶。现在,Anthropic、DeepSeek、Google和xAI都在推出自己的推理模型。这些模型需要更多时间和计算能力来核查事实并思考问题,然后再给出答案。
推理技术对AI来说是个游戏规则的改变者,特别是在数学和编码方面。科技界的许多人认为,这些推理模型对AI代理——那些无需人类监督就能自主完成任务的系统——至关重要。不过,它们的成本也更高。
Google对此并不陌生——他们之前已经尝试过推理模型,比如去年12月发布的那个“思考”版本的Gemini。但Gemini 2.5?这是他们向OpenAI的“o”系列发起的重大挑战。
Google声称Gemini 2.5 Pro在多项基准测试中超越了他们的旧模型和竞争对手的一些顶级模型。他们定制了Gemini 2.5,使其在视觉上惊艳的网页应用和能够独立运行的编码项目中表现出色。
在Aider Polyglot代码编辑测试中,Gemini 2.5 Pro取得了68.6%的优异成绩,击败了OpenAI、Anthropic和DeepSeek的最佳模型。但在SWE-bench Verified软件开发测试中,它达到了63.8%——足以击败OpenAI的o3-mini和DeepSeek的R1,但未能超过Anthropic的Claude 3.7 Sonnet,后者得分70.3%。
还有Humanity's Last Exam,这是一个包含数学、人文学科和科学等数千道题目的复杂多模态测试。Gemini 2.5 Pro取得了18.8%的成绩,优于大多数知名模型。
一经推出,Gemini 2.5 Pro就具备100万个令牌的上下文窗口——这就像能一口气读完整个《指环王》系列。而且很快,他们计划将其扩展到200万个令牌。
Google目前尚未公开API定价,但他们承诺将在未来几周内公布详情。
相关文章
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片
相关专题推荐
评论 (39)
0/500
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔

周二,Google推出了Gemini 2.5,一套全新的AI模型,这些模型在给出答案前会真正“思考”片刻。就像它们在试图模仿我们人类,对吧?
领头的是Gemini 2.5 Pro Experimental,Google宣称这是他们迄今最智能的模型。这个厉害的家伙是多模态的,能像冠军一样处理推理任务。从周二开始,你可以在Google AI Studio上体验它,或者如果你每月支付20美元订阅Gemini Advanced,你可以通过Gemini应用访问它。
Google对推理功能非常重视——他们计划将其融入未来所有的AI模型中。
自从OpenAI在2024年9月发布了首个AI推理模型o1以来,科技界一直在奋力追赶。现在,Anthropic、DeepSeek、Google和xAI都在推出自己的推理模型。这些模型需要更多时间和计算能力来核查事实并思考问题,然后再给出答案。
推理技术对AI来说是个游戏规则的改变者,特别是在数学和编码方面。科技界的许多人认为,这些推理模型对AI代理——那些无需人类监督就能自主完成任务的系统——至关重要。不过,它们的成本也更高。
Google对此并不陌生——他们之前已经尝试过推理模型,比如去年12月发布的那个“思考”版本的Gemini。但Gemini 2.5?这是他们向OpenAI的“o”系列发起的重大挑战。
Google声称Gemini 2.5 Pro在多项基准测试中超越了他们的旧模型和竞争对手的一些顶级模型。他们定制了Gemini 2.5,使其在视觉上惊艳的网页应用和能够独立运行的编码项目中表现出色。
在Aider Polyglot代码编辑测试中,Gemini 2.5 Pro取得了68.6%的优异成绩,击败了OpenAI、Anthropic和DeepSeek的最佳模型。但在SWE-bench Verified软件开发测试中,它达到了63.8%——足以击败OpenAI的o3-mini和DeepSeek的R1,但未能超过Anthropic的Claude 3.7 Sonnet,后者得分70.3%。
还有Humanity's Last Exam,这是一个包含数学、人文学科和科学等数千道题目的复杂多模态测试。Gemini 2.5 Pro取得了18.8%的成绩,优于大多数知名模型。
一经推出,Gemini 2.5 Pro就具备100万个令牌的上下文窗口——这就像能一口气读完整个《指环王》系列。而且很快,他们计划将其扩展到200万个令牌。
Google目前尚未公开API定价,但他们承诺将在未来几周内公布详情。
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔





首页






