谷歌通过将原生计算机操作集成至 Gemini 3.5 Flash 中,打破了多模态切换的壁垒。

Google DeepMind 团队宣布取得了重大突破,他们将原生计算机操作能力直接整合到了 Gemini 3.5 Flash 模型中。如今,开发者只需使用同一个模型,就能构建出能够在浏览器、移动设备和桌面端上自主查看屏幕内容并执行相应操作的 AI 智能体。
此前,这项功能仅作为独立的模型提供,开发者不得不处理不同模型之间的复杂切换与上下文传递问题。通过原生集成后,AI 在执行跨平台的长时任务时无需再手动传递信息,从而大幅简化了开发流程。
避免上下文丢失以提高智能体可靠性
Google 的团队认为,AI 智能体的核心瓶颈并非单个工具的局限性,而是在切换不同工具时会出现的上下文信息丢失问题。通过将搜索、地图和计算机操作统一在同一个模型架构中,上下文能够实现连续流转,进而显著降低复杂任务出错的可能性。
这种“多工具集成”的设计类似于建造一座内部设有连接通道的单一建筑,从而避免了多座独立建筑之间繁琐且易出错的通信过程。这样的架构变革有望大幅提升基于智能体的任务的可靠性与响应速度。
针对三种核心场景构建多层安全防护体系
这项原生能力将主要应用于三种核心场景:需要连续运行数小时或数天的自动化任务、用于自动验证 UI 一致性的持续软件测试,以及涉及多款应用程序的知识密集型工作。这些场景高度依赖任务间的上下文连贯性,能够有效替代人类执行重复性、高强度的操作。
在安全性方面,Google 采用了多层防御策略,包括针对性的对抗性训练、针对敏感操作的企业级安全防护措施,以及间接提示注入检测功能。这些机制共同帮助企业用户在开放且缺乏管控的计算机环境中建立起较为完善的安全屏障。
相关文章
中国启动大模型与IPv6专项行动:生成式AI应用将全面拥抱下一代网络
雄安新区正式启动面向智能时代网络基础设施升级的重大举措第一阶段。中国国家互联网信息办公室(CAC)联合北京、上海、浙江、深圳等地的地方网信部门,以及五家头部大模型开发者,共同启动“人工智能大模型IPv6能力增强专项行动”。此次协同行动旨在确保生成式大模型应用在IPv6网络上的全面支持,为智能时代的未来发展奠定坚实的网络基础。IPv6是由互联网工程任务组(IETF)制定的下一代互联网协议,旨在取代IPv4。其采用128位地址,地址空间高达2^128——这一规模之大,理论上可为地球上的每一粒沙子分
全球人工智能监管转向发布前强制测试
随着大型人工智能模型的快速发展,全球监管框架正从自愿指南转向由政府主导、基于证据的强制性要求。这一转变标志着实用化人工智能监管新时代的开启。1. 新标准:谁负责审计人工智能模型?此前,开发者主要依赖内部红队测试或自行发布的安全报告。这种自我评估方式已不再满足国家安全要求。引领这一转变的是英国人工智能安全研究所(AISI)和美国商务部的人工智能标准与创新中心(CAISI)。发布前的国家安全评估现已成为行业标准要求。测试内容是什么? 重点已从广泛的原则转向具体的技术风险:大规模网络攻击的潜力
阿里巴巴的马云、曹兴信:人工智能将成为无形基础设施,知识工作者总可寻市场达50万亿美元
阿里巴巴集团主席马云最近在“Vento 2026”(意大利技术与投资峰会)上发表演讲,预测人工智能将在五年内从独立话题转变为跨行业的嵌入式基础设施。马云指出,尽管当前的人工智能在节省时间方面表现出色,但其增强我们时间利用方式的潜力仍 largely 未被挖掘。他将提升知识型工作者的生产力视为最具可行性的应用场景,估计总可触达市场规模为 50 万亿美元。此外,人工智能有望加速医疗和科学研究的突破。关于阿里巴巴的战略路线图,马云将公司的发展划分为“公元前”(BC)和“公元后”(AD)两个阶段,以
相关专题推荐
评论 (0)
0/500

Google DeepMind 团队宣布取得了重大突破,他们将原生计算机操作能力直接整合到了 Gemini 3.5 Flash 模型中。如今,开发者只需使用同一个模型,就能构建出能够在浏览器、移动设备和桌面端上自主查看屏幕内容并执行相应操作的 AI 智能体。
此前,这项功能仅作为独立的模型提供,开发者不得不处理不同模型之间的复杂切换与上下文传递问题。通过原生集成后,AI 在执行跨平台的长时任务时无需再手动传递信息,从而大幅简化了开发流程。
避免上下文丢失以提高智能体可靠性
Google 的团队认为,AI 智能体的核心瓶颈并非单个工具的局限性,而是在切换不同工具时会出现的上下文信息丢失问题。通过将搜索、地图和计算机操作统一在同一个模型架构中,上下文能够实现连续流转,进而显著降低复杂任务出错的可能性。
这种“多工具集成”的设计类似于建造一座内部设有连接通道的单一建筑,从而避免了多座独立建筑之间繁琐且易出错的通信过程。这样的架构变革有望大幅提升基于智能体的任务的可靠性与响应速度。
针对三种核心场景构建多层安全防护体系
这项原生能力将主要应用于三种核心场景:需要连续运行数小时或数天的自动化任务、用于自动验证 UI 一致性的持续软件测试,以及涉及多款应用程序的知识密集型工作。这些场景高度依赖任务间的上下文连贯性,能够有效替代人类执行重复性、高强度的操作。
在安全性方面,Google 采用了多层防御策略,包括针对性的对抗性训练、针对敏感操作的企业级安全防护措施,以及间接提示注入检测功能。这些机制共同帮助企业用户在开放且缺乏管控的计算机环境中建立起较为完善的安全屏障。
中国启动大模型与IPv6专项行动:生成式AI应用将全面拥抱下一代网络
雄安新区正式启动面向智能时代网络基础设施升级的重大举措第一阶段。中国国家互联网信息办公室(CAC)联合北京、上海、浙江、深圳等地的地方网信部门,以及五家头部大模型开发者,共同启动“人工智能大模型IPv6能力增强专项行动”。此次协同行动旨在确保生成式大模型应用在IPv6网络上的全面支持,为智能时代的未来发展奠定坚实的网络基础。IPv6是由互联网工程任务组(IETF)制定的下一代互联网协议,旨在取代IPv4。其采用128位地址,地址空间高达2^128——这一规模之大,理论上可为地球上的每一粒沙子分
全球人工智能监管转向发布前强制测试
随着大型人工智能模型的快速发展,全球监管框架正从自愿指南转向由政府主导、基于证据的强制性要求。这一转变标志着实用化人工智能监管新时代的开启。1. 新标准:谁负责审计人工智能模型?此前,开发者主要依赖内部红队测试或自行发布的安全报告。这种自我评估方式已不再满足国家安全要求。引领这一转变的是英国人工智能安全研究所(AISI)和美国商务部的人工智能标准与创新中心(CAISI)。发布前的国家安全评估现已成为行业标准要求。测试内容是什么? 重点已从广泛的原则转向具体的技术风险:大规模网络攻击的潜力
阿里巴巴的马云、曹兴信:人工智能将成为无形基础设施,知识工作者总可寻市场达50万亿美元
阿里巴巴集团主席马云最近在“Vento 2026”(意大利技术与投资峰会)上发表演讲,预测人工智能将在五年内从独立话题转变为跨行业的嵌入式基础设施。马云指出,尽管当前的人工智能在节省时间方面表现出色,但其增强我们时间利用方式的潜力仍 largely 未被挖掘。他将提升知识型工作者的生产力视为最具可行性的应用场景,估计总可触达市场规模为 50 万亿美元。此外,人工智能有望加速医疗和科学研究的突破。关于阿里巴巴的战略路线图,马云将公司的发展划分为“公元前”(BC)和“公元后”(AD)两个阶段,以





首页






