OpenAI 将 GPT-5.5 作为 ChatGPT 的新默认模型,取代了 GPT-5.3
OpenAI 于周二发布了其最新一代基础模型 GPT-5.5Instant,并宣布该模型将取代 GPT-5.3Instant,成为 ChatGPT 中的默认模型。新版本在保持低延迟的同时,旨在减轻法律、医疗和金融等敏感行业中的认知偏见。 此次更新延续了上月随 GPT-5.5 系列推出的战略,该战略侧重于提升编码能力以及在知识密集型任务中的表现。

根据基准测试,GPT-5.5Instant展现出显著的性能提升: 它在AIME2025数学评估中获得81.2分,远超前代模型的65.4分;在MMMU-Pro多模态推理测试中获得76分,较前代的69.2分有所提升。 这些结果凸显了其在复杂推理和跨模态理解方面的增强能力。
从产品功能角度来看,此次升级将“上下文管理”作为一项关键能力加以突出。 GPT-5.5Instant 可通过搜索功能访问历史对话、文档和 Gmail 邮件,从而生成更个性化的回复。该功能目前已向网页版 Plus 和 Pro 层级的用户开放,并将在未来几周内推广至移动设备以及 Free、Go Business 和企业用户账户。
此外,ChatGPT 还推出了“可视化记忆源”功能,允许用户查看模型回复中引用的历史信息来源。用户还可以根据需要删除或编辑这些记忆。关于隐私问题,OpenAI 已确认在共享聊天记录时不会披露记忆源,从而消除了用户对数据使用的担忧。
对于开发者而言,GPT-5.5将通过名为“chat-latest”的API提供,而GPT-5.3Instant将在为期三个月的过渡期内继续作为付费选项提供。
值得注意的是,OpenAI 此前的新旧模型替换策略曾在用户中引发争议。2026 年 2 月,GPT-4o 停止服务时,因其“高度共情风格”导致用户对平台产生情感依赖而招致批评。 鉴于这一背景,GPT-5.5Instant的推出面临着更大的压力,需确保产品性能的稳定性并满足用户的心理预期。
总而言之,GPT-5.5Instant的发布代表着在模型性能、可控性和个性化能力之间寻求平衡的进一步努力。这也反映出该平台正加速推进模型标准化和统一访问策略的实施。
相关文章
GPT 5.5 领跑 AI 安全竞赛,DeepSeek 在成本效益方面位居榜首
Kasra Rahjerdi,一名安全研究人员,最近发布了一份重要报告,详细阐述了对主要大型语言模型的安全推理能力进行的实际测试。他通过构建一个故意存在漏洞的书评应用程序实现了这一目标。在该场景中,模拟了现实世界中的漏洞,Rahjerdi 在应用程序文件中嵌入了 Google 移动后端服务的凭据。这些模型的任务是解压并识别这些凭据,从而直接访问数据库。顶级模型对比在严格的两小时时间限制和 10 美元预算约束下,各模型的表现水平各不相同。GPT-5.5 成为表现最强的模型,成功完成了 10 次尝试
马斯克称,SpaceX的人工智能可能在半年内超越Anthropic
SpaceXAI首席执行官埃隆·马斯克预测,公司将在六个月内主导人工智能领域,并借助计算硬件来缩小与竞争对手的差距。SpaceXAI首席执行官埃隆·马斯克近日在X平台上表示,其公司计划在约六个月内引领前沿人工智能领域。马斯克表达了谨慎乐观的态度,暗示SpaceXAI有望在两到三个月内达到Anthropic的Fable或OpenAI的GPT-6的水平。SpaceXAI目前提供17种模型,每种模型在智
WeRide 发布 WITT——一款物理人工智能大模型
自动驾驶技术正以惊人的速度发展。7月17日,领先的自动驾驶公司威瑞德(WeRide)发布了其自主研发的物理AI认知基础模型——WeRide WITT。此次发布标志着AI在理解和处理复杂的现实世界数据能力方面迈出了重要一步。WeRide WITT的核心理念是“最小物理事实单元”。 该框架旨在帮助人工智能解读视频、图像和文本等多模态输入,将动态的现实世界场景分解为核心事实要素。通过识别和验证这些单元,
相关专题推荐
评论 (0)
0/500
OpenAI 于周二发布了其最新一代基础模型 GPT-5.5Instant,并宣布该模型将取代 GPT-5.3Instant,成为 ChatGPT 中的默认模型。新版本在保持低延迟的同时,旨在减轻法律、医疗和金融等敏感行业中的认知偏见。 此次更新延续了上月随 GPT-5.5 系列推出的战略,该战略侧重于提升编码能力以及在知识密集型任务中的表现。

根据基准测试,GPT-5.5Instant展现出显著的性能提升: 它在AIME2025数学评估中获得81.2分,远超前代模型的65.4分;在MMMU-Pro多模态推理测试中获得76分,较前代的69.2分有所提升。 这些结果凸显了其在复杂推理和跨模态理解方面的增强能力。
从产品功能角度来看,此次升级将“上下文管理”作为一项关键能力加以突出。 GPT-5.5Instant 可通过搜索功能访问历史对话、文档和 Gmail 邮件,从而生成更个性化的回复。该功能目前已向网页版 Plus 和 Pro 层级的用户开放,并将在未来几周内推广至移动设备以及 Free、Go Business 和企业用户账户。
此外,ChatGPT 还推出了“可视化记忆源”功能,允许用户查看模型回复中引用的历史信息来源。用户还可以根据需要删除或编辑这些记忆。关于隐私问题,OpenAI 已确认在共享聊天记录时不会披露记忆源,从而消除了用户对数据使用的担忧。
对于开发者而言,GPT-5.5将通过名为“chat-latest”的API提供,而GPT-5.3Instant将在为期三个月的过渡期内继续作为付费选项提供。
值得注意的是,OpenAI 此前的新旧模型替换策略曾在用户中引发争议。2026 年 2 月,GPT-4o 停止服务时,因其“高度共情风格”导致用户对平台产生情感依赖而招致批评。 鉴于这一背景,GPT-5.5Instant的推出面临着更大的压力,需确保产品性能的稳定性并满足用户的心理预期。
总而言之,GPT-5.5Instant的发布代表着在模型性能、可控性和个性化能力之间寻求平衡的进一步努力。这也反映出该平台正加速推进模型标准化和统一访问策略的实施。
GPT 5.5 领跑 AI 安全竞赛,DeepSeek 在成本效益方面位居榜首
Kasra Rahjerdi,一名安全研究人员,最近发布了一份重要报告,详细阐述了对主要大型语言模型的安全推理能力进行的实际测试。他通过构建一个故意存在漏洞的书评应用程序实现了这一目标。在该场景中,模拟了现实世界中的漏洞,Rahjerdi 在应用程序文件中嵌入了 Google 移动后端服务的凭据。这些模型的任务是解压并识别这些凭据,从而直接访问数据库。顶级模型对比在严格的两小时时间限制和 10 美元预算约束下,各模型的表现水平各不相同。GPT-5.5 成为表现最强的模型,成功完成了 10 次尝试
马斯克称,SpaceX的人工智能可能在半年内超越Anthropic
SpaceXAI首席执行官埃隆·马斯克预测,公司将在六个月内主导人工智能领域,并借助计算硬件来缩小与竞争对手的差距。SpaceXAI首席执行官埃隆·马斯克近日在X平台上表示,其公司计划在约六个月内引领前沿人工智能领域。马斯克表达了谨慎乐观的态度,暗示SpaceXAI有望在两到三个月内达到Anthropic的Fable或OpenAI的GPT-6的水平。SpaceXAI目前提供17种模型,每种模型在智
WeRide 发布 WITT——一款物理人工智能大模型
自动驾驶技术正以惊人的速度发展。7月17日,领先的自动驾驶公司威瑞德(WeRide)发布了其自主研发的物理AI认知基础模型——WeRide WITT。此次发布标志着AI在理解和处理复杂的现实世界数据能力方面迈出了重要一步。WeRide WITT的核心理念是“最小物理事实单元”。 该框架旨在帮助人工智能解读视频、图像和文本等多模态输入,将动态的现实世界场景分解为核心事实要素。通过识别和验证这些单元,





首页






