GPT-5.4 正式发布,具备透明思维模式、百万令牌上下文处理能力及原生计算机控制功能
OpenAI 于 2026 年 3 月 5 日正式推出了GPT-5.4系列。这一版本标志着重大飞跃,实现了推理、编程和智能体工作流能力的深度融合。
在 ChatGPT 网页界面和移动应用中,全新的“思考(推理)”模式开创了一种变革性的交互方式:
思考路径预览:在给出最终答案前,AI 会先概述其“推理计划”。用户可以实时观察它规划问题解决方法的过程,并可在该过程的任何阶段介入以调整其方向。
增强型深度搜索:针对高度专业化和复杂的查询,思考模式具备更强大的多轮网络搜索能力。它能够交叉引用信息来源,并以人类专家般的洞察力综合生成高质量答案。

生产力引擎:Codex 基因与专业优化的结合
GPT-5.4 全面融合了GPT-5.3-Codex 的顶尖编程能力,确立了其作为 OpenAI 旗舰“主流推理模型”的地位。
办公套件集成:该模型针对电子表格(Excel)、演示文稿(PPT)及文档处理等生产力场景进行了专门微调,显著降低了内容生成过程中的逻辑错误。
低错误率与高事实准确性:数据显示,GPT-5.4的事实错误率比GPT-5.2低18%,错误陈述减少了33%。其在金融和法律分析等专业领域的表现,现已可与人类专业人士媲美。
智能体飞跃:原生“计算机控制”与百万令牌上下文
GPT-5.4已超越简单的聊天界面,具备了真正的原生计算机操作能力:
多应用执行:该模型可通过解析虚拟环境或本地软件中的截图和指令,直接执行点击、拖拽和输入等操作,从而实现复杂的跨应用工作流。
百万令牌上下文:它支持长达100 万令牌(1M Tokens)的超长上下文窗口。这使得智能代理能够一次性“阅读”整个大型代码库或数个季度的财务报告,进而规划并验证跨越数小时甚至数天的长期任务。
版本与定价
本次发布还推出了GPT-5.4Pro版本,主要面向高强度专业开发者和企业客户:
Pro 版本专属功能:支持更高的推理强度设置(推理强度:高/极高),专为科研或建筑设计中极具挑战性的任务而设计。
可用性
相关文章
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
相关专题推荐
评论 (0)
0/500
OpenAI 于 2026 年 3 月 5 日正式推出了GPT-5.4系列。这一版本标志着重大飞跃,实现了推理、编程和智能体工作流能力的深度融合。
在 ChatGPT 网页界面和移动应用中,全新的“思考(推理)”模式开创了一种变革性的交互方式:
思考路径预览:在给出最终答案前,AI 会先概述其“推理计划”。用户可以实时观察它规划问题解决方法的过程,并可在该过程的任何阶段介入以调整其方向。
增强型深度搜索:针对高度专业化和复杂的查询,思考模式具备更强大的多轮网络搜索能力。它能够交叉引用信息来源,并以人类专家般的洞察力综合生成高质量答案。

生产力引擎:Codex 基因与专业优化的结合
GPT-5.4 全面融合了GPT-5.3-Codex 的顶尖编程能力,确立了其作为 OpenAI 旗舰“主流推理模型”的地位。
办公套件集成:该模型针对电子表格(Excel)、演示文稿(PPT)及文档处理等生产力场景进行了专门微调,显著降低了内容生成过程中的逻辑错误。
低错误率与高事实准确性:数据显示,GPT-5.4的事实错误率比GPT-5.2低18%,错误陈述减少了33%。其在金融和法律分析等专业领域的表现,现已可与人类专业人士媲美。
智能体飞跃:原生“计算机控制”与百万令牌上下文
GPT-5.4已超越简单的聊天界面,具备了真正的原生计算机操作能力:
多应用执行:该模型可通过解析虚拟环境或本地软件中的截图和指令,直接执行点击、拖拽和输入等操作,从而实现复杂的跨应用工作流。
百万令牌上下文:它支持长达100 万令牌(1M Tokens)的超长上下文窗口。这使得智能代理能够一次性“阅读”整个大型代码库或数个季度的财务报告,进而规划并验证跨越数小时甚至数天的长期任务。
版本与定价
本次发布还推出了GPT-5.4Pro版本,主要面向高强度专业开发者和企业客户:
Pro 版本专属功能:支持更高的推理强度设置(推理强度:高/极高),专为科研或建筑设计中极具挑战性的任务而设计。
可用性
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic





首页






