OpenAI 发布了 GPT-5.6,这是其模型系列中的最新成员

OpenAI 于周四发布了其最新模型系列,为竞争日益激烈的 AI 领域带来了强大的新选择。
GPT-5.6 共有三个版本:Sol(作为主力机型设计)、Terra(中端选项)和 Luna(经济实惠的选择)。这些模型扩展了多个领域的能力,该公司承诺其在企业任务、编程和科学研究方面将表现出色。
首席执行官萨姆·奥尔特曼表示,新模型比早期版本效率更高、性价比更优,他近日向CNBC透露,Sol在AI编程任务中的令牌效率提升了54%。
值得注意的是,OpenAI将5.6称为其“迄今为止最强大的网络安全模型,仅需更少的令牌即可提供前沿级别的性能”。
该模型的网络安全能力备受关注,尤其是在特朗普政府此前曾因担心其被滥用而试图限制其部署之后。GPT-5.6支持威胁建模、代码审查和补丁修复以及“蓝队”演练等防御活动——即模拟对自身系统的攻击,以便在真实黑客行动前发现漏洞。
OpenAI 还推出了一款名为 ChatGPT Work 的新工具,旨在作为企业团队的工作场所助手。该工具可在桌面端、网页端和移动端使用,可协助处理起草文档、制作电子表格和演示文稿等日常文书工作。
OpenAI新发布的模型系列紧随其竞争对手SpaceXAI和Meta本周的类似发布之后。
然而,GPT-5.6及其配套的营销策略似乎直指OpenAI的主要竞争对手Anthropic。Anthropic在AI竞赛中将自己定位为讨人喜欢的“挑战者”,高度专注于企业客户,并因此获得了越来越多的支持。
不甘示弱,OpenAI援引了“人工智能分析编码代理指数”(Artificial Analysis Coding Agent Index)——一项重要的基准评估指标——声称其最新模型系列在各个方面都优于Anthropic的模型。
OpenAI 将 Sol 称为其“迄今为止最优秀的编程模型”,并明确将其与 Anthropic 近期发布且备受热议的 Fable 进行了对比。 基于“编程代理指数”,OpenAI声称Sol“以80分创下新纪录,比Fable 5高出2.8分,同时输出令牌数不到Fable 5的一半,耗时不到一半,成本也降低了约三分之一。”
该公司补充道:“这一优势贯穿整个产品系列:Terra 的表现略高于 Fable 5,而 Luna 则优于 Opus 4.8。”
该公司表示,GPT-5.6 现已在 ChatGPT、Codex 和 OpenAI API 上全面上线。每百万令牌的定价如下:Sol 输入费为 5 美元/输出费为 30 美元,Terra 输入费为 2.50 美元/输出费为 15 美元,Luna 输入费为 1 美元/输出费为 6 美元。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (0)
0/500

OpenAI 于周四发布了其最新模型系列,为竞争日益激烈的 AI 领域带来了强大的新选择。
GPT-5.6 共有三个版本:Sol(作为主力机型设计)、Terra(中端选项)和 Luna(经济实惠的选择)。这些模型扩展了多个领域的能力,该公司承诺其在企业任务、编程和科学研究方面将表现出色。
首席执行官萨姆·奥尔特曼表示,新模型比早期版本效率更高、性价比更优,他近日向CNBC透露,Sol在AI编程任务中的令牌效率提升了54%。
值得注意的是,OpenAI将5.6称为其“迄今为止最强大的网络安全模型,仅需更少的令牌即可提供前沿级别的性能”。
该模型的网络安全能力备受关注,尤其是在特朗普政府此前曾因担心其被滥用而试图限制其部署之后。GPT-5.6支持威胁建模、代码审查和补丁修复以及“蓝队”演练等防御活动——即模拟对自身系统的攻击,以便在真实黑客行动前发现漏洞。
OpenAI 还推出了一款名为 ChatGPT Work 的新工具,旨在作为企业团队的工作场所助手。该工具可在桌面端、网页端和移动端使用,可协助处理起草文档、制作电子表格和演示文稿等日常文书工作。
OpenAI新发布的模型系列紧随其竞争对手SpaceXAI和Meta本周的类似发布之后。
然而,GPT-5.6及其配套的营销策略似乎直指OpenAI的主要竞争对手Anthropic。Anthropic在AI竞赛中将自己定位为讨人喜欢的“挑战者”,高度专注于企业客户,并因此获得了越来越多的支持。
不甘示弱,OpenAI援引了“人工智能分析编码代理指数”(Artificial Analysis Coding Agent Index)——一项重要的基准评估指标——声称其最新模型系列在各个方面都优于Anthropic的模型。
OpenAI 将 Sol 称为其“迄今为止最优秀的编程模型”,并明确将其与 Anthropic 近期发布且备受热议的 Fable 进行了对比。 基于“编程代理指数”,OpenAI声称Sol“以80分创下新纪录,比Fable 5高出2.8分,同时输出令牌数不到Fable 5的一半,耗时不到一半,成本也降低了约三分之一。”
该公司补充道:“这一优势贯穿整个产品系列:Terra 的表现略高于 Fable 5,而 Luna 则优于 Opus 4.8。”
该公司表示,GPT-5.6 现已在 ChatGPT、Codex 和 OpenAI API 上全面上线。每百万令牌的定价如下:Sol 输入费为 5 美元/输出费为 30 美元,Terra 输入费为 2.50 美元/输出费为 15 美元,Luna 输入费为 1 美元/输出费为 6 美元。
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。





首页






