OpenAI发布高级AI推理模型,o3和o4-mini

OpenAI周三推出o3和o4-mini,新AI模型设计为在回答前暂停并分析问题。
OpenAI称o3是其迄今最先进的推理模型,在数学、编码、推理、科学和视觉理解测试中超越先前模型。同时,o4-mini平衡了成本、速度和性能,是开发者构建AI驱动应用的优选。
与早期模型不同,o3和o4-mini利用ChatGPT工具,如网页浏览、Python代码执行、图像处理和图像生成。从今天起,这些模型及o4-mini-high(额外耗时以提升答案准确性)对OpenAI的Pro、Plus和Team计划订阅者开放。
这些模型是OpenAI在全球AI竞赛中超越Google、Meta、xAI、Anthropic和DeepSeek等对手的举措。尽管OpenAI以o1开创AI推理,但竞争对手随后发布了相当或更优的模型,使推理模型成为AI实验室的关键焦点。
最初,o3未计划用于ChatGPT发布。OpenAI CEO Sam Altman二月暗示专注于使用o3技术的更高级替代方案。然而,竞争压力可能促使OpenAI推出它。
OpenAI报告o3在SWE-bench验证(无自定义脚手架)中表现顶尖,编码任务得分69.1%。O4-mini得分68.1%,o3-mini得分49.3%,相比Claude 3.7 Sonnet的62.3%。
OpenAI称o3和o4-mini是其首批有效处理图像的模型。用户可上传白板草图或PDF图表等图像,模型在推理过程中分析它们,能处理模糊或低质量图像,并执行缩放或旋转等任务。
除图像外,o3和o4-mini通过ChatGPT的Canvas功能在浏览器中执行Python代码,并为实时事件查询搜索网络。
所有三款模型—o3、o4-mini和o4-mini-high—均可通过OpenAI的Chat Completions API和Responses API访问,开发者可将其集成到应用中,采用基于使用的定价。
OpenAI为o3定价为每百万输入令牌10美元(约75万字),输出令牌每百万40美元。O4-mini与o3-mini定价相同,每百万输入令牌1.10美元,输出令牌每百万4.40美元。
未来几周,OpenAI计划推出o3-pro,o3的高算力版本,仅限ChatGPT Pro订阅者。
CEO Sam Altman表示,o3和o4-mini可能是OpenAI在ChatGPT中推出GPT-5前最后的独立推理模型,GPT-5将整合传统和推理模型功能。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (3)
0/500
Wow, OpenAI's o3 sounds like a game-changer! Pausing to think before answering? That's some next-level AI. Can't wait to see how it stacks up against other models in real-world tasks! 🤯

OpenAI周三推出o3和o4-mini,新AI模型设计为在回答前暂停并分析问题。
OpenAI称o3是其迄今最先进的推理模型,在数学、编码、推理、科学和视觉理解测试中超越先前模型。同时,o4-mini平衡了成本、速度和性能,是开发者构建AI驱动应用的优选。
与早期模型不同,o3和o4-mini利用ChatGPT工具,如网页浏览、Python代码执行、图像处理和图像生成。从今天起,这些模型及o4-mini-high(额外耗时以提升答案准确性)对OpenAI的Pro、Plus和Team计划订阅者开放。
这些模型是OpenAI在全球AI竞赛中超越Google、Meta、xAI、Anthropic和DeepSeek等对手的举措。尽管OpenAI以o1开创AI推理,但竞争对手随后发布了相当或更优的模型,使推理模型成为AI实验室的关键焦点。
最初,o3未计划用于ChatGPT发布。OpenAI CEO Sam Altman二月暗示专注于使用o3技术的更高级替代方案。然而,竞争压力可能促使OpenAI推出它。
OpenAI报告o3在SWE-bench验证(无自定义脚手架)中表现顶尖,编码任务得分69.1%。O4-mini得分68.1%,o3-mini得分49.3%,相比Claude 3.7 Sonnet的62.3%。
OpenAI称o3和o4-mini是其首批有效处理图像的模型。用户可上传白板草图或PDF图表等图像,模型在推理过程中分析它们,能处理模糊或低质量图像,并执行缩放或旋转等任务。
除图像外,o3和o4-mini通过ChatGPT的Canvas功能在浏览器中执行Python代码,并为实时事件查询搜索网络。
所有三款模型—o3、o4-mini和o4-mini-high—均可通过OpenAI的Chat Completions API和Responses API访问,开发者可将其集成到应用中,采用基于使用的定价。
OpenAI为o3定价为每百万输入令牌10美元(约75万字),输出令牌每百万40美元。O4-mini与o3-mini定价相同,每百万输入令牌1.10美元,输出令牌每百万4.40美元。
未来几周,OpenAI计划推出o3-pro,o3的高算力版本,仅限ChatGPT Pro订阅者。
CEO Sam Altman表示,o3和o4-mini可能是OpenAI在ChatGPT中推出GPT-5前最后的独立推理模型,GPT-5将整合传统和推理模型功能。
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
Wow, OpenAI's o3 sounds like a game-changer! Pausing to think before answering? That's some next-level AI. Can't wait to see how it stacks up against other models in real-world tasks! 🤯





首页






