Openai的O3型号可能比最初想象的要昂贵

当OpenAI在去年12月推出其o3“推理”AI模型时,他们与ARC-AGI的创建者合作,这是一个旨在挑战AI能力极限的基准测试,以展示o3的潜力。几个月后,结果经过调整,显示o3的表现可能不如最初想象的那样耀眼。
就在上周,负责ARC-AGI的Arc奖基金会修订了他们对o3计算成本的估计。最初,他们认为o3的顶级版本,称为o3 high,解决一个ARC-AGI问题需要大约3000美元。但现在,他们认为每个任务的成本更像是3万美元。这是一个巨大的跳跃!
这一修订揭示了尖端AI模型的成本有多高,特别是在早期阶段。OpenAI尚未为o3定价,也没有向公众发布。然而,Arc奖基金会建议,OpenAI的o1-pro模型的定价可以让我们大致了解预期。
为了提供一些背景,o1-pro目前是OpenAI提供的最昂贵的模型。
Arc奖基金会的联合创始人Mike Knoop在接受TechCrunch采访时表示:“我们认为o1-pro是真正o3成本的更接近比较……因为使用了大量的测试时计算资源。但这仍然是一个代理,我们在排行榜上将o3标记为预览,以反映在正式定价公布前的 uncertainty。”
考虑到o3 high据报道需要的巨大计算能力,高昂的价格标签并不令人震惊。据Arc奖基金会称,o3 high比o3 low(o3中最不苛刻的版本)消耗了172倍的计算资源,仅用于应对ARC-AGI任务。
关于OpenAI为企业客户制定的潜在定价计划也有很多讨论。早在三月初,《The Information》报道称,OpenAI可能考虑为专业AI“代理”收取高达每月2万美元的费用,例如软件开发代理。
有人可能会争辩说,即使是OpenAI最昂贵的模型,与雇用人类承包商或员工的成本相比仍然是划算的。但正如AI研究员Toby Ord在X上指出的,这些模型可能不如我们希望的那样高效。例如,o3 high在ARC-AGI的每个任务上需要尝试1024次才能达到最佳分数。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (47)
0/500
Les coûts d'exploitation de l'IA montent en flèche... OpenAI nous présente o3 comme une révolution, mais à quel prix ? Entre les benchmarks ajustés et la consommation énergétique, on dirait une course à l'armement technologique 🚀. Est-ce que ces modèles 'raisonnants' vont vraiment bénéficier au grand public ou juste aux géants tech ?
Wow, o3's higher costs are a bit of a shocker! 🤯 I wonder if OpenAI expected this or if it’s just the price of pushing AI boundaries. Curious to see how this impacts their pricing for users.
El modelo o3 parecía prometedor al principio, pero ahora está claro que es un poco caro! 😅 Aún así, las capacidades de razonamiento son impresionantes, aunque desearía que fuera más rentable. ¿Quizás OpenAI encuentre una manera de hacerlo más asequible pronto? 🤞
El modelo o3 de OpenAI parecía prometedor al principio, pero los costos operativos son un verdadero fastidio. Es como comprar un coche deportivo y luego darte cuenta de que no puedes pagar la gasolina. Aún así, las mejoras de rendimiento son impresionantes, pero ojalá encontraran una manera de hacerlo más asequible. ¿Alguien más siente la presión? 😅
The o3 model seemed promising at first, but now it's clear it's a bit of a money pit! 😅 Still, the reasoning capabilities are impressive, though I wish it was more cost-effective. Maybe OpenAI will figure out a way to make it more affordable soon? 🤞

当OpenAI在去年12月推出其o3“推理”AI模型时,他们与ARC-AGI的创建者合作,这是一个旨在挑战AI能力极限的基准测试,以展示o3的潜力。几个月后,结果经过调整,显示o3的表现可能不如最初想象的那样耀眼。
就在上周,负责ARC-AGI的Arc奖基金会修订了他们对o3计算成本的估计。最初,他们认为o3的顶级版本,称为o3 high,解决一个ARC-AGI问题需要大约3000美元。但现在,他们认为每个任务的成本更像是3万美元。这是一个巨大的跳跃!
这一修订揭示了尖端AI模型的成本有多高,特别是在早期阶段。OpenAI尚未为o3定价,也没有向公众发布。然而,Arc奖基金会建议,OpenAI的o1-pro模型的定价可以让我们大致了解预期。
为了提供一些背景,o1-pro目前是OpenAI提供的最昂贵的模型。
Arc奖基金会的联合创始人Mike Knoop在接受TechCrunch采访时表示:“我们认为o1-pro是真正o3成本的更接近比较……因为使用了大量的测试时计算资源。但这仍然是一个代理,我们在排行榜上将o3标记为预览,以反映在正式定价公布前的 uncertainty。”
考虑到o3 high据报道需要的巨大计算能力,高昂的价格标签并不令人震惊。据Arc奖基金会称,o3 high比o3 low(o3中最不苛刻的版本)消耗了172倍的计算资源,仅用于应对ARC-AGI任务。
关于OpenAI为企业客户制定的潜在定价计划也有很多讨论。早在三月初,《The Information》报道称,OpenAI可能考虑为专业AI“代理”收取高达每月2万美元的费用,例如软件开发代理。
有人可能会争辩说,即使是OpenAI最昂贵的模型,与雇用人类承包商或员工的成本相比仍然是划算的。但正如AI研究员Toby Ord在X上指出的,这些模型可能不如我们希望的那样高效。例如,o3 high在ARC-AGI的每个任务上需要尝试1024次才能达到最佳分数。
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
Les coûts d'exploitation de l'IA montent en flèche... OpenAI nous présente o3 comme une révolution, mais à quel prix ? Entre les benchmarks ajustés et la consommation énergétique, on dirait une course à l'armement technologique 🚀. Est-ce que ces modèles 'raisonnants' vont vraiment bénéficier au grand public ou juste aux géants tech ?
Wow, o3's higher costs are a bit of a shocker! 🤯 I wonder if OpenAI expected this or if it’s just the price of pushing AI boundaries. Curious to see how this impacts their pricing for users.
El modelo o3 parecía prometedor al principio, pero ahora está claro que es un poco caro! 😅 Aún así, las capacidades de razonamiento son impresionantes, aunque desearía que fuera más rentable. ¿Quizás OpenAI encuentre una manera de hacerlo más asequible pronto? 🤞
El modelo o3 de OpenAI parecía prometedor al principio, pero los costos operativos son un verdadero fastidio. Es como comprar un coche deportivo y luego darte cuenta de que no puedes pagar la gasolina. Aún así, las mejoras de rendimiento son impresionantes, pero ojalá encontraran una manera de hacerlo más asequible. ¿Alguien más siente la presión? 😅
The o3 model seemed promising at first, but now it's clear it's a bit of a money pit! 😅 Still, the reasoning capabilities are impressive, though I wish it was more cost-effective. Maybe OpenAI will figure out a way to make it more affordable soon? 🤞





首页






