Openai的O3型號可能比最初想像的要昂貴

當OpenAI在去年12月推出其o3「推理」AI模型時,他們與ARC-AGI的創建者合作,該基準旨在挑戰AI能力的極限,以展示o3的潛力。幾個月後,結果經過調整,顯示o3的表現可能不如最初預期的耀眼。
就在上週,負責ARC-AGI的Arc獎金基金會修正了他們對o3計算成本的估計。最初,他們認為o3的頂級版本,稱為o3 high,解決單一ARC-AGI問題的成本約為3,000美元。但現在,他們認為每項任務的成本更接近30,000美元。這是一個相當大的跳躍!
這一修正揭示了尖端AI模型的成本有多高,特別是在早期階段。OpenAI尚未為o3定價,也尚未對公眾發布。然而,Arc獎金基金會表示,OpenAI的o1-pro模型的定價可能為我們提供一個大致的參考。
為了提供一些背景,o1-pro目前是OpenAI提供的最昂貴模型。
Arc獎金基金會的聯合創始人Mike Knoop在接受TechCrunch採訪時表示:「我們相信o1-pro的成本更接近o3的真實成本……因為使用了大量的測試時計算資源。但這仍然是一個代理值,我們在排行榜上將o3標記為預覽版,以反映在正式定價公布前的這種不確定性。」
鑑於據報導o3 high需要的大量計算能力,高昂的價格標籤並不令人震驚。根據Arc獎金基金會的數據,o3 high比o3 low(o3中最不耗資源的版本)多消耗了172倍的計算資源,僅僅是為了應對ARC-AGI任務。
關於OpenAI對企業客戶的潛在定價計劃也有很多討論。早在三月初,《The Information》報導稱,OpenAI可能考慮為專業AI「代理」,如軟件開發者代理,每月收取高達20,000美元的費用。
有些人可能會爭辯說,即使是OpenAI最昂貴的模型,與雇用人力承包商或員工的成本相比仍然是划算的。但正如AI研究員Toby Ord在X上指出的,這些模型的效率可能不如我們期望的那樣。例如,o3 high在ARC-AGI的每項任務中需要嘗試1,024次才能達到最佳分數。
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (47)
0/500
Les coûts d'exploitation de l'IA montent en flèche... OpenAI nous présente o3 comme une révolution, mais à quel prix ? Entre les benchmarks ajustés et la consommation énergétique, on dirait une course à l'armement technologique 🚀. Est-ce que ces modèles 'raisonnants' vont vraiment bénéficier au grand public ou juste aux géants tech ?
Wow, o3's higher costs are a bit of a shocker! 🤯 I wonder if OpenAI expected this or if it’s just the price of pushing AI boundaries. Curious to see how this impacts their pricing for users.
El modelo o3 parecía prometedor al principio, pero ahora está claro que es un poco caro! 😅 Aún así, las capacidades de razonamiento son impresionantes, aunque desearía que fuera más rentable. ¿Quizás OpenAI encuentre una manera de hacerlo más asequible pronto? 🤞
El modelo o3 de OpenAI parecía prometedor al principio, pero los costos operativos son un verdadero fastidio. Es como comprar un coche deportivo y luego darte cuenta de que no puedes pagar la gasolina. Aún así, las mejoras de rendimiento son impresionantes, pero ojalá encontraran una manera de hacerlo más asequible. ¿Alguien más siente la presión? 😅
The o3 model seemed promising at first, but now it's clear it's a bit of a money pit! 😅 Still, the reasoning capabilities are impressive, though I wish it was more cost-effective. Maybe OpenAI will figure out a way to make it more affordable soon? 🤞

當OpenAI在去年12月推出其o3「推理」AI模型時,他們與ARC-AGI的創建者合作,該基準旨在挑戰AI能力的極限,以展示o3的潛力。幾個月後,結果經過調整,顯示o3的表現可能不如最初預期的耀眼。
就在上週,負責ARC-AGI的Arc獎金基金會修正了他們對o3計算成本的估計。最初,他們認為o3的頂級版本,稱為o3 high,解決單一ARC-AGI問題的成本約為3,000美元。但現在,他們認為每項任務的成本更接近30,000美元。這是一個相當大的跳躍!
這一修正揭示了尖端AI模型的成本有多高,特別是在早期階段。OpenAI尚未為o3定價,也尚未對公眾發布。然而,Arc獎金基金會表示,OpenAI的o1-pro模型的定價可能為我們提供一個大致的參考。
為了提供一些背景,o1-pro目前是OpenAI提供的最昂貴模型。
Arc獎金基金會的聯合創始人Mike Knoop在接受TechCrunch採訪時表示:「我們相信o1-pro的成本更接近o3的真實成本……因為使用了大量的測試時計算資源。但這仍然是一個代理值,我們在排行榜上將o3標記為預覽版,以反映在正式定價公布前的這種不確定性。」
鑑於據報導o3 high需要的大量計算能力,高昂的價格標籤並不令人震驚。根據Arc獎金基金會的數據,o3 high比o3 low(o3中最不耗資源的版本)多消耗了172倍的計算資源,僅僅是為了應對ARC-AGI任務。
關於OpenAI對企業客戶的潛在定價計劃也有很多討論。早在三月初,《The Information》報導稱,OpenAI可能考慮為專業AI「代理」,如軟件開發者代理,每月收取高達20,000美元的費用。
有些人可能會爭辯說,即使是OpenAI最昂貴的模型,與雇用人力承包商或員工的成本相比仍然是划算的。但正如AI研究員Toby Ord在X上指出的,這些模型的效率可能不如我們期望的那樣。例如,o3 high在ARC-AGI的每項任務中需要嘗試1,024次才能達到最佳分數。
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
Les coûts d'exploitation de l'IA montent en flèche... OpenAI nous présente o3 comme une révolution, mais à quel prix ? Entre les benchmarks ajustés et la consommation énergétique, on dirait une course à l'armement technologique 🚀. Est-ce que ces modèles 'raisonnants' vont vraiment bénéficier au grand public ou juste aux géants tech ?
Wow, o3's higher costs are a bit of a shocker! 🤯 I wonder if OpenAI expected this or if it’s just the price of pushing AI boundaries. Curious to see how this impacts their pricing for users.
El modelo o3 parecía prometedor al principio, pero ahora está claro que es un poco caro! 😅 Aún así, las capacidades de razonamiento son impresionantes, aunque desearía que fuera más rentable. ¿Quizás OpenAI encuentre una manera de hacerlo más asequible pronto? 🤞
El modelo o3 de OpenAI parecía prometedor al principio, pero los costos operativos son un verdadero fastidio. Es como comprar un coche deportivo y luego darte cuenta de que no puedes pagar la gasolina. Aún así, las mejoras de rendimiento son impresionantes, pero ojalá encontraran una manera de hacerlo más asequible. ¿Alguien más siente la presión? 😅
The o3 model seemed promising at first, but now it's clear it's a bit of a money pit! 😅 Still, the reasoning capabilities are impressive, though I wish it was more cost-effective. Maybe OpenAI will figure out a way to make it more affordable soon? 🤞





首頁






