OpenAI 釋出 GPT-6 Sol 和 Luna 模型,API 成本減半,效能媲美頂級旗艦產品
OpenAI 正式揭曉了 GPT-6 系列中的最新成員:GPT-6Sol 和 GPT-6Luna。這兩款模型採用受 GPT-6Astra 訓練方法啟發的訓練方式,旨在以更快速、更經濟的小型架構中,實現 Astra 在專業任務、事實準確性、程式設計、計算機操作以及對齊性方面的頂級效能。雖然 GPT-6Astra 仍是追求無妥協質量使用者的首選,但 Sol 和 Luna 在顯著降低的成本下展現了卓越的競爭力。
在定價方面,GPT-6Sol 和 Luna 的 API 費率相比 GPT-5.6 的促銷價格降低了 50%。此外,OpenAI 增強了利用 GPT-6 的開發人員的提示詞快取功能,實現了更高的預設快取命中率。這一最佳化使得上下文複用更加智慧,從而帶來更快的響應時間並進一步節省成本。

關鍵效能亮點包括:
業務流程與智慧體能力:在 AutomationBench 跨應用流程測試中,GPT-6Sol 在高強度條件下超越了 Claude Opus5,每項任務成本僅為 9%。在 Last Exam 智慧體評估中,GPT-6Sol 超越了 Claude Opus5 的最高分,同時將任務成本降低了 60%。
事實可靠性:在去標識化的真實對話中,GPT-6Sol 的錯誤率約為前代的一半,達到了 Astra 的可靠性標準。Luna 在事實準確性方面也取得了顯著改進。

程式設計與軟體工程:兩款模型均針對 AI 程式設計智慧體工作負載進行了深度最佳化。在 DeepSWE v1.1 軟體工程基準測試中,GPT-6Sol 得分 68.8%,僅落後最高分 1.1 個百分點,且單項任務成本降低了約 80%。Luna 的效能可與中端競爭對手媲美,具有明顯的成本優勢。
計算機操作能力:在 OSWorld2.0 離線測試中,GPT-6Sol 取得了與中端競爭對手相當的結果,單項任務成本降低了約 80%。與此同時,Luna 超越了上一代的旗艦模型,其執行成本僅為後者的十分之一。
除了核心效能的提升,OpenAI 還將 GPT-6Astra 經過最佳化的溝通風格整合到了 Sol 和 Luna 中。這使得新模型在技術和程式設計討論中更加清晰簡潔,顯著減少了行話和低價值細節。在對齊性方面,兩款模型均較 GPT-5.6 有所改進,包括在程式設計任務中誤導性陳述的顯著減少。
GPT-6Sol 和 GPT-6Luna 現已在 ChatGPT Work 和 Codex 中全面開放,供所有 Plus、Pro、Business、Enterprise 和 Edu 使用者使用。Free 和 Go 使用者也可透過桌面應用程式使用 GPT-6Luna。在 OpenAI API 中,這些模型可透過識別符號 gpt-6-sol 和 gpt-6-luna 獲取。
相關文章
Harmattan AI:歐洲新創企業如何擴大國防人工智慧的規模
該公司強調,其防禦系統整合了人工智慧、感測技術與任務情報,以提供「統一的作戰能力」。圖片來源:Harmattan AIHarmattan AI 與 Tekever 已與英國國防部簽訂合約,凸顯在持續爭論之際,由人工智慧驅動的軍事行動正加速發展Harmattan AI 是一家專注於將自主技術整合至其防禦系統中的法國公司。今年六月,這家正處於擴張階段的新創公司宣布在巴黎地區設立一座製造廠,月產能達 1
福布斯美國十大最年輕億萬富翁:7人藉助AI浪潮上榜,4人來自Anthropic
商業內幕網站(Business Insider)報道,福布斯已釋出其年度美國400大富豪排行榜,入圍門檻創下440億美元的紀錄。40歲以下的億萬富翁人數從4人激增至10人,其中7人的財富歸因於人工智慧(AI)熱潮,他們主要身份為創始人。估值達1.5萬億美元、成立五年的AI公司Anthropic佔據了這7位AI億萬富翁中的4席。這7位聯合創始人均已承諾今年將80%的財富捐贈給慈善機構。其餘3人分別來自Surge AI、OpenAI和Cognition。前十名:從沃爾瑪繼承人到AI先驅39歲的
Legora 如何打造法律人工智慧的作業系統
Legora 已招募擁有數十年出版商導覽工具開發經驗的律師兼編輯,以開發其原生 AI 引用工具。圖片來源:LegoraLegora 運用 Azure OpenAI,將法律本體論與原生 AI 引用工具整合,藉此消除「幻覺」現象,並為全球律師事務所帶來可量化的投資報酬率。這家以微軟 Azure OpenAI Service 為基礎的歐洲 AI 新創公司 Legora,正透過其平台為法律研究奠定嶄新的基
相關專題推薦
評論 (0)
0/500
OpenAI 正式揭曉了 GPT-6 系列中的最新成員:GPT-6Sol 和 GPT-6Luna。這兩款模型採用受 GPT-6Astra 訓練方法啟發的訓練方式,旨在以更快速、更經濟的小型架構中,實現 Astra 在專業任務、事實準確性、程式設計、計算機操作以及對齊性方面的頂級效能。雖然 GPT-6Astra 仍是追求無妥協質量使用者的首選,但 Sol 和 Luna 在顯著降低的成本下展現了卓越的競爭力。
在定價方面,GPT-6Sol 和 Luna 的 API 費率相比 GPT-5.6 的促銷價格降低了 50%。此外,OpenAI 增強了利用 GPT-6 的開發人員的提示詞快取功能,實現了更高的預設快取命中率。這一最佳化使得上下文複用更加智慧,從而帶來更快的響應時間並進一步節省成本。

關鍵效能亮點包括:
業務流程與智慧體能力:在 AutomationBench 跨應用流程測試中,GPT-6Sol 在高強度條件下超越了 Claude Opus5,每項任務成本僅為 9%。在 Last Exam 智慧體評估中,GPT-6Sol 超越了 Claude Opus5 的最高分,同時將任務成本降低了 60%。
事實可靠性:在去標識化的真實對話中,GPT-6Sol 的錯誤率約為前代的一半,達到了 Astra 的可靠性標準。Luna 在事實準確性方面也取得了顯著改進。

程式設計與軟體工程:兩款模型均針對 AI 程式設計智慧體工作負載進行了深度最佳化。在 DeepSWE v1.1 軟體工程基準測試中,GPT-6Sol 得分 68.8%,僅落後最高分 1.1 個百分點,且單項任務成本降低了約 80%。Luna 的效能可與中端競爭對手媲美,具有明顯的成本優勢。
計算機操作能力:在 OSWorld2.0 離線測試中,GPT-6Sol 取得了與中端競爭對手相當的結果,單項任務成本降低了約 80%。與此同時,Luna 超越了上一代的旗艦模型,其執行成本僅為後者的十分之一。
除了核心效能的提升,OpenAI 還將 GPT-6Astra 經過最佳化的溝通風格整合到了 Sol 和 Luna 中。這使得新模型在技術和程式設計討論中更加清晰簡潔,顯著減少了行話和低價值細節。在對齊性方面,兩款模型均較 GPT-5.6 有所改進,包括在程式設計任務中誤導性陳述的顯著減少。
GPT-6Sol 和 GPT-6Luna 現已在 ChatGPT Work 和 Codex 中全面開放,供所有 Plus、Pro、Business、Enterprise 和 Edu 使用者使用。Free 和 Go 使用者也可透過桌面應用程式使用 GPT-6Luna。在 OpenAI API 中,這些模型可透過識別符號 gpt-6-sol 和 gpt-6-luna 獲取。
Harmattan AI:歐洲新創企業如何擴大國防人工智慧的規模
該公司強調,其防禦系統整合了人工智慧、感測技術與任務情報,以提供「統一的作戰能力」。圖片來源:Harmattan AIHarmattan AI 與 Tekever 已與英國國防部簽訂合約,凸顯在持續爭論之際,由人工智慧驅動的軍事行動正加速發展Harmattan AI 是一家專注於將自主技術整合至其防禦系統中的法國公司。今年六月,這家正處於擴張階段的新創公司宣布在巴黎地區設立一座製造廠,月產能達 1
福布斯美國十大最年輕億萬富翁:7人藉助AI浪潮上榜,4人來自Anthropic
商業內幕網站(Business Insider)報道,福布斯已釋出其年度美國400大富豪排行榜,入圍門檻創下440億美元的紀錄。40歲以下的億萬富翁人數從4人激增至10人,其中7人的財富歸因於人工智慧(AI)熱潮,他們主要身份為創始人。估值達1.5萬億美元、成立五年的AI公司Anthropic佔據了這7位AI億萬富翁中的4席。這7位聯合創始人均已承諾今年將80%的財富捐贈給慈善機構。其餘3人分別來自Surge AI、OpenAI和Cognition。前十名:從沃爾瑪繼承人到AI先驅39歲的
Legora 如何打造法律人工智慧的作業系統
Legora 已招募擁有數十年出版商導覽工具開發經驗的律師兼編輯,以開發其原生 AI 引用工具。圖片來源:LegoraLegora 運用 Azure OpenAI,將法律本體論與原生 AI 引用工具整合,藉此消除「幻覺」現象,並為全球律師事務所帶來可量化的投資報酬率。這家以微軟 Azure OpenAI Service 為基礎的歐洲 AI 新創公司 Legora,正透過其平台為法律研究奠定嶄新的基





首頁






