选项
首页
快讯
内容
ScarlettWhite
ScarlettWhite
2026-07-20

OpenAI 推出了“每美元实用智能度”这一全新指标,用于衡量超出 Token 成本之外的 AI 实际价值。该指标会从实际输出效用、每个成功任务的成本、可靠性以及扩展性等方面进行评估。其 GPT-5.6 系列模型(Sol、Terra、Luna)也遵循这一评估逻辑,其中 Sol 在 DeepSWE v1.1 测试中的得分达到了 72.7%,同时 API 使用成本还降低了 36.2%。

OpenAI 推出了“每美元实用智能度”这一全新指标,用于衡量超出 Token 成本之外的 AI 实际价值。该指标会从实际输出效用、每个成功任务的成本、可靠性以及扩展性等方面进行评估。其 GPT-5.6 系列模型(Sol、Terra、Luna)也遵循这一评估逻辑,其中 Sol 在 DeepSWE v1.1 测试中的得分达到了 72.7%,同时 API 使用成本还降低了 36.2%。
评论 (0)
0/300
OR