选项
首页
新闻
科技公司对成本效益高的AI模型表现出兴趣

科技公司对成本效益高的AI模型表现出兴趣

2026-06-26
56

科技公司对成本效益高的AI模型表现出兴趣

人工智能的蓬勃发展依赖于一个核心假设:规模更大的模型能力更强,而最强大的模型才能取得成功。如今,这个行业即将面临这样一个挑战:当这一假设开始出现裂痕时,会发生什么?

不断上升的成本已经迫使用户重新考虑使用规模更小、价格更低的模型。这种基于成本考虑的模型选择方式是前所未有的,目前还不清楚它将如何重塑整个行业——但它的影响很可能是深远的。

Coinbase联合创始人Brian Armstrong最明确地表达了一个预测:绝大多数任务将会转移到价格更低的模型上。

Armstrong在X平台上写道:“对智能的需求几乎是无限的,但在12到18个月内,80%的工作负载将会使用成本降低99%的模型来处理;而剩下的20%工作负载仍然会依赖最新一代、能够最大化智能水平的模型。”

如果Armstrong的预测成真,这对人工智能行业来说将是一个具有重大意义的转变。

在此之前,大多数人工智能公司都是通过提升模型质量来进行竞争的,这意味着它们会优先选择最先进的模型。但如果同样的任务可以用价格更低的模型来完成,而且质量不会受到影响,那么这无疑意味着人工智能行业的经济格局将会发生巨大变化。更重要的是,这些成本节省所带来的收益,很大程度上将直接来自那些大型研究机构的收入——而对于即将上市的开源AI公司来说,这无异于是一次沉重的打击。

这对整个行业来说可能是一场具有颠覆性的变革,而关键的问题在于:各家公司是否已经准备好转向使用规模较小的模型?

初步的测试结果表明,在适当的配置下,使用价格更低的模型完全可以在不牺牲质量的前提下完成任务。例如,法律人工智能工具Harvey最近进行的一项测试显示,该工具在与推理平台Fireworks AI合作的情况下,将推理成本降低了三倍,而且质量丝毫没有下降。这项测试结合使用了Claude Opus和Fireworks的GLM 5.1模型,在处理要求最高的任务时改用了Opus模型,结果就是服务器的压力大大减轻,整体成本也得到了降低。

Harvey的联合创始人Gabe Pereyra在接受TechCrunch采访时说:“在法律领域,质量始终是第一位的。然而,对质量的定义也在发生变化——不再仅仅是使用最强大的模型来处理所有任务,而是要选择那些能以最高效率得出正确结果的模型。”

人们常常将这种趋势描述为大型研究机构与中国的开放源代码模型之间的竞争,但这种看法其实忽略了更本质的问题。真正的区别并不在于私有模型和开放源代码模型之间,而在于大规模模型和小规模模型之间。将GPT-5.5替换为DeepSeek的V4Flash确实可以节省成本,但换成GPT-5.4-mini也同样能够达到良好的效果。

目前,大型研究机构自主研发的推理技术与独立提供的开放源代码模型之间正在进行一场激烈的价格竞争。而对于“小型模型与大规模模型之间的竞争”这一更宏观的问题来说,究竟哪种类型的小型模型能够胜出其实并不重要。

所有这些观点看起来似乎都很显而易见——当然,人们不应该使用超出实际需要的计算资源——但这种观念与迄今为止主导整个行业的发展策略是截然相反的。由于之前取得了巨大的成功,各研究机构都倾向于训练那些计算需求极高的模型,不断推动人工智能模型能力的上限。在投资者的大力支持下,客户们也没有理由不选择最先进的模型。

然而,随着代币价格的上涨和补贴政策的减少,用户们首次面临着成本压力。我们目前还不知道这种新的成本压力是否真的会促使企业用户转向使用规模较小的模型。他们同样可以通过减少调用次数、缩短上下文窗口的长度,或者干脆放弃那些效果不佳的应用场景来节省成本。

但如果事实证明,大多数应用场景使用规模较小的模型同样能够取得良好的效果,那么这无疑会对当前日益增长的对推理服务的需求产生严重的影响——同时也会引发新的问题:如何为训练这些高端模型所投入的成本找到合理的解释呢?

相关文章
Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。与此同时,OpenAI的
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本 在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本 在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略 Frontier AI Labs 拒绝透露针对失控模型的遏制策略 最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
聊天机器人 用于语言练习、面试准备和日常流利度的最佳 AI 角色扮演聊天应用
用于语言练习、面试准备和日常流利度的最佳 AI 角色扮演聊天应用

2026 年最新最佳顶级评分 AI 角色扮演聊天应用,用于语言练习、面试准备和日常流利度!XIX.AI 精心策划了一个强大的变革性合集,提供免费与付费对比、真实世界测试以及每周更新的排名。这些必试工具可帮助您提升写作技能,克服流利度挑战,并提高所有日常场景下的沟通效率。立即探索,发现您语言成长的完美工具!

10 个工具
xix.ai
音乐创作 用于混音制作、采样准备及卡拉OK母带处理的 AI 声部分离工具
用于混音制作、采样准备及卡拉OK母带处理的 AI 声部分离工具

2026年最新、最优秀且评分最高的AI音轨分离工具汇总,专为混音制作、采样准备以及卡拉OK音频处理而设计。这些功能强大的创新工具经过实际测试,能够实现精准的音频分离,显著提升工作效率。XIX.AI每周都会更新免费的付费产品对比指南,帮助您找到最适合自身需求的工具。立即探索,发挥您的AI优势。

8 个工具
xix.ai
数据分析 用于收入看板、转化漏斗分析及产品指标分析的 AI SQL 助手
用于收入看板、转化漏斗分析及产品指标分析的 AI SQL 助手

2026年最新最优秀的AI SQL辅助工具排名揭晓!XIX.AI精心挑选了一系列功能强大的工具,这些工具会定期更新,并通过真实的场景测试来验证其性能。使用这些值得尝试的工具,您可以快速生成精准的收入分析报表、分析销售流程,并追踪产品各项指标,从而大幅提升工作效率。立即探索,找到最适合您的数据驱动决策工具!238个字符

9 个工具
xix.ai
音乐创作 最佳用于歌曲草稿的 AI 旋律创作工具
最佳用于歌曲草稿的 AI 旋律创作工具

2026 年最新最佳顶级评分 AI 旋律创作工具,助力歌曲草稿创作!XIX.AI 精心策划了一套极具影响力且经过严格真实世界测试的变革性合集,旨在提供最佳的创作体验。您可以找到详细的免费与付费版对比、精准的排名以及必试选项,这些工具旨在帮助您轻松创作出令人惊艳的歌曲草稿,并显著提升您的创意生产力。立即探索,发现您的完美工具!

8 个工具
xix.ai
聊天机器人 最佳AI对话训练工具,助你备战面试
最佳AI对话训练工具,助你备战面试

2026年最新、最受好评的AI面试模拟训练工具现已登陆XIX.AI!这份精心精选的合集收录了功能强大、具有革命性意义的工具,它们均经过严格的实际测试,能够提供精准的反馈。 您将看到免费版与付费版的对比分析以及详细排名,助您挑选出必试之选,从而提升自信并精进技能。立即探索,发现助您面试成功的完美工具!

12 个工具
xix.ai
设计与艺术 最适合创意实验的AI风格转换工具
最适合创意实验的AI风格转换工具

2026年最新最佳、评价最高的AI风格转换工具,助您开展创意实验!XIX.AI精心甄选了一系列功能强大、颠覆性的必试工具,这些工具经过实际测试和严格排名,可带来卓越的效果。这些顶级解决方案通过加速内容创作并释放无限创意潜能,帮助创作者显著提升工作效率。 立即探索,找到最适合您的工具,今天就开始创作吧!

9 个工具
xix.ai
评论 (0)
0/500
OR