選項
首頁
新聞
科技公司對成本效益高的AI模型表現出興趣

科技公司對成本效益高的AI模型表現出興趣

2026-06-26
55

科技公司對成本效益高的AI模型表現出興趣

人工智慧的蓬勃發展依賴於一個核心假設:規模更大的模型能力更強,而最強大的模型才能取得成功。如今,這個行業即將面臨這樣一個挑戰:當這一假設開始出現裂痕時,會發生什麼?

不斷上升的成本已經迫使使用者重新考慮使用規模更小、價格更低的模型。這種基於成本考慮的模型選擇方式是前所未有的,目前還不清楚它將如何重塑整個行業——但它的影響很可能是深遠的。

Coinbase聯合創始人Brian Armstrong最明確地表達了一個預測:絕大多數任務將會轉移到價格更低的模型上。

Armstrong在X平臺上寫道:“對智慧的需求幾乎是無限的,但在12到18個月內,80%的工作負載將會使用成本降低99%的模型來處理;而剩下的20%工作負載仍然會依賴最新一代、能夠最大化智慧水平的模型。”

如果Armstrong的預測成真,這對人工智慧行業來說將是一個具有重大意義的轉變。

在此之前,大多數人工智慧公司都是透過提升模型質量來進行競爭的,這意味著它們會優先選擇最先進的模型。但如果同樣的任務可以用價格更低的模型來完成,而且質量不會受到影響,那麼這無疑意味著人工智慧行業的經濟格局將會發生巨大變化。更重要的是,這些成本節省所帶來的收益,很大程度上將直接來自那些大型研究機構的收入——而對於即將上市的開源AI公司來說,這無異於是一次沉重的打擊。

這對整個行業來說可能是一場具有顛覆性的變革,而關鍵的問題在於:各家公司是否已經準備好轉向使用規模較小的模型?

初步的測試結果表明,在適當的配置下,使用價格更低的模型完全可以在不犧牲質量的前提下完成任務。例如,法律人工智慧工具Harvey最近進行的一項測試顯示,該工具在與推理平臺Fireworks AI合作的情況下,將推理成本降低了三倍,而且質量絲毫沒有下降。這項測試結合使用了Claude Opus和Fireworks的GLM 5.1模型,在處理要求最高的任務時改用了Opus模型,結果就是伺服器的壓力大大減輕,整體成本也得到了降低。

Harvey的聯合創始人Gabe Pereyra在接受TechCrunch採訪時說:“在法律領域,質量始終是第一位的。然而,對質量的定義也在發生變化——不再僅僅是使用最強大的模型來處理所有任務,而是要選擇那些能以最高效率得出正確結果的模型。”

人們常常將這種趨勢描述為大型研究機構與中國的開放原始碼模型之間的競爭,但這種看法其實忽略了更本質的問題。真正的區別並不在於私有模型和開放原始碼模型之間,而在於大規模模型和小規模模型之間。將GPT-5.5替換為DeepSeek的V4Flash確實可以節省成本,但換成GPT-5.4-mini也同樣能夠達到良好的效果。

目前,大型研究機構自主研發的推理技術與獨立提供的開放原始碼模型之間正在進行一場激烈的價格競爭。而對於“小型模型與大規模模型之間的競爭”這一更宏觀的問題來說,究竟哪種型別的小型模型能夠勝出其實並不重要。

所有這些觀點看起來似乎都很顯而易見——當然,人們不應該使用超出實際需要的計算資源——但這種觀念與迄今為止主導整個行業的發展策略是截然相反的。由於之前取得了巨大的成功,各研究機構都傾向於訓練那些計算需求極高的模型,不斷推動人工智慧模型能力的上限。在投資者的大力支援下,客戶們也沒有理由不選擇最先進的模型。

然而,隨著代幣價格的上漲和補貼政策的減少,使用者們首次面臨著成本壓力。我們目前還不知道這種新的成本壓力是否真的會促使企業使用者轉向使用規模較小的模型。他們同樣可以透過減少呼叫次數、縮短上下文視窗的長度,或者乾脆放棄那些效果不佳的應用場景來節省成本。

但如果事實證明,大多數應用場景使用規模較小的模型同樣能夠取得良好的效果,那麼這無疑會對當前日益增長的對推理服務的需求產生嚴重的影響——同時也會引發新的問題:如何為訓練這些高階模型所投入的成本找到合理的解釋呢?

相關文章
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具 Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具 Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本 OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本 在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
音樂創作 用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具
用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具

2026年最新、最優秀且評分最高的AI音軌分離工具彙總,專為混音製作、取樣準備以及卡拉OK音訊處理而設計。這些功能強大的創新工具經過實際測試,能夠實現精準的音訊分離,顯著提升工作效率。XIX.AI每週都會更新免費的付費產品對比指南,幫助您找到最適合自身需求的工具。立即探索,發揮您的AI優勢。

8 個工具
xix.ai
數據分析 用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手
用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手

2026年最新最優秀的AI SQL輔助工具排名揭曉!XIX.AI精心挑選了一系列功能強大的工具,這些工具會定期更新,並透過真實的場景測試來驗證其效能。使用這些值得嘗試的工具,您可以快速生成精準的收入分析報表、分析銷售流程,並追蹤產品各項指標,從而大幅提升工作效率。立即探索,找到最適合您的資料驅動決策工具!238個字元

9 個工具
xix.ai
音樂創作 最佳用於歌曲草稿的 AI 旋律創作工具
最佳用於歌曲草稿的 AI 旋律創作工具

2026 年最新最佳頂級評分 AI 旋律創作工具,助力歌曲草稿創作!XIX.AI 精心策劃了一套極具影響力且經過嚴格真實世界測試的變革性合集,旨在提供最佳的創作體驗。您可以找到詳細的免費與付費版對比、精準的排名以及必試選項,這些工具旨在幫助您輕鬆創作出令人驚豔的歌曲草稿,並顯著提升您的創意生產力。立即探索,發現您的完美工具!

8 個工具
xix.ai
聊天機器人 最適合面試練習的 AI 對話訓練工具
最適合面試練習的 AI 對話訓練工具

2026 年最新、最受好評的 AI 面試對話訓練工具,盡在 XIX.AI!這份精心精選的清單收錄了多款功能強大、顛覆傳統的工具,這些工具均經過嚴格的實戰測試,能提供精準的回饋。 您將在此找到免費版與付費版的比較分析,以及詳細的排名榜單,助您挑選必試的選項,從而提升自信與技能。立即探索,發掘助您在面試中脫穎而出的完美工具!

12 個工具
xix.ai
設計與藝術 最適合進行創意實驗的 AI 風格轉移工具
最適合進行創意實驗的 AI 風格轉移工具

2026 年最新、最佳且評價最高的 AI 風格轉移工具,助您進行創意實驗!XIX.AI 精心精選了一系列強大且具革命性的必試工具,這些工具經實際測試與嚴格評比,能帶來卓越成果。這些頂尖解決方案能加速內容創作並開啟無盡的創意可能性,協助創作者顯著提升生產力。 立即探索,找出最適合您的工具,並從今天開始創作吧!

9 個工具
xix.ai
漫畫創作 最適合視覺敘事的 AI 對話氣泡工具
最適合視覺敘事的 AI 對話氣泡工具

2026 年最新、最受好評的視覺敘事 AI 對話氣泡工具,現已登陸 XIX.AI!這份精心挑選的合集收錄了強大且具顛覆性的工具,能協助創作者提升生產力並突破創作瓶頸。 查看免費版與付費版的比較、參考實際測試結果,並查閱最新排行榜,找出最適合打造引人入勝視覺敘事的必試解決方案。立即探索,發掘您的理想工具!

10 個工具
xix.ai
評論 (0)
0/500
OR