選項
首頁
新聞
Anthropic 推出具備專門模型角色的 AI 顧問工具

Anthropic 推出具備專門模型角色的 AI 顧問工具

2026-04-27
118

Anthropic 已正式在 Claude 平台 API 中推出「顧問工具」(Advisor Tool),向開發者介紹一種嶄新的混合智能模型。在此架構下,一個成本更低且運算速度更快的模型負責處理大部分工作負載,僅在面臨複雜決策時,才會自動諮詢最強大的模型以獲取策略建議。此設計從根本上重新思考了傳統代理(Agent)開發中「大模型規劃、小模型執行」的模式,提供了一種真正兼具成本效益與性能的解決方案。

創新機制:小模型執行,大模型諮詢

此新功能將Claude Sonnet 或 Haiku定位為「執行者」,負責呼叫工具、處理任務及整合結果。執行者僅在遇到無法獨立解決的難題時,才會將當前語境傳遞給Claude Opus以獲取建議。

Opus 會提供高階解決方案、方向修正或策略指引,隨後立即將控制權交還給執行者。關鍵在於,Opus不會直接呼叫工具或向使用者輸出最終結果,而是扮演一個隱形的「策略家」。這種倒置設計確保了絕大部分的代幣消耗發生在成本較低的模型上,並將高端運算能力保留給關鍵時刻。

image.png

效能與成本:測試中的雙贏局面

官方測試數據顯示顯著效益:

Sonnet 搭配 Opus Advisor的組合,在多語言 SWE-bench 測試中較單獨使用 Sonnet提升了 2.7 個百分點,同時每項任務的整體成本降低了11.9%。

Haiku 搭配 Opus Advisor的組合則展現出更為驚人的成果。其在 BrowseComp 測試中的得分從 19.7% 躍升至41.2%,效能實質上翻了一倍。雖然其表現仍比 Sonnet 單獨運作時低約 29%,但成本僅為 Sonnet 的15%,使其成為高並發、批次處理且對錯誤容忍度較高的情境下的理想選擇。

這些結果證明,透過智慧導向關鍵決策,開發人員得以擺脫「Opus 成本過高,不適合全時使用」與「單獨使用 Sonnet 效能不足」之間的兩難抉擇。

操作簡便:僅需一行設定即可啟用

開發人員只需在 Messages API 的 tools 陣列中新增類型為advisor_20260301的工具定義,即可啟用此功能。模型切換與上下文傳遞等複雜操作,皆會於單一 API 請求中自動處理,無需手動協調多次呼叫或管理額外上下文。

透過max_uses參數,可靈活控制每次請求中顧問諮詢的最大次數。在計費方面,執行器與顧問的代幣使用量將分別計費,確保透明度與控制權。目前此功能處於Beta 階段,使用時需在請求標頭中加入 `anthropic-beta: advisor-tool-2026-03-01`。

產業影響:為經濟高效的代理程式開發開啟新大門

Advisor Tool 的推出標誌著 AI 代理開發範式的重大演進。它讓開發者能在約 95% 的任務中享受 Sonnet 的執行效率與近似 Sonnet 的定價,同時在 5% 的關鍵決策點獲得 Opus 級別的判斷能力。這種「執行器 + 顧問」的混合策略,不僅大幅削減了大規模部署的成本,更顯著提升了小型模型在複雜工作流程中的可行性。

無論是開發程式碼生成代理程式、瀏覽器自動化工具,還是高吞吐量資料處理系統,「顧問工具」皆提供高效、靈活且經濟實惠的解決方案。Anthropic 再次證明,模型能力的突破不僅源於參數規模,更來自架構與使用模式的創新。

隨著 Beta 階段持續推進,這項功能勢必將迅速成為開發者打造高效能且兼顧成本效益的 AI 代理程式之標準工具。其後續更新與進一步的基準測試表現,絕對值得密切關注。

相關文章
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。 DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。 Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額 儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額 儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代 加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代 Guident 在南佛羅里達州營運一輛 AuveTech 接駁車,並運用其遠端監控技術,管理西棕櫚灘的一條四英里路線以及博卡拉頓的一條一英里路線。| 圖片來源:Guident加州正重新定義無人駕駛車輛的監管格局,從科技產業的「快速行動、打破常規」心態,轉向嚴格的問責制與嚴謹的行駛里程要求。Guident 執行董事長兼執行長哈羅德·布勞恩(Harold Braun)在《機器人報告》(The Robo
相關專題推薦
視頻創作 適用於 Reels、Shorts 及產品上市活動的 AI 短影片吸睛開場生成器
適用於 Reels、Shorts 及產品上市活動的 AI 短影片吸睛開場生成器

2026 年最新最佳 AI 短影片開場白生成器,適用於 Reels、Shorts 及產品上市活動!XIX.AI 嚴選備受好評、功能強大且能顛覆遊戲規則的工具,這些工具皆經過實際測試,能帶來絕對值得一試的成果。本頁面每週更新,提供免費與付費版本的比較排行榜,助您找到提升內容創意與生產力的完美解決方案。 立即探索,釋放您的 AI 競爭優勢!

11 個工具
xix.ai
寫作 適用於長篇寫作的 AI 文章大綱工具
適用於長篇寫作的 AI 文章大綱工具

2026 年最新、最受好評的長文寫作 AI 大綱工具!這份精選清單收錄了強大且具顛覆性的工具,能透過實際測試生成精準、結構化的大綱,大幅提升寫作效率。XIX.AI 正是這份菁英名單中的一員。 獲取免費版與付費版的比較指南,助您挑選最合適的工具。立即探索,釋放您的 AI 優勢!

9 個工具
xix.ai
聊天機器人 用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用
用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用

2026 年最新最佳頂級評分 AI 角色扮演聊天應用,用於語言練習、面試準備和日常流利度!XIX.AI 精心策劃了一個強大的變革性合集,提供免費與付費對比、真實世界測試以及每週更新的排名。這些必試工具可幫助您提升寫作技能,克服流利度挑戰,並提高所有日常場景下的溝通效率。立即探索,發現您語言成長的完美工具!

10 個工具
xix.ai
音樂創作 用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具
用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具

2026年最新、最優秀且評分最高的AI音軌分離工具彙總,專為混音製作、取樣準備以及卡拉OK音訊處理而設計。這些功能強大的創新工具經過實際測試,能夠實現精準的音訊分離,顯著提升工作效率。XIX.AI每週都會更新免費的付費產品對比指南,幫助您找到最適合自身需求的工具。立即探索,發揮您的AI優勢。

8 個工具
xix.ai
數據分析 用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手
用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手

2026年最新最優秀的AI SQL輔助工具排名揭曉!XIX.AI精心挑選了一系列功能強大的工具,這些工具會定期更新,並透過真實的場景測試來驗證其效能。使用這些值得嘗試的工具,您可以快速生成精準的收入分析報表、分析銷售流程,並追蹤產品各項指標,從而大幅提升工作效率。立即探索,找到最適合您的資料驅動決策工具!238個字元

9 個工具
xix.ai
音樂創作 最佳用於歌曲草稿的 AI 旋律創作工具
最佳用於歌曲草稿的 AI 旋律創作工具

2026 年最新最佳頂級評分 AI 旋律創作工具,助力歌曲草稿創作!XIX.AI 精心策劃了一套極具影響力且經過嚴格真實世界測試的變革性合集,旨在提供最佳的創作體驗。您可以找到詳細的免費與付費版對比、精準的排名以及必試選項,這些工具旨在幫助您輕鬆創作出令人驚豔的歌曲草稿,並顯著提升您的創意生產力。立即探索,發現您的完美工具!

8 個工具
xix.ai
評論 (1)
0/500
MarkGonzalez
MarkGonzalez 2026-06-30 10:00:11

So they're basically using a cheap intern to do the grunt work and only calling in the senior dev when things get messy? That's actually a smart way to cut costs, but I wonder if the hand-off between models will cause any weird logic gaps. 🤔

OR