选项
首页
新闻
Anthropic 推出配备专业模型角色的 AI 顾问工具

Anthropic 推出配备专业模型角色的 AI 顾问工具

2026-04-27
117

Anthropic 已正式在 Claude 平台 API 中推出“顾问工具”Advisor Tool),向开发者展示了一种新型的混合智能模型。在此架构中,一个成本更低、速度更快的模型负责处理大部分工作负载,仅在面临复杂决策时,才会自动向最强大的模型寻求战略建议。这种设计从根本上重新构思了传统智能体开发中“大模型规划、小模型执行”的模式,提供了真正兼顾成本与性能的优化解决方案。

创新机制:小模型执行,大模型顾问

此新功能将Claude Sonnet 或 Haiku定位为“执行者”,负责调用工具、处理任务及整合结果。当执行者遇到无法独立解决的难题时,才会将当前上下文传递给Claude Opus以获取建议。

Opus 提供高层次的解决方案、路径修正或战略指导,随后立即将控制权交还给执行者。关键在于,Opus不会直接调用工具或向用户输出最终结果,而是作为一位隐形的“战略家”发挥作用。这种倒置的设计确保了绝大多数令牌消耗发生在低成本模型上,并将高端计算能力保留给关键节点。

image.png

性能与成本:测试中的双赢局面

官方测试数据揭示了显著优势:

Sonnet 与 Opus Advisor的组合在多语言 SWE-bench 测试中,相较于单独使用 Sonnet 提升了2.7 个百分点,同时每项任务的总体成本降低了11.9%。

Haiku 与 Opus Advisor的组合表现更为惊人。其在 BrowseComp 测试中的得分从 19.7% 跃升至41.2%,性能几乎翻倍。尽管其性能仍比 Sonnet 单独运行时低约 29%,但成本仅为 Sonnet 的15%,因此非常适合对错误容忍度较高的高并发、批处理场景。

这些结果表明,通过智能路由关键决策,开发人员可以摆脱“Opus 成本过高,无法长期使用”与“仅使用 Sonnet 性能不足”之间的两难选择。

使用简便:仅需一行配置即可启用

开发者只需在 Messages API 的 tools 数组中添加类型为advisor_20260301的工具定义,即可激活此功能。模型切换和上下文传递等复杂操作会在单次 API 请求内自动完成,无需手动协调多次调用或管理额外上下文。

通过max_uses参数,可灵活控制每次请求中顾问咨询的最大次数。在计费方面,执行器和顾问的代币使用量将分别计费,确保透明度和可控性。该功能目前处于Beta 阶段,使用时需在请求头中添加 `anthropic-beta: advisor-tool-2026-03-01`。

行业影响:为经济高效的智能体开发开启新篇章

Advisor Tool 的推出标志着 AI 代理开发范式的重大演进。它使开发者在约 95% 的任务中既能享受 Sonnet 的执行效率和接近 Sonnet 的定价,又能在 5% 的关键决策点获得 Opus 级别的判断能力。这种“执行器 + 顾问”的混合策略不仅大幅降低了大规模部署的成本,还显著提升了小型模型在复杂工作流中的可行性。

无论是构建编程代理、浏览器自动化工具还是海量数据处理系统,Advisor Tool 都提供了一种高效、灵活且经济的解决方案。Anthropic 再次证明,模型能力的突破不仅源于参数规模,更源于架构和使用模式的创新。

随着 Beta 阶段的持续推进,该功能有望迅速成为开发者构建高性能、注重成本的 AI 代理的标准工具。其后续更新及进一步的基准测试表现无疑值得密切关注。

相关文章
印度科技巨头投资3000万美元,打造微软Office的AI竞争对手 印度科技巨头投资3000万美元,打造微软Office的AI竞争对手 连续创业者 Bhavin Turakhia 正投入 3000 万美元自有资金,押注企业 AI 领域仍有新玩家的空间。他最新的创业项目 Neo 基于一个核心信念:传统的职场软件不能仅靠聊天机器人进行修补,而需要进行彻底的架构重构。46 岁的 Turakhia 有着支持雄心勃勃的企业科技项目的历史。在过去二十年中,他联合创立了 Directi、Radix、Titan 和 Zeta,在寻求外部投资之前,主要使用个人资本为这些项目提供资金。他正将同样的自力更生策略应用于 Neo。Turakhia 向
前OpenAI首席科学家Ilya的SSI首次发布模型 前OpenAI首席科学家Ilya的SSI首次发布模型 AI 取得了另一项重大里程碑。在从 OpenAI 离职后,前首席科学家伊利亚·苏茨克弗(Ilya Sutskever)创立了 Safe Superintelligence Inc.(SSI),该公司最近公布了其首个模型的详细信息。海外社交媒体上的报道指出,该团队正在利用 TTT(测试时训练)开发一个紧凑的推理引擎,这是他们在追求安全超级智能过程中的关键进展。这种新颖的架构专注于使模型能够“学习如何学习”。与在推理过程中保持参数静态的传统大型语言模型不同,该引擎在处理现实世界任务时会动态更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field 2026年5月14日,AI应用开发平台Lovable宣布参与丹麦硬件初创公司Atech的80万美元种子轮融资。该轮由Lovable领投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在内的顶级风险投资机构。此次投资标志着Lovable将“Vibe Coding”概念从纯软件开发战略扩展至硬件工程领域。Atech旨在通过AI驱动的交互式平台简化复杂的硬件原型制作。用户购买基础硬件套件,并通过AI聊天机器人以自然语言描述其设计概念;系统
相关专题推荐
聊天机器人 最佳AI对话训练工具,助你备战面试
最佳AI对话训练工具,助你备战面试

2026年最新、最受好评的AI面试模拟训练工具现已登陆XIX.AI!这份精心精选的合集收录了功能强大、具有革命性意义的工具,它们均经过严格的实际测试,能够提供精准的反馈。 您将看到免费版与付费版的对比分析以及详细排名,助您挑选出必试之选,从而提升自信并精进技能。立即探索,发现助您面试成功的完美工具!

12 个工具
xix.ai
设计与艺术 最适合创意实验的AI风格转换工具
最适合创意实验的AI风格转换工具

2026年最新最佳、评价最高的AI风格转换工具,助您开展创意实验!XIX.AI精心甄选了一系列功能强大、颠覆性的必试工具,这些工具经过实际测试和严格排名,可带来卓越的效果。这些顶级解决方案通过加速内容创作并释放无限创意潜能,帮助创作者显著提升工作效率。 立即探索,找到最适合您的工具,今天就开始创作吧!

9 个工具
xix.ai
漫画创作 最适合视觉叙事的AI对话气泡工具
最适合视觉叙事的AI对话气泡工具

2026年最新、最受欢迎的视觉叙事AI对话气泡工具现已登陆XIX.AI!这份精心精选的合集汇集了功能强大、具有颠覆性的工具,可帮助创作者提升工作效率并突破创作瓶颈。 获取免费版与付费版的对比分析,查看实际测试结果,并查阅最新排行榜,找到最适合打造引人入胜的视觉叙事的必试解决方案。立即探索,发现您的理想工具!

10 个工具
xix.ai
会议助理 顶级AI会议摘要工具:清晰追踪决策与后续跟进
顶级AI会议摘要工具:清晰追踪决策与后续跟进

2026年最新高评分最佳AI会议摘要工具,助您清晰追踪决策并轻松跟进。这份精心筛选的清单展示了功能强大、具有颠覆性的解决方案,它们通过自动化会议记录、识别关键行动项以及简化所有项目中的团队协调,显著提升工作效率。 获取免费版与付费版的对比分析,以及实际测试报告和每周更新的排行榜,助您找到最适合的工具。立即探索,释放您的AI优势!

9 个工具
xix.ai
数据分析 最佳人工智能数据清洗工具:快速处理缺失值与重复数据
最佳人工智能数据清洗工具:快速处理缺失值与重复数据

2026年最新、最优秀且评分最高的AI数据清洗工具,可快速处理缺失值与重复数据问题。这份精心挑选的清单展示了那些功能强大、能带来颠覆性变革的解决方案,可显著提升工作效率。所有候选工具都经过了严格的实际应用测试,以确保其稳定性。您可以获取免费版与付费版的对比信息,找出最符合您需求的必备工具。即刻访问XIX.AI,开启您的AI优势之旅。

11 个工具
xix.ai
设计与艺术 最佳AI创意构思工具,助力艺术家突破视觉瓶颈
最佳AI创意构思工具,助力艺术家突破视觉瓶颈

2026 年最新最佳顶级评分 AI 创意构思工具由 XIX.AI 精心策划,旨在帮助创作者突破视觉瓶颈并即时提升创造力。这些强大的变革性工具提供真实世界测试、详细的免费与付费对比以及每周更新的排名。发现您的完美工具,加速内容创作,并立即释放您的 AI 优势。立即探索!

14 个工具
xix.ai
评论 (1)
0/500
MarkGonzalez
MarkGonzalez 2026-06-30 10:00:11

So they're basically using a cheap intern to do the grunt work and only calling in the senior dev when things get messy? That's actually a smart way to cut costs, but I wonder if the hand-off between models will cause any weird logic gaps. 🤔

OR