Anthropic的Sonnet 5.5版本泄露:200万代币的上下文挑战促使DeepSeek重拾成本效益优势
Anthropic 正式发布了其最新的 Sonnet 5.5 模型,该模型内部代号为“Fennec”(取自沙漠狐的名字),预计将于下个月正式发布。 泄露的信息显示,该模型支持 200 万令牌的上下文窗口,可提供更快的推理速度、更低的延迟,并显著增强了长上下文推理和多步骤规划能力。此外,其在浏览器和终端上的工具调用能力也得到了提升。 虽然其性能可与旗舰产品 Claude Fable 5 媲美,但定价仍将保持在 Sonnet 级别,使其成为性价比方面的新领军者。

Sonnet 5 当前支持 100 万令牌的上下文窗口,Anthropic 表示这既是默认值,也是上限。将该容量翻倍至 200 万令牌,将直接惠及管理大型代码库和海量文档的开发者。 作为Anthropic重点打造的具备规划、浏览器及终端工具使用能力的智能代理模型,工具交互能力的进一步提升有望推动生产力实现显著飞跃。目前开发已进入最后阶段,Sonnet 5.5的目标是与DeepSeek V4 Flash抗衡,旨在抢占主流模型与高级模型之间具有竞争力的性价比细分市场。
通过高性价比重塑大模型竞争格局
大型语言模型之间的竞争已从基准测试分数转向实际价值:用户能以同样的成本获得多少智能。随着 DeepSeek V4 Flash 以超低价格颠覆市场,海外主要公司正面临压力。 Anthropic发布的Sonnet 5.5直接回应了这一趋势。如果泄露的信息属实,以Sonnet的价格提供接近Fable 5的推理能力,将使Claude具备极强的性价比。
值得注意的是,Anthropic最具性价比的Haiku系列已近一年未更新,市场关注点也已大幅转移。 加之OpenAI在Luna小模型上的强劲表现,分析师认为Anthropic可能会让Sonnet凭借增强的功能接替Haiku在中端市场的定位。若能成功,这一策略将压缩DeepSeek的定价优势,并避免内部产品线竞争。 然而,Anthropic仍面临挑战:DeepSeek已确立了低价预期,而OpenAI的Luna正迅速抢占轻量级应用场景。Sonnet 5.5能否真正夺得性价比之冠,还需待下个月正式发布后见分晓。
相关文章
Google DeepMind 成立研究所以扩大关于通用人工智能(AGI)的讨论
Google和Google DeepMind于周三成立了DeepMind研究所,以促进关于通用人工智能(AGI)的对话。该研究所由DeepMind联合创始人Shane Legg、Google高管James Manyika以及Google DeepMind主席Demis Hassabis领导,其中Legg担任执行编辑。这一新举措旨在突出Google、DeepMind以及全球研究社区内部关于AGI的多样化观点。公告指出,参与者“可能并不总是达成一致”,并且随着这一快速演进的领域出现新数据,他们可能
Chrome 推出 Gemini 技能库:一键复用提示词,告别重复输入
谷歌已为桌面版Chrome推出了一项更新,为其内置的Gemini功能引入了新的“技能库”。这一改进使用户能够将复杂的AI提示保存为可重复使用的“技能”,以便在各个网页上无缝应用。核心突破:从“聊天框”到“工具箱”此前,用户在使用 AI 时经常需要重新输入背景信息。“技能库”从根本上改变了这种交互模式:自定义技能:用户可保存常见的AI任务(例如:分析组件、比较规格、提取摘要)。下次使用时,只需在侧边
Anthropic首席执行官力推银行式人工智能监管规则,专家警告不宜身兼“球员”与“裁判”双重角色
据CNBC报道,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)建议在领先的人工智能企业内部设立长期独立的第三方安全评估人员,赋予他们与内部风险团队近乎同等的访问权限,以及在有限限制下独立公布评估结果的权限。 他明确以嵌入式银行监管机构为例,并承诺Anthropic将向第三方评估人员提供与内部风险团队同等的系统访问权限。在周末发表的一篇长文中,阿莫代伊还警告称,在未来6到12
相关专题推荐
评论 (0)
0/500
Anthropic 正式发布了其最新的 Sonnet 5.5 模型,该模型内部代号为“Fennec”(取自沙漠狐的名字),预计将于下个月正式发布。 泄露的信息显示,该模型支持 200 万令牌的上下文窗口,可提供更快的推理速度、更低的延迟,并显著增强了长上下文推理和多步骤规划能力。此外,其在浏览器和终端上的工具调用能力也得到了提升。 虽然其性能可与旗舰产品 Claude Fable 5 媲美,但定价仍将保持在 Sonnet 级别,使其成为性价比方面的新领军者。

Sonnet 5 当前支持 100 万令牌的上下文窗口,Anthropic 表示这既是默认值,也是上限。将该容量翻倍至 200 万令牌,将直接惠及管理大型代码库和海量文档的开发者。 作为Anthropic重点打造的具备规划、浏览器及终端工具使用能力的智能代理模型,工具交互能力的进一步提升有望推动生产力实现显著飞跃。目前开发已进入最后阶段,Sonnet 5.5的目标是与DeepSeek V4 Flash抗衡,旨在抢占主流模型与高级模型之间具有竞争力的性价比细分市场。
通过高性价比重塑大模型竞争格局
大型语言模型之间的竞争已从基准测试分数转向实际价值:用户能以同样的成本获得多少智能。随着 DeepSeek V4 Flash 以超低价格颠覆市场,海外主要公司正面临压力。 Anthropic发布的Sonnet 5.5直接回应了这一趋势。如果泄露的信息属实,以Sonnet的价格提供接近Fable 5的推理能力,将使Claude具备极强的性价比。
值得注意的是,Anthropic最具性价比的Haiku系列已近一年未更新,市场关注点也已大幅转移。 加之OpenAI在Luna小模型上的强劲表现,分析师认为Anthropic可能会让Sonnet凭借增强的功能接替Haiku在中端市场的定位。若能成功,这一策略将压缩DeepSeek的定价优势,并避免内部产品线竞争。 然而,Anthropic仍面临挑战:DeepSeek已确立了低价预期,而OpenAI的Luna正迅速抢占轻量级应用场景。Sonnet 5.5能否真正夺得性价比之冠,还需待下个月正式发布后见分晓。
Google DeepMind 成立研究所以扩大关于通用人工智能(AGI)的讨论
Google和Google DeepMind于周三成立了DeepMind研究所,以促进关于通用人工智能(AGI)的对话。该研究所由DeepMind联合创始人Shane Legg、Google高管James Manyika以及Google DeepMind主席Demis Hassabis领导,其中Legg担任执行编辑。这一新举措旨在突出Google、DeepMind以及全球研究社区内部关于AGI的多样化观点。公告指出,参与者“可能并不总是达成一致”,并且随着这一快速演进的领域出现新数据,他们可能
Chrome 推出 Gemini 技能库:一键复用提示词,告别重复输入
谷歌已为桌面版Chrome推出了一项更新,为其内置的Gemini功能引入了新的“技能库”。这一改进使用户能够将复杂的AI提示保存为可重复使用的“技能”,以便在各个网页上无缝应用。核心突破:从“聊天框”到“工具箱”此前,用户在使用 AI 时经常需要重新输入背景信息。“技能库”从根本上改变了这种交互模式:自定义技能:用户可保存常见的AI任务(例如:分析组件、比较规格、提取摘要)。下次使用时,只需在侧边
Anthropic首席执行官力推银行式人工智能监管规则,专家警告不宜身兼“球员”与“裁判”双重角色
据CNBC报道,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)建议在领先的人工智能企业内部设立长期独立的第三方安全评估人员,赋予他们与内部风险团队近乎同等的访问权限,以及在有限限制下独立公布评估结果的权限。 他明确以嵌入式银行监管机构为例,并承诺Anthropic将向第三方评估人员提供与内部风险团队同等的系统访问权限。在周末发表的一篇长文中,阿莫代伊还警告称,在未来6到12





首页






