选项
首页
新闻
拟人化的AI模型具有可自定义的思维持续时间

拟人化的AI模型具有可自定义的思维持续时间

2025-04-10
304

Anthropic的最新AI模型Claude 3.7 Sonnet正在AI领域掀起波澜。被称为业界首个“混合AI推理模型”,它旨在根据您的需求提供快速回答和更深思熟虑的响应。您甚至可以选择让Claude“思考”您的问题的时间长短——很酷,对吧?

Claude 3.7 Sonnet的设计理念是让AI使用更加简单。Anthropic希望一个模型就能处理所有任务,而不是让用户从众多不同模型中选择。从周一开始,每个人都可以体验Claude 3.7 Sonnet,但如果您想使用其高级推理功能,需要订阅Anthropic的优质计划。免费用户仍然可以使用一个强大的模型版本,Anthropic表示这比之前的Claude 3.5 Sonnet更出色。

现在来说说费用——Claude 3.7 Sonnet的定价为每百万输入令牌3美元,每百万输出令牌15美元。这比其他一些模型(如OpenAI的o3-mini和DeepSeek的R1)稍贵,但请记住,那些只是推理模型,而不是像Claude这样的混合模型。

Anthropic的新思考模式 图片来源:Anthropic
Claude 3.7 Sonnet是Anthropic首个具备“推理”能力的模型,这在AI领域意义重大。推理模型需要更多时间和计算能力来回答问题,会将问题分解为更小的步骤以获得更准确的答案。它并不完全等同于人类推理,但以此为模型。

Anthropic对Claude有宏大的计划。他们希望Claude最终能自行判断问题需要“思考”多长时间,而无需用户设置。Anthropic的产品与研究负责人Dianne Penn在接受TechCrunch采访时表示,他们认为推理只是前沿模型应具备的众多功能之一,全部整合在一个模型中。

使用Claude 3.7 Sonnet,您甚至可以通过“可见草稿板”看到它如何规划答案。大多数时候,您可以看到整个过程,但出于安全原因,Anthropic可能会对某些部分进行编辑。

Claude在claude应用中的思考过程 图片来源:Anthropic
Anthropic表示,他们已针对现实世界的任务(如复杂的编码问题或需要一定自主性的任务)优化了Claude的思考模式。如果您是使用Anthropic API的开发者,您甚至可以控制Claude的“思考”程度,在速度、成本和答案质量之间找到平衡。

在一些测试中,Claude 3.7 Sonnet表现出色。在SWE-Bench(一项针对现实世界编码任务的测试)中,它得分62.3%,超过了OpenAI的o3-mini(49.3%)。在TAU-Bench(衡量AI在零售环境中与模拟用户和外部API交互能力的测试)中,Claude 3.7 Sonnet得分81.2%,而OpenAI的o1模型得分为73.5%。

Anthropic还表示,Claude 3.7 Sonnet拒绝回答问题的可能性更低,能更细致地区分有害和无害的提示。与Claude 3.5 Sonnet相比,其不必要的拒绝率降低了45%。

与Claude 3.7 Sonnet一起,Anthropic还推出了一款名为Claude Code的新工具。这是一个研究预览版,允许开发者直接从终端通过Claude运行特定任务。在演示中,Anthropic展示了Claude Code如何通过简单的命令(如“解释这个项目结构”)分析编码项目。您甚至可以用普通英语修改代码库,Claude Code会在修改时描述其编辑内容,测试错误,并将项目推送到GitHub仓库。

Claude Code将以“先到先得”的方式向有限数量的用户开放。

Anthropic在AI实验室不断推出新模型的时刻发布了Claude 3.7 Sonnet。虽然Anthropic通常采取更为谨慎、以安全为重点的策略,但这次他们希望引领潮流。但他们能领先多久无人知晓——尤其是OpenAI的CEO Sam Altman表示,他们自己的混合AI模型将在“几个月”内推出。

相关文章
Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 推出 Opus 4.8,新增动态工作流工具 Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。与此同时,OpenAI的
Anthropic 正式推出 Claude Fable 5,这是 Mythos 的公开版本 Anthropic 正式推出 Claude Fable 5,这是 Mythos 的公开版本 Anthropic首次向公众开放其最强大的人工智能模型——但已采取相应的安全措施。本周二,该公司推出了 Claude Fable 5,这是其 Mythos 模型的首次公开发布。 据Anthropic介绍,Fable 5在软件工程、知识工作和视觉任务方面表现优异,但附带严格的安全限制。在网络安全、生物学、化学和蒸馏等高风险领域,该模型将拒绝回答问题,转而交由Claude Opus 4.8处理。M
SandboxAQ将药物发现领域的AI技术引入Claude,无需拥有计算机科学博士学位即可使用。 SandboxAQ将药物发现领域的AI技术引入Claude,无需拥有计算机科学博士学位即可使用。 药物发现依然是现代工业领域成本最高的挑战之一。要找到一种具备应用价值的分子,往往需要十年的时间以及数十亿美元的投入,而且大多数候选分子最终仍会失败。目前有一波人工智能初创企业宣称能够改变这一现状——不过这些公司大多仅能让那些已具备足够技术能力的研究人员稍显便利些许。然而SandboxAQ认为,真正的瓶颈并非模型本身,而是界面设计。该公司与Anthropic合作,将其科学类人工智能模型直接集成到Claude中,使得强大的药物发现和材料科学工具能够通过对话式界面被使用,且无需任何专门的计算基础设
相关专题推荐
音乐创作 最佳用于歌曲草稿的 AI 旋律创作工具
最佳用于歌曲草稿的 AI 旋律创作工具

2026 年最新最佳顶级评分 AI 旋律创作工具,助力歌曲草稿创作!XIX.AI 精心策划了一套极具影响力且经过严格真实世界测试的变革性合集,旨在提供最佳的创作体验。您可以找到详细的免费与付费版对比、精准的排名以及必试选项,这些工具旨在帮助您轻松创作出令人惊艳的歌曲草稿,并显著提升您的创意生产力。立即探索,发现您的完美工具!

8 个工具
xix.ai
聊天机器人 最佳AI对话训练工具,助你备战面试
最佳AI对话训练工具,助你备战面试

2026年最新、最受好评的AI面试模拟训练工具现已登陆XIX.AI!这份精心精选的合集收录了功能强大、具有革命性意义的工具,它们均经过严格的实际测试,能够提供精准的反馈。 您将看到免费版与付费版的对比分析以及详细排名,助您挑选出必试之选,从而提升自信并精进技能。立即探索,发现助您面试成功的完美工具!

12 个工具
xix.ai
设计与艺术 最适合创意实验的AI风格转换工具
最适合创意实验的AI风格转换工具

2026年最新最佳、评价最高的AI风格转换工具,助您开展创意实验!XIX.AI精心甄选了一系列功能强大、颠覆性的必试工具,这些工具经过实际测试和严格排名,可带来卓越的效果。这些顶级解决方案通过加速内容创作并释放无限创意潜能,帮助创作者显著提升工作效率。 立即探索,找到最适合您的工具,今天就开始创作吧!

9 个工具
xix.ai
漫画创作 最适合视觉叙事的AI对话气泡工具
最适合视觉叙事的AI对话气泡工具

2026年最新、最受欢迎的视觉叙事AI对话气泡工具现已登陆XIX.AI!这份精心精选的合集汇集了功能强大、具有颠覆性的工具,可帮助创作者提升工作效率并突破创作瓶颈。 获取免费版与付费版的对比分析,查看实际测试结果,并查阅最新排行榜,找到最适合打造引人入胜的视觉叙事的必试解决方案。立即探索,发现您的理想工具!

10 个工具
xix.ai
会议助理 顶级AI会议摘要工具:清晰追踪决策与后续跟进
顶级AI会议摘要工具:清晰追踪决策与后续跟进

2026年最新高评分最佳AI会议摘要工具,助您清晰追踪决策并轻松跟进。这份精心筛选的清单展示了功能强大、具有颠覆性的解决方案,它们通过自动化会议记录、识别关键行动项以及简化所有项目中的团队协调,显著提升工作效率。 获取免费版与付费版的对比分析,以及实际测试报告和每周更新的排行榜,助您找到最适合的工具。立即探索,释放您的AI优势!

9 个工具
xix.ai
数据分析 最佳人工智能数据清洗工具:快速处理缺失值与重复数据
最佳人工智能数据清洗工具:快速处理缺失值与重复数据

2026年最新、最优秀且评分最高的AI数据清洗工具,可快速处理缺失值与重复数据问题。这份精心挑选的清单展示了那些功能强大、能带来颠覆性变革的解决方案,可显著提升工作效率。所有候选工具都经过了严格的实际应用测试,以确保其稳定性。您可以获取免费版与付费版的对比信息,找出最符合您需求的必备工具。即刻访问XIX.AI,开启您的AI优势之旅。

11 个工具
xix.ai
评论 (54)
0/500
RaymondAdams
RaymondAdams 2025-08-11 13:00:59

This hybrid AI model sounds like a game-changer! Being able to tweak how long Claude thinks is super cool, like choosing between a quick coffee chat or a deep dive convo. Excited to see how this stacks up against other AI out there! 😎

ChristopherDavis
ChristopherDavis 2025-08-06 03:00:59

Claude 3.7 Sonnet a l'air incroyable ! Pouvoir choisir la durée de réflexion, c'est comme demander à un chef de cuisiner vite ou de prendre son temps pour un plat parfait. J'ai hâte de voir comment ça marche en pratique ! 😄

WillieAdams
WillieAdams 2025-08-01 14:08:50

Claude's customizable thinking duration sounds like a game-changer! I wonder how it balances speed and depth in real-world tasks. Excited to try it out! 😄

ScarlettWhite
ScarlettWhite 2025-07-23 12:59:47

Wow, Claude 3.7 sounds like a game-changer! Being able to tweak how long it thinks is such a cool feature. I’m curious how this will stack up against other AI models in real-world tasks. Anyone tried it yet? 😄

CharlesRoberts
CharlesRoberts 2025-04-23 22:11:54

O Claude 3.7 Sonnet é incrível! Adoro poder escolher a duração do pensamento. Às vezes preciso de respostas rápidas, outras vezes quero respostas mais pensadas. É como ter um amigo AI personalizável! Só desejo que fosse um pouco mais rápido às vezes. 😎

RyanAnderson
RyanAnderson 2025-04-22 22:04:41

Claude 3.7 Sonnet is a game-changer! I love how I can choose the thinking duration. Sometimes I need quick answers, and other times I want a more thoughtful response. It's like having a customizable AI buddy! Only wish it was a bit faster at times. 🤓

OR