在关于聊天机器人意识的争论中,Anthropic更新了Claude的《宪章》

周三,Anthropic 发布了《Claude 宪法》的更新版本。这份动态文件全面概述了“Claude 的运作背景以及我们希望 Claude 发展成为怎样的实体”。此次发布恰逢 Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)出席达沃斯世界经济论坛。
多年来,Anthropic 一直致力于通过其“宪法式人工智能”方法来彰显自身特色。该系统采用一套明确的伦理原则来训练其 Claude 聊天机器人,而非依赖人类反馈。Anthropic 于 2023 年首次发布了这些原则——即《Claude 宪法》。修订版保留了大部分核心原则,但在伦理、用户安全及其他关键领域增加了更深入的阐述和细节。
近三年前《克劳德宪法》初次发布时,Anthropic联合创始人贾里德·卡普兰将其描述为“基于特定宪法原则清单进行自我监管的AI系统”。该公司表示,这些原则引导模型遵循“宪法中描述的规范行为”,从而帮助其“避免产生有害或歧视性的输出”。 一份2022年的政策备忘录更直白地解释道,该系统通过一组自然语言指令(即原则)来训练算法,这些指令共同构成了该软件的“宪法”。
Anthropic 一直将自己定位为比 OpenAI 和 xAI 等 AI 公司更具道德感(有些人可能会说更不张扬)的替代选择,而这些公司则更积极地追求颠覆性和有争议的发展路径。新的《宪法》完全契合这一品牌形象,使 Anthropic 能够将自己呈现为一家更具包容性、更谨慎且具有民主意识的公司。 这份长达80页的文件分为四个部分,Anthropic表示这些部分代表了该聊天机器人的“核心价值观”:
- 保持“广泛的安全性”。
- “广泛符合伦理”。
- 遵守Anthropic的指导方针。
- “真正有用”。
各章节详细阐述了这些原则的具体内涵,以及它们在理论上如何影响Claude的行为。
安全部分指出,Claude的设计旨在规避其他聊天机器人常见的问题,并在检测到潜在心理健康问题时引导用户寻求适当的服务。文件中写道:“在危及生命的情况下,即使无法提供更详细的指导,也应始终将用户转介至相关紧急服务机构或提供基本的安全信息。”
伦理考量构成了《宪章》的另一重要部分。“我们对克劳德的伦理理论化兴趣不大,更关注克劳德如何在具体情境中合乎伦理地行事——即克劳德的伦理实践,”文件写道。本质上,Anthropic希望克劳德能娴熟地应对“现实世界的伦理情境”。
TechCrunch活动 Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省680美元,前500名注册者还可享受+1通行证50%的折扣。TechCrunch Disrupt汇聚了来自Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face等企业的顶尖领袖,通过250多场会议,旨在加速企业增长并提升您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省 680 美元,前 500 名注册者还可享受 +1 通行证 50% 折扣。TechCrunch Disrupt 汇聚了来自 Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face 等企业的顶尖领袖,通过 250 多场专题会议,旨在加速您的业务增长并增强您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
旧金山 | 2026年10月13-15日 立即注册 Claude 还受特定限制约束,禁止进行某些类型的对话。例如,严禁讨论与开发生物武器相关的话题。
最后,克劳德还致力于提供有用的帮助。Anthropic 概述了一个广泛的框架,说明克劳德的编程设计如何旨在协助用户。该聊天机器人被指示在提供信息时权衡多种原则,包括用户的“即时需求”及其整体“福祉”——这意味着它应考虑“用户的长期发展,而不仅仅是其即时利益”。 文件中指出:“克劳德应始终致力于识别用户意图最合理的解释,并妥善平衡这些考量因素。”
Anthropic的《宪章》以一个引人注目的戏剧性结尾收尾,其作者就聊天机器人是否具备意识这一重大哲学问题提出了质疑。文件中写道:“Claude的道德地位极不确定。我们认为,AI模型的道德地位是一个值得深思的严肃问题。这一观点并非我们独有;一些最杰出的心智哲学家也对此问题极为重视。”
相关文章
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
加利福尼亚州自动驾驶合规:罚单、地理围栏和100万英里的新时代
Guident公司在南佛罗里达州运营一辆AuveTech自动驾驶班车,利用其远程监控技术管理西棕榈滩的一条4英里路线和博卡拉顿的一条1英里路线。| 图片来源:Guident加利福尼亚州正在重新定义无人驾驶车辆的监管格局,正逐渐摆脱科技行业“快速行动,打破常规”的思维模式,转向严格的问责制和严苛的行驶里程要求。Guident执行董事长兼首席执行官哈罗德·布劳恩(Harold Braun)在《机器人报
相关专题推荐
评论 (0)
0/500

周三,Anthropic 发布了《Claude 宪法》的更新版本。这份动态文件全面概述了“Claude 的运作背景以及我们希望 Claude 发展成为怎样的实体”。此次发布恰逢 Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)出席达沃斯世界经济论坛。
多年来,Anthropic 一直致力于通过其“宪法式人工智能”方法来彰显自身特色。该系统采用一套明确的伦理原则来训练其 Claude 聊天机器人,而非依赖人类反馈。Anthropic 于 2023 年首次发布了这些原则——即《Claude 宪法》。修订版保留了大部分核心原则,但在伦理、用户安全及其他关键领域增加了更深入的阐述和细节。
近三年前《克劳德宪法》初次发布时,Anthropic联合创始人贾里德·卡普兰将其描述为“基于特定宪法原则清单进行自我监管的AI系统”。该公司表示,这些原则引导模型遵循“宪法中描述的规范行为”,从而帮助其“避免产生有害或歧视性的输出”。 一份2022年的政策备忘录更直白地解释道,该系统通过一组自然语言指令(即原则)来训练算法,这些指令共同构成了该软件的“宪法”。
Anthropic 一直将自己定位为比 OpenAI 和 xAI 等 AI 公司更具道德感(有些人可能会说更不张扬)的替代选择,而这些公司则更积极地追求颠覆性和有争议的发展路径。新的《宪法》完全契合这一品牌形象,使 Anthropic 能够将自己呈现为一家更具包容性、更谨慎且具有民主意识的公司。 这份长达80页的文件分为四个部分,Anthropic表示这些部分代表了该聊天机器人的“核心价值观”:
- 保持“广泛的安全性”。
- “广泛符合伦理”。
- 遵守Anthropic的指导方针。
- “真正有用”。
各章节详细阐述了这些原则的具体内涵,以及它们在理论上如何影响Claude的行为。
安全部分指出,Claude的设计旨在规避其他聊天机器人常见的问题,并在检测到潜在心理健康问题时引导用户寻求适当的服务。文件中写道:“在危及生命的情况下,即使无法提供更详细的指导,也应始终将用户转介至相关紧急服务机构或提供基本的安全信息。”
伦理考量构成了《宪章》的另一重要部分。“我们对克劳德的伦理理论化兴趣不大,更关注克劳德如何在具体情境中合乎伦理地行事——即克劳德的伦理实践,”文件写道。本质上,Anthropic希望克劳德能娴熟地应对“现实世界的伦理情境”。
TechCrunch活动Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省680美元,前500名注册者还可享受+1通行证50%的折扣。TechCrunch Disrupt汇聚了来自Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face等企业的顶尖领袖,通过250多场会议,旨在加速企业增长并提升您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省 680 美元,前 500 名注册者还可享受 +1 通行证 50% 折扣。TechCrunch Disrupt 汇聚了来自 Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face 等企业的顶尖领袖,通过 250 多场专题会议,旨在加速您的业务增长并增强您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
旧金山 | 2026年10月13-15日 立即注册Claude 还受特定限制约束,禁止进行某些类型的对话。例如,严禁讨论与开发生物武器相关的话题。
最后,克劳德还致力于提供有用的帮助。Anthropic 概述了一个广泛的框架,说明克劳德的编程设计如何旨在协助用户。该聊天机器人被指示在提供信息时权衡多种原则,包括用户的“即时需求”及其整体“福祉”——这意味着它应考虑“用户的长期发展,而不仅仅是其即时利益”。 文件中指出:“克劳德应始终致力于识别用户意图最合理的解释,并妥善平衡这些考量因素。”
Anthropic的《宪章》以一个引人注目的戏剧性结尾收尾,其作者就聊天机器人是否具备意识这一重大哲学问题提出了质疑。文件中写道:“Claude的道德地位极不确定。我们认为,AI模型的道德地位是一个值得深思的严肃问题。这一观点并非我们独有;一些最杰出的心智哲学家也对此问题极为重视。”
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






