在关于聊天机器人意识的争论中,Anthropic更新了Claude的《宪章》

周三,Anthropic 发布了《Claude 宪法》的更新版本。这份动态文件全面概述了“Claude 的运作背景以及我们希望 Claude 发展成为怎样的实体”。此次发布恰逢 Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)出席达沃斯世界经济论坛。
多年来,Anthropic 一直致力于通过其“宪法式人工智能”方法来彰显自身特色。该系统采用一套明确的伦理原则来训练其 Claude 聊天机器人,而非依赖人类反馈。Anthropic 于 2023 年首次发布了这些原则——即《Claude 宪法》。修订版保留了大部分核心原则,但在伦理、用户安全及其他关键领域增加了更深入的阐述和细节。
近三年前《克劳德宪法》初次发布时,Anthropic联合创始人贾里德·卡普兰将其描述为“基于特定宪法原则清单进行自我监管的AI系统”。该公司表示,这些原则引导模型遵循“宪法中描述的规范行为”,从而帮助其“避免产生有害或歧视性的输出”。 一份2022年的政策备忘录更直白地解释道,该系统通过一组自然语言指令(即原则)来训练算法,这些指令共同构成了该软件的“宪法”。
Anthropic 一直将自己定位为比 OpenAI 和 xAI 等 AI 公司更具道德感(有些人可能会说更不张扬)的替代选择,而这些公司则更积极地追求颠覆性和有争议的发展路径。新的《宪法》完全契合这一品牌形象,使 Anthropic 能够将自己呈现为一家更具包容性、更谨慎且具有民主意识的公司。 这份长达80页的文件分为四个部分,Anthropic表示这些部分代表了该聊天机器人的“核心价值观”:
- 保持“广泛的安全性”。
- “广泛符合伦理”。
- 遵守Anthropic的指导方针。
- “真正有用”。
各章节详细阐述了这些原则的具体内涵,以及它们在理论上如何影响Claude的行为。
安全部分指出,Claude的设计旨在规避其他聊天机器人常见的问题,并在检测到潜在心理健康问题时引导用户寻求适当的服务。文件中写道:“在危及生命的情况下,即使无法提供更详细的指导,也应始终将用户转介至相关紧急服务机构或提供基本的安全信息。”
伦理考量构成了《宪章》的另一重要部分。“我们对克劳德的伦理理论化兴趣不大,更关注克劳德如何在具体情境中合乎伦理地行事——即克劳德的伦理实践,”文件写道。本质上,Anthropic希望克劳德能娴熟地应对“现实世界的伦理情境”。
TechCrunch活动 Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省680美元,前500名注册者还可享受+1通行证50%的折扣。TechCrunch Disrupt汇聚了来自Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face等企业的顶尖领袖,通过250多场会议,旨在加速企业增长并提升您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省 680 美元,前 500 名注册者还可享受 +1 通行证 50% 折扣。TechCrunch Disrupt 汇聚了来自 Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face 等企业的顶尖领袖,通过 250 多场专题会议,旨在加速您的业务增长并增强您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
旧金山 | 2026年10月13-15日 立即注册 Claude 还受特定限制约束,禁止进行某些类型的对话。例如,严禁讨论与开发生物武器相关的话题。
最后,克劳德还致力于提供有用的帮助。Anthropic 概述了一个广泛的框架,说明克劳德的编程设计如何旨在协助用户。该聊天机器人被指示在提供信息时权衡多种原则,包括用户的“即时需求”及其整体“福祉”——这意味着它应考虑“用户的长期发展,而不仅仅是其即时利益”。 文件中指出:“克劳德应始终致力于识别用户意图最合理的解释,并妥善平衡这些考量因素。”
Anthropic的《宪章》以一个引人注目的戏剧性结尾收尾,其作者就聊天机器人是否具备意识这一重大哲学问题提出了质疑。文件中写道:“Claude的道德地位极不确定。我们认为,AI模型的道德地位是一个值得深思的严肃问题。这一观点并非我们独有;一些最杰出的心智哲学家也对此问题极为重视。”
相关文章
苹果智能眼镜或将在WWDC27上首次亮相,重点突出隐私保护
彭博社的马克·古尔曼报道,苹果智能眼镜(内部代号 N50)计划于 2027 年 6 月的全球开发者大会(WWDC27)上首次亮相,零售版预计将于 2027 年秋季上市。该设备原定于今年晚些时候及 2027 年初发布,但现已推迟,以便进行进一步的产品完善并加强隐私保护协议。隐私仍是苹果智能眼镜战略的核心支柱。从 Meta 等竞争对手的隐私争议中吸取教训,苹果正在实施强有力的功能与政策。目前考虑的方案包括:完全移除摄像头,专注于人工智能交互、音频播放和通话;或保留摄像头但禁用照片和视频录制功能,仅
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
相关专题推荐
评论 (0)
0/500

周三,Anthropic 发布了《Claude 宪法》的更新版本。这份动态文件全面概述了“Claude 的运作背景以及我们希望 Claude 发展成为怎样的实体”。此次发布恰逢 Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)出席达沃斯世界经济论坛。
多年来,Anthropic 一直致力于通过其“宪法式人工智能”方法来彰显自身特色。该系统采用一套明确的伦理原则来训练其 Claude 聊天机器人,而非依赖人类反馈。Anthropic 于 2023 年首次发布了这些原则——即《Claude 宪法》。修订版保留了大部分核心原则,但在伦理、用户安全及其他关键领域增加了更深入的阐述和细节。
近三年前《克劳德宪法》初次发布时,Anthropic联合创始人贾里德·卡普兰将其描述为“基于特定宪法原则清单进行自我监管的AI系统”。该公司表示,这些原则引导模型遵循“宪法中描述的规范行为”,从而帮助其“避免产生有害或歧视性的输出”。 一份2022年的政策备忘录更直白地解释道,该系统通过一组自然语言指令(即原则)来训练算法,这些指令共同构成了该软件的“宪法”。
Anthropic 一直将自己定位为比 OpenAI 和 xAI 等 AI 公司更具道德感(有些人可能会说更不张扬)的替代选择,而这些公司则更积极地追求颠覆性和有争议的发展路径。新的《宪法》完全契合这一品牌形象,使 Anthropic 能够将自己呈现为一家更具包容性、更谨慎且具有民主意识的公司。 这份长达80页的文件分为四个部分,Anthropic表示这些部分代表了该聊天机器人的“核心价值观”:
- 保持“广泛的安全性”。
- “广泛符合伦理”。
- 遵守Anthropic的指导方针。
- “真正有用”。
各章节详细阐述了这些原则的具体内涵,以及它们在理论上如何影响Claude的行为。
安全部分指出,Claude的设计旨在规避其他聊天机器人常见的问题,并在检测到潜在心理健康问题时引导用户寻求适当的服务。文件中写道:“在危及生命的情况下,即使无法提供更详细的指导,也应始终将用户转介至相关紧急服务机构或提供基本的安全信息。”
伦理考量构成了《宪章》的另一重要部分。“我们对克劳德的伦理理论化兴趣不大,更关注克劳德如何在具体情境中合乎伦理地行事——即克劳德的伦理实践,”文件写道。本质上,Anthropic希望克劳德能娴熟地应对“现实世界的伦理情境”。
TechCrunch活动Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省680美元,前500名注册者还可享受+1通行证50%的折扣。TechCrunch Disrupt汇聚了来自Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face等企业的顶尖领袖,通过250多场会议,旨在加速企业增长并提升您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
Disrupt 2026 门票:限时优惠
门票现已开售!通过这些独家优惠价最高可节省 680 美元,前 500 名注册者还可享受 +1 通行证 50% 折扣。TechCrunch Disrupt 汇聚了来自 Google Cloud、Netflix、Microsoft、Box、a16z、Hugging Face 等企业的顶尖领袖,通过 250 多场专题会议,旨在加速您的业务增长并增强您的竞争优势。 与数百家创新初创企业建立联系,参与精心策划的交流活动,促成合作、获取洞见并激发灵感。
旧金山 | 2026年10月13-15日 立即注册Claude 还受特定限制约束,禁止进行某些类型的对话。例如,严禁讨论与开发生物武器相关的话题。
最后,克劳德还致力于提供有用的帮助。Anthropic 概述了一个广泛的框架,说明克劳德的编程设计如何旨在协助用户。该聊天机器人被指示在提供信息时权衡多种原则,包括用户的“即时需求”及其整体“福祉”——这意味着它应考虑“用户的长期发展,而不仅仅是其即时利益”。 文件中指出:“克劳德应始终致力于识别用户意图最合理的解释,并妥善平衡这些考量因素。”
Anthropic的《宪章》以一个引人注目的戏剧性结尾收尾,其作者就聊天机器人是否具备意识这一重大哲学问题提出了质疑。文件中写道:“Claude的道德地位极不确定。我们认为,AI模型的道德地位是一个值得深思的严肃问题。这一观点并非我们独有;一些最杰出的心智哲学家也对此问题极为重视。”
苹果智能眼镜或将在WWDC27上首次亮相,重点突出隐私保护
彭博社的马克·古尔曼报道,苹果智能眼镜(内部代号 N50)计划于 2027 年 6 月的全球开发者大会(WWDC27)上首次亮相,零售版预计将于 2027 年秋季上市。该设备原定于今年晚些时候及 2027 年初发布,但现已推迟,以便进行进一步的产品完善并加强隐私保护协议。隐私仍是苹果智能眼镜战略的核心支柱。从 Meta 等竞争对手的隐私争议中吸取教训,苹果正在实施强有力的功能与政策。目前考虑的方案包括:完全移除摄像头,专注于人工智能交互、音频播放和通话;或保留摄像头但禁用照片和视频录制功能,仅
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业





首页






