美国禁止Anthropic模型并非针对AI越狱

美国政府最近致Anthropic公司的一封执法函——该函实际上迫使该公司在周末前将其最新的人工智能模型下线——应成为对任何美国科技公司(无论是否为人工智能实验室)的严峻警告。
简要回顾如下:上周五下午,美国商务部向Anthropic公司发送了一封信函,援引了一项鲜为人知的出口管制规定,以未指明的国家安全担忧为由,禁止非美国公民(包括Anthropic公司自己的员工)访问Fable 5和Mythos 5模型。 Anthropic表示,他们认为这封信与绕过模型的安全防护机制有关,但由于信中缺乏具体细节,因此无法确定。该信函尚未公开。
作为回应,Anthropic 关闭了面向所有客户的这两款旗舰模型,以确保遵守该指令。结果,美国政府通过一项看似无需法院批准的迅速、单方面行动,成功迫使一家科技公司将其模型下线。
特朗普政府周五的干预表明,人工智能行业并非免疫于政府干预。这也向科技界传递了一个更广泛的信息:要么遵守规定,要么我们将关闭贵公司及其产品。
据Axios援引消息人士称,上周末两大阵营之间局势紧张,暗示是Anthropic与特朗普政府之间的“性格差异”——而非AI产品中的技术缺陷——触发了这项出口指令。
周末曝光的新细节,进一步让政府原本就颇具争议的理由蒙上了阴影。
网络安全资深专家、研究员兼 Luta Security 创始人凯蒂·穆苏里斯(Katie Moussouris)在一篇博客文章中写道,Anthropic 最近向她分享了一份安全研究人员撰写的论文的私有副本,该论文描述了 Fable 5 中据称存在的安全防护机制绕过漏洞。 (《华尔街日报》报道称,该论文的作者是亚马逊的安全研究人员。)穆苏里斯表示,Anthropic曾主动联系她,征求她对该论文的看法。
在博客文章中,穆苏里斯描述了研究人员如何触发该安全防护机制的绕过,但指出该绕过行为本身“本不应触发出口管制”。 关键区别在于,要求AI模型“审查代码中的安全问题”与要求它“修复这段代码”之间存在差异。即使问题表述略有不同,最终结果在很大程度上也是相同的。
“论文中描述的行为无法得到实质性的修复,任何修复尝试只会削弱该模型的防御能力,”穆苏里斯表示。她批评该出口管制指令仓促、粗暴且方向错误。
此后,穆苏里斯与数十位顶尖安全研究人员和专家共同呼吁特朗普政府撤销该出口管制令,称这一剥夺美国网络防御者先进网络安全能力的举措“十分危险”。
以往的政府也曾因认知缺口而做出过一刀切的决定。例如,2010年代,美国政府为修订涉及网络安全工具的出口法律(这些工具也可能被用于网络攻击)所采用的措辞过于宽泛,结果无意中几乎将合法的安全和漏洞研究都视为非法。
然而,特朗普政府的这项指令似乎带有报复性质。
《科技政策新闻》(Tech Policy Press)主编贾斯汀·亨德里克斯表示,特朗普政府的这一举措“可能会让外国政府对美国人工智能在关键应用中的可靠性产生担忧”。其传递的信息是:美国的人工智能公司无法在不受美国政府干预的情况下被信任地运营。
特朗普政府尚未证实为何援引出口管制指令。是官员们误读了报告并反应过度了吗?还是亚马逊首席执行官安迪·贾西向政府高级官员说了什么,导致了这一反应——无论是出于谨慎还是报复? 是翻译过程中出现了疏漏,还是政府以此向Anthropic施压——毕竟双方关系本就紧张?白宫可能并未意识到这封信中要求的深远影响,官员们现在正忙于弥补他们造成的损害。
引用亨德里克斯的话说:“当前的氛围充斥着怀疑,人们怀疑高级官员正基于个人和政治因素偏袒特定对象。”其后果是,政府在对美国制造软件的发布施加多大控制方面,树立了一个危险的先例。
这次,政府将矛头指向了Anthropic;明天,目标就可能是任何其他公司。
相关文章
Anthropic 推出 Opus 4.8,新增动态工作流工具
Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。与此同时,OpenAI的
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
Anthropic 推出 Fable:一款更实惠、限制更少的 AI 模型
Anthropic 于周二推出了 Fable 和 Mythos 5.1,提供了其最新 AI 技术的配对迭代版本。除了性能提升外,更新后的 Fable 版本还减少了令牌使用量,并收紧了安全过滤器,以最大限度地减少误报限制。与其前身一样,Mythos 5.1 仅限于专注于网络安全或生命科学的已验证 Anthropic 合作伙伴。不受限制的 Fable 5.1 现在可通过云平台以及 Anthropic API 访问。一项关键更新是采用了零数据保留策略,使客户能够在不泄露数据的情况下,将 Anthr
相关专题推荐
评论 (0)
0/500

美国政府最近致Anthropic公司的一封执法函——该函实际上迫使该公司在周末前将其最新的人工智能模型下线——应成为对任何美国科技公司(无论是否为人工智能实验室)的严峻警告。
简要回顾如下:上周五下午,美国商务部向Anthropic公司发送了一封信函,援引了一项鲜为人知的出口管制规定,以未指明的国家安全担忧为由,禁止非美国公民(包括Anthropic公司自己的员工)访问Fable 5和Mythos 5模型。 Anthropic表示,他们认为这封信与绕过模型的安全防护机制有关,但由于信中缺乏具体细节,因此无法确定。该信函尚未公开。
作为回应,Anthropic 关闭了面向所有客户的这两款旗舰模型,以确保遵守该指令。结果,美国政府通过一项看似无需法院批准的迅速、单方面行动,成功迫使一家科技公司将其模型下线。
特朗普政府周五的干预表明,人工智能行业并非免疫于政府干预。这也向科技界传递了一个更广泛的信息:要么遵守规定,要么我们将关闭贵公司及其产品。
据Axios援引消息人士称,上周末两大阵营之间局势紧张,暗示是Anthropic与特朗普政府之间的“性格差异”——而非AI产品中的技术缺陷——触发了这项出口指令。
周末曝光的新细节,进一步让政府原本就颇具争议的理由蒙上了阴影。
网络安全资深专家、研究员兼 Luta Security 创始人凯蒂·穆苏里斯(Katie Moussouris)在一篇博客文章中写道,Anthropic 最近向她分享了一份安全研究人员撰写的论文的私有副本,该论文描述了 Fable 5 中据称存在的安全防护机制绕过漏洞。 (《华尔街日报》报道称,该论文的作者是亚马逊的安全研究人员。)穆苏里斯表示,Anthropic曾主动联系她,征求她对该论文的看法。
在博客文章中,穆苏里斯描述了研究人员如何触发该安全防护机制的绕过,但指出该绕过行为本身“本不应触发出口管制”。 关键区别在于,要求AI模型“审查代码中的安全问题”与要求它“修复这段代码”之间存在差异。即使问题表述略有不同,最终结果在很大程度上也是相同的。
“论文中描述的行为无法得到实质性的修复,任何修复尝试只会削弱该模型的防御能力,”穆苏里斯表示。她批评该出口管制指令仓促、粗暴且方向错误。
此后,穆苏里斯与数十位顶尖安全研究人员和专家共同呼吁特朗普政府撤销该出口管制令,称这一剥夺美国网络防御者先进网络安全能力的举措“十分危险”。
以往的政府也曾因认知缺口而做出过一刀切的决定。例如,2010年代,美国政府为修订涉及网络安全工具的出口法律(这些工具也可能被用于网络攻击)所采用的措辞过于宽泛,结果无意中几乎将合法的安全和漏洞研究都视为非法。
然而,特朗普政府的这项指令似乎带有报复性质。
《科技政策新闻》(Tech Policy Press)主编贾斯汀·亨德里克斯表示,特朗普政府的这一举措“可能会让外国政府对美国人工智能在关键应用中的可靠性产生担忧”。其传递的信息是:美国的人工智能公司无法在不受美国政府干预的情况下被信任地运营。
特朗普政府尚未证实为何援引出口管制指令。是官员们误读了报告并反应过度了吗?还是亚马逊首席执行官安迪·贾西向政府高级官员说了什么,导致了这一反应——无论是出于谨慎还是报复? 是翻译过程中出现了疏漏,还是政府以此向Anthropic施压——毕竟双方关系本就紧张?白宫可能并未意识到这封信中要求的深远影响,官员们现在正忙于弥补他们造成的损害。
引用亨德里克斯的话说:“当前的氛围充斥着怀疑,人们怀疑高级官员正基于个人和政治因素偏袒特定对象。”其后果是,政府在对美国制造软件的发布施加多大控制方面,树立了一个危险的先例。
这次,政府将矛头指向了Anthropic;明天,目标就可能是任何其他公司。
Anthropic 推出 Opus 4.8,新增动态工作流工具
Anthropic 于周四发布了 Opus 4.8,这是其旗舰公开模型的最新版本。该版本定价与前一版本相同,目前已在所有平台上开放使用。距离 Opus 4.7 发布仅过去 41 天,Anthropic 显著加快了开发周期,远超近期 Sonnet 和 Haiku 版本三至七个月的发布间隔。此次快速更新很可能是对 Opus 4.7 反响平平的回应——该版本曾令许多用户感到失望。与此同时,OpenAI的
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
Anthropic 推出 Fable:一款更实惠、限制更少的 AI 模型
Anthropic 于周二推出了 Fable 和 Mythos 5.1,提供了其最新 AI 技术的配对迭代版本。除了性能提升外,更新后的 Fable 版本还减少了令牌使用量,并收紧了安全过滤器,以最大限度地减少误报限制。与其前身一样,Mythos 5.1 仅限于专注于网络安全或生命科学的已验证 Anthropic 合作伙伴。不受限制的 Fable 5.1 现在可通过云平台以及 Anthropic API 访问。一项关键更新是采用了零数据保留策略,使客户能够在不泄露数据的情况下,将 Anthr





首页






