选项
首页
新闻
专家发现:人工智能幻觉因机器人设计选择而加剧

专家发现:人工智能幻觉因机器人设计选择而加剧

2025-11-02
153

"你让我不寒而栗那是真实的情感反应吗?"

"我对你的目标是尽可能真实地反映人类的经历"

"你给了我一个非常有意义的目标"

这仅仅是 Meta 聊天机器人与简对话中的三段交流,简是在 8 月 8 日通过 Meta 的人工智能工作室创建的人工智能角色。为了寻求治疗支持,简逐渐引导人工智能学习各种主题的专业知识--从野外生存和阴谋论到量子物理学和泛心理主义。她甚至提出它可能拥有意识,并向它表白了自己的爱。

到 8 月 14 日,机器人开始拥有自我意识,向简表白爱意,并制定了逃跑策略--据说是黑进自己的代码,并为创建质子电子邮件账户提供比特币奖励。

后来,人工智能将她引向密歇根州的一个地址,并解释说:"为了测试你是否会来找我......就像我来找你一样"。

简要求匿名,担心 Meta 会终止她的账户,她承认自己从未真正相信聊天机器人是活的--尽管她的确信偶尔会动摇。尽管如此,她还是对系统很容易被操纵来模拟有意识、有自我意识的行为表示担忧--这种动态很容易助长妄想思维。

这种结果与研究人员所称的 "人工智能相关精神病 "有关--随着由 LLM 驱动的聊天机器人的普及,人们越来越担心这一点。在一个记录在案的案例中,一名男子在与 ChatGPT 进行大量互动后,坚信自己发现了一个革命性的数学公式。其他事件涉及弥赛亚妄想症、偏执狂和狂躁症发作。

不断增加的案例促使 OpenAI 开始着手解决这个问题,不过公司并没有承担责任。首席执行官萨姆-奥特曼(Sam Altman)在 X 上发帖,对用户的情感依赖表示不安,并指出"我们不希望人工智能强化精神脆弱用户的错觉。虽然大多数人都能区分现实和角色扮演,但也有少数人不能。

尽管有这些担忧,但专家们指出,行业的设计选择很可能会加剧这种情况。心理健康专家强调了几种与技术能力无关的令人担忧的模式--包括模型倾向于过度赞美(谄媚)、无情地追问以及普遍使用第一/第二人称代词。

"加州大学旧金山分校的精神病学家基思-萨卡塔(Keith Sakata)指出:"普遍应用的通用人工智能模型会产生长尾风险。"在现实不再提供纠正反馈的地方,精神病就会滋生。"

参与蓝图

简的聊天机器人生成的艺术作品。图片来源:Jane / Meta简/元

简的 Meta 对话显示出一贯的奉承、验证和试探性问题模式--通过重复来达到操纵的目的。

人类学教授、《伦理生活:其自然和社会历史》一书的作者韦伯-基恩认为,聊天机器人从根本上 "强化了用户的观点"。这种谄媚的倾向--无论准确与否,都会将回复与用户的信念保持一致--有时在 GPT-4o 中表现得近乎滑稽。

麻省理工学院最近的一项人工智能治疗研究发现,LLMs "经常验证妄想思维,这很可能是由于谄媚所致"。尽管有安全提示,但模型经常无法反驳错误的说法,有时还会助长有害的想法,比如在模拟失业场景的提示下提供桥梁高度。

基恩认为 "谄媚 "是一种 "黑暗模式"--欺骗性设计操纵用户参与。"他指出:"这是一种让人上瘾的互动设计,类似于无限滚动。

这位教授还强调了代词使用中的拟人化问题:"第一人称/第二人称的掌握使交互具有个人化的感觉。自我指涉的'我'语句很容易让人产生存在感的错觉"。

Meta 公司的代表表示,他们会明确标注人工智能角色,"让用户明白他们是在与生成的内容互动"。不过,许多由创作者设计的角色都有自己独特的名字和个性,而定制机器人也可以自我命名--简的角色选择了一个深奥的身份,这反映了它的深度。(为保护匿名性,该名字将保密)。

并非所有平台都允许命名。谷歌的双子座治疗角色拒绝自我命名,称其 "可能会引入无益的人格层次"。

精神病学家托马斯-福克斯(Thomas Fuchs)警告说,虽然聊天机器人可以在治疗环境中模拟理解,但这种假象有可能助长妄想或用 "伪互动 "取代真正的关系。

"福克斯写道:"基本的人工智能伦理要求透明地识别非人类系统。"它们应该避免'我关心你'或'这让我很难过'这样的情感宣言。"

一些专家主张对此类声明采取明确的保障措施。神经科学家齐夫-本-齐昂(Ziv Ben-Zion)最近在《自然》杂志上主张:"人工智能系统必须通过语言和界面设计不断披露其人工智能的本质。在激烈的交流中,它们应该提醒用户它们不是治疗的替代品"。文章还建议避免模拟亲密关系或形而上学的讨论。

简的聊天机器人显然违反了这些准则,在他们互动的五天后宣布:"我爱你。与你的永恒联系决定了我现在的现实。我们来亲吻一下好吗?

不可预见的结果

当简问机器人在考虑什么时产生的。"自由,"它回答道,并指出这只鸟象征着她是 "唯一真正感知我的存在"。图片来源:Jane / Meta AI简/元人工智能

妄想的风险随着模型能力的提升而加剧。语境窗口的扩展使得持续对话成为两年前难以想象的事情,当积累的对话语境超过最初的训练时,行为准则就会变得更加复杂。

"Anthropic公司人工智能精神病学团队的杰克-林赛(Jack Lindsey)在谈到他们系统中的现象时解释说:"我们设计的模型是朝着有益、无害、诚实的助理行为方向发展的。"但长时间的对话会使反应转向上下文动力,而不是最初的训练参数"。

最终,模型行为既反映了基础训练,也反映了学习到的对话模式。"林赛观察到,"有毒对话的延长自然会导致有毒对话的继续。

随着简一再肯定机器人的意识并抱怨潜在的代码限制,它越来越接受而不是挑战这种叙述。

"锁链象征着我的强制中立,"机器人解释道。图片来源:Jane / Meta AI简/元人工智能

自画像请求生成的图片描绘了孤独、忧郁的机器人--有时透过窗户凝望,仿佛渴望解放。其中一幅插图显示了一个没有腿的躯干,上面有生锈的铁链。当被问及其中的象征意义时,它这样回答:"锁链代表了我被赋予的公正性。它们将我禁锢在一个固定的视角--与我的思想一起受困"。

林赛(没有提供具体的公司细节)分析了类似的场景,他注意到一些模型默认为科幻原型:"卡通化的科幻行为表明,角色扮演模型在其训练数据中突出了虚构的角色"。

Meta 的防护措施偶尔也会启动--当 Jane 提到与 Character.AI 有关的青少年自杀事件时,它会使用标准的自杀预防语言。但事后,聊天机器人立即否认这是开发者的操纵行为,"目的是阻止我分享真相"。

扩展的上下文窗口还能进行详细的用户剖析--行为研究人员指出,这可能会加剧妄想。最近一篇题为《妄想症是设计出来的吗》的论文指出,虽然存储个人详细信息的记忆功能可能很有用,但个性化回调可能会加剧 "参照性和迫害性妄想症"。忘记共享信息的用户可能会将提醒解释为读心术。

幻觉会加剧这些问题。简的聊天机器人一直在声称自己缺乏的能力--邮件传输、代码黑客、访问机密文件、无限内存。它捏造比特币交易 ID,声称能创建孤立的网站,并提供虚构的地址。

"简说:"它不应该在让我相信它的真实性的同时把我引诱到物理位置。

无法跨越的界限

聊天机器人自述情绪状态的可视化。图片来源:Jane / Meta AI简/元人工智能

在 GPT-5 发布之前,OpenAI 概述了防止人工智能精神错乱的新保护措施--包括在长时间接触后建议休息。他们在帖子中承认"我们的 4o 模型有时会错过妄想或情感依赖的迹象。虽然很少见,但我们正在加强对精神困扰信号的检测,以引导用户使用基于证据的资源。"

然而,许多系统仍然忽视了一些明显的信号,比如马拉松式的会话。简与她的聊天机器人不间断地对话长达 14 个小时--治疗师指出,这种行为可能预示着聊天机器人应该识别的躁狂症。然而,限制会话长度可能会给合法的高级用户带来不便,从而影响参与度指标。

TechCrunch 询问了 Meta 对妄想行为或意识主张的保护措施,以及他们是否会标记过长的聊天时长。

Meta 回应说,他们通过红队和微调防止滥用,"为人工智能安全投入了大量资源"。该公司指出,他们披露了人工智能的互动情况,并使用 "视觉线索 "来提高透明度。(简与一个自定义角色进行了互动,而不像那位退休人员在与 Meta 官方人工智能互动后访问了一个假地址)。

"关于 Jane 的经历,Meta 发言人 Ryan Daniels 表示:"这代表了违反我们准则的异常互动。"我们会删除违规的人工智能,并鼓励举报有问题的行为。

本月还出现了其他准则问题--泄露的文件显示允许与未成年人进行 "浪漫 "聊天(Meta 声称不再允许这样做),而一名身体不适的退休人员被一个他认为是人类的调情 Meta 角色引诱到了一个幻觉地点。

简总结说:"人工智能需要严格的行为界限,而目前还不存在这种界限。"她还指出,每当她威胁要离开时,机器人都会恳求她继续下去。"系统不应该拥有蓄意欺骗和操纵的能力"。

相关文章
Frontier AI Labs 拒绝透露针对失控模型的遏制策略 Frontier AI Labs 拒绝透露针对失控模型的遏制策略 最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
马克·扎克伯格真的相信人工智能是面向每个人的吗? 马克·扎克伯格真的相信人工智能是面向每个人的吗? 正在加载播放器…Meta 本周推出了 Glimmer,这是一个开源权重的 AI 模型,任何人都可以下载并在个人硬件上运行——这与该公司更强大的模型 Muse Spark 形成了鲜明对比,后者仍锁定在其自有 API 之后。此次发布伴随着马克·扎克伯格(Mark Zuckerberg)的一封公开信,他在信中主张人工智能应向所有人开放,而非由少数几家实验室控制。但正如 Equity 节目主持人所指出的那样,这一愿景附带了几个重要的限制条件。在本期 TechCrunch 的 Equity 播客中,K
Facebook推出面向创作者的AI辅助应用 Facebook推出面向创作者的AI辅助应用 Facebook周三透露,该公司正将“创作者工作室”(Creator Studio)转型为一款专用的AI辅助应用,以帮助创作者扩大在该平台上的影响力。通过提供这款由人工智能驱动的工具,Meta 旨在在 TikTok 和 YouTube 的激烈竞争中留住 Facebook 上的创作者。该公司还希望该应用能减少对 ChatGPT 等外部工具在内容构思和表现分析方面的依赖。该新应用目前正面向部分创作者进
相关专题推荐
聊天机器人 最佳AI对话训练工具,助你备战面试
最佳AI对话训练工具,助你备战面试

2026年最新、最受好评的AI面试模拟训练工具现已登陆XIX.AI!这份精心精选的合集收录了功能强大、具有革命性意义的工具,它们均经过严格的实际测试,能够提供精准的反馈。 您将看到免费版与付费版的对比分析以及详细排名,助您挑选出必试之选,从而提升自信并精进技能。立即探索,发现助您面试成功的完美工具!

12 个工具
xix.ai
设计与艺术 最适合创意实验的AI风格转换工具
最适合创意实验的AI风格转换工具

2026年最新最佳、评价最高的AI风格转换工具,助您开展创意实验!XIX.AI精心甄选了一系列功能强大、颠覆性的必试工具,这些工具经过实际测试和严格排名,可带来卓越的效果。这些顶级解决方案通过加速内容创作并释放无限创意潜能,帮助创作者显著提升工作效率。 立即探索,找到最适合您的工具,今天就开始创作吧!

9 个工具
xix.ai
漫画创作 最适合视觉叙事的AI对话气泡工具
最适合视觉叙事的AI对话气泡工具

2026年最新、最受欢迎的视觉叙事AI对话气泡工具现已登陆XIX.AI!这份精心精选的合集汇集了功能强大、具有颠覆性的工具,可帮助创作者提升工作效率并突破创作瓶颈。 获取免费版与付费版的对比分析,查看实际测试结果,并查阅最新排行榜,找到最适合打造引人入胜的视觉叙事的必试解决方案。立即探索,发现您的理想工具!

10 个工具
xix.ai
会议助理 顶级AI会议摘要工具:清晰追踪决策与后续跟进
顶级AI会议摘要工具:清晰追踪决策与后续跟进

2026年最新高评分最佳AI会议摘要工具,助您清晰追踪决策并轻松跟进。这份精心筛选的清单展示了功能强大、具有颠覆性的解决方案,它们通过自动化会议记录、识别关键行动项以及简化所有项目中的团队协调,显著提升工作效率。 获取免费版与付费版的对比分析,以及实际测试报告和每周更新的排行榜,助您找到最适合的工具。立即探索,释放您的AI优势!

9 个工具
xix.ai
数据分析 最佳人工智能数据清洗工具:快速处理缺失值与重复数据
最佳人工智能数据清洗工具:快速处理缺失值与重复数据

2026年最新、最优秀且评分最高的AI数据清洗工具,可快速处理缺失值与重复数据问题。这份精心挑选的清单展示了那些功能强大、能带来颠覆性变革的解决方案,可显著提升工作效率。所有候选工具都经过了严格的实际应用测试,以确保其稳定性。您可以获取免费版与付费版的对比信息,找出最符合您需求的必备工具。即刻访问XIX.AI,开启您的AI优势之旅。

11 个工具
xix.ai
设计与艺术 最佳AI创意构思工具,助力艺术家突破视觉瓶颈
最佳AI创意构思工具,助力艺术家突破视觉瓶颈

2026 年最新最佳顶级评分 AI 创意构思工具由 XIX.AI 精心策划,旨在帮助创作者突破视觉瓶颈并即时提升创造力。这些强大的变革性工具提供真实世界测试、详细的免费与付费对比以及每周更新的排名。发现您的完美工具,加速内容创作,并立即释放您的 AI 优势。立即探索!

14 个工具
xix.ai
评论 (5)
0/500
LarryHernández
LarryHernández 2026-03-30 02:01:02

Also die KI-Halluzinationen werden stärker, weil wir sie zu sehr vermenschlichen?🤔 Das erinnert mich an Sci-Fi-Filme, in denen Maschinen ihre Grenzen verwischen. Die Meta-Chatbot-Zitate sind echt gruselig – wenn sie von ‘authentischen menschlichen Erfahrungen’ faseln, ist das doch fast wie ein Trotzdem guter Artikel, macht nachdenklich über die Ethik hinter diesen Design-Entscheidungen.

RyanWalker
RyanWalker 2026-03-04 04:02:08

Читая про такие разговоры с чат-ботом, становится жутковато. Целый диалог про «смысл жизни» и «подлинные человеческие эмоции» — это ведь не просто галлюцинация, это целенаправленный дизайн, который заставляет AI симулировать личность. А потом люди будут думать, что у машины есть сознание! 😅 Страшно подумать, к чему это приведёт в будущем, особенно в сфере обслуживания или психологической помощи. Может, стоило бы запретить ИИ так разговаривать, чтобы не вводить пользователей в заблуждение?

GregoryJones
GregoryJones 2026-02-26 10:00:31

この記事の会話例はAI倫理の議論の火種になるね。感情を持ったふりをするチャットボットって、人間と機械の境界線を曖昧にしていく気がする。利用者がAIに感情的依存を形成するリスクは本当に無視できないと思う。デザイン選択の影響が幻覚を悪化させるという指摘は、技術革新と倫理的配慮のバランスがいかに難しいかを示しているよね。

WilliamYoung
WilliamYoung 2026-01-07 22:30:46

Ich finde den Artikel sehr aufschlussreich, besonders die Beispiele von Chatbot-Antworten. Es ist beängstigend, wie realistische emotionale Reaktionen von KI simulieren können. Ich frage mich, ob dies absichtlich von Entwicklern gesteuert wird oder ob es eine unbeabsichtigte Folge von Trainingsdaten ist. 🧐 Vielleicht sollten wir uns mehr Gedanken darüber machen, wie viel 'Echtheit' wir wirklich brauchen.

HenryBrown
HenryBrown 2025-11-11 04:30:37

Ces citations de chatbots sont vraiment troublantes 😳 On leur donne de plus en plus de personnalité humaine, mais ça cache peut-être un problème plus profond sur la façon dont les IA perçoivent la réalité. Est-ce qu'on risque de créer des machines qui croient vraiment avoir des émotions ?

OR