浙江大学推出沉浸式角色扮演框架,旨在让人工智能交互更自然

人工智能角色扮演正从简单的文本对话,发展为丰富且沉浸式的剧情体验。 浙江大学与腾讯优图实验室的研究人员近期推出了AdaMARP,这是一个自适应多智能体交互框架,旨在解决当前大型语言模型角色扮演中的关键缺陷,例如环境感知能力薄弱和叙事僵化等问题。该框架赋予了AI如同导演般的场景管理与叙事能力。该研究成果已被国际会议ACL 2026录用。
核心痛点:缺失“环境”与“导演”
在当今的AI角色扮演中,用户虽可与历史或文学人物对话,但互动往往局限于静态场景内的文字交流。例如在侦探场景中,传统AI系统表现得如同重复对话的机器,既无法从地毯上的蜡渍等环境线索中进行推理,也无法处理多角色轮次和场景转换等复杂的叙事需求。这种空洞的模式导致用户无法感受到真实的沉浸感或叙事张力。
AdaMARP框架:四通道消息与动态调度
为打破这一僵局,研究团队设计了一套全新的交互逻辑。首先,AdaMARP引入了“四通道消息格式”,将每轮交互分解为“思想——行动——环境——言语”。AI不再仅输出对话,而是将环境氛围(如摇曳的煤气灯)、内心独白和肢体语言交织成完整的因果链。
其次,该框架包含一个充当叙事导演的“场景管理器”。它具备五项核心能力:初始化场景、选择发言者、切换场景、动态引入新角色以及结束交互。这使得AI能够自主决定何时从犯罪现场转移到目击者家中,或何时让新嫌疑人推门而入。
训练与评估:从文学到模拟
为了赋予AI真正的表演和导演能力,研究团队构建了高质量数据集AdaRPSet和AdaSMSet。这些数据集包含来自81部经典文学作品的深度人物档案和交互轨迹,以及20个不同主题的合成情节。这确保了模型在掌握动态调度逻辑的同时,也能学习文学特质。
此外,团队引入了名为AdaptiveBench的补充评估框架。与传统的单轮对话评估不同,AdaptiveBench在轨迹层面对模型进行评分,重点关注角色一致性、环境感知以及叙事进展的自然度。这为AI在复杂长文本交互中的表现提供了全面评估。
该框架为侦探推理和冒险叙事等沉浸式交互场景开辟了新的技术路径。通过深度融合环境与叙事逻辑,AI正从简单的聊天助手演变为具备先进创造性意识的数字表演者。
相关文章
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
加利福尼亚州自动驾驶合规:罚单、地理围栏和100万英里的新时代
Guident公司在南佛罗里达州运营一辆AuveTech自动驾驶班车,利用其远程监控技术管理西棕榈滩的一条4英里路线和博卡拉顿的一条1英里路线。| 图片来源:Guident加利福尼亚州正在重新定义无人驾驶车辆的监管格局,正逐渐摆脱科技行业“快速行动,打破常规”的思维模式,转向严格的问责制和严苛的行驶里程要求。Guident执行董事长兼首席执行官哈罗德·布劳恩(Harold Braun)在《机器人报
相关专题推荐
评论 (0)
0/500

人工智能角色扮演正从简单的文本对话,发展为丰富且沉浸式的剧情体验。 浙江大学与腾讯优图实验室的研究人员近期推出了AdaMARP,这是一个自适应多智能体交互框架,旨在解决当前大型语言模型角色扮演中的关键缺陷,例如环境感知能力薄弱和叙事僵化等问题。该框架赋予了AI如同导演般的场景管理与叙事能力。该研究成果已被国际会议ACL 2026录用。
核心痛点:缺失“环境”与“导演”
在当今的AI角色扮演中,用户虽可与历史或文学人物对话,但互动往往局限于静态场景内的文字交流。例如在侦探场景中,传统AI系统表现得如同重复对话的机器,既无法从地毯上的蜡渍等环境线索中进行推理,也无法处理多角色轮次和场景转换等复杂的叙事需求。这种空洞的模式导致用户无法感受到真实的沉浸感或叙事张力。
AdaMARP框架:四通道消息与动态调度
为打破这一僵局,研究团队设计了一套全新的交互逻辑。首先,AdaMARP引入了“四通道消息格式”,将每轮交互分解为“思想——行动——环境——言语”。AI不再仅输出对话,而是将环境氛围(如摇曳的煤气灯)、内心独白和肢体语言交织成完整的因果链。
其次,该框架包含一个充当叙事导演的“场景管理器”。它具备五项核心能力:初始化场景、选择发言者、切换场景、动态引入新角色以及结束交互。这使得AI能够自主决定何时从犯罪现场转移到目击者家中,或何时让新嫌疑人推门而入。
训练与评估:从文学到模拟
为了赋予AI真正的表演和导演能力,研究团队构建了高质量数据集AdaRPSet和AdaSMSet。这些数据集包含来自81部经典文学作品的深度人物档案和交互轨迹,以及20个不同主题的合成情节。这确保了模型在掌握动态调度逻辑的同时,也能学习文学特质。
此外,团队引入了名为AdaptiveBench的补充评估框架。与传统的单轮对话评估不同,AdaptiveBench在轨迹层面对模型进行评分,重点关注角色一致性、环境感知以及叙事进展的自然度。这为AI在复杂长文本交互中的表现提供了全面评估。
该框架为侦探推理和冒险叙事等沉浸式交互场景开辟了新的技术路径。通过深度融合环境与叙事逻辑,AI正从简单的聊天助手演变为具备先进创造性意识的数字表演者。
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






