选项
首页
快讯
内容
FrankRoberts
FrankRoberts
2026-07-17

Tongyi Lab 发布了 Wan-Streamer v0.2,这是一款端到端多模态 AI 模型,可实现 550 毫秒的响应延迟,支持实时面对面交互。该模型将听、看、说和动作功能整合到单个 Transformer 中,视频分辨率提升至 640x368。 该流式架构可实现160毫秒的处理速度,支持全身数字人应用于辅导和咨询等场景。

Tongyi Lab 发布了 Wan-Streamer v0.2,这是一款端到端多模态 AI 模型,可实现 550 毫秒的响应延迟,支持实时面对面交互。该模型将听、看、说和动作功能整合到单个 Transformer 中,视频分辨率提升至 640x368。 该流式架构可实现160毫秒的处理速度,支持全身数字人应用于辅导和咨询等场景。
评论 (0)
0/300
OR