上传一张照片,瞬间构建3D世界:Ling Guang应用率先将世界模型带入移动端
只需一张照片和一部智能手机,你就能踏入一个由人工智能生成的世界。
4月27日,蚂蚁灵光应用正式推出“世界模型体验”功能,成为首个在移动端提供世界模型体验的AGI产品。 用户只需上传一张照片,即可在手机上探索长达60秒的3D世界,并能像玩手机游戏一样自由控制视角。 从发出指令到开始探索仅需几秒钟。这标志着业界首次实现了具备分钟级长期一致性和实时交互性的世界模型边缘部署,再次引领了AGI产品的行业风向。 灵光始终致力于突破智能的边界;此前,它推出了“闪电应用”功能,首次实现了在30秒内于移动设备上生成应用程序,引领了“随心编程”的潮流。

(操作步骤:打开灵光,点击左下角的“+”上传图片,然后选择“生成图片中的世界”即可开始探索。)
世界模型被视为通往AGI(通用人工智能)的关键路径,也是连接数字世界与物理世界的必经桥梁。灵光应用中的“体验世界模型”功能,由开源的Ant Lingbo LingBot-World-Fast世界模型提供支持。
灵光让您轻松体验世界模型。 打开应用,在聊天框中上传一张照片,系统会智能提示下一步操作——选择“生成图片中的世界”。或者,输入“从第一人称视角展示这个世界”等自然语言提示,模型将在几秒内开始生成。
进入世界模型体验后,Lingguang 提供了一个适合移动设备的双摇杆界面。左摇杆控制角色在 3D 场景中移动,右摇杆控制视角旋转,从而实现无缝探索。这种移动游戏玩家熟悉的操控方案,确保了沉浸式探索无需任何学习成本。
在移动设备上部署世界模型面临着巨大的工程挑战——高计算需求、严格的延迟限制以及硬件配置的差异。 “灵光”团队通过高效、低延迟的流式传输技术克服了这些挑战,将响应时间控制在100毫秒以内。这使用户能够在几秒内开始探索3D世界,彻底打破了“世界模型天生资源消耗大且不切实际”的固有观念。
“灵光”应用负责人蔡伟表示:“‘体验世界模型’功能是‘灵光’在突破智能边界征程中的又一步。 我们早前的‘Flash App’功能让用户仅需30秒即可通过自然语言生成完整的应用程序,使普通用户也能拥有曾经仅属于专业开发者的编程能力。灵光致力于不断探索这些前沿领域,发掘未被满足的需求,并为每个人带来卓越的AI体验。”
目前,灵光应用已在各大应用商店开放下载,用户可立即体验“世界模型”功能。
相关文章
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
相关专题推荐
评论 (0)
0/500
只需一张照片和一部智能手机,你就能踏入一个由人工智能生成的世界。
4月27日,蚂蚁灵光应用正式推出“世界模型体验”功能,成为首个在移动端提供世界模型体验的AGI产品。 用户只需上传一张照片,即可在手机上探索长达60秒的3D世界,并能像玩手机游戏一样自由控制视角。 从发出指令到开始探索仅需几秒钟。这标志着业界首次实现了具备分钟级长期一致性和实时交互性的世界模型边缘部署,再次引领了AGI产品的行业风向。 灵光始终致力于突破智能的边界;此前,它推出了“闪电应用”功能,首次实现了在30秒内于移动设备上生成应用程序,引领了“随心编程”的潮流。

(操作步骤:打开灵光,点击左下角的“+”上传图片,然后选择“生成图片中的世界”即可开始探索。)
世界模型被视为通往AGI(通用人工智能)的关键路径,也是连接数字世界与物理世界的必经桥梁。灵光应用中的“体验世界模型”功能,由开源的Ant Lingbo LingBot-World-Fast世界模型提供支持。
灵光让您轻松体验世界模型。 打开应用,在聊天框中上传一张照片,系统会智能提示下一步操作——选择“生成图片中的世界”。或者,输入“从第一人称视角展示这个世界”等自然语言提示,模型将在几秒内开始生成。
进入世界模型体验后,Lingguang 提供了一个适合移动设备的双摇杆界面。左摇杆控制角色在 3D 场景中移动,右摇杆控制视角旋转,从而实现无缝探索。这种移动游戏玩家熟悉的操控方案,确保了沉浸式探索无需任何学习成本。
在移动设备上部署世界模型面临着巨大的工程挑战——高计算需求、严格的延迟限制以及硬件配置的差异。 “灵光”团队通过高效、低延迟的流式传输技术克服了这些挑战,将响应时间控制在100毫秒以内。这使用户能够在几秒内开始探索3D世界,彻底打破了“世界模型天生资源消耗大且不切实际”的固有观念。
“灵光”应用负责人蔡伟表示:“‘体验世界模型’功能是‘灵光’在突破智能边界征程中的又一步。 我们早前的‘Flash App’功能让用户仅需30秒即可通过自然语言生成完整的应用程序,使普通用户也能拥有曾经仅属于专业开发者的编程能力。灵光致力于不断探索这些前沿领域,发掘未被满足的需求,并为每个人带来卓越的AI体验。”
目前,灵光应用已在各大应用商店开放下载,用户可立即体验“世界模型”功能。
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






