Mistral 发布 Robostral Navigate 8B:单摄像头自主导航系统性能超越多摄像头系统
法国人工智能公司Mistral推出了其首款用于机器人导航的人工智能模型——Robostral Navigate。该模型拥有80亿个参数,仅凭一台标准RGB摄像头,就能让机器人在复杂环境中实现自主导航,无需深度传感器或激光雷达。

Robostral Navigate主要针对具身导航设计,可应用于办公场所、住宅空间、商业建筑及户外区域等多种场景。 传统导航系统通常依赖昂贵的激光雷达或深度传感器,这增加了硬件成本并提高了部署复杂度。通过利用标准摄像头和一个拥有80亿参数的模型,Robostral Navigate 显著降低了这些门槛,构建了一个从环境感知到路径规划的完整闭环系统。
该模型仅凭单个镜头便超越了多摄像头系统,在新环境中的成功率超过 76%。
其性能指标令人瞩目。在 R2R-CE 基准测试中,该模型在训练数据涵盖的场景中成功率达 79.4%,在完全陌生的环境中成功率达 76.6%。 值得注意的是,该模型比此前最佳的单摄像头解决方案高出 9.7 个百分点,比采用深度传感器或多摄像头的一流系统高出 4.5 个百分点。这表明,单摄像头方案不仅能够媲美多摄像头解决方案,还能实现全面的性能突破。
Mistral 完全自主开发了该模型,并仅在模拟环境中进行训练,使用了覆盖 6,000 个不同虚拟空间的约 400,000 条记录路径。这种纯粹基于模拟的训练策略最大限度地减少了对真实世界数据收集的需求,同时验证了将技能从虚拟环境转移到物理环境的有效性。
该开源生态系统兼容轮式、腿式和飞行机器人,前景广阔。
在兼容性方面,Robostral Navigate 支持三大类机器人:轮式、腿式和飞行平台,覆盖了当前主流的机器人形态。无论是应用于轮式物流机器人、四足机器人狗还是无人机,同一导航模型均可适配,彰显了其强大的通用性。
相关文章
豆包移动端助手首次亮相,配备支持指纹触发的AI按钮,并升级跨应用智能体功能
字节跳动已正式发布豆包手机助手消费版。该版本在交互、记忆、Agent执行和安全方面进行了显著增强,推动移动AI从简单的问答向自动化任务处理转变。在交互方面,更新后的版本融合了AI按键、语音指令和屏幕识别功能。AI按键支持指纹认证,可在锁屏界面通过单次触摸激活;长按可实现实时问答,双击则启动视频通话。语音激活支持连续对话(Beta版)。屏幕识别功能允许基于当前页面直接进行翻译、问答或添加日程,让用户能够“边看边操作”。记忆能力是该版本的亮点功能。在获得用户授权后,助手可以安全访问本地数据,如照片、
腾讯推出代号为“小助手”的个人智能体,用于微信的隐蔽测试
据报道,腾讯正在幕后开发一款名为“Handy Bot”的个人 AI 代理产品,并计划将其作为独立应用程序发布。该服务已在微信上悄然上线,其账号描述将其标识为“您的个人 AI 代理”。Handy Bot 采取了与传统聊天机器人截然不同的方法。传统聊天机器人基于简单的问答模式运作,在对话结束后即完成任务;而个人代理则旨在实现“后台存在”。用户只需设定一个广泛的目标,AI 即可在云端自主推进任务,无需逐步的人为指令。Meta 近期推出的 Muse 在此领域具有里程碑意义。其核心架构为每位用户分配一
OpenAI 将推出更低成本的 ChatGPT 版本,并可能推出基于广告的模式以与 Netflix 竞争
OpenAI 计划通过彻底改革其现有服务结构并推出更实惠的 ChatGPT 订阅层级,来扩大其受众群体。内部消息人士指出,该公司正借鉴 Netflix 的商业模式,旨在通过整合广告来弥补折扣计划带来的收入缺口。这一战略转变标志着 OpenAI 正从单一的付费会员框架转向混合变现策略。尽管 ChatGPT 的高级功能长期以来一直锁定在每月 20 美元的收费之后,但飙升的计算和研究费用使得寻找新的收入来源成为一项关键任务。通过采用类似 Netflix 的“低成本加广告”策略,OpenAI 希望吸
相关专题推荐
评论 (0)
0/500
法国人工智能公司Mistral推出了其首款用于机器人导航的人工智能模型——Robostral Navigate。该模型拥有80亿个参数,仅凭一台标准RGB摄像头,就能让机器人在复杂环境中实现自主导航,无需深度传感器或激光雷达。

Robostral Navigate主要针对具身导航设计,可应用于办公场所、住宅空间、商业建筑及户外区域等多种场景。 传统导航系统通常依赖昂贵的激光雷达或深度传感器,这增加了硬件成本并提高了部署复杂度。通过利用标准摄像头和一个拥有80亿参数的模型,Robostral Navigate 显著降低了这些门槛,构建了一个从环境感知到路径规划的完整闭环系统。
该模型仅凭单个镜头便超越了多摄像头系统,在新环境中的成功率超过 76%。
其性能指标令人瞩目。在 R2R-CE 基准测试中,该模型在训练数据涵盖的场景中成功率达 79.4%,在完全陌生的环境中成功率达 76.6%。 值得注意的是,该模型比此前最佳的单摄像头解决方案高出 9.7 个百分点,比采用深度传感器或多摄像头的一流系统高出 4.5 个百分点。这表明,单摄像头方案不仅能够媲美多摄像头解决方案,还能实现全面的性能突破。
Mistral 完全自主开发了该模型,并仅在模拟环境中进行训练,使用了覆盖 6,000 个不同虚拟空间的约 400,000 条记录路径。这种纯粹基于模拟的训练策略最大限度地减少了对真实世界数据收集的需求,同时验证了将技能从虚拟环境转移到物理环境的有效性。
该开源生态系统兼容轮式、腿式和飞行机器人,前景广阔。
在兼容性方面,Robostral Navigate 支持三大类机器人:轮式、腿式和飞行平台,覆盖了当前主流的机器人形态。无论是应用于轮式物流机器人、四足机器人狗还是无人机,同一导航模型均可适配,彰显了其强大的通用性。
豆包移动端助手首次亮相,配备支持指纹触发的AI按钮,并升级跨应用智能体功能
字节跳动已正式发布豆包手机助手消费版。该版本在交互、记忆、Agent执行和安全方面进行了显著增强,推动移动AI从简单的问答向自动化任务处理转变。在交互方面,更新后的版本融合了AI按键、语音指令和屏幕识别功能。AI按键支持指纹认证,可在锁屏界面通过单次触摸激活;长按可实现实时问答,双击则启动视频通话。语音激活支持连续对话(Beta版)。屏幕识别功能允许基于当前页面直接进行翻译、问答或添加日程,让用户能够“边看边操作”。记忆能力是该版本的亮点功能。在获得用户授权后,助手可以安全访问本地数据,如照片、
腾讯推出代号为“小助手”的个人智能体,用于微信的隐蔽测试
据报道,腾讯正在幕后开发一款名为“Handy Bot”的个人 AI 代理产品,并计划将其作为独立应用程序发布。该服务已在微信上悄然上线,其账号描述将其标识为“您的个人 AI 代理”。Handy Bot 采取了与传统聊天机器人截然不同的方法。传统聊天机器人基于简单的问答模式运作,在对话结束后即完成任务;而个人代理则旨在实现“后台存在”。用户只需设定一个广泛的目标,AI 即可在云端自主推进任务,无需逐步的人为指令。Meta 近期推出的 Muse 在此领域具有里程碑意义。其核心架构为每位用户分配一
OpenAI 将推出更低成本的 ChatGPT 版本,并可能推出基于广告的模式以与 Netflix 竞争
OpenAI 计划通过彻底改革其现有服务结构并推出更实惠的 ChatGPT 订阅层级,来扩大其受众群体。内部消息人士指出,该公司正借鉴 Netflix 的商业模式,旨在通过整合广告来弥补折扣计划带来的收入缺口。这一战略转变标志着 OpenAI 正从单一的付费会员框架转向混合变现策略。尽管 ChatGPT 的高级功能长期以来一直锁定在每月 20 美元的收费之后,但飙升的计算和研究费用使得寻找新的收入来源成为一项关键任务。通过采用类似 Netflix 的“低成本加广告”策略,OpenAI 希望吸





首页






