蚂蚁森林LingBot发布开源数据集,包含6台摄像头拍摄的200万张真实样本,规模达2.7T
3月31日,蚂蚁凌博科技正式开源了大规模RGB-D数据集LingBot-Depth-Dataset。该数据集包含300万对高质量样本,其中200万对来自真实环境,100万对为合成渲染数据。 该数据集总容量达2.71TB,涵盖六款主流深度摄像头的数据,是迄今为止基于真实场景的最大规模开源RGB-D数据集。此次发布将提供更丰富、更真实的数据,以推动具身智能、空间感知和3D视觉领域的研究。

(图:LingBot-Depth-Dataset 的样本示例。从上至下依次为:RGB 图像、传感器原始深度图以及 ground truth 深度图。该数据集同时提供原始深度信息和 ground truth 深度信息,为在真实世界条件下训练和评估模型提供了强有力的支持。)
长期以来,公开的深度数据集一直面临规模有限、真实场景覆盖不足以及依赖单一硬件类型等挑战。许多数据集主要由合成数据构成,在噪声模式、深度缺失和材质表现等方面与真实传感器数据存在显著差距,这阻碍了训练模型的实际部署。
LingBot-Depth-Dataset 通过提供大规模的真实场景数据,有效填补了空间感知领域中的这一数据缺口。 每个样本包含一张RGB图像、一张原始传感器深度图以及一张对应的 ground truth 深度图,可直接用于训练和评估深度估计及深度补全模型。该数据集支持六款主流深度相机——Orbbec 335、335L 以及 Intel RealSense D405、D415、D435、D455,有助于提升模型在不同设备和场景下的泛化能力与评估效果。
Ant Lingbo此前开源的高精度空间感知模型LingBot-Depth,正是以该数据集为核心数据进行训练的。与PromptDA和PriorDA等主流行业方法相比,LingBot-Depth在室内场景中将深度预测误差降低了70%以上,在稀疏深度补全任务中降低了约47%。 该模型部署后,可使商用深度摄像头在透明玻璃、反光表面和逆光等严苛条件下生成更完整、更平滑、更清晰的深度图,且无需任何硬件改装。在某些场景下,其性能可媲美高端工业级深度摄像头。
对于学术和研究机构而言,这一开源项目降低了数据采集与标注的门槛,加速了空间感知技术从研究向实际应用的转化。随着机器人技术和具身智能迅速融入物理环境,基于真实世界数据的大规模高质量数据集将成为推动行业持续进步的关键基础设施。
相关文章
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
相关专题推荐
评论 (0)
0/500
3月31日,蚂蚁凌博科技正式开源了大规模RGB-D数据集LingBot-Depth-Dataset。该数据集包含300万对高质量样本,其中200万对来自真实环境,100万对为合成渲染数据。 该数据集总容量达2.71TB,涵盖六款主流深度摄像头的数据,是迄今为止基于真实场景的最大规模开源RGB-D数据集。此次发布将提供更丰富、更真实的数据,以推动具身智能、空间感知和3D视觉领域的研究。

(图:LingBot-Depth-Dataset 的样本示例。从上至下依次为:RGB 图像、传感器原始深度图以及 ground truth 深度图。该数据集同时提供原始深度信息和 ground truth 深度信息,为在真实世界条件下训练和评估模型提供了强有力的支持。)
长期以来,公开的深度数据集一直面临规模有限、真实场景覆盖不足以及依赖单一硬件类型等挑战。许多数据集主要由合成数据构成,在噪声模式、深度缺失和材质表现等方面与真实传感器数据存在显著差距,这阻碍了训练模型的实际部署。
LingBot-Depth-Dataset 通过提供大规模的真实场景数据,有效填补了空间感知领域中的这一数据缺口。 每个样本包含一张RGB图像、一张原始传感器深度图以及一张对应的 ground truth 深度图,可直接用于训练和评估深度估计及深度补全模型。该数据集支持六款主流深度相机——Orbbec 335、335L 以及 Intel RealSense D405、D415、D435、D455,有助于提升模型在不同设备和场景下的泛化能力与评估效果。
Ant Lingbo此前开源的高精度空间感知模型LingBot-Depth,正是以该数据集为核心数据进行训练的。与PromptDA和PriorDA等主流行业方法相比,LingBot-Depth在室内场景中将深度预测误差降低了70%以上,在稀疏深度补全任务中降低了约47%。 该模型部署后,可使商用深度摄像头在透明玻璃、反光表面和逆光等严苛条件下生成更完整、更平滑、更清晰的深度图,且无需任何硬件改装。在某些场景下,其性能可媲美高端工业级深度摄像头。
对于学术和研究机构而言,这一开源项目降低了数据采集与标注的门槛,加速了空间感知技术从研究向实际应用的转化。随着机器人技术和具身智能迅速融入物理环境,基于真实世界数据的大规模高质量数据集将成为推动行业持续进步的关键基础设施。
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






