蚂蚁灵波发布LingBot-Depth 2.0及视觉基座模型LingBot-Vision
蚂蚁灵波发布新一代空间感知模型LingBot-Depth 2.0,配套开源视觉基座模型LingBot-Vision,并与奥比中光合作推动产业落地。
AI 编撰 · 内容基于所列来源,重要信息请以原文为准
蚂蚁灵波于今日正式发布新一代空间感知模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身LingBot-Depth 2.0,并同步开源把代码、数据集或硬件设计公开给所有人免费使用。机器人公司常用开源来换取开发者和科研生态的支持。◆ 小白科普 · 现身视觉基座模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身LingBot-Vision。LingBot-Depth 2.0的训练数据用来「喂」给 AI 模型学习的教材。对机器人来说,主要是「看到的画面 + 做出的动作」一一配对的操作示范。◆ 小白科普 · 现身从1.0版本的300万扩充至1.5亿,在深度补全基准16项测评中获得12项第一。针对室内大面积深度缺失场景,深度误差较上一代减半(RMSE从0.132降至0.062),在玻璃、镜面、透明物体等场景中表现突出。该模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身已通过奥比中光深度视觉实验室认证,基于奥比中光Gemini 330系列双目3D相机,在边缘清晰度、物体轮廓完整性等方面明显提升。
LingBot-Vision是业内首个将“边界结构”作为预训练目标的视觉基础模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身,预训练语料为1.6亿张图像,比DINOv3小一个数量级。此次开源了ViT-G/L/B/S四个版本,具备“一模多用”的通用能力。商业化方面,蚂蚁灵波与奥比中光深度合作,奥比中光RGB-D版EGO设备将适配LingBot-Depth的数采版本,后续将集成更高版本商业模型。奥比中光还将推出集成LingBot-Depth的SDK产品,并计划于年底推出集成商业版的一体化相机产品。目前,两款模型的技术报告和LingBot-Vision权重已开源。
