刚刚,首个空间原生的具身视觉基模开源!机器人更会看我们的世界了
中文摘要
蚂蚁灵波开源首个空间原生具身视觉基模LingBot-Vision及深度模型LingBot-Depth 2.0,显著提升机器人在复杂场景下的空间感知精度。
English Summary
Ant Group's Lingbo open-sourced LingBot-Vision and LingBot-Depth 2.0, enhancing robotic spatial perception in complex environments via space-native embodied vision base models.
Original Excerpt
📌 一句话摘要 蚂蚁灵波发布首个空间原生的具身视觉基模 LingBot-Vision 及深度模型 LingBot-Depth 2.0,通过边界强制预训练显著提升机器人在透明、远距离、复杂光照等场景下的空间感知精度,并已开源。 📝 详细摘要 文章报道蚂蚁灵波最新发布的空间原生视觉基模 LingBot-Vision 和深度补全模型 LingBot-Depth 2.0。文章从机器人视觉的四大难点(透明反光、小目标远距离、室内...