具身大模型 R1 时刻:LIBERO 终结者,99.9%背后的物理推理新范式
中文摘要
中国式具身大模型LaST-R1,隐空间物理推理,99.9%成功率。
English Summary
LaST-R1: Embodied AI model achieves 99.9% success with latent space physical reasoning.
Original Excerpt
📌 一句话摘要 LaST-R1 提出了一种新的具身大模型后训练范式,通过 LAPO 算法在隐空间中进行物理推理,让机器人先思考再行动,在 LIBERO 基准上达到 99.9% 的成功率。 📝 详细摘要 本文介绍了由至简动力、北大、港中文联合提出的 LaST-R1 框架,旨在解决现有具身大模型(VLA)泛化性差的问题。核心创新在于放弃了低效的语言思维链(CoT),转而在隐空间(Latent Space)中构建物理推理链,...