小米宣布正式开源视觉-语言-动作(VLA)大模型 Xiaomi-Robotics-0 的真机后训练完整流程,标志其在具身智能领域的关键突破。研发团队基于预训练基座,仅用约20小时任务数据即使机器人完成亚毫米级精准装配任务,如将耳机收纳入盒。该模型可在极微公差内实时修正动作偏差,展现高精度空间感知与执行能力。此次开源同时包含模型权重、技术报告与源代码,构建完整的开发生态。小米表示,这一举措显著降低开发者进入具身智能研究的门槛,并推动机器人从实验阶段向实际生产应用加速。相关资料已在官方网站与GitHub公开。