小米发布100K小时真实轨迹训练的视觉-语言-动作基础模型Xiaomi-Robotics-1
原标题:Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories
推荐理由
小米发布VLA基础模型,基于10万小时真实轨迹,预示人形机器人通用操作能力新进展,具产业影响。
ROBOAIRADAR BRIEF
结构化情报
01
发生了什么
小米提出Xiaomi-Robotics-1,一种视觉-语言-动作(VLA)基础模型,能够在未见环境中遵循语言指令执行多种移动操作任务,并通过少量微调数据高效适应新任务。该模型采用两阶段训练,包括预训练和后训练,在超过10万小时真实轨迹数据上训练,展示了通用移动操作能力。具体技术细节和性能有待进一步验证。
02
为什么重要
小米发布VLA基础模型,基于10万小时真实轨迹,预示人形机器人通用操作能力新进展,具产业影响。
03
行业影响
模型能力变化可能影响机器人感知、规划和交互技术栈,但落地仍取决于硬件与实时性能。
04
仍需确认
当前是单一公开来源,需要补充公司公告、客户确认或其他可信媒体报道。
信息说明
RoboAIRadar 对公开信源进行聚合、中文整理和价值判断,不替代原始报道。 涉及产品参数、交易金额或公司声明时,请以原文为准。
查看原始报道