小米MiMo通过国家大模型备案,计划未来三年AI投入超600亿
来源:互联网
时间:2026-07-21 13:13:17
7月16日,小米自研端侧大模型MiMo正式通过国家生成式人工智能服务备案。这一进展意味着小米在端侧AI的合规化道路上迈出了关键一步。目前,小米MiMo已构建起大语言、多模态、语音完整模型矩阵,依托端云协同运行模式,全面赋能手机、汽车、智能家居等全生态体系,将AI落地到各类实体硬件场景中。

AI、芯片、OS是小米长期重点布局的三大核心技术方向。值得关注的是,小米在2026年度AI领域投入计划达160亿元,未来三年累计投入不低于600亿元。这一数字背后,是小米对AI基础设施的持续加码。
除了端侧通用大模型,小米在具身智能领域也有重磅动作。7月15日,小米发布了Xiaomi-Robotics-U0多模态具身基础模型,参数量达380亿。这是具身智能领域首款可统一处理四类核心任务的生成式模型,打通了机器人图像、视频数据生成与编辑的全链路。

据官方介绍,该模型在维持空间几何逻辑不变的前提下,可对现有素材进行物体替换、光影调整、背景更换、环境干扰增加等数据增强操作,无需重新实地采集数据。同时支持从零搭建全新仿真场景,覆盖高危、极端、长尾等实体机器人难以测试的环境。搭配FlashAR+推理加速方案,模型生成效率相较传统自回归架构提升约83倍,大幅降低机器人训练数据规模化制备的落地成本。
性能表现方面,Xiaomi-Robotics-U0在全球126款参评模型中拿下WorldArena评测基准综合得分第一。在真机实测环节,面对陌生光照、全新背景等分布外场景,借助该模型扩增数据训练的机器人,策略任务完成效率平均提升26%以上。
整套模型采用统一多模态自回归框架,覆盖四类核心任务:
依托文本指令生成多视角仿真环境,适配桌面、厨房、仓储、开放复杂空间等机器人作业场景。
将机器人运动轨迹迁移至全新环境,同步调整光影、材质、物体,保留原有机械臂动作与空间布局。
根据初始画面与操作指令生成连贯动作视频,兼顾物理逻辑与动作流畅度,支持零样本跨场景使用。
保留通用视觉生成能力,将互联网视觉知识复用至机器人训练任务。