首页
看点啥
插画图片
首页 看点啥 小米MiMo通过国家大模型备案:计划未来三年AI投入超600亿

小米MiMo通过国家大模型备案:计划未来三年AI投入超600亿

2026-07-21 0

【快讯】7月16日,小米自研端侧大模型MiMo正式通过国家生成式人工智能服务备案。小米MiMo已构建起大语言、多模态、语音完整模型矩阵,依托端云协同运行模式,全面赋能小米手机、汽车、智能家居人车家全生态体系,推动人工智能落地各类实体硬件场景。

AI、芯片、OS是小米长期重点布局的三大核心技术方向。官方表示, 2026年度将在AI领域投入达160亿元,未来三年在AI赛道累计投入规模不低于600亿元。

除端侧通用大模型取得备案进展外,小米于7月15日发布了Xiaomi-Robotics-U0多模态具身基础模型,参数量达380亿。该模型是具身智能领域首款可统一处理四类核心任务的生成式模型,打通机器人图像、视频数据生成与编辑全链路。

据官方介绍,该模型可在维持空间几何逻辑不变的基础上,对现有素材完成物体替换、光影调整、背景更换、增加环境干扰等数据增强操作,无需重新实地采集数据;同时支持从零搭建全新仿真场景,覆盖高危、极端、长尾等实体机器人难以实地测试的环境。搭配FlashAR+推理加速方案,模型生成效率相较传统自回归架构提升约83倍,大幅降低机器人训练数据规模化制备的落地成本。

Xiaomi-Robotics-U0在全球126款参评模型中拿下WorldArena评测基准综合得分第一;在真机实测环节,面对陌生光照、全新背景等分布外场景,借助该模型扩增数据训练的机器人,策略任务完成效率平均提升26%以上。

整套模型采用统一多模态自回归框架,覆盖四类核心任务:

具身场景生成:依托文本指令生成多视角仿真环境,适配桌面、厨房、仓储、开放复杂空间等机器人作业场景

具身迁移:将机器人运动轨迹迁移至全新环境,同步调整光影、材质、物体,保留原有机械臂动作与空间布局

机器人交互视频生成:根据初始画面与操作指令生成连贯动作视频,兼顾物理逻辑与动作流畅度,支持零样本跨场景使用

通用文生图与图像编辑:保留通用视觉生成能力,将互联网视觉知识复用至机器人训练任务

喜欢(0)

上一篇

OpenAI正在研发首款硬件产品智能音箱

OpenAI正在研发首款硬件产品智能音箱

下一篇

2027款星途ES上市 智能升级动力选择多样 置换补贴后16.99万起

2027款星途ES上市 智能升级动力选择多样 置换补贴后16.99万起
猜你喜欢