Xiaomi MiMo

♨1.9万 热度

Xiaomi MiMo是小米公司自研的AI大模型系列,是小米“人车家”全生态战略的核心智能底座,采用“端云协同”架构。

直达网站
Xiaomi MiMo 工具界面或产品展示图
工具介绍

一、Xiaomi MiMo 是什么?

Xiaomi MiMo 是小米自研的 AI 大模型系列,业界评价其为小米「人车家」全生态战略的核心智能底座。它瞄准的不只是「聊天」,而是智能体(Agent)时代的旗舰基座——强调持续可靠地完成复杂工作流、长程规划与精准工具调用。

核心设计理念是「端云协同」:

  • 云端侧:负责复杂推理、长文本、知识问答等高负载任务,提供最强的模型能力。

  • 端侧:针对小米手机、IoT 设备深度优化,实现低延迟、隐私保护的本地 AI 服务。

这种架构让 MiMo 从诞生之初就不是孤立的云端模型,而是为小米生态量身定制的 AI 核心。小米已于 2025 年 12 月宣布,2026 年 AI 投入将超 160 亿元,显示出对这一战略的长期承诺。

Xiaomi MiMo 官方品牌标志(小米 MiMo 团队)
图:Xiaomi MiMo 官方品牌标志

二、MiMo 模型矩阵:从旗舰到全模态(2026 全家福)

截至 2026 年 8 月,MiMo 已形成覆盖文本、语音、视觉、具身智能的完整产品矩阵。当前旗舰为 MiMo-V2.5-Pro,其下既有 V2.5 系列(Pro / UltraSpeed / TTS / ASR),也保留了庞大的 V2 系列开源与专用模型。

1. MiMo-V2.5-Pro(当前旗舰基座)

  • 定位:「A leap in agentic and long horizon coherence」——在智能体能力和长时间连贯性上的跃升。

  • 规模:约 1 万亿参数(1T);MiMo-V2.5-Pro-UltraSpeed 模式通过模型与系统极致 Codesign,将 1T 参数模型的生成速度推向 1000 tokens/s。

  • 架构:HySparse 混合稀疏注意力(Oracle Token Selection + KV Cache Sharing,2026-02 论文),兼顾长上下文与推理效率。

  • 适用:中高强度 Agent 工作场景,编程、长程任务规划与工具调用。

2. MiMo-V2.5(增强智能 + 多模态)

「A leap in agency and multimodality」——在智能性与多模态理解上更进一步。

3. MiMo-V2.5-TTS Series 与 MiMo-V2.5-ASR(语音)

  • V2.5-TTS:端到端语音合成(「给智能体一个声音,一个灵魂」),高拟人、支持唱歌与方言,实现「千人千声」。

  • V2.5-ASR:语音识别/转写。

4. MiMo-V2-Pro(上一代旗舰基座,真实成绩有据)

  • 规模:总参数超过 1 万亿(较上代翻两番),激活参数 420 亿,上下文长度 100 万 Token,创新混合注意力架构。

  • 性能:第三方 AI 评测机构 Artificial Analysis 数据显示,MiMo-V2-Pro 在 10 个测评集综合得分 49,全球排名第 7、国内排名第 3,仅次于智源 GLM-5 和 MiniMax M2.7,高于 Grok 4.20 Beta。

  • 场景:雷军举例称适用编程和「养虾」等复杂场景。

5. MiMo-V2-Omni(全模态基座)

原生支持图像、视频、音频、文本全模态感知与跨模态理解;具备原生 Agent 与 Browser Use 能力,是「通往具身智能的基座」;内测期间 Pinchbench 均分第一。

6. MiMo-V2-Flash(开源推理模型,MIT)

  • 规模:3090 亿总参 / 150 亿活跃参数,256K 上下文,约 150 tokens/s。

  • 创新:混合滑动窗口注意力(5:1,KV 缓存减少近 6 倍)+ 3 层多 Token 预测(加速 2.0–2.6 倍)。

  • 成本:每百万 token 输入约 0.1 美元、输出约 0.3 美元,推理价格仅为 Claude Sonnet 4.5 的 2.5%。

  • 基准:SWE-bench Verified 73.4%,超越所有开源模型、直逼 GPT-5-High;AIME 2025、GPQA-Diamond 均列开源前二。

7. MiMo-VL 系列(视觉语言)

  • MiMo-VL-7B:原生分辨率 ViT 编码器 + 高效 MLP 投影器 + MiMo-7B,混合策略强化学习(MORL)。

  • MiMo-VL-Miloco-7B:端侧视觉语言模型,专为智能家居优化,支持全屋视觉问答、规则触发、场景化动态推理。

8. MiMo-Audio 与 MiMo-Embodied(专用模型)

  • MiMo-Audio:语音模型,3 句样本快速学习,可区分车内/车外指令,识别玻璃破碎、烟雾报警等环境音。

  • MiMo-Embodied:业界首个打通自动驾驶与具身智能的跨域模型,应用于扫地机器人、工厂 AGV、SU7 高阶智驾等。

Xiaomi MiMo 全模态模型矩阵:旗舰基座、全模态、语音、开源推理、视觉与具身,端云协同
图:Xiaomi MiMo 全模态模型矩阵(端云协同 + 生态兼容)

模型

类型

关键规格

许可/部署

MiMo-V2.5-Pro

旗舰基座

约 1T 参数,HySparse,UltraSpeed 1000 TPS

云端 API

MiMo-V2.5

全模态

增强智能与多模态

云端 API

MiMo-V2.5-TTS / ASR

语音

拟人语音、唱歌、方言 / 语音转写

云端 API(TTS 限时免费)

MiMo-V2-Pro

上一代旗舰

>1 万亿总参,420 亿激活,100 万上下文

云端 API

MiMo-V2-Omni

全模态

图/视频/音频/文本 + Browser Use

云端 API

MiMo-V2-Flash

开源推理

3090 亿总参,256K,150 tokens/s

MIT 开源、可自部署

MiMo-VL-7B / Miloco-7B

视觉语言

原生分辨率,端侧全屋视觉问答

开源 / 端侧

MiMo-Audio

语音

少样本学习、环境音识别

专用

MiMo-Embodied

具身

自动驾驶 × 具身智能跨域

专用

三、端云协同架构与部署方式

  • 云端 API:通过 Xiaomi MiMo API 平台调用(platform.xiaomimimo.com),适合需要旗舰能力、长上下文与复杂推理的场景。

  • 端侧本地运行:针对小米手机、IoT 设备优化,支持轻量版本地部署,低延迟、隐私保护。

  • 开源自主部署:MiMo-V2-Flash、MiMo-7B 等模型已在 Hugging Face、GitHub 开源,采用 MIT 协议,可自由修改与商业使用。

四、生态兼容性:OpenClaw / Claude Code / Cursor 等直接接入

MiMo 在工具链兼容性上做了深度适配,MiMo Studio 底层采用 SGLang 推理加速,API 接口设计一键兼容主流开发工具,开发者可无缝接入现有工作流:

  • OpenClaw、Claude Code、OpenCode、KiloCode、Cursor、Cline 等编程/代理工具。

五、性能、中文优势与开源策略

  1. 中文能力突出:中文语料占比超过 40%,中文互联网语境下的理解力、表达力普遍优于同档海外模型。

  2. 小米生态深度融合:在米家智能设备控制、IoT 开发等场景具有独家优势。

  3. 端云协同架构:兼顾性能与隐私,支持本地运行。

  4. 高性价比:MiMo-V2-Flash 推理成本仅为同类闭源模型的 2.5%。

  5. 开源策略:关键模型采用 MIT 协议开源,吸引大量第三方开发者。

六、Token 定价方案(Lite / Standard / Pro / Max)

MiMo 采用 Token 折算机制,额度透明可控,提供四级梯度套餐(首购优惠价,每账号仅享一次):

套餐

原价

首购优惠价

Credits/月

适用人群

核心权益

Lite

¥39/月

¥34.32/月

6000 万

尝鲜入门

全模型支持

Standard

¥99/月

¥87.12/月

2 亿

进阶用户

3.3 倍 Lite 用量

Pro

¥329/月

¥289.52/月

7 亿

专业开发者

11.7 倍 Lite 用量

Max

¥659/月

¥579.92/月

16 亿

编程开发发烧友

26.7 倍 Lite 用量

统一权益:支持 MiMo 各旗舰模型(如 MiMo-V2.5-Pro / V2-Pro / V2-Omni 等)、可接 OpenClaw / Claude Code / OpenCode / KiloCode 等主流编程工具、MiMo TTS 模型限时免费。

API 定价参考(MiMo-V2-Pro):256K 上下文 输入约 1/百万、输出约 3/百万 Tokens;100 万上下文 输入约 2/百万、输出约 6/百万 Tokens。(以上为阶段性参考,以官网实时与结算页面为准。)

七、平台入口与如何开始

  • Xiaomi MiMo API:https://platform.xiaomimimo.com/(API 调用、Token 购买)

  • Xiaomi MiMo Studio:https://aistudio.xiaomimimo.com/#/(在线体验、模型测试)

  • 官方博客:https://mimo.xiaomi.com/(产品动态、技术博客)

  • 开源仓库:Hugging Face / GitHub(模型权重、推理代码)

快速开始:在 MiMo API 平台注册账号,获取 API Key,选择适合自己的 Token 套餐,即可通过云端 API 或直接接入 OpenClaw / Claude Code / Cursor / Cline 等工具使用。

八、应用场景

  • 编程开发:代码生成、Bug 修复、工具调用(长程编程 Agent,如 MiMo Code)。

  • 智能家居:全屋视觉问答、场景联动、设备控制(MiMo-VL 端侧)。

  • 智能座舱:语音交互、环境音识别(MiMo-Audio)。

  • 具身智能:扫地机器人、自动驾驶、工厂 AGV(MiMo-Embodied)。

九、Xiaomi MiMo 常见问题(FAQ)

Q1:Xiaomi MiMo 是什么?

小米自研 AI 大模型系列,定位「定义智能体时代的旗舰基座大模型」,是小米「人车家」全生态的核心智能底座,采用端云协同架构。

Q2:MiMo 的当前旗舰是什么?

截至 2026 年 8 月,当前旗舰为 MiMo-V2.5-Pro,约 1 万亿参数,采用 HySparse 混合稀疏注意力,UltraSpeed 模式生成速度可达 1000 tokens/s。

Q3:MiMo 是免费的吗?

MiMo 提供 Token 套餐(Lite 至 Max,¥39–659/月,首购有优惠),部分语音模型(如 TTS)限时免费;开源模型(V2-Flash、MiMo-7B)在 MIT 协议下可免费自部署。

Q4:MiMo 能接 OpenClaw / Claude Code / Cursor 吗?

可以。MiMo API 兼容 OpenClaw、Claude Code、OpenCode、KiloCode、Cursor、Cline 等主流工具,MiMo Studio 底层用 SGLang 加速,可一键接入。

Q5:MiMo 开源了吗?

关键模型采用 MIT 协议开源,如 MiMo-V2-Flash、MiMo-7B、MiMo-VL 系列,可在 Hugging Face / GitHub 下载自主部署。

Q6:MiMo 有哪些系列?

覆盖文本、语音、视觉、具身的全模态矩阵,包括 V2.5-Pro / V2.5 / V2.5-TTS / V2.5-ASR / V2-Pro / V2-Omni / V2-Flash / MiMo-VL / MiMo-Audio / MiMo-Embodied 等。

Q7:MiMo 的中文能力如何?

中文语料占比超 40%,中文互联网语境的理解力与表达力普遍优于同档海外模型。

Q8:MiMo 支持音视频等多模态吗?

支持。MiMo-V2-Omni 原生支持图像、视频、音频、文本全模态感知与 Browser Use;MiMo-VL 支持视觉问答;MiMo-Audio 支持环境音识别。

十、结语:Xiaomi MiMo 的定位与价值

Xiaomi MiMo 的价值,在于它不是「又一个云端聊天模型」,而是为小米「人车家」全生态定制的 AI 核心。它以端云协同兼顾性能与隐私,以 MiMo-V2.5-Pro 旗舰基座 + 全模态矩阵覆盖文本、语音、视觉与具身智能,又以强大的生态兼容性(OpenClaw / Claude Code / Cursor 等)与 MIT 开源策略吸引开发者。对开发者而言,它提供了高性价比、中文友好、可自由部署的一流选择;对小米自身而言,它是连接手机、车、家与具身智能的「大脑」。2026 年,随着 160 亿 AI 投入落地,MiMo 有望成为国内大模型竞争中不可忽视的一极。