小米MiMo爆发:开源AI编程助手发布,推理速度突破1000 tokens/秒
6月11日,小米MiMo技术团队一天之内扔出两颗炸弹。
上午,MiMo Code开源AI编程助手在GitHub上线,MIT协议,5人团队仅用14天开发完成。同模型配置下,SWE-Bench Pro V2和Terminal Bench 2跑分比Claude Code高出5个百分点。内置免费MiMo-V2.5多模态模型,性能对标Claude Sonnet 4.6,同时支持接入DeepSeek、Kimi、GLM等主流模型。
下午,MiMo-V2.5-Pro UltraSpeed推理模式限时开放,万亿参数大模型生成速度突破1000 tokens/秒,峰值1200 tokens/秒——不使用任何定制芯片,仅靠常规8卡GPU服务器稳定运转。消息公布后,已有超过3000家企业及开发者提交API试用申请。
一天之内,工具开源和推理加速两条线同时推进。这不是一次常规的产品更新,而是中国AI生态从”能用”到”好用”的转折信号。
MiMo Code:5人14天,MIT开源凭什么挑战Claude Code?
MiMo Code的核心差异点不在模型能力,而在持久记忆系统。
传统的AI编程助手每次会话独立运行,切换任务或上下文窗口溢出后,之前的理解全部丢失。MiMo Code通过独立子智能体自动维护项目记忆、会话检查点和任务进度。当上下文窗口临近上限,系统自动生成精简简报供主Agent接续。每7天触发一次/dream收敛机制,压缩合并历史记忆,实现”越用越懂项目和代码仓库”的自进化。
这套设计直接击中了当前AI编程工具的痛点——健忘。GitHub Copilot、Claude Code、Cursor都没有在持久记忆层面做到如此深度的工程化。小米用一个独立子智能体解决了这个问题,工程思路清晰且克制。
此外,Compose模式覆盖从需求分析到代码审查的自动化开发全流程,支持语音输入与控制。MIT协议意味着任何开发者可以自由使用、修改甚至二次分发——对于中国开发者生态而言,一个真正开源且无法律风险的AI编程工具,价值远超闭源的Claude Code。
1000 tokens/秒:万亿参数模型不需要定制芯片?
MiMo-V2.5-Pro是小米首个为推理而生的大模型,总参数量超1万亿(42B激活参数),支持1M超长上下文。UltraSpeed模式的核心突破在于模型与系统的极致协同设计:相同等待时间内,模型可并行跑数十条推理路径,自动验证纠错。
这背后的技术意义是巨大的。过去,”万亿参数”和”实时交互”几乎是互斥的概念——要么牺牲模型规模,要么烧钱堆定制芯片。小米用纯软件层面的系统优化,证明了一条新路径:通过推理时并行化策略,常规GPU也能跑出极致速度。
定价策略也值得关注:UltraSpeed模式为MiMo-V2.5-Pro的3倍价格,体验期仅限6月9日至6月23日。这不是放量策略,更像是一次市场试探——测试企业和开发者对”高速度推理”的支付意愿。3000+的申请量已经给出了初步答案。
为什么小米在这个时间点全面发力AI?
把MiMo Code和UltraSpeed放在一起看,小米的AI路线图变得清晰:工具生态开源圈开发者,底层模型提速度建立技术壁垒,两条线并行推进。
同一天(6月11日),何小鹏发布内部信宣布亲自兼任机器人业务CEO,人形机器人IRON进入量产前200天冲刺。华为昇腾950DT芯片提前至8月上线,搭载自研HBM性能翻倍。国产AI芯片已正式纳入国家信创安全认证体系,9款产品获I级认证。甲骨文CEO在财报电话会上披露全球GPU利用率高达97.5%,AI算力供不应求已不是新闻而是常态。
这些事件并非孤立。中国AI产业正在经历从“模型跟随”到”生态建设”的质变:底层有昇腾950DT和信创认证保障算力自主,中间层有MiMo等国产大模型持续追赶,上层有MiMo Code这样的开源工具降低开发者门槛。整个生态的每一层都在加速闭合。
小米选择MIT协议开源MiMo Code,战略眼光是精准的——在Claude Code闭源、Cursor收费、GitHub Copilot绑定的市场格局下,一个开源的、支持多模型的、自带持久记忆的AI编程工具,恰好填上了中国开发者最需要的空白。
接下来看什么?
但真正的考验还没来。
MiMo Code能否从”首发惊艳”进入”日常可靠”?持久记忆系统在大型项目中的稳定性如何?UltraSpeed模式从14天限时到常态化定价后的企业留存率有多少?这些问题的答案,将决定小米这次双线出击是一次漂亮的技术Demo,还是中国AI工具生态真正的转折点。
有一点可以确定:当小米这样的硬件巨头开始用MIT开源协议和1000 tokens/秒的推理速度认真做AI工具时,市场格局不会再是OpenAI和Anthropic的二人转了。