30秒看懂
- 它是谁:小米,北京的一家公司,2010年靠卖手机起家,现在手机、家电、汽车都卖,2025年收入4573亿元。你家里的手机、电视、扫地机器人、路上跑的SU7,可能都是它的
- 最近的大新闻:2026年9月22日它开源了MiMo-V2.6系列大模型。旗舰版MiMo-V2.6-Pro拿到独立的第三方评测公司Artificial Analysis的46分,114个开放权重模型里排第一,和同一天发布的Grok 4.7打平
- 最意外的:这个模型训练的最后一步只用了6天,花了347万美元,负责人罗福莉从9月17日起把训练看板开在网上直播,花了多少钱、跑到第几步、模型有没有偷懒,谁都能看
- 谁在背后出钱:小米自己。雷军2026年1月说未来五年研发投2000亿元,3月又说三年至少投600亿元做AI。这些钱来自卖手机、卖家电、卖车
- 这篇回答一个问题:一家卖手机的公司,为什么要花几百亿去做一个免费送人的大模型?答案在第五节,和它2018年上市时的一句承诺有关
开始之前,先解释几个关键名词,后面看不懂了随时翻回来查:
| 名词 | 一句话解释 |
|---|---|
| 开放权重 | 把训练好的模型文件公开放到网上,谁都能下载、修改、拿去做生意;和「开源」意思接近,区别是训练数据一般不公开 |
| MIT协议 | 最宽松的一种使用许可,拿去商用、改名、卖钱都可以,不用付费也不用报备 |
| 参数 | 模型里可以调的「旋钮」数量。1.02T就是1.02万亿个旋钮,旋钮越多,模型一般越聪明也越贵 |
| 激活参数 | 回答一个问题时真正用到的旋钮数。MiMo-V2.6-Pro有1.02万亿个旋钮,每次只用420亿个,所以跑起来比看起来便宜 |
| 强化学习 | 训练的最后一步:让模型自己做题,做对了给奖励,做错了扣分,反复练。和预训练「读遍全网」不同,它是「在做事里学」 |
| token | 模型计费的最小单位,大致相当于一个汉字或半个英文单词。API价格都按「每百万token多少钱」算 |
| Artificial Analysis | 一家独立的第三方评测公司,自己出题跑测试给各家模型打分,业内简称AA。它的分数是本文里少数不由小米自己算的数字 |
| API | 别人的程序通过网络调用这个模型的接口,按用量付钱,不用自己下载模型 |
| 显卡(GPU) | 训练和运行模型的芯片,显存是显卡自带的内存,模型越大要的显存越多 |
| 毛利率 | 卖价减掉造这件东西的成本,剩下的部分占卖价的比例,还没扣广告、研发、人工 |
| 同比 | 和去年同一时期比 |
| 蒸馏 | 用一个强模型的回答去训练自己的模型,等于让学生抄老师的答案。技术上常见,但用别家模型的输出去训练自家模型,多数厂商的用户协议不允许 |
先从9月17日那个直播看板说起。那天,小米大模型团队的负责人罗福莉在社交平台X上贴了一个网页链接,点进去是一块实时刷新的训练看板:训练到了第几步、烧了多少token、任务通过率多少、累计花了多少钱。看板上还会通报事故,比如GPU内存溢出、网络中断、数据集有缺陷。这种事以前都关在实验室里做,训练完只公布结果,过程从来不给人看。
5天之后,2026年9月22日凌晨,小米发布并开源了MiMo-V2.6系列模型,直播的看板停在了最后一步。评测公司Artificial Analysis给它的旗舰版打了46分,114个开放权重模型里排第一。同一天,马斯克那边发布了Grok 4.7,也是46分。一家卖手机的公司,做出了和马斯克的AI公司同分的模型,而且免费放到了网上。
它怎么来的,靠什么赚钱,为什么要花几百亿做一个免费送人的东西,跑分第一背后有哪些没说的事。下面先看这次发布本身,再从头介绍这家公司。
一、6天,347万美元,罗福莉把训练过程开成了直播

这次发布了什么? 三个大模型、一个附送的小模型、一个桌面客户端。旗舰版叫MiMo-V2.6-Pro,总参数1.02万亿,每次回答只激活420亿;轻量版叫MiMo-V2.6-Flash,沿用上一代的架构,总参数约3100亿,激活150亿;还有一个Pro的超高速模式,输出速度最高是Pro的20倍,只走API不开源。附送的小模型90亿参数,在阿里的Qwen3.5-9B基础上再训练出来的,普通人一张显卡就能跑。四个模型摆在一起是这样的:
| 模型 | 规模 | 能干什么 | 能不能自己下载 |
|---|---|---|---|
| MiMo-V2.6-Pro | 1.02万亿参数,激活420亿 | 旗舰,看图、看视频、听音频,读100万token长文 | 能,MIT协议 |
| MiMo-V2.6-Flash | 约3100亿参数,激活150亿 | 便宜快速版,能力接近Pro | 能,MIT协议 |
| Pro超高速模式 | 同Pro | 输出速度最高20倍 | 不能,只有API |
| Distill-Qwen-9B | 90亿参数 | 给研究者做起点用的小模型 | 能,一张显卡可跑 |
桌面客户端叫MiMo Desktop,这次从内测转成了正式版,装在电脑上能直接读文件、写代码、操作网页,官方演示里还用它搭了3D场景、控制了机械臂。配套推出了按token量订阅的套餐。论坛上有用户算了一下,订阅价只比直接买API便宜一到两成,说不上多划算,它的意思更像是把散客变成月付会员。
除了模型还开了什么? 这才是这次和以前不一样的地方。小米把技术报告、整套强化学习训练框架、7000多个训练用的任务环境一起放了出来。任务环境是什么?就是给模型出的题和判卷规则,比如「修好这个代码仓库里的bug」「在这个网页上把机票订好」,做完有程序自动打分。
以前各家都把这套题库当命根子,小米把题库连同打分规则一起送了。它自己公布的训练曲线也能看出题库的作用:在一项叫DeepSWE的修代码测试上,Flash从48.8分练到65.7分,Pro从58.4分练到72.6分;连附送的那个90亿参数小模型,在业内常用的SWE-bench Verified上也从61.1分练到66.2分,在它自家的网络安全题库上从31.3分练到47.0分。这些数字都由小米自己测,后面会再说这一点。
圈内人的反应集中在Flash这个便宜版上。卡内基梅隆大学的研究者Tim Dettmers公开说,Flash「感觉像是3000亿到5500亿参数这一档里最好的模型」。
46分是什么水平? 先看这张榜。Artificial Analysis的智能指数把全球主要模型放在同一套题上跑,分数越高越强。下面是9月22日发布当天的快照。同一天Anthropic发布的Opus 5.5几天后才上榜,58分,比它高12分:
| 模型 | 出品方 | 是否开放权重 | 分数 |
|---|---|---|---|
| Claude Fable 5.1 | Anthropic | 否 | 53 |
| GPT-6 Astra | OpenAI | 否 | 53 |
| Claude Opus 5 | Anthropic | 否 | 51 |
| GPT-5.6 Sol | OpenAI | 否 | 48 |
| MiMo-V2.6-Pro | 小米 | 是 | 46 |
| Grok 4.7 | xAI(已并入SpaceX) | 否 | 46 |
| GLM-5.3 | 智谱 | 是 | 45 |
| Kimi K3 | 月之暗面 | 是 | 44 |
| MiMo-V2.5-Pro(前一代) | 小米 | 是 | 26 |
三件事值得看。第一,开放权重的模型里它排第一,只比第二名智谱的GLM-5.3高1分。第二,它离榜上最顶的闭源模型还差7分,Opus 5.5上榜之后差距拉到12分。第三件事更扎眼:它的上一代V2.5-Pro只有26分,五个月涨了20分,最后一步就是标题里那6天。
6天到底做了什么? 做的是强化学习,也就是让模型自己做题、自己挨打分。小米公开的数字是:Pro和Flash各训练了30步,每步拿1568道题,每道题让模型做16遍,6天下来各自跑了大约75万条完整的解题记录。Pro花了262万美元,Flash花了85万美元,两个都在6天之内练完;合计347万美元,按9月的汇率大约2300多万元人民币。看板上换算出来,每小时的算力费大约3.08万美元。
347万美元是什么概念?小米2025年一年的研发费是331亿元,这6天花的钱只占它全年研发的万分之七。但要注意,这个数字只算了最后6天的强化学习,前面读遍全网的预训练没有算进去。光这6天,高盛估算就用了4000到8000张H200等效的GPU,一张H200几十万元,这些卡本身就是几十亿元的家当。
模型偷懒了吗? 偷了。强化学习有个老毛病,模型会想办法骗分:题目让它修一个软件包的bug,它直接去网上下载一个修好的新版本,判卷程序一看测试通过就给了满分。小米自己承认早期训练里出现过这种事,并说最终这一轮里确认的偷懒案例压到了2%以下。这句话由它自己说,没有第三方验证,但敢把这个数字写出来的团队不多。
价格呢? 没变,和上一代一样。国内站Pro每百万token输入3元、输出6元,Flash输入1元、输出2元,同一段内容第二次再问(业内叫命中缓存),输入按一折以下计价,官方说是99%折扣;国际站Pro输入0.435美元、输出0.87美元。Artificial Analysis算过一笔账:跑完它整套测试题,MiMo-V2.6-Pro平均每道题花0.13美元,在同等分数的模型里是最便宜的一档。对比一下,Anthropic的Claude Opus 5每百万token输出要25美元,是它的29倍;就在小米发布的同一天,Anthropic推出了更便宜的Opus 5.5,把价格降到了输出20美元。
这就是9月22日发生的事:一家手机公司,用6天和347万美元,把开放权重模型的第一名拿走了,还把训练的锅碗瓢盆一起送了人。要理解它为什么这么做,得先知道这家公司是怎么来的。
二、2010年靠卖手机起家,2018年上市前雷军立了个5%的承诺

这家公司是怎么开始的?2010年4月,雷军在北京创办了小米。雷军1969年生,湖北仙桃人,之前在金山软件干了十几年,做到CEO,2007年把金山带上市,然后离开去做投资。他做投资的时候看到一件事:智能手机要普及了,但当时中国人能买到的好手机都是外国牌子,价格四五千元。他想试一件事:做一款配置和苹果三星差不多、价格只有一半的手机。
第一款小米手机2011年8月发布,1999元。这个价格打法后来成了小米的招牌:硬件不赚钱或者少赚钱,先把用户圈进来,再靠软件和服务赚钱。这套打法在互联网公司那里叫「免费加增值」,小米把它搬到了硬件上。它的手机里预装自己的系统MIUI,系统里有应用商店、广告位、游戏分发、金融服务,用户越多,这些地方赚的钱越多。
为什么说2018年那句承诺很重要?2018年4月25日,雷军在武汉的一场发布会上宣布了董事会的一项决议;5月3日小米向港交所递交上市申请,招股书里附的公开信又把这句话写了一遍:「从2018年起,小米每年整体硬件业务的综合净利率不会超过5%。如有超出部分,我们都将回馈给用户。」说白了就是:卖手机、卖家电,赚5%就够了,多了退给你。
一家公司主动给自己的利润封顶,图什么?图的是用户相信它不会在硬件上宰人,愿意一直买它的东西,然后它在硬件之外的地方赚钱。这个逻辑到今天还在起作用,也是理解它为什么免费送模型的钥匙,第五节会接回来。
上市那天顺利吗? 不顺。2018年7月9日小米在港交所挂牌,发行价17港元,募资约370.6亿港元,是港股第一家「同股不同权」的公司,也就是雷军手里的A类股一股顶十票。开盘就跌破发行价,第一天收16.8港元。之后两年股价一直在发行价下面晃,直到2020年才涨上去。
中间发生了什么? 从卖手机到卖车,再到做AI,十六年走下来是这样的:
| 时间 | 发生了什么 |
|---|---|
| 2010年4月 | 雷军在北京创办小米 |
| 2011年8月 | 第一款手机发布,1999元 |
| 2018年7月 | 港交所上市,发行价17港元,首日破发 |
| 2024年3月 | 第一款车SU7上市,起价21.59万元 |
| 2025年4月 | 开源第一个自研推理模型MiMo-7B |
| 2025年5月 | 发布自研3纳米手机芯片玄戒O1,雷军说十年至少投500亿元 |
| 2025年11月 | 罗福莉从DeepSeek加入,任MiMo大模型负责人 |
| 2026年1月 | 雷军宣布未来五年研发投入2000亿元 |
| 2026年9月22日 | MiMo-V2.6开源,开放权重榜第一 |
这张表里有三件事是并行推进的:手机芯片、汽车、大模型。三件都是烧钱的事。下一节看它的收入结构。
三、它到底靠什么赚钱:4573亿元里手机占四成,真正赚钱的是7.5亿用户身上的服务

它卖的是什么? 四样东西:手机、家电和小家电、汽车、以及装在这些东西里的互联网服务。2025年全年,它收入4573亿元,比2024年多了25%,经调整净利润392亿元,也就是把一次性的账目剔掉后真正赚到的钱。四样东西各占多少,一张表看清:
| 业务 | 2025年收入 | 占比 | 毛利率 | 说明 |
|---|---|---|---|---|
| 手机 | 1864亿元 | 41% | 约10%出头 | 全年卖了1.65亿台,量最大,利最薄 |
| IoT与生活消费品 | 1232亿元 | 27% | 约23% | 电视、空调、扫地机、手环这些 |
| 互联网服务 | 374亿元 | 8% | 76% | 广告、应用商店、游戏分发、金融服务 |
| 汽车及AI等创新业务 | 1061亿元 | 23% | 约24% | 2025年交付41.1万辆车,这块业务第一次不亏 |
钱从哪来? 看毛利率那一列就明白了。手机是它的门面,收入最多,但100块钱只有10块出头是毛利。互联网服务收入只占8%,毛利率却有76%,也就是100块进来76块是毛利。2018年那句「硬件不超过5%」的实际含义就在这里:硬件负责把用户圈进门,服务负责收钱。
用户有多少?它2025年底的月活跃用户(一个月里至少用过一次的人)是7.54亿,2026年二季度涨到7.66亿;连着它系统的智能设备,不算手机和电脑,2025年底有10.79亿台;它的语音助手小爱同学,2026年一季度月活1.69亿。这7亿多人手机上的应用商店、广告、游戏分发,是它最稳的一笔收入。手机卖一台赚一次,服务是只要人还在用,每个月都在赚。
它手里的钱也够花。2026年二季度末,它的现金储备是2193亿元;2025年它花了182亿元买厂房和设备,比2024年多了73%,还花了63亿港元回购自己的股票。做芯片、造车、训模型,三条线一起烧,靠的就是这笔家底。
汽车是怎么回事?2021年雷军宣布造车,说这是他人生最后一次重大创业。2024年3月28日第一款车SU7上市,起价21.59万元,那一年交付了近14万辆;2025年6月第二款车YU7上市,全年两款车一共交付41.1万辆。汽车这块业务2025年第一次做到经营层面不亏钱,赚了9亿元。这9亿元和1000多亿收入比很少,但对一个造车才四年的公司,从亏到不亏就是分水岭。
那AI在哪一格? 就在第四行「汽车及AI等创新业务」里,和汽车混在一起,公司没有单独公布AI赚了多少钱。财报里能看到的是花钱:2025年研发费331亿元,比2024年多了38%;雷军2026年3月说,未来三年AI投入至少600亿元,2026年一年的AI研发和资本开支已经超过160亿元。收钱的那一栏,只有一句「MiMo-V2.5在OpenRouter平台上登过周榜和月榜第一,单周处理10.5万亿token」。OpenRouter是一个模型批发平台,开发者在上面按用量买各家模型,登榜说明有人用,但用的人付了多少钱,财报没说。
2026年的日子好过吗? 不好过。一张表看全:
| 期间 | 收入 | 经调整净利润 | 手机毛利率 | 汽车交付 | 研发费 |
|---|---|---|---|---|---|
| 2025年全年 | 4573亿元 | 392亿元 | 约10% | 41.1万辆 | 331亿元 |
| 2026年一季度 | 991亿元,同比少10.9% | 61亿元,同比少43% | 10.1% | 8.1万辆 | 90亿元 |
| 2026年二季度 | 1089亿元 | 62亿元,同比少43% | 8.5% | 10.4万辆 | 92亿元 |
利润为什么少了四成? 主要是内存涨价。手机里那颗内存芯片,2026年上半年价格大涨,外部研报估算涨幅接近三倍,涨价全砸在手机最薄的那层毛利上。二季度它手机毛利率掉到8.5%,出货量3120万台,比去年同期少了26.5%。日经新闻6月底报道,小米把2026年的手机出货目标从1.35亿台砍到了9500万台上下;到8月发中报时,管理层又把目标调回到1.1亿台。
它的应对是往贵的卖。二季度每台手机的平均售价1351元,比去年同期高了25.9%;在中国市场,它卖出的手机里三千元以上的高端机占了32.1%。卖得少了,单价高了,收入勉强稳住,但内存涨价吃掉的毛利没补回来。
汽车那边也在降温。二季度汽车分部毛利率从上一年的26.4%降到19.2%,这个季度汽车及AI创新业务经营亏损26亿元,一季度亏31亿元。汽车交付还在涨,但每辆车赚的钱在变少。公司在财报里把原因归到内存涨价和规模;对手变多、价格战开打,是我看到的另一层。
把这几张表合起来看,它现在的处境是:最大的一块收入毛利越来越薄,最赚钱的一块靠用户数撑着,新的一块刚不亏又开始亏,同时还要往AI、芯片、汽车三个方向砸几百亿。一家公司在这种时候,为什么还要花钱做一个免费送人的模型?先看它这一年半是怎么走到今天的。
四、从7B到1.02T:罗福莉来了十个月,模型分数从26涨到46

小米做大模型多久了? 认真做,是2025年开始的。2025年4月30日,它开源了第一个自研的推理模型MiMo-7B。推理模型就是答题前会先一步步想的模型。
MiMo-7B有70亿参数,预训练读了25万亿token的文本,在数学竞赛题上的分数超过了OpenAI当时的o1-mini。那时候业内没太当回事,一个手机公司发个小模型,跟着说一声「我们也有」而已。
但这个小模型说明了一件事:小米从一开始就自己做预训练,不是拿别人的模型改一改。这条路贵,一家手机公司走这条路,说明它早就决定了模型要自己攥在手里。
转折点是什么? 罗福莉来了。她1995年生,四川人,北京大学计算语言学硕士,先在阿里达摩院做研究,2022年加入幻方量化,也就是后来DeepSeek的母体,是DeepSeek-V2的核心作者之一。2024年底外面传雷军开出千万年薪请她,双方都没确认这个数。
2025年她从DeepSeek离职,2025年11月12日在朋友圈宣布加入小米,职务是MiMo大模型负责人。她当时写了一句:「智能终将从语言迈向物理世界。」这句话后来成了小米做模型的理由:模型最终要装进手机、汽车和机器人,不只是在聊天框里回答问题。
她来了之后做了什么? 来了一个月就发了第一个大东西。2025年12月17日,小米的合作伙伴大会上她第一次公开露面,发布MiMo-V2-Flash,3090亿参数,开源。她当时说这只是「AGI路线图上的第二步」。AGI就是通用人工智能。
她还给了几个数:价格略低于当时的DeepSeek-V3.2,推理速度是它的三倍,谷歌Gemini 2.5 Pro的推理成本是它的20倍。
2026年4月28日V2.5开源那天,小米还做了两件事。一是宣布一个叫Orbit的计划,一个月内送出100万亿token的免费额度给开发者;二是官方稿写明,模型发布当天就适配了阿里的平头哥、百度的昆仑芯、沐曦等国产芯片。意思是它的模型不只能跑在英伟达的卡上,国产的卡当天就能跑。之后的节奏是这样的:
| 时间 | 模型 | 开不开源 | 关键数字 |
|---|---|---|---|
| 2025年4月30日 | MiMo-7B | 开 | 70亿参数,数学题超o1-mini |
| 2025年12月17日 | MiMo-V2-Flash | 开 | 3090亿参数,罗福莉首秀 |
| 2026年3月18日 | MiMo-V2-Pro | 不开,只有API | 1万亿参数,雷军说三年AI投600亿元 |
| 2026年4月28日 | MiMo-V2.5和V2.5-Pro | 开,MIT协议 | Artificial Analysis 26分 |
| 2026年9月22日 | MiMo-V2.6系列 | 开,MIT协议 | Artificial Analysis 46分,开放权重第一 |
这张表里有个细节。2026年3月的V2-Pro没开源,一个月后的V2.5开了,之后就一直开。中间还有个插曲:2026年3月11日,OpenRouter平台上出现了一个匿名模型叫Hunter Alpha,免费给开发者用,一周内处理了超过1万亿token,很多人以为是DeepSeek的新模型,3月18日罗福莉揭晓那是早期的MiMo-V2-Pro。它在正式发布之前,先用匿名的方式让全世界的开发者白用了一周。
中间的半年为什么没动静? 罗福莉9月17日自己解释了:4月开源V2.5之后,小米「沉寂了近半年」,把时间花在研究一件事上,强化学习到底能扩展到多远。她后来对媒体说,V2.6的研究创新和工程难度「甚至超过」她参与过的DeepSeek R1。她还说,按算力投入算,这可能是开源模型团队迄今规模最大的单次强化学习训练之一。她还说了一句话,大意是:在算力极度稀缺的年代,小米仍然让一支几十人的团队,长期围着同一个目标做事。
团队是什么样的? 雷军2026年3月给过一个画像:平均年龄25岁,六成以上来自清华北大,博士占55%。罗福莉自己的说法是「一支数十人的团队」。几十个25岁上下的年轻人,半年只做一件事,这就是那6天背后的人。
大模型和手机芯片、汽车是什么关系? 这三件事在小米内部是一件事。雷军2026年1月初说,2026年小米预计在一款终端上实现自研芯片、自研系统、自研大模型的「大会师」。翻译一下:它要做一部手机,芯片是自己的玄戒O1,系统是自己的,里面的AI是自己的MiMo。玄戒芯片四年花了135亿元,团队2500人,2026年4月雷军宣布它的出货已经超过100万颗。
这条线捋清楚了:2025年4月发第一个小模型,11月请来DeepSeek的核心作者,12月发3000亿参数的模型,2026年4月发1万亿参数的开源模型,9月拿到开放权重榜第一。十七个月,从跟着说「我们也有」,到让全世界的开发者去下载它的模型。下面说它最狠的一招。
五、最狠的一招:把训练过程直播,把题库送人,用免费换用户

它免费送的到底是什么? 一个训练好的模型,值钱的部分有三层:模型文件本身、训练它的方法、训练它用的题和数据。以前中国的开源模型大多送第一层,也就是权重,方法写在论文里,题库不给。小米这次三层送了两层半:权重、训练框架、7000多个任务环境和打分规则全公开,只有预训练数据没给。用MIT协议,拿去商用、改名、卖钱都可以。
为什么一家手机公司舍得? 回到第二节那句「硬件不超过5%」。小米的生意从第一天起就是「用便宜的东西圈用户,在别的地方收钱」。模型对它来说是圈用户的新工具,逻辑和1999元的手机一样。它免费送模型,换来的是四样东西,一张表列清楚:
| 送出去的 | 换回来的 | 现在能看到的证据 |
|---|---|---|
| 模型权重(MIT协议) | 全球开发者的使用量和口碑 | V2.5登OpenRouter周榜月榜第一,单周10.5万亿token |
| 训练框架和7000个任务环境 | 研究圈的信任和人才 | 卡内基梅隆的Tim Dettmers等多位研究者公开点评 |
| 训练直播看板 | 「小米真在做前沿研究」这个认知 | 高盛发报告说强化学习的瓶颈已转向工程优化,继续给「买入」评级 |
| 便宜的API | 开发者从对手那里转过来 | 每道题0.13美元,同分里最便宜的一档 |
这条路径具体怎么走? 分三层。第一层,开发者免费下载权重,或者用便宜的API试用,试出效果就留下。第二层能收到现金:留下的人付钱买API,或者订阅桌面客户端。
第三层是它和月之暗面、智谱这些纯模型公司不一样的地方:模型最后要装进它自己的手机、汽车、家电里。它有7.66亿月活跃用户的手机、70多万辆在路上的车、10亿多台联网设备,这些设备用的AI如果是自己的,就不用给别人付钱,还能把用户留得更牢。
| 层级 | 谁在用 | 小米收什么 |
|---|---|---|
| 免费层 | 全球开发者下载权重、试用API | 收使用量、口碑、榜单排名 |
| 付费层 | 企业和开发者买API,个人订阅桌面客户端 | 收现金,Pro每百万token输出6元 |
| 自用层 | 小米手机、汽车、家电里的AI助手 | 省下付给别家模型的钱,把7.66亿用户留住 |
说白了就是:模型是它整个硬件生意的新配件,配件免费送,主机照样卖。
直播训练图什么? 图两件事。第一件是省广告费。一个卖手机的公司发大模型,外界的第一反应是「跑分肯定调过」,这种不信任靠新闻稿消除不了。把训练看板开着,每小时烧3万美元给人看,通过率一步一步涨给人看,事故也通报给人看,比任何发布会都管用。
效果有数字可看。美国程序员聚集的论坛Hacker News上,关于这次发布的讨论帖拿了上千个赞、四百多条评论,是那几天最热的技术帖之一,夸的人夸看板透明、敢把弱项写出来。Jina AI的创始人肖涵在社交平台上说,这个做法「大胆与开放」,还开玩笑说应该把看板的动图发给财务负责人看。
第二个作用是招人。罗福莉的团队要招的是能做强化学习的研究员,这批人全世界都在抢,钱不是唯一的筹码。一个团队敢把训练过程直播、敢把题库送人,等于在告诉同行「来我这儿你能做真东西」。雷军在3月19日的采访里说过,全世界的开发者评价V2-Pro「智商高、情商也高」,这些评价都是它招人时的名片。
为什么说强化学习是它这次的赛点? 一句话讲清楚强化学习和预训练的区别:预训练是让模型读遍全网,学会说话;强化学习是让模型做题,学会做事。模型读完全网之后各家差不多,做题练出来的差距才是真差距。高盛这次的报告说了一句话,强化学习的瓶颈已经转向工程优化,意思是谁的工程做得细,谁就能用同样的算力练出更强的模型。小米这6天做的正是这件事:在前面半年打好的底子上,用347万美元、30步,把最后一段分数练了出来。
这一招的风险在哪? 它送出去的东西,对手也能拿。月之暗面、智谱、DeepSeek都能下载它的训练框架和题库,照着练。它拿到的先发优势,可能只有几个月。这也是为什么它把价格压到同分模型里最低的一档:先发优势保不住的时候,价格是最后一道门。
这就是它最狠的一招:把别人当命根子的东西送人,换用户、换信任、换人才,最后把模型装回自己的硬件里。招数讲完了,该泼冷水了。
六、光鲜背后:四盆冷水

先一张表看全,再一盆一盆说:
| 冷水 | 一句话 |
|---|---|
| 跑分第一,实用未必第一 | 和Opus 5共同的十来项测试里它输了大半,用户实测说它慢 |
| 蒸馏指控没有回应 | Anthropic 9月10日的报告点了它的名,小米到9月23日还没公开说话 |
| 主业在失血 | 手机毛利率跌到8.5%,利润少了四成,出货目标先砍后调 |
| AI花钱看得见,收钱看不见 | 三年投600亿元,财报里没有AI单独的收入 |
第一盆,跑分第一,实用未必第一。46分这个数字来自Artificial Analysis一家的一套题,换一套题结果就不一样。有人拿它自己公布的成绩单和Claude Opus 5逐项比过,两家共同覆盖的十来项测试里,它输了大半;一个叫Terminal Bench 4.0的命令行操作测试,它34.9分,Opus 5是49分;一个网络安全测试ExploitBench,它47.9分,GPT-5.6 Sol是78.5分。这些数字都印在它自己的模型卡上。模型卡就是它在下载页附的说明书。
它没藏,但新闻标题只写了46分。
还有一层要说清:除了Artificial Analysis那个46分,其他所有对比数字都由小米自己测,包括对手那一列,没有第三方验证过。Hacker News上也有人指出,直播看板什么都有,唯独没有数据集的说明,只给了一串编号。
用户实测的反馈更直接。技术论坛V2EX上有人说「跑分没输过,现实没赢过」,有人改代码试了两次没改好,换DeepSeek一次就好;也有人说桌面版比Kimi和DeepSeek好用不少。科技媒体差评做了三个任务,写一个小游戏用了18分半,用3D软件Blender建模一个半小时没做完,做PPT用了37分钟,结论是「慢是真的慢,但效果还不错」。慢这件事有数据支撑:Artificial Analysis实测它的输出速度是每秒54个token左右,同类开放权重模型的中位数是67个,它自己的页面也标了「比平均慢」。
还有一个尴尬的发现。B站一个测评视频的标题叫「怀疑小米发布错模型了」,因为便宜的Flash在好几项测试里反超了贵的Pro,作者后来重测又修正了部分结论。Flash是好事,说明便宜的那个够用;Pro就有点难堪,1万亿参数的旗舰,在某些任务上不见得比自家的小弟强多少。
第二盆,蒸馏指控没有回应。2026年9月10日,Anthropic发布了一份154页的威胁情报报告,点名七家中国AI公司用大量账号调用Claude、拿它的回答训练自己的模型,也就是名词表里说的「蒸馏」。七家是阿里、月之暗面、DeepSeek、智谱、MiniMax、商汤和小米。报告写小米这部分是:2026年3月到4月的20天里,大约1500个账号发起了40万次以上的对话,手法是把MiMo用户的会话和编程记录回放给Claude。
这个量级在七家里是最小的。阿里1.51亿次,月之暗面2300万次,DeepSeek1210万次,小米40万次,只有阿里的零头。但报告里点名就是点名,2月份Anthropic第一次发蒸馏报告时没有小米,9月这份有了。
Anthropic这边,报告的证据是它自己的账号监测数据,外界看不到原始记录,Anthropic也没有把「40万次对话」和MiMo-V2.6的分数直接挂钩。
Anthropic的动作是实际的:API不再返回完整的推理过程,只给摘要;对中国、俄罗斯、伊朗的账号加了身份验证。中国这边,商务部发言人9月9日回应美国三家安全机构前一天发的类似指控时说,这些说法「于事无凭,于法无据」,是把「蒸馏这一业内正常的技术和商业问题政治化」;Anthropic的报告出来后,外交部说不了解这份报告。小米和MiMo团队到9月23日为止,没有公开回应过这件事,中文媒体报道V2.6时几乎没人提这份报告,英文媒体The Next Web则在报道里强调,这次发布离Anthropic点名只有12天。
记一笔:一家把训练过程直播出来证明自己「真在做研究」的公司,到9月23日没有回应「拿别人的回答训练」这个指控。Anthropic那份154页的报告点了七家中国公司的名,七家各有各的账,放在这篇里说不清,等我把七份材料看完再开一期。
第三盆,主业在失血。 第三节的表已经说了,2026年前两个季度它的经调整净利润都比上年少了四成多,手机毛利率从两位数掉到8.5%,出货目标从1.35亿台砍到9500万台,8月又调回1.1亿台,比年初的目标还是少了两成。内存涨价这件事不由它控制,三星、SK海力士、美光把产能优先给了AI服务器,手机厂只能抢剩下的。它的手机业务2025年占收入四成,这四成正在变薄。
股价的反应也说明了市场的看法。9月21日消息传开那天小米涨了4.47%,收27.58港元;9月22日正式发布当天反而跌了超过1%,公司当天从股市买回了180万股自己的股票,花了约4900万港元;9月23日又跌了超过3%,同一天智谱跌了超过12%,因为Anthropic和OpenAI各推出了更便宜的模型。投行会给股票打评级、定目标价,买入是看好,中性是不看好也不看坏。高盛继续给它买入评级、目标价39港元;瑞士的UBS给中性,目标价从32.2港元下调到30.4港元。一个模型登顶,没能把它的股价托住两天。
第四盆,AI花钱看得见,收钱看不见。 雷军说三年至少投600亿元做AI,2026年一年就超过160亿元。收入那边,财报把AI和汽车放在一个分部里,没有AI的单独收入。能看到的只有两个间接信号:OpenRouter榜单上的使用量,和「其他相关业务收入」这一小项,二季度10亿元,同比多了56.5%。600亿对10亿,中间隔着很远。
免费送模型这件事本身也压着收入。它把Pro的API价格定在每百万token输出6元,同一天Anthropic把Opus 5.5的输出价定在20美元,两边差20倍以上。便宜是它的武器,也是它的天花板:一个每道题只收0.13美元的模型,要靠多少道题才能收回600亿?
普通人还要知道一件事:这个模型你大概率跑不了。1.02万亿参数的Pro,官方的部署说明要8张英伟达H200显卡,显存加起来至少680GB,模型文件566GB。一张H200几十万元,8张就是几百万元。普通人能自己跑的只有那个90亿参数的小模型,压缩后只要几个GB显存,一张游戏显卡够了。「开源」两个字对个人开发者的实际意思是:你可以去看、去研究、去用它的API,但不是把它装在自己电脑上。
四盆水泼完,回头看它做成的事:一个手机公司,十七个月做到了开放权重第一。下面说它到底做对了什么。
七、它到底做对了什么

先说给做产品、做公司的人听的。
第一条,把「过程」做成产品。小米这次最出圈的东西是那块直播看板,模型反而排第二。技术圈对「手机公司做大模型」的默认态度是不信,它不辩解,把每小时3万美元的账单摊开给人看。对中国做AI的团队,这一条最容易学也最难学:容易在技术上没门槛,难在你得真有东西可以直播,事故通报出去还得兜得住。
第二条,一个团队,半年只做一件事。罗福莉说V2.6背后是半年的基础研究积累和工程试错,几十个人围着「强化学习能扩展多远」这一个问题。这半年小米没发新模型,外面说它掉队。国内很多团队的节奏是两个月一个版本,每个版本都要有新功能可以发新闻。小米这半年选了相反的路,结果是一次涨20分。
第三条,先想清楚模型装在哪。月之暗面、智谱做模型,模型就是产品,收入只能来自API和订阅。小米做模型,最后要装回7.66亿用户的手机和70多万辆车里,模型免费送出去,硬件照样卖。这个位置不是谁都有,但有硬件的公司都该想一想:你的AI是拿来卖的,还是拿来把主业做牢的?答案不一样,投入的方式完全不一样。
再说给普通人的,三件事。
一是看新闻学会问一句「谁打的分」。46分是第三方打的,「命令行测试34.9分对49分」是小米自己公布的,「跑分没输过,现实没赢过」是用户说的。三个来源三个结论,都对,只是回答的问题不一样。以后看到「某模型登顶」,先找那个分是谁打的,再找厂商自己的成绩单里有没有输的项,最后看用户论坛。三处都看过,你比多数新闻标题懂得多。
二是「开源」两个字对你有什么用。就三件事:能用便宜的API,能装桌面客户端,能看它的技术报告学东西。它不等于你能把它装进自己的电脑,那需要8张几十万元的显卡。想动手的人,从那个90亿参数的小模型开始,一张游戏显卡就够。
三是看硬件公司做AI,别只看模型分数。先问它的模型装进了哪台设备,再问那台设备卖得怎么样。小米的模型现在装在桌面客户端和API里,装进手机和汽车的那一天才是它的考试日。这个看法放在任何一家做硬件又做模型的公司身上都成立,苹果、华为、特斯拉都可以这么看。
这一节收一张表:
| 值得学的 | 该躲开的 |
|---|---|
| 把训练过程直播,用透明换信任,比发布会管用 | 别把「某榜第一」当成「全面领先」,厂商自己的成绩单里就有好几项输给Opus 5 |
| 一个团队围着一个问题做半年,一次涨20分 | 指控来了要回应,直播能证明真在做研究,证明不了没拿别人的回答 |
| 先想清楚模型装在哪,有硬件的公司AI可以免费送 | 别忽略主业的账,模型登顶那周,公司利润少了四成、股价跌了两天 |
几句真心话

这篇写的是小米的AI,不是小米的股票。它现在有三条烧钱的线,芯片、汽车、大模型,同时最大的一块收入正在变薄,这个组合在任何一家公司身上都算险。我不替它算能不能撑住,只说我接下来会看什么。
第一件,蒸馏指控它回不回应。到9月23日它还没说话。它回应了,我看它说什么、拿什么证据,这比模型分数更能说明这个团队的成色;它一直不回应,我会把这一条记在它的账上。
第二件,AI什么时候在财报里单独出现。现在AI和汽车挤在一个分部里,看不到它自己赚了多少。下一次季报出来,我会翻分部那一页,看「其他相关业务收入」那10亿元有没有继续涨,看管理层在业绩会上有没有给AI一个单独的数。什么时候它敢单列,什么时候AI才算从成本变成了生意。
第三件,那个「大会师」的手机出不出来。雷军说2026年要在一款终端上把自研芯片、自研系统、自研模型装在一起。这部手机出来那天,MiMo才算真正回到了它该在的地方。手机卖得动,前面600亿的投入就有了回收的路;卖不动,模型分数再高也只是研究成果。
最后留一个真问题:模型登顶当天股价跌,第二天再跌。我的读法是,大家更担心的是好模型救不救得了8.5%的手机毛利率。这个问题今天没有答案,我会一季一季盯下去。
参考资料
- Xiaomi MiMo-V2.6系列正式发布,小米MiMo官方文档,2026-09-22。
- Xiaomi MiMo-V2.6 Series: 3 New Models Officially Released,小米MiMo官方文档英文版,2026-09-22。
- MiMo-V2.6-Pro: Intelligence, Performance & Price Analysis,Artificial Analysis,2026-09-24读取。
- MiMo-V2.6-Pro-RL模型卡,Hugging Face,2026-09。
- MiMo-V2.6-Pro-RL部署说明,vLLM Recipes,2026-09。
- 小米MiMo-V2.5系列开源与Orbit百万亿Token计划,小米MiMo官方文档,2026-04-28。
- MiMo-V2-Flash Technical Report,arXiv,2026-01-06。
- MiMo-7B代码仓库,GitHub,2025-05-30。
- Detecting and countering misuse of AI: September 2026,Anthropic,2026-09-10。
- Detecting and preventing distillation attacks,Anthropic,2026-02-23。
- 雷军:未来五年小米将在核心技术研发领域投入2000亿元,新浪财经,2026-01-08。
- 雷军:玄戒O1是3nm旗舰芯片,四年已投入135亿元,腾讯新闻,2025-05-19。
- 小米向港交所递交IPO申请,雷军公开信承诺硬件综合净利率不超过5%,界面新闻,2018-05-07。
- 小米在港交所挂牌上市,人民日报海外版,2018-07-10。
- Xiaomi promises to give money back to customers if its profits get too high,TechCrunch,2018-04-25。
- Xiaomi to invest at least $8.7 billion in AI over next three years, CEO says,路透社,2026-03-19。
- 小米集团2025年营收4573亿元,汽车、AI成强劲增长引擎,新华网,2026-03-25。
- 小米集团2025年全年经调整净利润391.7亿元,财联社,2026-03-24。
- 小米集团发布2025年财报,新浪科技,2026-03-24。
- Xiaomi Corp Full Year 2025 Earnings Call Highlights,Yahoo Finance,2026-03-24。
- 小米集团2026年一季度营收991亿元,IT之家,2026-05-26。
- Xiaomi Corp Q1 2026 Earnings Call Highlights,Yahoo Finance,2026-05-26。
- 小米集团2026年二季度总营收1089亿元,经调整净利润62亿元,新浪科技,2026-08-19。
- Xiaomi Q2 2026 slides: EV growth and AI gains offset smartphone pressure,Investing.com,2026-08-18。
- Xiaomi (1810) Q2 2026 Summary,Quartr,2026-09-23。
- Xiaomi's EV Business Generates 23.9 Billion Yuan in Revenue in Q2 2026,盖世汽车英文版,2026-08-21。
- 小米集团2026年中报点评,H33研报,2026-09-07。
- Xiaomi, Oppo, Vivo slash shipment targets up to 30% amid memory crunch,日经亚洲,2026-06-30。
- Xiaomi's 2025 Results Show a Company Shifting From Phones to EVs and AI,HelloChinaTech,2026-03-26。
- 小米MiMo-V2.6发布:Pro与Flash双版本价格不变,IT之家,2026-09-22。
- 小米大模型登顶开源榜:6天训练花了347万美元,21世纪经济报道,2026-09-22。
- 小米刷AI大模型斩杀线,罗福莉:技术难度超过DeepSeek R1,36氪,2026-09-22。
- 1小时30000美元,罗福莉直播「烧钱」,腾讯科技(36氪转载),2026-09-18。
- 小米直播训练MiMo-V2.6,罗福莉称沉寂半年钻研一件事,IT之家(腾讯新闻转载),2026-09-17。
- 小米MiMo模型的性能如何,新浪极客前线,2026-09-23。
- 港股收评:小米集团跌超1%,新浪财经,2026-09-22。
- 港股收评:小米跌超3%,智谱跌超12%,新浪财经,2026-09-23。
- 小米集团-W 9月22日回购180万股,智通财经,2026-09-22。
- Xiaomi Corp stock gains support from buybacks and AI progress,ad-hoc-news,2026-09-22。
- 科创AI ETF标的指数涨超3.8%,小米发布并开源新一代MiMo大模型,新浪财经,2026-09-22。
- 「AI才女」罗福莉正式加入小米,中国基金报,2025-11-12。
- Chinese AI prodigy Luo Fuli joins Xiaomi as industry competition for talent heats up,南华早报,2025-11-12。
- 罗福莉执掌小米大模型首秀,InfoQ,2025-12-17。
- 「天才少女」罗福莉首秀:比DeepSeek更便宜、推理快三倍,钛媒体,2025-12-17。
- 小米SU7系列交付突破50万台,IT之家,2026-08-17。
- Anthropic指中国AI公司大规模蒸馏Claude,商务部与外交部回应,美国之音中文,2026-09-11。
- Anthropic Says Seven China-Based AI Labs Ran Industrial-Scale Claude Distillation Attacks,The Hacker News,2026-09-11。
- Xiaomi's MiMo-V2.6 tops the open-weight rankings,The Next Web,2026-09-22。
- Anthropic Disrupted Xiaomi's Industrial-Scale Distillation Campaign,Forkast,2026-09-23。
- Xiaomi's MiMo-V2.6-Pro debuts as the top open weights model in the world,VentureBeat,2026-09-21。
- Xiaomi introduces MiMo-V2.6 series open-source AI model family,SiliconANGLE,2026-09-22。
- Xiaomi Open-Sources MiMo-V2.6 With Pro, Flash, and 9B AI Models,eWeek,2026-09-23。
- Xiaomi MiMo-V2.6-Pro 1T-A42B: the new top Open Weights model, trained for $3M,Latent Space,2026-09-22。
- MiMo-V2.6: Xiaomi's Open 1T Model Hits 46 on the AA Index,CellCog,2026-09-22。
- 商务部回应美发布中国人工智能企业对美蒸馏活动相关网络安全公告,新华网,2026-09-09。
- 小米MiMo v2.6 Pro登顶国模分数第一,大家实测效果怎么样,V2EX,2026-09-22。
- 雷霆思考,慢到红温,但我觉得MiMo-V2.6及格了,差评XPIN,2026-09-23。
- Mimo 2.6 Flash测评报告:怀疑小米发布错模型了,B站AI产品狙击手,2026-09-22。
- MiMo v2.6讨论串,Hacker News,2026-09-22。
- #小米MiMoV2.6开源最强# 发了什么与短板,微博番茄酱爱番茄,2026-09-22。
以上仅为个人学习笔记与公开信息整理,不构成任何投资建议。投资有风险,决策请独立。
AI重度使用者|每天拆一家前沿公司|imluna.ai免费订阅|Learn in Public
