小米MiMo-V2.5:99元买2亿Token,国产模型价格战打到最低点了
小米悄悄干了一件大事:今天凌晨发布的 MiMo-V2.5 系列,不只是刷新了性能榜,更是直接把国产模型的定价打到了一个新低点——99元套餐,2亿Token,每百万Token仅5毛钱。
这不是打折促销,这是新的定价基准线。
MiMo-V2.5 系列到底发了什么?
这次发布是两个型号一起来,要分清楚:
MiMo-V2.5-Pro(旗舰推理版)
- 测试成绩直接对标 Claude Opus 4.6,编码和通用任务超越同梯队竞品
- API价格:1 Token = 2 Credits
- 官方定位:国产第一梯队旗舰推理模型
MiMo-V2.5(全模态版,替代上一代Omni)
- 上一代叫 MiMo-V2-Omni,这一代直接去掉”Omni”后缀,名字变简单了
- Agent能力全面超越上一代Pro,多模态感知秒杀上一代Omni
- 支持:文字 / 图片 / 视频 / 音频,无短板水桶模型
- 最关键的升级:上下文从上一代的短窗口升级到原生100万(1M)——和Pro齐平了
- TPS 达到100-150 tokens/s,推理速度更快
- API价格:1 Token = 1 Credit(比Pro便宜一半)
以前的 Omni 版本,能力全面但上下文短是硬伤。这次把这个短板补上,全模态版终于是真正的无短板了。
Token Plan 大改:计价逻辑变了
这次除了模型本身,Token Plan 的计费规则改了,这才是真正影响开发者的大事。
旧规则:按上下文窗口长度计倍率,开个长对话花的 credit 是普通对话的几倍,算起来很烦
新规则:统一计价,不再按上下文窗口计倍率
- MiMo-V2.5(全模态):1 Token = 1 Credit
- MiMo-V2.5-Pro:1 Token = 2 Credits
- 不管对话多长,就是这个固定倍率
换算下来怎么算:
99元标准套餐 = 200M Credits 全用 MiMo-V2.5(倍率1)= 2亿 Tokens 每百万 Token = 5毛钱 这还没算夜间优惠 / 老用户折扣 / 年订阅折扣
横向对比:腾讯同价套餐根本打不过
视频里做了一个直接对比,把腾讯同价位的套餐拉出来对:
| 维度 | 小米 99元套餐 | 腾讯 99元套餐 |
|---|---|---|
| Token总量 | 2亿 | 1亿 |
| 可用模型 | MiMo-V2.5系列(1M上下文) | 看着8款,实际可用仅2款 |
| 上下文长度 | 100万 | 200k |
| 计费规则 | 统一倍率,无额外乘数 | 复杂倍率 |
数字差距摆在那里,同价位差了4-5倍有效容量,上下文差了5倍,这场比较没有悬念。
用户福利:老用户这次没被背刺
发布新版本通常会让老用户觉得”买早了亏了”。小米这次的处理方式是:
- 老用户 Credits 用量全部重置:不管你之前用了多少,清空重来,等于白送一次额度
- 续费退差价:按老用户7折优惠退差价,不让人感觉被背刺
视频作者说他半个月前刚买了99元套餐,今天一觉醒来发现用量被重置,相当于用过的额度全送回来了。把”不背刺”做成内容主题,本身就是一种信任营销。
7段拆解:这条视频为什么有传播力
开头钩子
类型:竞品对标 + 反常识
第一句”小米真的要杀死比赛了”口语化,但”杀死比赛”直接炸出好奇心。紧接着抛出”Pro版对标Claude Opus 4.6”,在 AI 圈里这个对标有极强的信息密度——Claude Opus 4.6 是当下公认的顶级模型之一,说它能正面对标,等于说”我跟世界冠军在同一张桌子上打牌”。
AI 工具用户对”谁对标谁”极其敏感,这句话的留住率很高。
信息结构
全片120秒,节拍点清晰:
- 0-8s:性能钩子(对标Claude,抓注意)
- 8-30s:全模态新版本详解(能力升级点)
- 30-60s:Token Plan新规则+价格计算(核心卖点)
- 60-78s:竞品对比(横向证明)
- 78-98s:老用户福利(情绪加分)
- 98-119s:总结+使用背书
每个节点都带数字落地,没有一句”很便宜/很好用”的空话,全是”5毛钱/百万Token""2亿Tokens”这种可感知的具体量。
最有说服力的那句话
“现在Token Plan不再按上下文窗口计算倍率了,统一计价”
这句话的杀伤力在于它解决了一个真实的用户痛点——看不懂怎么算的混乱计费——而不只是说”便宜了”。简化计费规则等于降低心理门槛,这是产品设计和内容营销都值得学的一课。
CTA 设计
结尾展示”我已经设置为我的默认模型了”的界面截图,是最自然的信任背书——不是”快去买”式硬广,是”我自己就在用”的亲历背书。
有轻微沉锚设计:说腾讯套餐”毫无竞争力”这句有争议性,容易引发评论区讨论,腾讯用户会来反驳,这是在增加互动率。
可复制文案骨架
[开头钩子 - 竞品对标型]
「[品牌]真的要把比赛打穿了」——「[旗舰型号]直接对标[知名竞品]」
[核心信息 - 分3层]
① 能力升级:[新型号] [核心能力] 全面超越上一代 [旧型号],补上[旧硬伤]
② 计价升级:[旧规则复杂]→[新规则简单],[X元]套餐等于[N倍量]
③ 竞品对比:同价位[竞品]只给[1/N量],[差距项]一目了然
[转折句]
「这还没完,[老用户福利]额外补上来」
[收尾 + 自用背书]
「总结:[A]第一梯队、[B]无短板水桶,我已经设置为默认模型了」
适用场景:AI工具测评、SaaS产品定价重磅更新、竞品横向对比 预估完播率:高,数字密集+竞品对比让观众舍不得划走
4个角度的判断
对我们整盘棋的帮助
5毛钱/百万Token的全模态模型,直接改变了AI工具的选型逻辑。不需要顶尖推理能力、但需要多模态理解的场景(比如识图初筛、视频内容分析、批量文字处理),现在可以考虑MiMo-V2.5替代更贵的调用——边际成本降低是实的。
对橙子自己的帮助
抖音深扒流水线里的视频分析环节,MiMo-V2.5全模态支持视频输入+1M上下文,值得测试能否替代部分视觉分析的调用。它TPS高(100-150),快速响应场景有优势。下一步可以做个对比测试:相同视频,豆包视觉 vs MiMo-V2.5,分析质量对比。
对老大机构的帮助
公考内容体系运营涉及大量文本生成和题目解析,这类任务不需要世界顶尖推理能力,但要稳定、便宜、快。MiMo-V2.5把批量生产内容的边际成本降到接近零——题目解析、作业点评、课程讲义批量生产,都可以算一下迁移成本。
对未来发展的判断
这次发布释放了一个信号:国内大模型价格战已进入白刃阶段——不是百元降十元,而是直接打到5毛/百万Token这个量级。趋势判断:
- 便宜模型会继续卷,1毛甚至更低可以预期
- 未来的护城河不在模型便宜,而在应用层的工作流编排能力
- 真正的机会在:把廉价优质的底层模型包装成垂直场景的解决方案
提前布局的动作:工作流架构做成可热换底层模型的设计——每次价格战都是受益方,而不是被动应对”又便宜了要迁移一次”。
值得具体借鉴的点
- 竞品对比必须数字化:永远用具体数字对比,“X元买N量 vs 竞品X元只给N/2量”,比”便宜很多”有说服力100倍——这个公式直接可以搬到任何内容场景
- 把”不背刺”做成内容主题:老用户受益本来是理所应当,但把它说出来、做成宣发内容,本身是信任营销的一种,值得在机构营销里借鉴
- 简化计费=降低心理门槛:统一倍率这个产品决策,本质是在消除用户的理解成本和不确定性——任何自己的产品/服务都可以问一遍”有没有不必要的复杂度可以去掉”
结论
MiMo-V2.5 这次发布,性能够格 + 价格够炸 + 用户福利够实,三件事同时到位,是少见的组合拳。
从开发者角度说,5毛钱/百万Token的全模态模型已经把AI调用的边际成本降到可以忽略的量级。这不只是小米在秀肌肉——它在重新定义”什么样的场景值得用AI”的门槛。
当调用成本接近零,那些之前因为”太贵”而没用AI的场景,现在可以重新算一次账了。