DeepSeek 涨价后,谁才是国内大模型性价比之王?一份真实比价调研
昨天 DeepSeek 官宣涨价(8 月 17 日生效,涨幅”较大”)。我把国内主流大模型的 API 和 Token Plan 价格全部拉了一遍官方页面,做了份对比。结论有点反直觉:DS 涨价,最大的受益者不是哪一家,而是”用户终于有了真实的比价空间”。
说明:以下价格均为人民币 / 百万 token,数据抓取自各官方定价页(2026-08-14),DS 涨价后价格为官方公布的 8/17 生效价。
一、先看 DeepSeek 到底涨了多少
官方人民币价(峰谷定价,高峰时段北京 9:00-12:00、14:00-18:00,闲时半价):
| 模型 | 输入(缓存命中) | 输入(缓存未命中) | 输出 |
|---|---|---|---|
| Flash 高峰 | ¥0.10 | ¥3.0 | ¥9.0 |
| Flash 闲时 | ¥0.05 | ¥1.5 | ¥4.5 |
| Pro 高峰 | ¥0.30 | ¥9.0 | ¥27.0 |
| Pro 闲时 | ¥0.15 | ¥4.5 | ¥13.5 |
对照涨价前(8 月以前的官方价):
| 模型 | 命中 | 未命中 | 输出 |
|---|---|---|---|
| Flash 涨前 | ¥0.02 | ¥1.0 | ¥2.0 |
| Pro 涨前 | ¥0.025 | ¥3.0 | ¥6.0 |
涨幅一目了然:命中价 5~12 倍,未命中 3 倍,输出 4.5 倍。 涨得最狠的是”缓存命中价”–这恰恰是 Agent 场景最依赖的省钱项。
二、竞品现在什么价(官方价)
| 模型 | 输入 | 输出 | 缓存命中 | 定位 |
|---|---|---|---|---|
| MiMo-V2.5(小米) | ¥1.0 | ¥2.0 | ¥0.02 | 能用里最便宜,1M 上下文 |
| MiMo-V2.5-Pro(小米) | ¥3.0 | ¥6.0 | ¥0.025 | 旗舰,1M 上下文 |
| Kimi K3 | ¥20 | ¥100 | ¥2.0 | 旗舰,1M 上下文 |
| Kimi K2.7 Code | ¥6.5 | ¥27 | ¥1.3 | Coding 模型 |
| MiniMax M3(永久五折) | ¥2.1 | ¥8.4 | ¥0.42 | Agentic 模型 |
| MiniMax M2.7 | ¥2.1 | ¥8.4 | ¥0.42 | 中端 |
| 阿里 Qwen3.8-max | ¥12 | ¥36 | – | 旗舰,阶梯价 |
| 腾讯混元 role-latest | ¥2.4 | ¥9.6 | – | 正迁 TokenHub |
| 智谱 GLM-5.3-Flash(限时5折两周) | ¥0.4 | ¥1.4 | ¥0.115 | 原生多模态,1M上下文,新架构 |
| 智谱 GLM-5.3 | ¥8 | ¥28 | ¥2 | 旗舰,1M 上下文 |
| 智谱 GLM-5.2 | ¥8 | ¥28 | ¥2 | 旗舰,1M 上下文 |
缓存命中价透明度注释: DS 和 MiMo 的缓存命中价为官方明确披露。GLM-5.2 和 Kimi 系列的缓存命中价来自官方定价页(GLM 按积分系数折算,Kimi 直接列出)。阿里 Qwen3.8 和腾讯混元未披露缓存命中价(表中标”-“),Agent 场景实际成本可能远高于预期。
几个关键看点:
-
MiMo-V2.5 的价格,跟 DS 涨价前”一模一样”。小米 MiMo 的国内定价:mimo-v2.5 命中 ¥0.02 / 未命中 ¥1.0 / 输出 ¥2.0,pro 命中 ¥0.025 / 未命中 ¥3.0 / 输出 ¥6.0–这正是 DS Flash/Pro 涨价前的价位。换句话说:DS 涨价后,MiMo 原地站到了”涨价前的 DS”那个位置上。而且 DS 全系 V4 模型(Flash/Pro/Vision)同样支持 1M 上下文(DS 官方定价页已明确标注),MiMo 也是 1M 上下文。但 DS 的 1M 上下文并没给它带来价格优势——涨后价格已经比 MiMo 贵了。按老沙的话–“能用的里面最便宜,很多算不得能用的,便宜与否都没价值“。
-
智谱 GLM-5.2 也在涨,但涨的是能力。GLM-5(¥4/¥18)→ GLM-5.1 → GLM-5.2(¥8/¥28),价格翻了一倍,但换来的是 1M 真无损上下文 + Coding 开源 SOTA + Code Arena 全球第一。同样涨价,GLM 是”加量也加价”,DS 是”加价不加量”–这是二者的本质区别。
-
MiniMax M3 永久五折后,输出 ¥8.4,已经跟 DS Pro 涨后价(¥27)拉开 3 倍差距。而且 M3 是”Agentic Model”,工具调用是强项。
-
Kimi K2.7 Code 输出 ¥27,正好跟 DS Pro 涨后价打平。但 Kimi 的缓存命中 ¥1.3 比 DS 的 ¥0.30 贵 4 倍–DS 涨后仍是缓存命中最便宜的。
-
谁都没想到的是:DS 涨完之后,”便宜”这个标签,它自己亲手撕掉了。 一年前 DS 是”碾压级便宜”,现在只是”缓存命中还便宜,输出跟 Kimi 打平,未命中跟 MiniMax 一个价”。
三、Token Plan 的坑(这才是真正的暗礁)
按量付费的 API 价格好对比,但各家 Token Plan(订阅套餐)里的坑,才是普通用户最容易踩的:
1. 额度窗口陷阱(老沙重点提醒,智谱官方文档原话作证)
Plan 套餐的额度常常不是”一个月随便用”,而是拆成多层。智谱 GLM Coding Plan 的官方文档把坑写得明明白白:
| GLM 套餐 | 5 小时积分 | 每周积分 | 月费 |
|---|---|---|---|
| Lite | 2,000 | 10,000 | ¥118 |
| Pro | 12,000 | 60,000 | ¥538 |
| Max | 28,000 | 140,000 | ¥1,078 |
官方原文一句话点破陷阱:
“当套餐额度耗尽后,需要等待下一个 5 小时周期恢复额度,系统不会继续消耗你的其他资源包/账户余额。”
翻译成大白话:你 Pro 套餐 5 小时刷爆了 12,000 积分,剩下 3 小时就只能干瞪眼–它不会动用你账户里另外充的钱来续航,硬等 5 小时窗口重置。 这就是”5 小时额度 + 周额度联动”的坑:
- 5 小时积分:请求消耗 5 小时后动态刷新
- 周积分:下单日起 7 天周期刷新
- 最坑的是:5 小时没超,但周额度超了(Pro 每周 60,000),一样停你
2. 阿里 Token Plan 的”烧积分”不透明
阿里的 token plan 用积分制,积分和实际 token 的换算不透明,用户很难算清”我这笔钱到底买了多少 token”。GLM 至少给了抵扣系数(GLM-5.2:输入 6.9 / 缓存 1.7 / 输出 24),阿里更黑箱。
3. MiniMax 的双轨:API 和 Token Plan 同时存在
MiniMax 既有按量 API,又有 Token Plan(Plus ¥49 / Max ¥119 / Ultra ¥469/月)。网友普遍觉得 API 透明划算,Plan 的积分和额度窗口容易踩坑。
4. 腾讯混元正在”搬家”
腾讯混元大模型正在迁往 TokenHub,迁移期间原平台停止新购。这本身就是个信号–云厂商的模型计费体系还在动荡。
5. GLM 的”最高省 92%”宣传,靠的是非高峰半价
GLM Coding Plan 宣传”相比按量 API 最高省 92%”,但这是把活全安排在非高峰(周一到周五 14:00-18:00 之外)才算出来的。高峰时段积分抵扣翻倍,省的钱大打折扣。
四、拿一个真实账号算账:10 亿 token 到底花多少?
比单价是纸上谈兵,真正的账要看“一个真实工作负载”。这里用一个 Agent 重度用户的真实样本(缓存命中率 93.7%、输出占比仅 0.59%)外推到 10 亿 token,套各家的缓存命中价算总账单:
| 模型 | 10 亿 token 总价 | 相对 DS 涨前 |
|---|---|---|
| DS Flash 涨前 / MiMo-V2.5 | ¥93 | 1x |
| DS Flash 涨后闲时 | ¥167 | 1.8x |
| DS Pro 涨前 / MiMo-V2.5-Pro | ¥247 | 2.7x |
| DS Flash 涨后高峰 | ¥335 | 3.6x |
| DS Pro 涨后闲时 / MiniMax M3 | ¥500~573 | 5.4x |
| DS Pro 涨后高峰 | ¥1004 | 10.8x |
| Kimi K2.7 Code | ¥1778 | 19x |
| 腾讯混元 | ¥2442 | 26x |
| GLM-5.3-Flash(限时) | ¥1390 | 14.9x |
| GLM-5.3-Flash(原价) | ¥2700 | 29x |
| GLM-5.2 | ¥2530 | 27x |
| Kimi K3 | ¥3706 | 40x |
| 阿里 qwen3.8-max | ¥12141 | 130x |
三个致命发现:
1. Agent 重度用户是“超级缓存敏感型”,几乎只能留 DS
这个样本 93.7% 的输入靠缓存命中、输出占比才 0.59%。这意味着账单几乎完全由“缓存命中价”决定:DS 涨后命中 ¥0.30 仍是全场最低,MiMo 命中 ¥0.02(跟 DS 涨前一样),GLM-5.3-Flash 限时命中 ¥0.115、MiniMax ¥0.42、Kimi ¥1.3、GLM-5.2 ¥2。换任何一家,账单立刻 6~40 倍起跳。 GLM-5.3-Flash 限时价是唯一接近 DS 的选项(¥1390 vs DS ¥335),但两周后回到 ¥2700。**
2. 涨价对这类用户的真实冲击:“半条烟变一条出头”,涨 3 倍
按 Flash 真实样本:涨前 ¥93 ≈ 不到半条烟,涨后(峰谷混用约 ¥250)≈ 一条烟。不是“五条烟”那么夸张(那是 Pro 高负载场景),但陡增 3 倍的“倍数感”,对习惯了 ¥93 的用户就是“突然贵了”。
3. 阿里 qwen3.8-max 是灾难性的 ¥12141——因为没缓存命中
这个极端数字是真实的:如果阿里不支持缓存命中(或命中价极高),那 9.3 亿命中 token 全按未命中价 ¥12 算,直接爆到 ¥12000+。这解释了为什么“便宜”的云厂商模型,对 Agent 重度用户反而是天价——它们便宜的是“输出”,但你根本不怎么输出,你烧的是“缓存命中”,而这块阿里没给你便宜。
结论:你不是“用不起 DS 涨后的价”,你是“除了 DS 无处可去”。 因为你的工作负载把“最便宜的缓存命中价”变成了生死线,而这条线全市场只有 DS(¥0.30)和 MiMo(¥0.02)压得低。
五、社区口碑(比官方价格更真实)
调研里最有价值的部分,其实是社区玩家的一手体感:
- opencode go 接 DeepSeek:便宜,但API 响应慢,是拿”速度”换”便宜”。
- MiMo API vs Token Plan:API 透明划算,Plan 有额度窗口坑。
- 自部署 DeepSeek Flash:有人自己部署省钱,但运维成本 + 响应质量参差。
- MiniMax 本行是 H3 生视频,代码模型 M2.7/M3 被当”廉价 sub-agent”用,是拿弱项当替补。
六、涨价后,我的选型建议
不搞”谁最强”,只讲”按场景怎么选”:
| 你的场景 | 建议 |
|---|---|
| 重度 Agent、缓存命中率高、图便宜 | MiMo-V2.5(价格=DS 涨前)优先,DS 涨后已不香 |
| 长文档、长上下文(>300K) | MiMo V2.5(唯一 1M 上下文统一费率) |
| Coding、缓存命中极敏感 | Kimi K2.7 Code(命中 ¥1.3)或 GLM-5.2(1M 上下文 + Coding SOTA,但贵) |
| 想省事、能开 Plan、不介意积分 | 阿里百炼(但积分不透明,要自己算) |
| 企业合规、多语言 | 腾讯混元 / 阿里(云厂商 SLA 成熟) |
| 生视频 | MiniMax H3(这才是它本行) |
七、一句总结
DeepSeek 涨价,最大的意义不是“它贵了多少”,而是它亲手把“最便宜”这个标签撕了,于是用户第一次认真去比价。
而比完价才发现:国内大模型的价格战,远没到“谁赢”的时候,只到“谁先扛不住涨价”的时候。 DS 用三个月推翻了它自己的“永久降价”承诺,而小米 MiMo 则默默停在了“涨价前 DS”的位置上——DS 自己把“最便宜”的王座腾了出来,MiMo 顺势坐下。
更关键的分野是:同样是涨价,智谱 GLM 涨出了 1M 上下文和 Coding SOTA,DS 涨出了一个“交代”。 一个是在为能力定价,一个是在为融资窗口期的生存定价——这决定了两家下一轮用户用脚投票的方向。
但别急着欢呼 MiMo 是“替代答案”,它可能是“下一个 DS”。如果传闻属实(小米把 MiMo 压到 DS 价位是雷军找罗福莉提的要求),那 MiMo 的低价就不是市场策略,而是老板意志 + KPI 的产物——跟 DS 当年一模一样:都是“憋着等收割”,不是“想服务用户”。 等缓存敏感的用户彻底没了别的选择,“最便宜”的王座就该轮到它也顺手涨一波了。到那时,普通用户不是“换一辆更便宜的自行车”,而是从蹬惯了的自行车上下来,跟 AI 说拜拜。
附:本文价格抓取时间 2026-08-14,官方价随时可能变,实际下单前请以各平台实时页面为准。