
你可能还没注意到,但中国AI行业正在经历一场定价革命。DeepSeek突然宣布API大幅涨价,智谱的GLM-5.3马上要冲万亿参数。这两件事看似独立,实际上指向同一个信号——AI大模型终于要从烧钱阶段,进入收割期了。有意思。
过去两年,大模型公司拼命压价,DeepSeek一度把API价格打到同行十分之一甚至百分之一,逼得整个行业跟着出血。现在呢?DeepSeek自己先涨价了。智谱也没闲着,GLM-5.3的参数从7400亿要跳到万亿级别,市场预期是”史诗级Plus”。这两步棋走完,大模型的商业逻辑就彻底变了。
说真的。
🔥 DeepSeek为什么敢涨价?底气从哪来
先看一个数据:OpenRouter最新周榜显示,DeepSeek V4-Flash单周调用量达到7.22万亿Token,全球第一。连续十四周,中国大模型周调用量碾压美国,28万亿对4万亿。这个差距不是一点点。
用户黏性已经建立了。
DeepSeek敢涨价的核心逻辑,就是调用量太大了。7.22万亿Token的周调用量意味着什么?意味着无数开发者的应用已经跑在DeepSeek上面,迁移成本极高。你现在涨价,他们骂两句,但不会走。这就是规模效应带来的定价权。当年AWS也是这么干的——先白菜价抢市场,等生态长出来,价格想怎么调就怎么调。
但DeepSeek涨价的另一个原因,可能跟即将上线的V4-Pro正式版有关。Pro版本性能更强,推理成本也更高,调价是为了给新版本腾出定价空间。说白了,便宜的产品线和贵的产品线要分层了。这步棋很聪明。
💡 智谱GLM-5.3:从7400亿到万亿的跨越
智谱这边也没闲着。创始人确认新一代GLM-5.3大模型即将发布,市场预期参数从GLM-5.2的7400亿级跳到万亿以上。什么概念?阿里Qwen3.8-Max是2.4万亿,Kimi K3是2.8万亿,字节跳动在讨论5万亿。万亿参数已经是头部玩家的入场券了。
但参数不是重点。
GLM-5.2在Artificial Analysis评测中拿了52分,是国产模型里第一个在编程能力上比肩美国前沿大模型的产品。如果GLM-5.3能按预期实现5分左右的综合能力跃升,那就有机会追平甚至超越Claude和GPT的前沿版本。这才是关键——不是参数大就行,是能力得跟上去。
智谱的股价已经替市场做了回答。8月7日港股智谱涨超16%,MiniMax涨超22%,高盛直接把中国AI大模型2026年经常性收入预期从100亿美元上调到130亿美元。资本是最诚实的。
🎯 涨价潮背后的AI商业化拐点
你可能会问:涨价不是坏事吗?用户不是会流失吗?
恰恰相反。
大模型行业过去两年的核心问题不是价格太高,而是价格太低。低到什么程度?DeepSeek V4-Flash的价格只有Claude Opus的百分之一。51万Token才花0.53元。这个价格意味着什么?意味着这些公司每提供一次服务都在亏钱。烧投资人的钱补贴用户,不可持续。
涨价说明三件事:第一,模型公司终于开始算经济账了,不能再无底线烧钱。第二,用户黏性已经足够强,涨价不会导致大规模流失。第三,分层定价的时代来了——便宜模型做量,贵模型做利润。
高盛的报告验证了这个判断。他们把智谱、MiniMax全年收入预期大幅上调,理由是业务结构正在向高增长API业务倾斜。什么意思?就是这些公司不靠融资活着了,开始靠卖API赚钱了。这是AI行业从”烧钱叙事”到”商业兑现”的分水岭。
机构说得好:AI从”宏大叙事”转向”兑现证据”。
🔮 竞争格局会怎么变
DeepSeek涨价,智谱冲万亿参数,字节跳动要搞5万亿但张一鸣明确反对蒸馏——这些动作叠加在一起,意味着中国AI大模型竞争进入了一个全新阶段。
什么阶段?
不再是比谁便宜,而是比谁能真正干活。阿里把Qwen3.8接入千问办公,在钉钉生态里落地企业级Agent。智谱GLM-5.2的编程能力已经比肩美国前沿模型。DeepSeek V4-Flash的Agent能力逼近Claude Opus。大家都在往应用层冲,往产业里扎。
字节跳动的策略最有意思。CEO梁汝波说”接受短期落后”,张一鸣禁止蒸馏技术,理由是”蒸馏最多只能逼近对方,很难真正实现超越”。这是一种长期主义的赌注——不追求短期排行榜好看,而是赌自研能跑通从基础研究到产业落地的完整链路。
这是对的。
大模型的终局不是排行榜上的分数,而是谁能真正渗透进千行百业的工作流。DeepSeek涨价是因为用户跑不掉,智谱冲万亿参数是因为能力要够用,字节拒绝蒸馏是因为想要原创。三条路,殊途同归——都在往”能干活、能赚钱”的方向走。
我的判断是,2026年下半年会是AI行业的一个分水岭。前半场比参数、比价格、比榜单;后半场比的是谁能真正把技术翻译成生产力。DeepSeek和智谱的这波操作,不过是后半场开场哨。真正的较量,才刚刚开始。















