mobile wallpaper 1mobile wallpaper 2mobile wallpaper 3mobile wallpaper 4mobile wallpaper 5mobile wallpaper 6mobile wallpaper 7
1497 字
4 分钟
大模型价格战下半场
2026-07-24

当推理价格被打到”白菜价”,大模型拼的就不再是模型了#

7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输入价格直接干到0.20美元/百万Token。同一个月里,腾讯Hy3把输入价格压到1元人民币/百万Token,Kimi K3开源后API定价只有Claude的三分之一,而一向以”价格屠夫”自居的DeepSeek,居然涨价了。你没看错——价格战打到最凶的时候,最便宜的那个人先涨钱了。

这件事比任何一次模型跑分刷新都更值得聊。因为它说明:大模型竞争的规则,已经悄悄换了一套。

发生了什么#

把时间线捋一遍。7月6日,腾讯发布混元Hy3,295B总参数、仅激活21B的MoE架构,输入1元/百万Token、输出4元,缓存命中更是只要0.25元。这是姚顺雨加盟后交出的第一份答卷,三天就冲上OpenRouter调用量第八。7月26日,月之暗面开源Kimi K3——2.8万亿参数、896个专家选16个激活,API输入3美元、输出15美元/百万Token,只有Claude Fable 5的34%。而DeepSeek呢?6月底V4最大降幅97.5%之后,7月转头引入”峰谷定价”:白天高峰时段价格翻倍。高盛的评价很直白:这不是需求变差,是行业从亏本换量回归理性。

一边是白菜价往死里卷,一边是最低价选手开始收钱。价格战的下半场,开场哨就是这么吹的。

为什么是现在#

答案藏在一个数字里:推理成本占模型生命周期计算开销的80%到90%。

上半场大家卷训练——谁参数大、谁跑分高。但训练是一次性的,推理是每天都在烧钱的。当模型能力差距缩小到用户感知不出来,真正的战场就变成了”每完成一个任务花多少钱”。阿里云把2026年AI投入的六成拿去买推理芯片,Meta要建60万张GPU的推理集群占预算55%,DeepSeek融了510亿第一件事是自研推理芯片——所有人都在干同一件事:把每个Token的成本往下砸。

IDC预测到2027年API均价会降到现在的五分之一以下。换句话说,今天觉得”已经够便宜了”的价格,两年后回头看还是贵的。

横向看对比#

把几家摆在一起看就有意思了。腾讯Hy3走的是”白菜价+自家生态”路线,背后是微信、企业微信、CodeBuddy这些分发渠道;Kimi K3走的是”开源+性价比”,用免费权重换开发者心智;DeepSeek走的是”成本极致化”,靠国产算力和架构优化把成本压到别人跟不上的地步。

而OpenAI降价80%这个动作,说明硅谷也坐不住了。以前是美国定价格锚点、中国跟着卷,现在反过来了——Kimi和DeepSeek把价格锚点拉到地板上,OpenAI不跟就丢企业客户。

我的判断是:模型本身正在变成”水电煤”,谁都能接、差别不大。真正拉开差距的是谁能把便宜的水电接到最多的电器上。微博上有句话说得对——“价格战打到尽头拼的就不是模型了,是生态和护城河。“CUDA有400万开发者,腾讯有十亿用户的社交入口,这才是别人抄不走的东西。

谁该关心#

开发者:最直接的受益者。推理便宜意味着Agent可以长时间跑、多步调用不再心疼钱。以前一个复杂任务调十几次API要算着花钱,现在可以让Agent自己”想清楚再动手”,试错成本趋近于零。DeepSeek的峰谷定价甚至催生了一种新玩法——把批量任务挪到晚上跑,成本直接砍半。

企业:选型逻辑要变了。别再盯着跑分榜,该算的是”每完成一个业务任务的总成本”。便宜但生态封闭的模型,可能不如贵一点但能无缝接入现有工作流的。

普通用户:短期感知不强,但长期意味着AI功能会变成App里的”默认配置”而不是付费卖点。

谁不适合:纯靠API转售赚差价的中间商,以及还在用”我模型跑分高”当唯一卖点的团队。价格战下半场,没有生态的模型就是裸奔。

一句话总结#

当推理价格被打到白菜价,模型就从”奢侈品”变成了”自来水”——没人会为自来水本身付溢价,但会为水龙头接在哪里、能浇什么地付钱。下半场的赢家,不是最便宜的那个,而是把便宜变成生态壁垒的那个。


参考资料#

分享

如果这篇文章对你有帮助,欢迎分享给更多人!

大模型价格战下半场
https://mizuki-eaf.pages.dev/posts/others/大模型价格战下半场/
作者
无名之子
发布于
2026-07-24
许可协议
CC BY-NC-SA 4.0

部分信息可能已经过时

目录