7 月 31 日,OpenAI 宣布 GPT-5.6 系列降价。要知道这系列 7 月 9 日才发布,三周就动手了。最轻量的 Luna 每百万 token 输入从 1 美元砍到 0.2 美元,输出从 6 美元砍到 1.2 美元,降了整整 80%;中端的 Terra 也便宜了 20%。旗舰 Sol 没动,动的全是走量的型号,意思很明白:OpenAI 开始抢中小开发者和 Agent 工作流这块市场了。几乎同一时间,DeepSeek 上线了 V4-Flash-0731,架构参数和四月的预览版一模一样,只重做了后训练,价格一分没涨,还是每百万 token 输入 1 元、输出 2 元。
两家走的是两条路。OpenAI 直接打骨折,DeepSeek 加量不加价。后训练的效果还挺唬人:Terminal Bench 2.1 从 61.8 涨到 82.7,代码 Agent 测试 DeepSWE 从 7.3 涨到 54.4。爱范儿拿它跑了五个任务,从数据报告到三体轨道模拟器,一共 393 次 API 调用、烧了三千多万 token,只花了 2.85 元。
我琢磨了一下,为什么偏偏是现在开始打价格战。答案大概是 Agent。以前聊天按次算,现在干活按任务算,任务越长,价格越敏感。
过去比的是跑分:参数大、上下文长、MMLU 高。但 Agent 干活不是问一句就完事。改个 bug,要读项目、搜代码、跑测试,报错了再回头重来,一次任务可能调几十次模型。单次便宜 80%,摊到一个长任务上,就是“用得起”和“用不起”的区别。OpenAI 在降价博文里直接贴了 Artificial Analysis 的对比图,说 Luna 每完成一个任务的成本比 DeepSeek V4 Pro 还低。这话有营销成分,但方向是真的:模型厂商开始用“每完成一个任务多少钱”来打架了。
DeepSeek 这边的处境其实挺拧巴。四月的 V4 Preview 风光过一阵,正式版却跳票了,原计划 7 月中旬,最新说法是推到 8 月 10 日到 20 日。对手也在施压:月之暗面的 Kimi K3 有 2.78 万亿参数,每 token 激活 1042 亿,开源圈断层第一,硅谷热度很高。V4 Pro 总参数 1.6 万亿、激活只有 49 亿,走的是省算力路线,参数规模上矮一头。所以这次 Flash 只做后训练不换结构,我猜一半是赶时间,一半是赌“身板不变、习惯变好”这条路还能挤出东西。
还有两个细节值得记下来。一是 DeepSeek 预告 API 要搞峰谷定价,北京时间上午九点到十二点、下午两点到六点价格翻倍。这种定价以前只在电网见过,现在轮到 API 了。便宜是暂时的,高峰真的挤不动了。二是官方提过,V4 深度适配了华为昇腾,下半年昇腾 950 超节点批量上市后,Pro 的价格还会再降。国产算力这条线,他们押得很重。
说回我自己。以前挑模型看榜单,谁跑分高用谁。现在先看每百万 token 的价格和上下文,再看任务失败率。Codex、Claude Code 这类 Agent 工具都能换后端模型,谁便宜又好用就切谁,切换成本几乎为零。这轮降价对做应用的人是好事,模型便宜了,Agent 才敢多试几次、跑长一点。对只会堆参数的厂商则是坏消息,成本压不下来就得出局。至于 DeepSeek 和 Kimi 谁能笑到最后,我不猜,我就看谁先把活干完,还干得便宜。
信息来源
- 爱范儿《实测 DeepSeek V4 正式版:3 块钱干完 5 件事,AI「智价比」之战开打了》:https://www.ifanr.com/1673553
- IT之家《降价 80%!OpenAI 下调 GPT-5.6 Luna AI 模型费用,性价比超 DeepSeek V4 Pro》:https://www.ithome.com/0/983/912.htm
- 新浪财经/智能纪元《突发!DeepSeek V4正式版或延至8月中旬,国内大模型竞速生变》:https://finance.sina.com.cn/wm/2026-07-28/doc-inikknsf6241063.shtml
- 腾讯新闻《DeepSeek V4 发布,全网最细解读 & 技术报告拆解》:https://news.qq.com/rain/a/20260424A04XFV00
- DeepSeek API 官方文档(模型与价格):https://api-docs.deepseek.com/zh-cn/quick_start/pricing