摘要:8月13日至23日,DeepSeek六天内两次调整API定价,从峰谷计费到周末统一低谷价;OpenAI同步将GPT-5.6 Sol降价20%以上。本文拆解这一轮价格博弈的底层逻辑与行业信号。
8月的大模型定价市场,像被按了快进键。
DeepSeek六天内两次调价。OpenAI跟着把GPT-5.6 Sol砍了20%。谷歌也没闲着,Gemini 3.7 Flash新版本定价直接砍半。
这不是一轮简单的价格战。方向不一致——有人涨、有人降,有人涨价后又变相降价。乱象背后,其实有清晰的逻辑。
DeepSeek第一次调价:涨价,但给了选择
8月13日,DeepSeek发布API调价公告。V4全系列模型正式版上线,价格体系全面调整。核心变化是引入峰谷定价——空闲时段价格为高峰时段的一半。高峰时段划定为北京时间9:00-12:00和14:00-18:00。
以旗舰模型V4-Pro为例:高峰时段每百万Tokens输出27元,空闲时段13.5元。对比此前6元的输出价格,高峰时段涨幅达到350%。缓存命中输入从0.025元涨到高峰时段的0.3元,涨幅1100%。
这不是简单的“涨价”。DeepSeek给了用户选择——愿意调整调用时间的,可以继续享受低价;非要挤在高峰时段的,多付钱。高盛在7月的研报里就说得很直白:DeepSeek实施高峰时段价格调整,不意味着需求走弱,反而反映出国内AI模型需求持续旺盛、算力资源趋紧。
DeepSeek第二次调价:周末变相降价50%
第一次调价生效不到一周,DeepSeek又动了。
8月23日00:00起,周六周日全天不再区分峰谷时段,统一按低谷时段价格计费。V4-Pro周末全天输出价13.5元/百万Tokens,比工作日的27元便宜一半。
六天时间,先涨价再变相降价。看起来反复,但逻辑是连贯的:工作日高峰时段资源紧张,涨价调节需求;周末资源闲置,降价提升利用率。DeepSeek在做的事情,本质上是用价格信号优化算力资源配置。
OpenAI的选择:旗舰降价,中低端早降了
8月21日,OpenAI宣布GPT-5.6 Sol的API和积分定价在未来3个月内下调20%以上。Sol是GPT-5.6家族的旗舰模型,原价输入5美元/百万Tokens、输出30美元/百万Tokens。调整后输入4美元、输出20美元——输出端降了33%,比官方说的“20%以上”还多一截。
但Sol不是OpenAI第一个降价的。7月30日,OpenAI已经将轻量级模型Luna的价格砍了80%——输入从1美元降到0.2美元,输出从6美元降到1.2美元。中端模型Terra同步降价20%。
三轮降价打下来,OpenAI的定价策略很清楚:中低端模型大幅让利抢市场,旗舰模型适度降价保份额。
“价格战”这个词已经不够用了
把这几件事放在一起看,会发现“价格战”三个字已经概括不了现在的情况。
中国厂商这边,集体在涨价。摩根士丹利的统计显示,2026年第二季度中国大模型平均API输入价格已升至每百万Token4.9元,输出价格升至21.9元,相比2025年第一季度分别上涨约48%和80%。腾讯云连续两次宣布涨价,智谱AI年内三次上调API价格。开源证券的判断是,“涨价”展示了大模型厂商从“以低价换市场”向“以价值定价”的战略转向。
美国厂商这边,OpenAI和谷歌在降价。美媒的分析认为,来自中国部分AI公司的开源和定价策略给美国公司带来了压力。
这不是同一场战争。中国厂商的涨价,建立在需求持续旺盛、算力资源趋紧的现实之上。美国厂商的降价,更像是对市场份额被侵蚀的回应——华泰证券的研报显示,DeepSeek V4 Flash的混合价格较OpenAI GPT-5.6 Luna低约65%,单任务成本低约57%。在性能接近的前提下,成本差距决定了一切。
中银证券的判断更值得注意:模型调用价格上升并不意味着算力需求减弱,反而验证了高性能模型供需紧张及优质算力的稀缺性。推理需求正从互联网应用向办公、金融、工业、政务等场景扩散。
算力不够用,所以涨价。市场份额被抢,所以降价。两件事同时发生,说明大模型行业的竞争已经过了“烧钱圈地”的阶段——现在拼的是谁能把有限的算力转化为有效的商业产出。
六天两次调价的DeepSeek和三个月限时降价的OpenAI,其实在做同一件事:试探市场对价格的真正承受力。



