7月31日,DeepSeek V4正式版仍未如期发布——这款原定于7月中旬亮相的模型已推迟了半个多月。但多个信号正在将目光指向一个具体日期:8月3日。这一次,可能真的不用等太久了。

涨价短信率先“泄密”

最先露出马脚的是模型服务平台硅基流动。该公司通过短信通知用户,将于8月3日起将DeepSeek V4 Pro大模型的缓存命中价格从当前的每百万Token 0.1元大幅上调至1.0元。10倍的涨幅,选在8月3日这个节点落地,很难用常规调价来解释。

关键不在于涨了多少,而在于“为什么是8月3日”。如果V4正式版不上线,服务商没有理由在这个时间点突然调整定价。

API已经悄悄“变聪明”了

另一条线索来自开发者社区的实测。在Linux.do论坛上,有用户发现DeepSeek V4 Flash模型已经能正确回答Claude Opus 4.5、Sonnet 4.5及Haiku 4.5的发布日期——而此前受限于知识库截止时间,V4在不联网状态下完全回答不了这类时效性问题。

多名网友通过API验证了这一变化,但并非所有用户都能复现——这正是灰度测试分批放量的典型特征。与此同时,DeepSeek服务近期频繁出现不稳定的情况,也从侧面印证团队正在不断小范围测试并撤回修改,为全面推送做最后打磨。

Flash已上线,Pro在路上

7月31日下午,DeepSeek通过API文档发布更新日志,宣布DeepSeek-V4-Flash正式版API上线公测。Flash版模型结构、尺寸与预览版完全一致,仅重新进行了后训练,重点增强Agent与编程能力。

在9项Agent及编程基准测试中,Flash正式版均明显超过预览版:Terminal Bench 2.1从61.8升至82.7,超过GLM-5.2的81.0;CyberGym从38.7升至76.7;DeepSWE从7.3跃升至54.4。正式版V4-Flash还原生支持Responses API格式,并针对性适配了Codex。

但官方明确表示,本次仅升级了V4-Flash的API接口,V4-Pro的API及APP/WEB端均未做更改,Pro正式版“将会尽快发布”。从产品节奏看,Flash先行、Pro压阵——8月3日最有可能迎来的正是Pro版的正式上线。

外部压力正在倒逼

DeepSeek V4面临的竞争环境已经比一个月前严峻得多。就在7月31日当天,OpenAI宣布GPT-5.6系列降价高达80%,降价后的性价比直追DeepSeek V4 Pro。与此同时,国内GLM最新订阅价格大涨2至3倍。

对手一边降价抢市场、一边涨价提营收——DeepSeek V4正式版能否用性能扳回一局,8月3日或将给出第一份答卷。