2026年8月2日,DeepSeek正式发布了DeepSeek-V4-Flash模型的稳定版本,并同步启动API公测。同日,国家超算互联网平台宣布上线该模型的正式版——DeepSeek-V4-Flash-0731,全面开放API调用服务及模型文件下载。企业和开发者无需繁琐的环境配置,即可一键接入,快速调用这一高性能模型。

性能:叫板最强闭源模型

DeepSeek-V4-Flash-0731经过大量后训练工作,智能体能力和指令遵循能力均获得大幅增强。在多项基准测试中,其综合性能可与当前业界最强的闭源模型相媲美。

具体来看,在Agent智能体测试中,V4-Flash正式版得分达到25.2分,接近Anthropic Opus 4.8的25.7分,远超V4-Pro预览版的15.8分。在Terminal Bench 2.1上拿下82.7分,NL2Repo 54.2分,Cybergym 76.7分,Toolathlon verified 70.3分。

更直观的对比来自实测:V4-Flash正式版接入Hermes后完成相同任务耗时约40秒,而GPT-5.6 Sol + Codex耗时1分47秒——速度快了一倍以上,交付结果同样达到可用水平。

这一表现尤为难得的是,V4-Flash只是一个小参数模型——采用混合专家(MoE)架构,总参数量284B,激活参数仅13B。相比之下,GLM-5.2总参数高达7440亿,激活参数为400亿,均远高于V4 Flash。以远小于对手的规模实现接近甚至超越的性能,这正是DeepSeek在架构效率上的核心优势。

一键调用,零门槛接入

国家超算互联网为企业和开发者提供了极为便捷的接入方式。用户只需登录国家超算互联网官网PC端,通过首页「服务」下拉菜单进入「模型服务」专区,即可一键直达模型API调用页面。

除API调用服务外,企业和开发者还可登录超算互联网AI社区,即刻下载DeepSeek-V4-Flash-0731模型文件,依托国家级算力底座和安全可信的Notebook开发环境,一站式完成模型部署、微调训练、适配优化等全流程开发工作。

目前,国家超算互联网AI社区已累计汇集1700余款国内外热门开源大模型,覆盖DeepSeek、GLM、Qwen、Kimi等主流系列。伴随核心节点已正式投运,国家超算互联网已成为全国首个十万卡级超智融合算力资源池。

从“能用”到“好用”的跨越

DeepSeek-V4-Flash正式版登陆国家超算互联网,意味着国产大模型的普惠化迈出了实质性一步。过去,企业要调用一个高性能大模型,往往需要自建算力、自行部署、自己维护——门槛高、周期长、成本贵。而现在,国家级算力平台加上一键接入的API服务,让任何一家企业——无论规模大小——都能以极低成本获得对标国际顶级闭源模型的AI能力。

当“性能比肩最强闭源模型”和“零门槛一键调用”同时成为现实,AI开发的门槛正在被重新定义。国家超算互联网与DeepSeek的这次联手,不只是又一个模型上线,而是国产AI基础设施走向“即开即用”的标志性一步。