7月31日下午,DeepSeek在API文档更新日志中低调上线V4-Flash正式版。随后开发者社区发现一个反常事实:V4-Flash正式版的总参数与激活参数较预览版未作任何改变,但其代码和智能体能力却“突变式”地达到全球顶尖模型水平。当2026年头部开源模型竞争进入“万亿参数时代”、更大的算力集群再次被视为模型能力突破关键之际,DeepSeek似乎再次打破了这一逻辑惯性——就像2025年春天那样。
“DeepSeek时刻”再现?
自“GPT时刻”以来,“算力即智力”的规模法则被全球资本市场奉为圭臬,直到DeepSeek V3和R1先后以极低成本比肩顶尖模型,“规模法则”首次遭遇正面质疑。但进入2026年,“规模法则”卷土重来:DeepSeek V4-Pro预览版以1.6万亿总参数开局,阿里Qwen 3.8-Max预览版推至2.4万亿,月之暗面Kimi K3更以2.8万亿参数登顶全球开源模型规模之最。“大力出奇迹”重回舞台中央——直到V4-Flash-0731正式发布,堆参数的逻辑惯性才被踩下刹车。
根据官方披露,V4-Flash正式版在九项智能体与代码基准得分上全部超过V4-Pro预览版,其中“DeepSWE”基准分差达41.6分,“ALE”基准与全球顶级的Claude Opus 4.8仅差半分。仅使用Pro预览版约六分之一的总参数和不到四分之一的激活参数,便大幅完成反超。DeepSeek在更新说明中表示,此次基准测试采用了自研的类似“Codex”工具DeepSeek Harness极简模式跑分,叠加重做后训练、加大智能体与工具使用方向专家训练力度等AI工程创新,才真正让DeepSeek再次成为算力之外的“X因素”。
AI性价比来到“临界点”
V4-Flash正式版也并非完美。部分海外开发者指出其输入缓存命中率偏低、安全分类器常超时,反映算力和参数储备不足仍是限制模型能力上限的瓶颈。资本市场层面,英伟达、博通、AMD等公司股价当日并未出现剧烈波动,市场已习惯DeepSeek创新带来的震撼,也并不认为AI工程技术迭代是算力需求的利空因素。摩根大通此前指出,DeepSeek强化了“算力供应扩张、定价纪律、结构性成本曲线压缩”三大支柱,对行业是顺风而非零和。
然而全球潮流已在悄然转变。部分欧美公司开始将中国大模型嵌入工作流以完成大部分普通任务,仅在复杂任务中调用顶尖模型,这与中国模型使用成本偏低以及非美地区客户对权限不可控的担忧有关。天风证券计算机团队在V4-Flash正式版发布当天以“大超预期”定调,指出其综合能力已接近顶尖水平,重申看好下半年国产模型链,认为成长性强、有基本面的软件公司将率先受益。这一判断的深意在于:当DeepSeek的性价比足够令软件公司本身使用并提效,更多因Token成本过高而不敢使用AI的公司便能开发高性价比AI服务,过去无法满足的智能体使用需求将变为现实。
“站在整个行业的对立面”
几周前Kimi K3冲到2.8万亿参数时,头部玩家普遍相信中国模型也要遵循“更大=更强”法则,而V4-Flash正式版再次证明AI发展不只需要大力出奇迹,还得慢工出细活。从价格看,此次V4-Flash正式版每百万Token价格分别为输入0.14美元、缓存命中0.0028美元、输出0.28美元,与“ALE”基准仅半分之差的Claude Opus 4.8相比,价格优势分别达36倍、179倍和89倍。有AI初创孵化人士感叹“梁文锋似乎站在了市面上所有模型玩家的对立面”,开发者社区中类似观点不绝于耳——DeepSeek长期稳居性价比之王的宝座,迫使其他公司必须至少提供比其性能更强的模型。“梁文锋的DeepSeek成为了一台永不停止的收割机,所有的AI大模型公司都在他前面奔跑,不管用什么方式,必须跑到DeepSeek前面才能生存。”





