关注飞总聊IT,了解IT行业的方方面面。
没有发布会,没有直播,没有PPT,连官网首页的横幅都没挂,DeepSeek公众号也没吭声。就这么安安静静在API文档里更新了一行字,当天下午到晚上,DeepSeek就冲上了知乎热搜第一。
7月31日,DeepSeek在API更新日志里写下这行字:"DeepSeek-V4-Flash正式版API上线公测"。这看起来是一次再普通不过的版本更新,但拆开细看,这一行字里,藏着一场足以搅动整个大模型行业接下来几个月走向的博弈。
这次更新最让人意外的地方,不是便宜,是成绩单。DeepSeek-V4-Flash是这家公司主打的轻量级模型,定位一直是"便宜好用的平替款",理论上不该跟自家的旗舰款V4-Pro正面竞争。但这次正式版交出的Agent智能体测试成绩是25.2分,直接逼近Claude Opus 4.8的25.7分,把自家V4-Pro预览版15.8分的成绩甩开了一大截。
一个定位是"轻量级"的模型,反过来把自己家的旗舰预览版按在地上摩擦,这在过去两年的行业惯例里几乎是没人做成过的事。第三方评测机构的数据也印证了这个结果——Artificial Analysis的智能指数测试里,V4-Flash正式版拿到50分,比预览版提升10分,比V4-Pro还要高出6分,跟OpenAI的GPT-5.6 Luna只差1分。Arena.ai的前端代码测试榜单上,V4-Flash-High拿到1586分,被认为刷新了"性能与成本综合表现"的帕累托前沿曲线,前端代码能力总排名第7、开放模型里排名第3。
更值得琢磨的是,这次能力跃升,靠的不是换了新架构、堆更多参数,而是模型结构和尺寸完全没变,仅仅是重新做了一遍后训练(post-training)。这说明,在模型规模已经摸到阶段性天花板的当下,"怎么训"正在变得比"训多大"更重要——同样的骨架,换一套更精细的训练方法,就能撬动一次肉眼可见的能力跃升。
这次更新还有一个细节,容易被忽略,但分量不轻——价格一分没动。就在这次发布前几天,OpenAI刚刚把GPT-5.6 Luna的价格砍了80%,摆出一副要用低价抢市场的架势。结果DeepSeek这边转头就把Agent能力拉高一大截,价格纹丝不动,等于是直接站在原地,把刚刚降价示好的OpenAI,又架回了牌桌中央比拼实力这条路上。
价格这块,DeepSeek本来就是行业公认的"卷王"。据实测反馈,有开发者把手头所有项目跑了一遍V4-Flash,累计消耗超过五亿Token,花费还不到一杯奶茶钱。这次借助DeepSeek第一方API接近98%的缓存命中折扣,V4-Flash-0731的单任务成本,比刚刚降价后的GPT-5.6 Luna还要再低约60%。也就是说,OpenAI这边刚刚打出的"降价牌",还没捂热,就被DeepSeek用"我价格不动、能力还更强"这套组合拳,正面接了下来。
这次更新里,还藏着一步更具战略意义的棋——DeepSeek首次原生支持了OpenAI的Responses API格式,并且专门针对Codex做了适配。Responses API是OpenAI统一处理模型输出、推理过程和工具调用的核心接口格式,也是Codex客户端跟模型交互的主要通道。这次适配完成后,开发者可以直接在Codex CLI、ChatGPT桌面端和VS Code的Codex插件里,把DeepSeek配置成模型提供方——甚至不用修改Base URL,换个模型名字就能切换过去。
这一步棋的精妙之处在于,DeepSeek没有选择自己重新搭一套生态,而是直接借道OpenAI自己搭建的Codex这个开发者生态入口,把自己的模型嵌了进去。对已经习惯用Codex写代码的开发者来说,切换成本几乎为零——这意味着DeepSeek不需要说服任何人换一套新工具,只需要说服他们在原有工具里,把底层模型换成更便宜、能力更强的自己。这已经不只是一次模型能力的比拼,更是一场关于"谁能占据Agent生态入口"的商业博弈。
需要说清楚的是,这次上线的只是V4系列的一半。官方明确表示,这次更新只涉及V4-Flash的API接口,V4-Pro的API以及App、Web端模型都没有调整,V4-Pro正式版会"尽快"发布,业内普遍预计是8月初。也就是说,眼下这场讨论热度,某种程度上只是一次"预热"——真正被寄予厚望的旗舰款V4-Pro正式版,还没有登场。
如果说V4-Flash正式版已经能把自家Pro预览版按在地上摩擦,那外界接下来最想知道的问题就是:等V4-Pro正式版真正发布,它到底还能不能守住自己"旗舰"这个称号?毕竟连一个轻量级模型都能逼近Claude Opus 4.8的水平,留给旗舰款的想象空间,反而变得更让人期待了。
把这次发布放进整个2026年的大模型竞争格局里看,会发现一个越来越清晰的趋势:这个行业已经从"比谁的参数堆得更大",切换成了"比谁能用更低的成本、更精细的训练,榨出更强的实际能力"。DeepSeek这次用一个没有换架构、只靠后训练调优的Flash模型,撬动了整个行业的关注度,证明了这条路是走得通的。
对开发者来说,这次更新最实际的意义是:迁移成本几乎为零,价格更便宜,能力反而更强,还能无缝接入原本已经在用的Codex工具链——几乎找不到不换的理由。对整个行业来说,这场看似低调的更新日志,实际上是一次响亮的宣战:定价权和Agent生态入口这两块阵地,接下来几个月,注定会迎来新一轮更激烈的争夺。
推荐飞总知识星球,在私域场合里畅所欲言,聊聊职场发展的事情,和飞总提问交流,这么低 的价格不会一直保留,机会难得,一定不要错过这个的机会。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.