网易首页 > 网易号 > 正文 申请入驻

5000亿估值背后,DeepSeek划下了一条“斩杀线”

0
分享至

8月5日,两条融资消息几乎同时传出。

第一条消息,是DeepSeek重启了第二轮融资。据“财经杂志”独家报道,大模型公司DeepSeek在7月底短暂暂停后,已悄然重启第二轮融资,计划募资500亿元,投前估值约5000亿元。若本轮顺利完成,DeepSeek将在不到五个月内累计融资超1000亿元。

第二条消息,是在同一天,月之暗面被曝出以500亿美元估值启动G轮(Pre-IPO轮)融资,在此之前,它刚刚完成315亿美元估值的F轮。

中国大模型“双雄”同日传出融资新进展。大笔资金仍在涌向头部。但真正牵动市场神经的,不是融资额的数字游戏,而是7月31日DeepSeek一次低调的模型更新。

那天,DeepSeek V4-Flash正式版悄然上线公测。没有发布会,没有预热海报,却催生了一个让整个AI圈为之震动的词:“斩杀线”。

“斩杀线”是什么?

这个词不是DeepSeek官方提出的,而是来自海外独立评测机构Artificial Analysis的一幅散点图。

7月31日当天,Artificial Analysis发布了最新的AI模型性价比排行榜。他们收录了128款主流模型,横轴是单次任务成本,纵轴是智能指数得分。DeepSeek V4-Flash 0731落在图中一个极为刺眼的位置:智能指数50分,单次任务成本约3美分。



50分是什么水平?比Anthropic的Claude Opus5低约10分。3美分又是什么水平?完成同一套基准测试,Claude Fable 5要3.15美元,DeepSeek的成本比 Claude 便宜了100倍。



从DeepSeek V4-Flash这个点往右拉一条横线、往下拉一条竖线,两条线夹出的右下角区域,就是开发者口中的“斩杀区”。判定标准很简单:比它贵、还比它笨的模型,商业上再没有存在的理由。在Artificial Analysis的散点图上,全球约70%的模型都落在了这条“斩杀线”以下。

更值得玩味的是技术细节。V4-Flash正式版的架构和参数规模与预览版完全相同:284B总参数,13B激活参数。没加一个参数,纯粹通过后训练的精细化调整,就把Agent能力推到了新的台阶。Terminal-Bench 2.1从61.8分拉到82.7分,DeepSWE从7.3分飙到54.4分,涨幅超过640%。在9项Agent基准测试上,这个“轻量版”直接碾压了自家旗舰V4-Pro预览版。



这意味着什么?DeepSeek用事实证明了:模型变强,不一定非要变得更大、更贵。这对那些“堆参数换能力、凭能力定高价”的传统逻辑,是釜底抽薪式的打击。

“斩杀”的原理:凭什么这么便宜?

一条斩杀线的形成,靠的不是补贴烧钱。DeepSeek的低价背后,是一整套工程优化的叠加。

首先是架构层面。V4-Flash采用MoE(混合专家)架构,虽然总参数2840亿,但每次推理只激活130亿个参数,不到总量的5%。这就像一栋大楼里只开了需要的几盏灯,电力消耗被压到最低。

更深层的优化在注意力机制上。V4系列设计了一套CSA(压缩稀疏注意力)与HCA(重度压缩注意力)交替排列的混合架构——核心逻辑很朴素:近处的信息记得很清楚,远处只记个大概。在百万token的超长上下文下,单token计算量降至前代V3.2的10%,KV缓存占用仅为原先的7%。

还有一个杀手锏是缓存命中机制。API调用中,大量内容是重复的,系统提示词、背景文档、对话历史。DeepSeek对命中缓存的输入token按标价的2%计费,折扣力度约98%,远超行业普遍的90%。在Agent这种天然需要多轮调用、前缀大量重复的场景里,这50倍的差价就是留给开发者的红利。

官方定价本身也已经极低:输出每百万token 0.28美元,输入0.14美元,缓存命中仅0.0028美元。横向对比,OpenAI经过两轮降价后的GPT-5.6 Luna输出价仍是它的4倍多。



用一位海外开发者的话说:同等智能,“100美元够你在V4 Flash上跑3333套测试,在Claude Fable 5上只能跑31套。”

市场反应:48小时内,格局改写

斩杀线的冲击,以小时为单位在传导。

7月30日,OpenAI宣布GPT-5.6系列降价,入门级Luna降幅80%。这本是美国巨头历史上最大幅度的单次调价,但一天后DeepSeek V4-Flash上线,用原价提能的姿态把这条性价比边界继续推远。开发者社区的反应很直接。OpenAI官方账号评论区被刷屏:“我们要DeepSeek的价格。”

8月1日,AI编程平台OpenCode披露,DeepSeek V4-Flash在其平台单日处理8万亿Token,使用量单日增长30%,新订阅用户同步增长30%。CEO Jay公布这组数据时,OpenAI核心产品负责人Tibo在评论区打起了自家Luna的广告,开发者直接怼回去:“我们希望得到DeepSeek的价格。”



OpenRouter最新周榜上,全球调用量前五名全部被中国模型包揽:DeepSeek V4-Flash、小米MiMo-V2.5、腾讯Hy3、DeepSeek V4-Pro、智谱GLM-5.2。中国大模型周调用量已连续14周超过美国厂商闭源模型的总和。



多名海外AI初创创始人在X平台公开复盘:团队全线迁移至DeepSeek后,月度推理成本下降60%至85%。对现金流紧绷的小微AI公司而言,这不是“省点钱”的问题,是能不能活下去的问题。

但这只是开始。DeepSeek手里还有一张牌没完全打出来,Harness。这是DeepSeek自研的Agent运行时框架,类似OpenAI的Codex和Anthropic的Claude Code,负责组织上下文、处理工具调用、压缩长会话。目前V4-Flash公布的基准测试成绩,大多是在Harness minimal模式下跑出来的。DeepSeek已明确表示,Harness完整版将与V4-Pro正式版同步上线。届时,同样的模型在同样任务上的实际成本可能再降一截。

斩了什么,没斩什么

回到文章开头那两条融资新闻。

月之暗面F轮刚以315亿美元估值完成交割,G轮就以500亿美元估值接踵而至。推动估值跳涨的核心变量,是Kimi K3模型的发布——2.8万亿参数,Code Arena编程能力登顶全球第一,全部开源。据“财经杂志”报道,曾有投资人坦言,K3发布前,F轮额度“兜售好几天都没人要”;K3一出,份额骤然紧俏,老股卖家坐地起价。

这说明什么?市场对两类模型依然愿意给出高溢价:一是能力断档领先的旗舰模型,二是抓住了差异化赛道(如AI Coding)的玩家。

DeepSeek V4-Flash的“斩杀线”,斩的不是最顶层。Claude Opus 4.8、GPT-5.6 Sol、Kimi K3这些旗舰模型,在复杂推理、专业任务、企业级服务上仍有不可替代性,高价有其合理性。斩的也不是最底层那些专做分类、摘要的小参数模型,它们本就便宜。



真正危险的,是中间地带。能力跟V4-Flash差不多甚至更弱,价格却贵数倍甚至几十倍的模型。过去开发者没得选,只能接受;现在有了参照物,一句“我为什么还要用你”就足以让这些模型的商业逻辑崩塌。

更深层的变化是,大模型竞争的核心标尺正在迁移。过去行业比参数量、比跑分、比训练算力规模;现在开发者最先核算的指标,变成了“完成一个任务到底花多少钱”。这不是价格战,这是整个行业定价逻辑被重写。

一条线,两种路线

DeepSeek划出的这条斩杀线,本质上是全球大模型两条发展路线的正面碰撞。

一条是硅谷巨头代表的路线:重金训练闭源旗舰模型,维持高毛利,重心面向大型企业客户,优先冲击能力上限。另一条是DeepSeek代表的路线:依靠工程优化压到极致的推理成本,走薄利多销的普惠路线,优先抢占开发者群体,用规模效应摊薄成本。

两条路线没有绝对的对错。但DeepSeek的崛起证明了一个核心事实:大模型竞争不再单纯比拼烧钱的规模。算力投入是基础,但推理效率、商业化定价、生态策略,同样能改写全球市场份额。

那些既不够强、又不够便宜、还解释不了自己溢价的模型,或许终将成为这条斩杀线下最先消失的名字。

但决定谁能跑到最后的,不只是账上的现金。最终要回答的问题很简单:当你的模型能力跟竞争对手差不多的时候,你的价格凭什么贵100倍?

而现在,变化已经发生。对于全球数百万AI开发者而言,选择变多了,成本下降了,创新的门槛正在被不断压低。

当AI的定价权开始转移,让更多人用得起、用得上的技术普惠,或许才是这条“斩杀线”背后,最值得记住的东西。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
武汉大学杰出教授是怎么堕落的!

武汉大学杰出教授是怎么堕落的!

爆角追踪
2026-09-04 21:00:55
演唱会上“衣不遮体”,惹争议!官媒下场,莫文蔚那英也没躲过

演唱会上“衣不遮体”,惹争议!官媒下场,莫文蔚那英也没躲过

皮皮电影
2026-09-05 14:20:16
美网|最强的郑钦文回来了!决胜盘0比5落后时上演史诗级逆转

美网|最强的郑钦文回来了!决胜盘0比5落后时上演史诗级逆转

上观新闻
2026-09-06 03:58:36
“不要惊慌 我们来救你!” 地下170米 9天没吃没喝!尼泊尔隧道两名被困者奇迹生还

“不要惊慌 我们来救你!” 地下170米 9天没吃没喝!尼泊尔隧道两名被困者奇迹生还

每日经济新闻
2026-09-05 21:58:02
当字节员工开始战略怀孕!

当字节员工开始战略怀孕!

城事堂
2026-09-06 08:52:28
中美看病费用差距明显,中国做CT约200元,美国却需要7000美元!

中美看病费用差距明显,中国做CT约200元,美国却需要7000美元!

凡知
2026-09-05 15:27:34
郑钦文:在最开始0-5落后时,我心想不能被零封吧,太丢人了

郑钦文:在最开始0-5落后时,我心想不能被零封吧,太丢人了

懂球帝
2026-09-06 03:04:13
首次质量督查:督察发现153个问题,已移交属地处置

首次质量督查:督察发现153个问题,已移交属地处置

界面新闻
2026-09-06 09:45:01
史诗逆转!郑钦文2-1决胜盘连赢7局逆转凯斯 第3次进美网16强

史诗逆转!郑钦文2-1决胜盘连赢7局逆转凯斯 第3次进美网16强

醉卧浮生
2026-09-06 01:37:23
恩佐首秀即闪耀!1.25亿没白花,撑起曼城后罗德里时代中场

恩佐首秀即闪耀!1.25亿没白花,撑起曼城后罗德里时代中场

体育闲话说
2026-09-06 07:32:34
五大联赛神剧情!89分钟绝平+93分钟绝杀 上赛季季军2-1逆转登顶

五大联赛神剧情!89分钟绝平+93分钟绝杀 上赛季季军2-1逆转登顶

狍子歪解体坛
2026-09-06 11:33:04
预警!联合国:史上最强厄尔尼诺降临,概率近100%将失控

预警!联合国:史上最强厄尔尼诺降临,概率近100%将失控

麓谷隐士
2026-09-06 00:10:03
与博彩平台达成合作!詹姆斯14秒短片引争议 大量球迷抗议要求删帖

与博彩平台达成合作!詹姆斯14秒短片引争议 大量球迷抗议要求删帖

罗说NBA
2026-09-05 22:04:26
赢5场奖金195万!郑钦文在美网一天烧掉超5万:单单团队工资近2万

赢5场奖金195万!郑钦文在美网一天烧掉超5万:单单团队工资近2万

侃球熊弟
2026-09-05 19:07:50
正式告别机顶盒,全国开始部署

正式告别机顶盒,全国开始部署

鲁中晨报
2026-09-05 17:14:04
郑钦文美网上演惊天逆转

郑钦文美网上演惊天逆转

澎湃新闻
2026-09-06 09:53:08
马斯克突然官宣,特斯拉电机完全摆脱稀土!中国:冲着我来的?

马斯克突然官宣,特斯拉电机完全摆脱稀土!中国:冲着我来的?

大卫聊科技
2026-09-05 12:19:52
2026年9月,养老金通知来了!滚动认证开启,补发涨薪消息别上当

2026年9月,养老金通知来了!滚动认证开启,补发涨薪消息别上当

陈博世财经
2026-09-06 09:55:14
985硕士李雷阳遇难,入职仅5天刚穿上白制服,聊天记录看哭无数人

985硕士李雷阳遇难,入职仅5天刚穿上白制服,聊天记录看哭无数人

小嵩
2026-09-05 14:38:43
北京月捐人停捐不到一个月被电话催捐,不少人吐槽有类似遭遇,有律师称停捐可能面临法律风险

北京月捐人停捐不到一个月被电话催捐,不少人吐槽有类似遭遇,有律师称停捐可能面临法律风险

Mr王的饭后茶
2026-09-05 21:17:06
2026-09-06 13:03:00
未来图灵 incentive-icons
未来图灵
在这里每个人都能读懂人工智能
1703文章数 2507关注度
往期回顾 全部

财经要闻

亏损高达200亿,昔日彩电霸主走下巅峰!

头条要闻

5架退役民航客机被打包拍卖 起拍价500万元

头条要闻

5架退役民航客机被打包拍卖 起拍价500万元

体育要闻

本西蒙斯加盟国王,不管怎样,回来就好

娱乐要闻

低调富养!郭富城两女儿入读香港名校

科技要闻

DeepSeek被曝将采购16万颗华为昇腾950DT

汽车要闻

带升降立标MPV 岚图梦想家9预售价42.99万起

态度原创

本地
亲子
家居
健康
公开课

本地新闻

扒完小作文,富豪们私藏的度假胜地有多绝

亲子要闻

平时忙碌,亏欠了孩子很多陪伴。趁着闲暇,带两个小朋友出门撒欢,看着他们开心奔跑的样子,瞬间觉得一切都值得,简单的幸福莫过于此。

家居要闻

2026建博会(广州) 公装联探展交流活动

脑梗取栓成功≠活下来,还有这三关

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版