网易首页 > 网易号 > 正文 申请入驻

开源模型两个月内杀死比赛

0
分享至


作者 | 四月

过去 60 天,全球主流 AI 部署平台 Vercel AI Gateway 的调用数据揭示出一个重要拐点:开源模型的 Token 调用份额从 28%暴涨至 62%,历史上首次反超闭源模型,成为当下模型市场的主流。


更关键的信号是,这轮反超恰逢闭源模型密集推新。纵使 OpenAI、Anthropic 接连发布旗舰、频繁降价抵御开源冲击,Token 增量还是更多地流向了对手阵营。

与此同时,黄仁勋开始重仓开源模型。

今日消息,知情人士透露,英伟达将向 Poolside 支付 60 亿美元技术授权费,另追加 10 亿美元股权投资,并收编其 100 多名工程师加入 Nemotron (开源大模型产品线)团队 ,目标直指能与 DeepSeek、Kimi 抗衡的前沿开源模型。

OpenAI、Anthropic 本是英伟达最重要的头部客户,如今英伟达却主动入局模型层,不惜与大客户为敌也要扶持更低成本的开源模型供给,其战略决心可见一斑。

最先进的模型明明还掌握在闭源巨头手中,但风向标却已明显倒向开源阵营。

黄仁勋变阵

60 亿美元砸向 Poolside,绝非黄仁勋一时兴起。

按照《华尔街日报》披露的交易结构,英伟达并未直接收购 Poolside,而是以 60 亿美元获得技术授权,再按 120 亿美元投前估值投资 10 亿美元,同时吸收 100 多名核心员工。


这实际上是一笔典型的“变相人才收购”(Acquihire),以绕开繁琐的“反垄断”审查。黄仁勋真正看中的,是 Poolside 在开源代码模型(Laguna S 为代表)领域积累的强化学习训练能力与顶尖工程师团队。

收编后,这批工程师将直接进入英伟达的 Nemotron 团队,目标是在未来一年内推出超万亿参数、真正具备 Frontier 水准的开源模型,正面迎战 DeepSeek、Kimi 等中国开源主力,也包括 OpenAI、Anthropic 的闭源产品。

这场瞄准开源市场的转向“蓄谋已久”。

早在今年 3 月,英伟达就牵头成立了 Nemotron Coalition,将 Mistral、Perplexity、Cursor、Thinking Machines 等一众模型与 Agent 明星团队拉入同一阵营,共享算力与数据。

7 月,黄仁勋在社交网络发表《Open Weights and American AI Leadership》,更是直言不讳地指出:“美国的 AI 领导力不取决于单一的闭源前沿模型,而取决于能否建立一个能够渗透进千行百业的开放体系。”

8 月,英伟达快马加鞭发布了开源的 Nemotron 3.5 Lightning 混合专家模型,并在底层与自身的 CUDA 及 TensorRT-LLM 算力基座深度绑定。


事实上,黄仁勋根本不在乎最终哪个模型跑分最高,他要的是把基础模型的推理成本彻底打穿。当开源模型变得极度廉价且唾手可得时,全世界应用将疯狂消耗 Token,最终所有的利润都只能重新沉淀回英伟达的硬件底座。

Token 倒戈

在每天路由数万亿 Token 的 Vercel AI Gateway 数据里,开源模型的增长曲线几乎是陡直上扬的:

4 月,开放权重模型的 Token 份额还只有约 11%;6 月下旬升至 28.4%,当时它们仅占不到 4%的 API 支出,却承担了近三分之一的调用;到 8 月 22 日,这个数字进一步冲到 62%,首次反超闭源模型,占据市场主流。

其中,DeepSeek 单独拿下了 22.6%的 Token 份额。GLM-5.2 上线后短短两周,日 Token 消耗量增长约 50 倍。

更值得注意的是,这轮反超并非建立在闭源失速的基础上,相反,投资人 Gavin Baker 指出,7 月 OpenAI 和 Anthropic 的绝对 Token 调用量其实仍在加速增长。换句话说,在闭源模型更新最激进、降价最凶狠的阶段,他们依然失掉了领先身位。

复盘过去半年开源 vs 闭源两大阵营的交火线,就会发现大模型的竞争节奏,已经被硬生生从“半年一代”压缩到了“两周一轮”的绞肉机模式。


4 月起 DeepSeek V4、Qwen3.6、Kimi K2.6 把开放模型的竞争重点从通用问答推向 Coding 与 Agent;随后 GLM-5.2、Kimi K3、DeepSeek V4 Pro、GLM-5.3 持续强化长程任务与工具调用,阿里 8 月开放 Qwen3.8-2.4T-A95B 的 Max 级旗舰权重。

过去开源阵营追赶的主要是“模型能力”,如今争夺的已经是真正消耗大量 Token 的生产工作流

闭源巨头也在同步调整防御策略。5—6 月 Anthropic 用 Opus 4.8、Fable 5 守住前沿,又迅速以 Sonnet 5 把高阶 Agent 能力下放到更便宜档位;7 月 OpenAI 发布 GPT-5.6 系列(Sol/Terra/Luna),破天荒把“Performance per dollar(单位美元性能)”作为核心卖点,Anthropic 紧急补位 Opus 5 价格腰斩;8 月谷歌 Gemini 3.7 Flash 距上一代仅三周,价格再对半砍。


“性价比”这个曾专属开源阵营的底层武器,已经成了OpenAI 们必须割肉流血回答的命题。

仅 Fireworks 一家开源推理平台,目前日均 Token 处理量就超过 40 万亿,约为 OpenAI 今年 3 月底 API 吞吐量的整整两倍。智谱 GLM-5.2 在上线后的短短两周内,日 Token 消耗量更是暴涨了约 50 倍。

SemiAnalysis 判断,最近两个月是开源模型 Agentic 时代的“爆发期”。对比之下,2025 年的“DeepSeek Moment”声势浩大,但 R1 主要承担边缘性测试任务,没有规模化进入产生经济价值的工作流;而到 2026 年,GLM 5.3、Kimi K3 已经能承担 Coding、Agent 等生产级任务,这恰恰是 Anthropic ARR 暴涨的核心腹地。

Fable5 滞销

如果只把这场变革简单归结为“开源更便宜”,显然是低估了它。

过去几年,闭源模型的商业模式依赖于一个稳定假设:率先造出 SOTA,就可以凭能力领先获得最多用户、最多 Token 和最高定价,再把“智能溢价”投入下一代 Frontier 模型。

但问题在于,这套飞轮最重要的前提正在松动——能力领先依然存在,但领先能够被变现的时间越来越短

SemiAnalysis 把大模型发展划为 Early Scaling、Reasoning、Agentic 三个周期,他们发现了一个非常稳定的规律:每当闭源实验室率先开创新一代范式,开放模型追上它所需的时间大约缩短一半


早期 Scaling 阶段,Llama 2 与 GPT-3.5 的初始综合能力差距一度达 35.8 分;进入 Reasoning 时代,o1 与开放模型的起始差距缩小到 12.1 分,DeepSeek R1-0528 约 8.5 个月完成追赶;到了 Agentic 阶段,Kimi K2.6 约 4.8 个月追过 Opus 4.5,GLM-5.2 约 6 个月追过 GPT-5.2。

闭源仍然可以率先抵达下一站,但它独占下一站的时间越来越短。过去投入几十亿美元训练出领先模型,或许可以依靠一年甚至更长的技术窗口收费;现在这个窗口可能只剩几个月。客户自然会重新计算:为了领先 5%的能力,究竟值不值得支付数倍乃至十倍的价格?

这一变化最直接的现实注脚,是 Anthropic 旗舰 Fable 5 的滞销。


《金融时报》援引 Ramp 对约 7 万家企业的支付数据称,Fable 5 作为能力最强、价格最高的旗舰模型,发布两个多月后仅占其企业客户模型总支出的约 11.4%,按 Token 计算更只有约 6%;而 7 月底才上线、更便宜的 Opus 5,企业支出很快便反超 Fable。

这打破了过去几年一个相当稳定的惯例——新旗舰发布,企业默认迁移到最新、最强模型。

重估智能溢价

最强模型卖不动,并非性能不足。Anthropic 重要投资方 Accel 合伙人 Miles Clements 的解释直击要害:“Most people don't need to operate at the frontier.”绝大多数企业任务,本来就不需要始终运行在智能最前沿。

这意味着,模型智能开始出现明显的边际效用递减。从 70 分提升到 90 分,可以让大量原本做不了的工作第一次变得可用;但从 95 分继续到 97 分,训练和推理成本急剧上涨,企业实际收益却未必同步增长。对邮件总结、搜索、普通 Coding、信息抽取和大量 Agent 子任务而言,95 分和 97 分之间的能力差,很难支撑数倍的成本差

同时,Agent 的兴起又进一步放大了这笔经济账。一次工作背后可能展开几十甚至上百轮模型调用,过去几分钱的 API 差价,在百万、千万乃至亿级 Token 调用面前,会直接变成产品的成本结构和毛利率。

过去半年,开源完成了一次比 Benchmark 登顶更重要的跨越:从“能用”,走到了“值得被大规模使用”。这也是为什么开源模型占据的 62%份额如此重要。最强能力、最多 Token 和最高收入,第一次不再绑定在同一个模型身上。

开源模型不需要全面成为世界第一,只要与 Frontier 之间的差距缩小到“足够好”,巨大的成本优势就足以让大量 Token 迁移过来。过去几年统治大模型行业的商业模式——只要持续制造最强智能,就能持续出售最高的智能溢价—被开源模型打破。

声明:本文为 AI 前线原创,不代表平台观点,也不构成投资建议,未经许可禁止转载。

会议推荐

QCon 全球软件开发大会·2026(上海站)现已正式启动。本届大会聚焦 Harness AI 时代的工程实践,从「构建 AI」到「驾驭 AI」,围绕 AI Native 架构、Agent Runtime、AI Infra、Agent 安全与可观测、Loop Engineering、具身智能与世界模型等热门技术方向,邀请全球技术社区与产业一线实践者,共同分享 AI Native 时代最具价值的工程经验。

今日荐文

你也「在看」吗?

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
美版“终战方案”曝光:100天换掉泽连斯基,乌克兰被按头签投降书

美版“终战方案”曝光:100天换掉泽连斯基,乌克兰被按头签投降书

施涛说
2026-09-11 16:50:49
3-0!3-0!澳门冠军赛:8强诞生!张本智和剃光头,美和打疯了!

3-0!3-0!澳门冠军赛:8强诞生!张本智和剃光头,美和打疯了!

kio鱼
2026-09-11 00:16:11
2026金球奖前十出炉:39岁梅西轰8球挤进榜单,榜首仍是凯恩

2026金球奖前十出炉:39岁梅西轰8球挤进榜单,榜首仍是凯恩

篮坛第一线
2026-09-10 16:08:46
江西24岁女子患病,未婚夫垫付30万治疗费!办完后事准备离开,未来岳父递来一个红袋子:定情物+12万彩礼,一句话让他当场泪崩

江西24岁女子患病,未婚夫垫付30万治疗费!办完后事准备离开,未来岳父递来一个红袋子:定情物+12万彩礼,一句话让他当场泪崩

背包旅行
2026-09-02 18:16:44
中国为什么还不吹填黄岩岛?沈逸:因为我们不想成为第二个美国

中国为什么还不吹填黄岩岛?沈逸:因为我们不想成为第二个美国

抽象派大师
2026-09-11 11:13:46
华南师范大学可能后悔录取唐尚珺,全校返校他却在老家盖房

华南师范大学可能后悔录取唐尚珺,全校返校他却在老家盖房

华庭讲美食
2026-09-11 10:26:36
倒数第1名:属相虎:9月12日过后:此人一旦靠近,你三年努力归零

倒数第1名:属相虎:9月12日过后:此人一旦靠近,你三年努力归零

叮当当科技
2026-09-11 17:23:17
华为“第一境”开局失利,首款车太小众难成气候!

华为“第一境”开局失利,首款车太小众难成气候!

言车有徐
2026-09-10 17:02:25
45年,全国小学从91.7万所降到12.83万所

45年,全国小学从91.7万所降到12.83万所

老郭在学习
2026-09-10 16:32:25
iPhone 17系列官网涨价线下大降价,差价达500元

iPhone 17系列官网涨价线下大降价,差价达500元

界面新闻
2026-09-11 13:12:23
比亚迪员工:去年发了9万多,等着今年利润奖,回家过国庆节了

比亚迪员工:去年发了9万多,等着今年利润奖,回家过国庆节了

蚂蚁大喇叭
2026-09-11 16:08:35
天涯老网友泪目:当年遇上的全是神仙,如今网络再也回不去了!

天涯老网友泪目:当年遇上的全是神仙,如今网络再也回不去了!

夜深爱杂谈
2026-09-08 21:09:05
93-74!女篮世界杯爆冷,四强出炉,欧洲冠军惨败,她们创历史

93-74!女篮世界杯爆冷,四强出炉,欧洲冠军惨败,她们创历史

云上乌托邦
2026-09-11 15:26:39
埃及知名女主播获判绞刑!锦衣玉食的她当庭崩溃:我连烟都没碰过

埃及知名女主播获判绞刑!锦衣玉食的她当庭崩溃:我连烟都没碰过

冰语历史
2026-09-10 18:33:47
国际奥委会“点名”刘翔,释放三个强烈信号,苏炳添的话没说错

国际奥委会“点名”刘翔,释放三个强烈信号,苏炳添的话没说错

让心灵得以栖息
2026-08-29 04:25:20
《暗黑破坏神4》Steam迎2.5折新史低 9月25日截止!

《暗黑破坏神4》Steam迎2.5折新史低 9月25日截止!

3DM游戏
2026-09-11 09:33:04
64万罚单刚落地!曹云金不再忍耐,现场给郭德纲倒油,句句直戳心窝

64万罚单刚落地!曹云金不再忍耐,现场给郭德纲倒油,句句直戳心窝

观星赏月
2026-09-11 10:57:43
七个葫芦娃回来了,景区证实,是爷爷自己挂上去的,“景区没有权利去要求人家去挂葫芦”

七个葫芦娃回来了,景区证实,是爷爷自己挂上去的,“景区没有权利去要求人家去挂葫芦”

极目新闻
2026-09-11 17:27:50
哈里并非愚钝!若不和威廉和解,待威廉登基,他或将面临严重后果

哈里并非愚钝!若不和威廉和解,待威廉登基,他或将面临严重后果

动物奇奇怪怪
2026-09-11 09:49:09
本田急了!骂日本供应商: 你降成和中国一样低的价格, 我能不买

本田急了!骂日本供应商: 你降成和中国一样低的价格, 我能不买

兵鉴史
2026-09-10 22:31:46
2026-09-11 18:40:49
AI前线 incentive-icons
AI前线
面向AI爱好者、开发者和科学家,提供AI领域技术资讯。
1727文章数 170关注度
往期回顾 全部

科技要闻

苹果折叠屏比小米华为贵5000元,该怎么选

头条要闻

时隔6天"葫芦娃爷爷"重新挂出葫芦:感觉对不起游客

头条要闻

时隔6天"葫芦娃爷爷"重新挂出葫芦:感觉对不起游客

体育要闻

37岁还能场场进球,还能翻跟头!

娱乐要闻

黄晓明直言帮太多白眼狼,杨颖遭殃

财经要闻

千叶珠宝创始人夫妇失联 股价应声"腰斩"

汽车要闻

买菜车也有小乐趣 风云T7不止是台合格家用SUV

态度原创

时尚
旅游
房产
公开课
军事航空

女人不管三十还是四十,衣服都可以多穿白色,清爽百搭又减龄

旅游要闻

文旅部门回应将核查措嘉冰川违规探险情况!南都曾推出调查

房产要闻

时隔7年,绿地海南再拿地!

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

涉伊朗核问题 中国和俄罗斯投下反对票

无障碍浏览 进入关怀版