网易首页 > 网易号 > 正文 申请入驻

大模型不再比谁更大

0
分享至

2026年7月,大模型行业迎来了一轮密集发布期。

月之暗面发布Kimi K3,2.8万亿参数规模,在多项复杂任务评测中进入全球第一梯队;xAI推出Grok 4.5,强调以更低价格提供接近顶级闭源模型的能力;OpenAI则进一步调整产品策略,将旗舰模型拆分为不同版本,覆盖不同能力和成本需求。

如果把这些发布放在一起看,模型公司依然在追求更强能力,但竞争重点开始偏移。

过去,大模型竞争更多围绕参数规模、训练资源和榜单成绩展开。一家公司的实力很大程度上取决于它拥有多少GPU、投入多少资金、训练出多大的模型。但随着模型能力逐渐接近,单纯扩大规模带来的收益正在下降。xbench在最新模型评测中也指出,头部模型的最高分并没有出现明显突破,但各家都开始关注成本效率。

这背后反映出一个更深层的变化:大模型正在从“谁能训练出最大的模型”,进入“谁能用更低成本提供更强能力”的阶段。

01 参数神话开始松动

大模型行业曾经相信一个简单的逻辑:模型越大,能力越强。

2020年,OpenAI发布GPT-3,1750亿参数规模第一次让行业看到大模型的潜力。随后,GPT-4等模型不断扩大训练规模,更多数据、更强算力和更大参数量成为提升模型能力的重要路径。在这个阶段,Scaling Law几乎成为人工智能行业最重要的判断依据:只要投入更多计算资源,模型能力就会继续提升。

全球科技公司纷纷开始建设自己的大模型基础设施。OpenAI、Google、Anthropic等企业持续扩大训练规模,国内企业也在2023年之后快速进入基础模型竞争,通义千问、豆包、智谱GLM、月之暗面、阶跃星辰等企业陆续推出自己的模型产品。



当时行业关注的问题很明确:谁拥有更强的大模型?参数规模、上下文长度、多模态能力以及各种公开测试成绩,成为判断模型实力的重要指标。

这种竞争逻辑在Grok系列上体现得非常明显。

马斯克旗下xAI推出Grok 4时,大规模投入训练资源,使用大量GPU进行模型训练,希望通过更强计算能力获得领先。

这种路线并没有错。在人工智能发展早期,规模扩大确实带来了明显能力提升。

但问题在于,当所有头部企业都开始扩大投入之后,继续增加计算资源还能带来多少收益?

这个问题,正在成为行业新的讨论焦点。

模型能力依然在提升,但提升速度正在放缓。斯坦福大学AI Index报告显示,中美顶尖模型之间的性能差距已经大幅缩小,开源模型与闭源模型之间的差距也在快速收敛。当领先优势从数量级差距变成几个百分点差距,单纯依靠投入更多资金建立优势,难度越来越高。

大模型竞争开始进入新的阶段。

02 DeepSeek改变了一笔账

2025年初,DeepSeek的出现改变了行业对大模型成本的认知。

此前,训练高性能模型通常意味着巨额投入。大量GPU、昂贵的数据中心和长期研发投入,是大模型公司的基本门槛。DeepSeek给出的答案是,能力提升并不只有扩大规模这一条路径。通过模型架构优化、训练方法改进以及计算资源利用效率提升,DeepSeek实现了以更低成本达到较高性能。

更重要的是,它改变了市场对于AI模型价格的预期。DeepSeek降低API调用价格后,国内外模型厂商纷纷调整价格策略,大模型服务价格快速下降。

对于企业用户而言,这种变化非常直接。过去很多企业并不是没有AI需求,而是调用成本过高,无法大规模部署。当模型价格下降,客服系统、企业知识库、代码助手、办公自动化等场景都开始重新计算投入产出比,更多应用场景具备了商业价值。

这也是为什么2026年的模型竞争中,越来越多企业开始强调“小参数、高效率”和“低成本推理”。

Kimi K3就是其中一个代表。

它采用MoE架构,通过让模型在不同任务中激活部分参数,减少实际计算消耗。模型总参数规模可以非常大,但每次推理并不需要调用全部能力。这种设计的核心目标是能力和成本之间的平衡。Grok 4.5也体现了类似趋势,xAI强调的不仅是模型规模,更是相比竞争对手更低的价格和更高的token利用效率。

过去,大模型公司的竞争方式是不断增加投入。现在,如何把计算资源利用得更有效,正在成为新的竞争方向。

03 模型公司开始精打细算

当模型能力逐渐接近,行业竞争的评价标准也发生变化。

第一个变化是推理能力的重要性提升。

早期大模型主要解决“回答问题”。用户提出问题,模型生成答案。但随着AI进入复杂工作场景,代码开发、数据分析、科研辅助、企业管理等任务从一次问答变成了一系列需要拆解问题、调用工具、验证结果的流程。因此,模型竞争开始从“谁回答得更快”,转向“谁能够完成更复杂的任务”。

推理能力提升也带来了新的成本问题。模型思考时间越长,消耗token越多。优秀模型需要同时解决两个问题:推理要强,成本要低。这也是为什么token效率成为越来越重要的指标。

第二个变化是多模态成为基础能力。

人工智能正在从理解文字走向理解现实世界,图片、视频、声音和空间信息都成为模型获取信息的重要方式。多模态已经不再只是加分项,而逐渐成为旗舰模型的基础配置。

第三个变化是模型开始进入具体应用场景。

过去企业选择模型会关注排行榜成绩,但真正进入商业环境后,企业更关心模型能否解决实际问题:代码生成是否稳定,企业知识库是否准确,复杂流程是否能够自动执行,这些比单一测试成绩更重要得多。

模型正在从一个技术产品,逐渐变成产业基础设施。

04 模型之后,生态成为战场



大模型竞争走到今天,一个越来越明显的变化是,模型本身正在逐渐标准化。

这并不意味着模型能力不重要。基础模型依然决定了人工智能能够达到的上限。但对于企业而言,真正决定长期价值的,不只是一个领先模型,能否围绕模型建立完整生态同样重要。

这也是为什么开源正在成为大模型竞争中的重要变量。过去,闭源模式被认为更容易形成技术壁垒,企业通过更大规模训练、更强模型能力建立领先优势,其他公司很难追赶。但随着模型能力逐渐扩散,开源正在改变这种格局。

DeepSeek、通义千问等中国企业持续开放模型能力,让更多开发者和企业可以直接使用先进模型,降低了技术使用门槛,也扩大了模型影响范围。

开源的意义不只是开放代码或者参数。更重要的是,它能吸引更多开发者参与,推动更多应用基于自身模型建立。

互联网时代,操作系统竞争的关键并不只是系统本身,而是围绕系统形成的开发者和应用生态。移动互联网时代,手机厂商竞争的核心也逐渐从硬件参数转向生态体验。

大模型行业可能正在经历类似变化。模型能力越来越普及,但围绕模型的应用生态、开发者网络和行业解决方案,可能成为新的竞争壁垒。

05 大模型进入下半场

从GPT-3推动行业关注大模型,到DeepSeek重新定义成本,再到Kimi K3、Grok 4.5开始强调效率,大模型竞争正在经历一次重要转向。

早期阶段,行业比拼的是谁拥有更大的模型、更强的算力和更多的数据。现在,企业开始关注另一套指标:模型能否以更低成本运行,能否完成更复杂任务,能否进入更多真实场景。这并不意味着参数规模失去意义。大型模型仍然需要大量计算资源,也仍然是推动人工智能能力提升的重要基础。但单纯扩大规模已经越来越难形成绝对优势。

未来的大模型竞争更像一场综合能力竞争。技术能力决定模型上限,计算效率决定商业化空间,生态建设决定长期影响力。

一个月内多家头部企业密集推出新模型,表面上看仍是一场军备竞赛。但更深层的变化是,行业正在重新定义什么才是一款好模型。现在的企业开始问:谁的模型能用更低成本服务更多用户?谁能让更多行业真正用起来?谁能围绕模型建立新的生态?

大模型战争并没有结束,只是竞争规则正在变化。下一阶段,决定胜负的,可能不再取决于模型本身,而要看谁能把模型能力转化为更广泛的产业价值。

下一篇,我们将讨论开源模型正在如何改变人工智能产业格局。

声明:个人原创,仅供参考

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
北京车牌放开的真相!只增发新能源指标,严控燃油指标,别再被骗

北京车牌放开的真相!只增发新能源指标,严控燃油指标,别再被骗

阿芒娱乐说
2026-09-30 06:23:33
王钰栋破门难救主!U23国足1-2遭逆转,无缘亚运会男足决赛

王钰栋破门难救主!U23国足1-2遭逆转,无缘亚运会男足决赛

中超伪球迷
2026-09-30 15:57:19
万科A从跌停到翻红!房地产板块探底回升

万科A从跌停到翻红!房地产板块探底回升

证券时报
2026-09-30 12:46:04
普京再签扩军令俄军增至244万人,今年以来已第4次扩军

普京再签扩军令俄军增至244万人,今年以来已第4次扩军

澎湃新闻
2026-09-29 01:54:46
米饭被点名!医生直言:米饭冷冻12小时,抗性淀粉翻倍控糖护肠

米饭被点名!医生直言:米饭冷冻12小时,抗性淀粉翻倍控糖护肠

健康科普365
2026-09-30 09:04:21
穷时遇到的那些无法释怀的事?网友:至今忘不了父亲那窘迫的眼神

穷时遇到的那些无法释怀的事?网友:至今忘不了父亲那窘迫的眼神

另子维爱读史
2026-09-30 15:56:38
社区免费体检没人去?真相不是老人糊涂,是怕得明明白白

社区免费体检没人去?真相不是老人糊涂,是怕得明明白白

偷喝一口奶
2026-08-31 08:26:56
你的成长不够快,只有一个原因

你的成长不够快,只有一个原因

请辩
2026-09-30 15:29:40
皇马23岁后卫阿森西奥胫骨伤情待评估,皇马将决定是否手术 ,或伤缺长达三月

皇马23岁后卫阿森西奥胫骨伤情待评估,皇马将决定是否手术 ,或伤缺长达三月

福酱的小时光
2026-09-30 07:28:21
回顾:真正危险在天上!中日若彻底开战,日本的导弹,第一波就可能瞄准上海!可上海不是中国的死穴,真正让人脊背发凉的,是另一种可能!

回顾:真正危险在天上!中日若彻底开战,日本的导弹,第一波就可能瞄准上海!可上海不是中国的死穴,真正让人脊背发凉的,是另一种可能!

林杰论事
2026-09-27 02:25:09
刘欢出道多年几乎不接商业广告,唯独为一瓶白酒破例,背后原因让人佩服!

刘欢出道多年几乎不接商业广告,唯独为一瓶白酒破例,背后原因让人佩服!

情感大头说说
2026-09-28 14:05:40
8亿铂金级肉签公布中签结果,中签号码9.07万个,股民中了即赚了!

8亿铂金级肉签公布中签结果,中签号码9.07万个,股民中了即赚了!

数据挖掘分析
2026-09-30 08:15:47
国台办驳斥林佳龙投书日媒发表相关言论:纯属歪曲事实、颠倒黑白

国台办驳斥林佳龙投书日媒发表相关言论:纯属歪曲事实、颠倒黑白

海峡导报社
2026-09-30 12:10:06
92米62!23岁斯里兰卡标枪手一年连夺四冠

92米62!23岁斯里兰卡标枪手一年连夺四冠

温柔且自由
2026-09-29 17:47:09
美国主导的打击“伊斯兰国”国际联盟部队结束在伊拉克的军事任务

美国主导的打击“伊斯兰国”国际联盟部队结束在伊拉克的军事任务

界面新闻
2026-09-30 15:33:21
街头连打架都少见,国家为何突然再掀扫黑风暴?真相让人背后发凉

街头连打架都少见,国家为何突然再掀扫黑风暴?真相让人背后发凉

网络易不易
2026-08-24 10:31:58
金·卡戴珊在上海活动上为粉丝的红色鳄鱼皮爱马仕铂金包签名

金·卡戴珊在上海活动上为粉丝的红色鳄鱼皮爱马仕铂金包签名

生活观察员啊
2026-09-30 00:08:26
漫威影业宣布《复仇者联盟 5:毁灭之日》即将全国献映,官方发布定档海报

漫威影业宣布《复仇者联盟 5:毁灭之日》即将全国献映,官方发布定档海报

大象新闻
2026-09-28 13:15:04
广州男篮官宣!徐昕新赛季继续征战CBA,冲击NCAA失败

广州男篮官宣!徐昕新赛季继续征战CBA,冲击NCAA失败

国篮会自强
2026-09-30 13:34:02
一针见血!俄知名导演公开信戳破俄乌战争真相:根本没法收手

一针见血!俄知名导演公开信戳破俄乌战争真相:根本没法收手

老马拉车莫少装
2026-09-13 21:07:52
2026-09-30 16:56:49
反熵 incentive-icons
反熵
在熵增时代,以硬科技穿透噪音,为清醒者重构认知与秩序。
54文章数 3关注度
往期回顾 全部

科技要闻

OpenAI凌晨大上新!新助手dots迎战Muse

头条要闻

40年首球 中国U23男足1比2不敌韩国无缘亚运会决赛

头条要闻

40年首球 中国U23男足1比2不敌韩国无缘亚运会决赛

体育要闻

石雨豪:亚运金牌与背后的十年

娱乐要闻

胡歌现身游本昌遗体告别仪式

财经要闻

中央财政首次贴息房贷 定向支持首套刚需

汽车要闻

真实力用“大考”亮出来 猛士X700开启预售 24.98万起

态度原创

艺术
家居
旅游
数码
军事航空

艺术要闻

90年代重庆豪宅群,烂了30多年,现在荒成什么样了?

家居要闻

2026建博会(广州) 公装联探展交流活动

旅游要闻

百券齐发,国庆陪你“象”出游!景区门票、零食券、茶饮券连抢10天

数码要闻

Marshall发布Bromley 150派对音箱:售价3999元

军事要闻

美军最后2500人撤离伊拉克

无障碍浏览 进入关怀版