网易首页 > 网易号 > 正文 申请入驻

唐杰解读智谱半年报:Scaling从未停止 GLM-6方向是自进化

0
分享至



雷递网 雷建平 9月2日

智谱(股票代码:“2513”)日前发布2026年上半年的财报。财报显示,智谱2026年上半年营收为9.54亿元,较上年同期的1.91亿增长399.7%。



截至2026年8月31日,智谱MaaS平台年化收入规模(ARR)按月度计算达到16亿美元、周度计算20亿美元,企业及开发者用户超过740万,Token调用量较年初增长超过40倍,付费日活用户增长603%,前十大客户日均调用量增长98%,API平均售价提升约101%。

智谱自2026年初起全面实施All-in-Infra战略,在训练与推理两侧同时投入,并将国产芯片纳入主力推理算力,已实现10万级国产芯片的规模化低成本推理,单位token推理成本较年初下降80%。

财报发布当天,智谱创始人、首席科学家唐杰、董事长刘德兵、董事会秘书肖磊出席电话会,并展开交流。

唐杰在报电话会上表示,任何单点的领先都是有时限的,今天一个Coding benchmark第一,可能几周或者几个月以后就会被追平,所以,对SOTA的理解不是“领先多久”,而是应该改写成“持续领先的能力有多强”。

“过去11个月,我们整个GLM家族从4.6、4.7、5、5.1、5.2、5.3连续完成多代迭代,整个能力曲线持续往上走,同时单位任务成本基本保持在相对比较健康的水平,这对我们而言是持续迭代的能力,它比某一次单一的榜单第一更重要。”

唐杰说,Coding持续领先及是否在每一个benchmark上领先,不是最本质问题,真正重要的问题是当Coding往下延伸时,是否很自然的把这套能力迁移到下一层,特别是Co-work层面,更复杂、更高价值的任务中去。

今年以来,智谱在一个基座上陆续发布了GLM-5、5.1、5.2、5.3,智谱提出long-horizon task、Autonomous AI概念,就是让模型可以自己学习预训练、中训练、后训练,自己搭建平台,让整个训练过程完全自主化。

唐杰也透露了新模型GLM 6.0的思路——那就是自进化。模型能自己判断自己什么时候停止,什么时候纠正自己。

唐杰说,在未来模型中,这会作为重点研究。同时,智谱也在降本增效,降低推理成本,希望下一代模型出来的第一天,就能够让大家满量用上,不是简单地做了一个大而用不上的模型。

以下是智谱创始人、首席科学家唐杰介绍:

唐杰:大模型发展已经有将近十年的时间了。从去年开始,智谱意识到大模型已经从对话开始转向做事,我们也是国内最早开始在这方面布局,我们将模型的Coding能力大大加强,去年中我们发布了GLM-4.5,这是第一个在Coding能力上做出很好效果的一个模型。

今年以来我们陆续发布了GLM-5、5.1、5.2、5.3,当然5这个系列都是在一个基座上做的。首先大家可能会说Scaling是不是一定要把参数做的很大?Scaling是通向更高智能的关键路径,今年以来,我们在基座的参数规模上,以及在后训练、环境上都做了大大的加强。

首先简单地把参数做大,不是一个Scaling的本质路径,这方面我们想了很多。比如说参数规模做大的时候,我们还要让这个模型深度做的更深。比如说我们可以通过Loop Transformer让这个模型想得更多。

另一方面,在后训练上也可以做很多事情,使得这个模型后续也可以做很多工作,因此我们在GLM-5.3上也做了很多工作,这个模型在后训练上做了大大的加强。

同时,大家知道不同的模型完成Coding的时候,Coding里面有很多任务,我们把Coding里面不同任务都进行加强的话,整个模型能力会大大加强。我们在不同环境上做了相关的工作。另一个方面,我们做模型的时候,更重要的是让做出的模型大家都能用。所以我们设计模型的时候,不仅要设计模型的大小,还要设计模型的激活参数,同时要思考这个模型的基础设施,让推理成本比较低,这样才能让它更加普惠大众。

今年设计整个GLM-5的时候,我们将基础设施能力大大加强,收购了一个基础设施的公司,GLM-5.1、5.2、5.3这几个模型很容易让大家用起来,用量非常大。到目前为止我们的调用量一度达到第一的效果,同时使得我们MaaS平台在每一次模型发布,调用量都能成倍的增加,这是我们今年整个的布局和基本的情况。

让模型完全自训练研究

在下一步的布局当中,我们有很多不同的思考。第一,在今年初的时候,我们看到Coding已经变成了一个大家都认可并且广而周知的事情。

我们思考,在Coding基础上让这个模型做更多的事情,于是今年出的5.1和5.2,我们发起了让这个模型做的更长,我们叫long-horizon task,甚至提出了Autonomous AI,让模型完全自治地做一件事情。有了这两个能力以后模型需要做更多的事情,我们现在开始启动让这个模型完全自训练的一个研究,这个模型完全可以自己学习预训练、中训练、后训练,自己搭建平台让整个训练过程能够完全自主化。

我们最近做基础设施优化的时候,尤其是这次5.3-flash发布,我们在国产卡上做基础设施优化的时候,我们已经借用了基础设施Agent,通过5.3的基础设施自主修正国产卡上的一个优化,使得我们这个效果大大增强。在未来我们将在这条路上进一步发展,让它做得更强。

最后,在普惠AI,让所有人用得上的这条路上,更重要的是有社会责任。一个模型的发布,让大家用起来,意味着模型能处理更高价值密度的任务、每单位智能对应更多的经济产出。

今年上半年关键词是“能力兑现”

刘德兵:如果说去年关键词是“智能上界”,那么今年上半年,关键词是“能力兑现”,模型第一次被证明不再只是工具,而是具有独立把一件事做完的能力;收入结构随之完成置换,好模型的商业价值,开始规模化兑现。

第一点思考是,今年3月的年度业绩会上,我们提过一个公式:AGI商业价值=智能上界×Token消耗规模。智能上界决定模型能处理哪些任务、单位token能创造多少用户价值。更高的智能上界,意味着模型能处理更高价值密度的任务、每单位智能对应更多的经济产出。

Token消耗规模反映智能被使用的广度与深度,环境的楼度、产出相差几个数量级。智能上界决定了任务的边界,任务的价值决定了商业空间。Token落在什么价值密度的地方,取决于模型能够打开什么样的任务边界,任务边界每上一级市场空间就放大一个量级。

第二点思考是,公司模型能力发展的五个阶段,我们认为大模型能力的演进不是几条并列的产品线,而是一条只能按顺序走完的阶梯,
Chat-Coding-Agent-Cowork-AutonomousAI这五个阶段,我们看到Chat交付的是一次性的回答,而Coding交付的是一段可运行的代码,Agent交付是一条被执行完的多步任务链,Cowork交付一份可以被专业人士可复核的专业成果,Autonomous AI交付的是持续运行的能力。

每一级向上,都有一个具体的技术门槛,而门槛跨过不去,上一层的商业模式就不成立。

从CHat-Coding门槛结果可验证,从MaaS到Agent门槛是长程规划-错误恢复,从Agent到Cowork门槛是可靠性达到专业人士愿意复核而不推倒重做的水平。从Cowork到Autonomous AI,门槛是模型能否自己判断做的对不对。

单点冠军只是转瞬即逝,持续最优才是不断向上轨迹

报告期内,公司的重心处在阶梯的第二级,也就是Coding到第四级Co-work之间,公司已经在网络安全、法律、金融、教育等方面展开尝试。其中网络安全进展最快,其余方向仍处于早期。尚未形成规模化收入,公司模型在CyberGym上取得84.5%的成绩,超过了Fable 5和GPT-5.6 Sol,在ExploitGym上完成了130项任务,仅次于Fable 5和GPT-5.6 Sol。

第三点思考,是持续最优的模型轨迹,保持SOTA。在过去一年行业对SOTA的理解正在被改写,十年榜单的领先不再是最重要的,重要的是更快的节奏,持续把更强的模型推向市场。

单点冠军只是转瞬即逝的点,持续最优才是不断向上的轨迹。

单位Token推理成本较年初下降80%

GLM系列在约11个月内完成了六次迭代,智能指数从32提升至60,单任务完成稳定在0.2美元档,GLM-5.3-Flash以0.045美元的单任务成本进入到智能成本前沿。

其中GLM-5以Coding 为入口打开了长程智能,它的能力重点由代码生成延伸至系统理解、任务规划、工具调用与工程交付,推动模型从Vibe Coding走向Agentic Engineering。编程方向已经成为公司收入的主要来源,在Coding中积累了长程任务能力,也已经在网络安全等方向得到迁移验证。

GLM-5.2是面向长程度任务时代的旗舰模型,支持真正可用的1M上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景更成功率进一步提升。一次任务既可以完成从需求到多端可部署产物的完整开发链路。

GLM-5.3是智谱最新的旗舰模型,复杂软件工程与Agent任务能力全面进阶,它适用于GLM-5.2相同的基础模型,所有提升均来自后训练,但在复杂编程与长程任务方面表现更加出色。

在GLM-5.3的训练中,我们进一步推进了任务环境的规模化训练,使训练任务不再只是传统的编程题,而是更接近专家在真实工作中承担的完整专业工作单元,同架构、同总参数、同激活参数,唯一变量是后训练规模,端到端完成率提升超过50%。GLM-5.3也证明Scaling不止参数一个因素,而后训练是当前余量最大的那一个。

如果说GLM-5.3代表当前能力的上界,GLM-5.3-Flash代表的是成本前沿,面向高频、大规模、对成本敏感的调用,GLM-5.3-Flash采用了全新架构,专为极低成本设计,总参数320B,激活参数18B,稀疏注意力与线性注意力混合,价格为GLM-5.2的十分之一,基准测试语实际应用均优于GLM-5.2。

发布前,它以匿名模型Ox-Alpha在OpenCode与OpenRouter上接受真实调用检验。上线首日冲至OpenRouter榜首,并刷新单日Token用量纪录,6天调用总量超过62万亿,带动平台整体调用量提升超过20%。

第四思考是在国芯推国模上的进展,年初我们将国产芯片纳入主力推理算力,GLM-5.3-Flash是公司第一次在超大规模,真实流量中全面使用国产芯片集群,提供服务的模型,芯片之间通过自研、高带宽互联网连接整个推理引擎由GLM-5.3驱动的infra agent为大幅加速,算子开发周期缩短一半,模型优化系统,系统承载模型,这个循环第一次在公司内部跑通了。

结果是在与同一硬件上的初始基线相比,端到端的服务性能提升了3倍,公司已经实现10万卡级国产芯片的规模化低成本推理。单位Token推理成本较年初下降80%。在全球算力供给持续紧张的情况下,这条路径意味着我们的成本曲线,已经开始掌握在我们自己手里。

雷递由媒体人雷建平创办,若转载请写明来源。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
9月10日苹果发布会全系列汇总:4款iPhone加3款手表加AirPods5售价和亮点一文说透

9月10日苹果发布会全系列汇总:4款iPhone加3款手表加AirPods5售价和亮点一文说透

叮当当科技
2026-09-07 09:12:17
跑车别跑侥幸!有网友求助:我爸爸开网约车,把人撞进了医院抢救,该怎么办?

跑车别跑侥幸!有网友求助:我爸爸开网约车,把人撞进了医院抢救,该怎么办?

用车指南
2026-09-08 10:01:49
克林顿后悔!奥巴马后悔!拜登后悔!他们“后悔”对中国决策太天真

克林顿后悔!奥巴马后悔!拜登后悔!他们“后悔”对中国决策太天真

爱吃醋的猫咪
2026-09-08 20:54:04
美国甩锅乌克兰的代价是什么?

美国甩锅乌克兰的代价是什么?

烽火瞭望者
2026-09-08 04:18:19
美国终于意识到不对劲:解放军可能不会武力收台,中国另有杀招?

美国终于意识到不对劲:解放军可能不会武力收台,中国另有杀招?

军机Nova
2026-08-30 00:34:10
印媒扬言,如巴基斯坦敢买中国歼-35,印度会先将其炸毁在机场

印媒扬言,如巴基斯坦敢买中国歼-35,印度会先将其炸毁在机场

流年恰似繁花汐
2026-08-21 16:17:39
红军城惨状再升级,俄军攻入康斯坦丁诺夫卡,俄乌血战何时落幕?

红军城惨状再升级,俄军攻入康斯坦丁诺夫卡,俄乌血战何时落幕?

混沌录
2026-05-12 23:09:07
美军在霍尔木兹海峡开展扫雷作业,最终确认找到的200多枚“水雷”里有95%是充气塑料袋,伊朗靠普通垃圾袋就搅动了全球能源运输的关键枢纽

美军在霍尔木兹海峡开展扫雷作业,最终确认找到的200多枚“水雷”里有95%是充气塑料袋,伊朗靠普通垃圾袋就搅动了全球能源运输的关键枢纽

人生录
2026-09-08 00:05:16
比黄金还贵!1公斤卖165万,之前在农村被当成垃圾,现在为何暴涨

比黄金还贵!1公斤卖165万,之前在农村被当成垃圾,现在为何暴涨

史之铭
2026-09-08 00:44:08
记者:拉菲尼亚无缘2026年金球奖30人候选名单

记者:拉菲尼亚无缘2026年金球奖30人候选名单

懂球帝
2026-09-08 20:45:34
研究发现:冠心病患者吃猪大肠,用不了半年,身体或有5个大变化

研究发现:冠心病患者吃猪大肠,用不了半年,身体或有5个大变化

芹姐说生活
2026-09-08 23:22:44
冷空气突然来袭,全国多地今天气温“打对折”!上海……

冷空气突然来袭,全国多地今天气温“打对折”!上海……

上海黄浦
2026-09-08 19:21:13
张天爱里面不穿,有点辣啊

张天爱里面不穿,有点辣啊

吃瓜党二号头目
2026-09-05 12:10:46
西梅已经上市!研究发现:糖尿病患者吃西梅,或能降低5种并发症

西梅已经上市!研究发现:糖尿病患者吃西梅,或能降低5种并发症

老马健康讲坛
2026-09-08 12:46:18
定期存单到期,别傻傻当天就取!牢记“两要两不要”

定期存单到期,别傻傻当天就取!牢记“两要两不要”

花小猫的美食日常
2026-09-08 04:57:10
十年磨一剑!折叠屏iPhone整整打磨了10年:由苹果前CEO库克推动完成

十年磨一剑!折叠屏iPhone整整打磨了10年:由苹果前CEO库克推动完成

快科技
2026-09-09 00:18:14
白露前后,菜市场最冤的6种菜:营养堪比人参,却总被嫌弃

白露前后,菜市场最冤的6种菜:营养堪比人参,却总被嫌弃

房产衫哥
2026-09-09 00:21:31
60岁开始打针,多活七八年?Nature证实:减肥神药司美格鲁肽不仅让你瘦,还能直击衰老根源

60岁开始打针,多活七八年?Nature证实:减肥神药司美格鲁肽不仅让你瘦,还能直击衰老根源

爱医斯坦
2026-09-07 12:00:16
2013年,金正哲联手张成泽发动朝鲜兵变,因一细节败露,双遭反杀

2013年,金正哲联手张成泽发动朝鲜兵变,因一细节败露,双遭反杀

阿胡
2025-03-11 13:28:03
纪委朋友酒后吐真言:被围猎的干部,基本都栽在这四个“第一次”

纪委朋友酒后吐真言:被围猎的干部,基本都栽在这四个“第一次”

荷兰豆爱健康
2026-08-25 11:59:30
2026-09-09 02:04:49
雷递 incentive-icons
雷递
关注互联网大产业
28044文章数 73053关注度
往期回顾 全部

财经要闻

智谱六连跌失守1000大关,发生了什么?

头条要闻

伊朗称捕获美军先进潜航器 现场画面公布

头条要闻

伊朗称捕获美军先进潜航器 现场画面公布

体育要闻

韩旭:我一定会再次走出去

娱乐要闻

郭德纲被处罚,郭麒麟被曝恋情瓜

科技要闻

小米再次背水一战

汽车要闻

领克20 领克的纯电小钢炮这次更运动了

态度原创

时尚
游戏
健康
本地
军事航空

会穿衣的女性,能够借助最合适的单品,"修身上衣"显瘦又大方

《塞尔达》40周年汇总:电影|时之笛|限定主机|周边等

同样是脑梗,为何康复结局大不同?

本地新闻

宁波,中国制造的隐藏大佬

军事要闻

胡塞武装用自行生产的导弹袭击沙特军车

无障碍浏览 进入关怀版