在8月31日晚间举办的2026年半年度业绩沟通会上,有分析师提出市场对智谱“只会后训练”的质疑,询问公司近期在参数规模上相对克制的原因。智谱创始人唐杰表示,下一代模型依旧会扩大基座规模,同时会对激活参数做管控,避免推理速度下滑和成本上升。算力层面,智谱披露,已实现10万级国产芯片规模化推理,单位Token推理成本较年初下降80%。GLM5.3Flash是智谱首款在超大规模真实流量下全面依托国产芯片集群提供服务的模型。公司称,对比同一硬件的初始基线,该模型端到端服务性能提升3倍。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.