8月31日晚间,智谱(02513.HK)在2026年半年度业绩沟通会上,创始人唐杰集中回应了外界对智谱“只会后训练、参数规模相对克制”的质疑,并披露了下一代模型GLM-6.0的技术方向。
过去数月,GLM-5.1、5.2、5.3版本沿用同一基座,模型能力迭代提升主要依靠后训练完成,引发市场对智谱是否过度依赖后训练的讨论。对此,唐杰回应称,这是公司结合现有数据、算力资源,权衡不同训练阶段边际收益作出的主动选择,并非停止基础大模型的迭代升级。
唐杰在业绩会上透露,公司今年1月完成GLM-5系列所用基座模型的训练,其参数规模约7450亿。当时公司即决定,该基座将使用半年以上,并提前规划了5.1、5.2、5.3在训练、后训练及任务环境层面的安排。唐杰表示,参数规模并非Scaling的唯一变量,“简单把参数做大,并不是Scaling的本质路径”。智谱将当前技术路线概括为“Scalingdeepwhilescalingup”——规模扩展涵盖模型规模、上下文窗口和算力,深度扩展则包含后训练、强化学习与长程任务反馈,现阶段资源更多向后训练倾斜。
智谱董事长刘德兵则明确表示,后训练做到极致之后,下一个阶段的增长必须回到基座模型上,公司下一代基座模型已经在推进。
算力层面,智谱披露已实现10万级国产芯片规模化推理,单位Token推理成本较年初下降80%。GLM-5.3-Flash是智谱首款在超大规模真实流量下全面依托国产芯片集群提供服务的模型。公司称,对比同一硬件的初始基线,该模型端到端服务性能提升3倍。智谱已打通“自主模型—国产算力—规模化应用”的完整链路。