传媒行业AI产业研究系列|模型跟踪-智谱GLM-5.3:后训练Scaling驱动能力跃升
证券研究报告 | 行业点评 请仔细阅读本报告末页声明 gszqdatemark 传媒 AI 产业研究系列|模型跟踪 智谱/GLM-5.3:后训练 Scaling 驱动能力跃升 事件:8 月 14 日,智谱发布 GLM-5.3 并上线官方编程工具 ZCode,模型权重将于两周内开源。 点评: 基座不变、后训练驱动能力跃升。GLM-5.3 延续 GLM-5.2 的架构与参数规模,全部提升来自后训练,包括数十倍扩充的长程任务环境、更丰富的环境类型与更长的后训练时间,并基于 IndexShare、SAO 与新一代 Slime 框架在同一基座上推进强化学习。据智谱披露,GLM-5.3 在 Terminal-Bench 3.0 上得分由 4.6 升至 28.3,DeepSWE v1.1 与 Agents‘ Last Exam 得分分别升至 66.9 和 28.5,多项公开基准位列开源第一,且当前基座的智能上界远未开发殆尽。我们认为,同一基座下仍能持续释放增量,体现智谱后训练体系的效率,后续切换更大预训练底座后的能力弹性值得期待。 编程能力对齐最强闭源模型,token 层面成本压力小于闭源旗舰。1)能力方面:据智谱披露,GLM-5.3 在终端操作、长程 Agent 任务上领先 Kimi K3,其中 Terminal-Bench 3.0 得分 28.3 对 17.4,传统软件工程任务上双方互有胜负。GLM-5.3 编程与智能体能力接近 Claude Fable 5,在自研 Z.ai Code Bench 中 High 档准确率 31.4%、每任务输出约 5 万 tokens,优于Claude Opus 4.8 最高档的 29.5%和约 12 万 tokens,Max 档 34.5%仍低于 Fable 5 的 39.5%。2)价格成本方面:GLM-5.3 定价与 GLM-5.2 持平,腾讯云平台报价每百万 tokens 输入 8 元、输出 28 元、缓存命中 2 元,叠加积分制峰谷五折与 98%以上的缓存命中率,token 层面的成本压力小于闭源旗舰。 多层次产品入口逐步形成,GLM-5.3 商业化空间有望持续释放。截至 8月 17 日,GLM-5.3 已通过 GLM Coding Plan、ZCode 及部分第三方开发与办公工具向用户提供服务。模型支持 1M 上下文和 128K 最大输出,能够承载大型代码库处理、长流程任务执行等高价值需求。随着通用 Model API、开放权重及配套开发工具陆续推出,其服务范围有望进一步从订阅用户扩展至企业客户和广大开发者。 后训练规模化的难点正从模型侧转向环境侧,ZCode 承接能力落地。据Z.ai 官方博客,后训练规模化的难点正从模型侧转向环境侧,训练数据正从文本、代码扩展为包含任务、工具、轨迹与奖励信号的完整环境,官方为此构建了端到端的环境合成管线,由研究型 Agent 采集真实任务模式、裁判型 Agent 验证任务可解性;GLM-5.3 的部分训练任务相当于工程师数天的工作量。截至 8 月 14 日,GLM-5.3 已上线智谱的 AI 编程工具 Zcode、效率工具 AutoClaw,支持通过 GLM Coding Plan 使用。我们认为,高质量环境将成为后训练阶段重要的数据资产,官方工具既是能力展示与订阅入口,也承担真实任务轨迹的回收职能,Zcode 重要性或将提升。 GLM-5.3 网络安全能力加速涌现,安全场景有望成为较早兑现生产力价值的场景。1)能力方面:智谱在后训练中引入漏洞发现数据与环境后,安全 能 力 随 训 练 规 模 扩 大加 速 涌 现 。 GLM-5.3 在 白 盒 漏 洞 发 现 基 准CyberGym 上得分 84.5%,高于 Mythos 5 的 83.8%;在更接近完整利用增持(维持) 行业走势 作者 分析师 刘文轩 执业证书编号:S0680526020003 邮箱:liuwenxuan@gszq.com 分析师 赵海楠 执业证书编号:S0680526020002 邮箱:zhaohainan@gszq.com 相关研究 1、《传媒:AI 产业研究系列|模型跟踪 SpaceXAI/Grok 4.6:后训练驱动能力跃升,性价比重塑格局》 2026-08-18 2、《AI 方向继续看好 Work 与云,新增关注 AI 数据方向,暑期档影视关注度提升:传媒互联网周观察(260810-260814)》 2026-08-17 3、《传媒:AI 产业研究系列|模型跟踪 Deepseek/V4-pro:能力迈入全球第一梯队,Harness 协同有望放大性价比优势》 2026-08-14 -30%-18%-6%6%18%30%2025-082025-122026-042026-08传媒沪深3002026 08 19年 月 日 gszqdatemark P.2 请仔细阅读本报告末页声明 的 ExploitBench 上得分 54.4%,仍低于 Mythos 5 的 78.0%。2)实际应用方面:GLM-5.2 发布以来,公司联合清华、南开及奇安信、绿盟、腾讯玄武等团队累计发现漏洞 2,436 个,其中中高危 1,097 个、覆盖 269 个项目,已提交 CNNVD/CNVD 国家漏洞库,按全球漏洞交易与赏金市场公开报价测算价值约 3,000 万元,并获微软官方致谢;此前 Hugging Face 安全事件中 GLM 已被用于防御。我们认为,安全场景是企业需求明确、专业价值较高的应用方向,且已有真实交付案例,有望成为继 Coding 之后较早兑现生产力价值的场景 风险提示:技术迭代不及预期;行业竞争加剧风险;算力不足风险等。 2026 08 19年 月 日 gszqdatemark P.3 请仔细阅读本报告末页声明 免责声明 国盛证券股份有限公司(以下简称“本公司”)具有中国证监会许可的证券投资咨询业务资格。本报告仅供本公司的客户使用。本公司不会因接收人收到本报告而视其为客户。在任何情况下,本公司不对任何人因使用本报告中的任何内容所引致的任何损失负任何责任。 本报告的信息均来源于本公司认为可信的公开资料,但本公司及其研究人员对该等信息的准确性及完整性不作任何保证。本报告中的资料、意见及预测仅反映本公司于发布本报告当日的判断,可能会随时调整。在不同时期,本公司可发出与本报告所载资料、意见及推测不一致的报告。本公司不保证本报告所含信息及资料保持在最新状态,对本报告所含信息可在不发出通知的情形下做出修改,投资者应当自行关注相应的更新或修改。 本公司力求报告内容客观、公正,但本报告所载的资料、工具、意见、信息及推测只提供给客户作参考之用,不构成任何投资、法律、会计或税务的最终操作建议,本公司不就报告中的内容对最终操作建议做出任何担保。本报告中所指的投资及服务可能不适合个别客户,不构成客户私人咨询建议。投资者应当充分
[国盛证券]:传媒行业AI产业研究系列|模型跟踪-智谱GLM-5.3:后训练Scaling驱动能力跃升,点击即可下载。报告格式为PDF,大小0.57M,页数3页,欢迎下载。



