据 ai987.cn 于 2026 年 8 月 19 日收到的消息 ‣ 中国人工智能公司智谱(Z.ai)近日正式发布了新一代大语言模型GLM-5.3。该模型在保持参数规模不变的前提下,通过后训练与优化实现了关键评测指标约50%的性能提升,智谱宣称其已成为当前最强开源模型,编程与智能体能力逼近Claude Opus 5等顶尖闭源模型。

GLM-5.3延续了GLM-5.2的7400亿参数架构,并未如外界此前传闻那样扩展至万亿参数量级。智谱表示,此次性能跃升主要得益于后训练技术、数据质量提升、推理优化以及针对工具使用与智能体任务的专项训练。这反映出当前AI研究的一个重要趋势:单纯堆叠参数量已非提升模型能力的唯一路径,优化训练策略能从现有架构中挖掘出显著更强的实用性能。
在标杆测试中,GLM-5.3展现出显著进步。专注于真实终端环境复杂任务完成度的Terminal-Bench 3.0测试中,得分从GLM-5.2的4.6大幅跃升至28.3。长周期软件工程评测DeepSWE v1.1得分从46.2提升至66.9。覆盖多专业场景、强调跨工具协作与长任务执行的Agents’ Last Exam得分从23.8增至28.5。此外,在涵盖44个职业、考察高价值专业知识工作的GDPval-AA v2评测中,GLM-5.3获得1769分,显示其能力不仅局限于编程,亦向通用专业知识作业延伸。
智谱明确将GLM-5.3定位为面向真实计算环境执行工作的智能体模型,而非单纯的对话生成系统。其核心优势集中在软件工程、复杂编码、终端操作、自主智能体工作流、跨工具协作及长程任务处理等领域。这些能力对于AI从“生成文本代码”向“自主完成多步骤工程任务”演进至关重要。
开源属性使得GLM-5.3的发布备受关注。若独立评测证实其性能声明,开发者、研究机构与企业将能在不完全依赖专有API的前提下,部署、定制并集成该模型至自有系统,这将为AI编程智能体市场带来重要竞争变量。
业界观察认为,GLM-5.3在保持架构规模不变的情况下实现大幅增益,验证了后训练与智能体导向优化的有效性。尽管尚未迈入万亿参数阵营,但智谱展示了在现有基础设施上持续挖掘模型潜力的能力。未来GLM系列是否会推出万亿参数版本(如GLM-5.5)仍属推测,但当前版本已证明:AI进步的关键正从“模型变大”转向“模型变强、变实用”。
综合自网络信息