as22 发表于 2026-6-18 14:25:16

智谱宣布上线并开源GLM-5.2模型

本帖最后由 as22 于 2026-6-18 14:26 编辑

6月18日,日前,智谱宣布上线并开源GLM-5.2。

据介绍,在全球百万用户参与盲测的前端开发评估系统Code Arena上,GLM-5.2取得全球可用模型第一的表现。



GLM-5.2专为长程任务能力而生,全新特色包括:Solid 1M上下文,稳定支撑长程任务;更强体感,更实用的Coding能力;极致Infra优化,Day 0运行在国产算力平台;MIT开源协议,无地域限制,技术平权无国界。

GLM-5.2的多个长程任务基准表明GLM-5.2的表现介于Claude Opus 4.7与4.8之间,是排名最高的开源模型。在FrontierSWE(测试AI是否能够像软件工程师在数小时尺度上完成复杂技术项目的测试集)上仅比Opus 4.8低1%,超过GPT-5.5(1%)和Opus 4.7(11%);不过在SWE-Marathon(考察Agent自主完成超长软件工程的测试集)上确实还需要进一步提高,低于Opus 4.8不少(13%)。



在主流编程基准上,GLM-5.2保持开源SOTA,与Claude Opus 4.8处于可比区间。例如在Terminal-Bench 2.1(评测AI Agent完成不同类型的计算机终端任务),GLM-5.2比Opus 4.8低4%,相比GLM-5.1提升了17.5%;在MCP-Atlas(大规模工具调研评测的数据集),GLM-5.2比Opus 4.8低0.8%。



另外,GLM-5.2在1M上下文长度下,将单位token的FLOPs降低至2.9倍。还改进了用于投机解码(speculative decoding)的MTP层,将接受长度(acceptance length)最多提升20%。训练侧则依赖自研Slime框架支撑大规模Agentic RL和OPD训练。



GLM-5.2在Hugging Face与ModelScope开源,模型权重遵循最高权限MIT License,可自由下载、部署与商用。vLLM、SGLang、transformers等主流推理框架已经支持。
同时,GLM-5.2 API已上线,并已纳入GLM Coding Plan,长上下文与长程任务同步升级,全量用户可使用。
页: [1]
查看完整版本: 智谱宣布上线并开源GLM-5.2模型