GLM-5.2是智谱2026年6月开源旗舰大模型(753B MoE),1M无损上下文,开源SOTA Coding能力,MIT许可证,API $1.40/$4.40/百万tokens。注意:纯文本模型,多模态需GLM-5V-Turbo。 定价:开源免费(MIT);API $1.40/$4.40每百万tokens。编辑评分:⭐ 4.5。
GLM-5.2是什么?
GLM-5.2 是智谱 AI(Z.ai)于 2026 年 6 月上线并开源的第五代基座大语言模型,也是当前国产开源大模型第一梯队的代表。它专为长程任务(Long-Horizon Task)而生——简单说,就是能一次性接住跨越数天、数周甚至数月的超长规划与执行,而不只是处理一轮对话。
在 Artificial Analysis 综合榜单上,GLM-5.2 拿到 51 分,与 Anthropic、OpenAI 一起位居前三,是开源模型里的 SOTA。对中文用户和开发者来说,最值得关注的两点是:真·100 万上下文,以及开源 SOTA 的 Coding 能力。
核心能力
1. 1M 无损超长上下文 GLM-5.2 实现了 Solid 1M 无损上下文(100 万 tokens)。和很多“名义 1M、实际几百 K 就劣化”的模型不同,它在数百 K 之后仍能稳定保持表现,特别适合长代码库、长文档和长链路 Agent 任务。
2. 开源 SOTA 的 Coding 能力 在 Code Arena(百万用户盲测的前端开发评估)上取得全球可用模型第一;在 FrontierSWE、SWE-Marathon、PostTrainBench 等长程软件工程基准上,表现介于 Claude Opus 4.7 与 4.8 之间,是排名最高的开源模型。对“让模型不知疲倦地写软件工程代码”这类场景尤其强。
3. 长程任务执行(Agent) 从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力。过去需要一支团队协作数周的项目(开发、联调、测试、打包),现在能在一次长程任务里跑完。
4. 原生多模态(GLM-5V-Turbo) 同系列的 GLM-5V-Turbo 是多模态 Coding 模型,原生融合视觉与文本,针对视觉编程与 Agent 任务专项优化。
5. 国产算力 Day 0 适配 上线即(Day 0)完成与平头哥、摩尔线程、寒武纪、昆仑芯、沐曦、海光、壁仞等国产算力平台的推理适配,在国产芯片集群上高吞吐、低延迟、大并发稳定运行,对信创与国产替代场景是实打实的优势。
GLM-5.1 和 GLM-5.2 有什么区别?
| 维度 | GLM-5.1 | GLM-5.2 |
|---|---|---|
| 定位 | 突破长程任务(Long-Horizon)概念 | 把 100 万上下文做成真正可用的长程交付能力 |
| 上下文 | 较长上下文 | Solid 1M 无损上下文 |
| Coding | 代码能力较强 | 开源 SOTA,Code Arena 全球第一 |
| 开源协议 | 开源 | MIT,无地域限制 |
| 升级节奏 | — | 约两个月一版 |
一句话总结:5.1 把长程任务的“概念”立住了,5.2 把“工程可用”做扎实了——尤其把 1M 上下文从纸面参数变成了真实可用的长程交付能力。
免费吗?怎么用?
- 开源权重:以最宽松的 MIT 协议开源,任何人都能下载、部署、商用,技术平权无国界。
- API / 平台:通过智谱 AI 开放平台(Z.ai / bigmodel.cn)调用,新用户有免费额度,重度使用按 token 计费。
- 智谱清言:C 端对话产品基于 GLM 系列模型,Web 端和 App 都能直接体验。
- 调用方式:申请 API Key 后用官方 SDK 或 RESTful API 调用,支持 Python、Java 等主流语言。
值不值得用?
适合谁:
- 需要处理超长代码库、长文档、长链路 Agent 任务的开发者
- 重视数据可控、想在本地或国产算力私有部署的团队(MIT 协议 + 国产芯片适配)
- 以中文场景为主、追求性价比的 AI 应用开发者
不太适合:
- 只想要一个轻量聊天机器人的轻度用户(它更偏“生产级底座”,不是玩具)
- 强依赖某个闭源生态、离不开商业 API 安全围栏的场景
总体结论: 如果你要的是“能真干活的开源底座”,GLM-5.2 目前是国产模型里最值得优先考虑的之一——1M 上下文 + 开源 SOTA 的 Coding + MIT 协议,这三点是硬实力。
GLM 版本演进对比:5.1 → 5.2 提升了什么
GLM-5.2 于 2026 年 6 月由智谱上线并开源,是 2025 年 4 月发布的 GLM-5.1 的代际升级。两者都采用 MIT 开源协议,但 5.2 在长上下文与 Coding / 长程任务上实现了跨越式提升:
| 对比维度 | GLM-5.1(2025.4) | GLM-5.2(2026.6) | 提升说明 |
|---|---|---|---|
| 上下文窗口 | 200K | 1M 无损 | 5 倍,且真实可用、数百 K 后不劣化 |
| 长程任务 | 单次连续工作约 8 小时 | 1M 上下文稳定支撑长程交付 | 可完整承载大型软件工程项目 |
| Terminal-Bench 2.1 | 63.5 | 81.0 | +17.5 分 |
| SWE-bench Pro | 58.4 | 62.1 | 持续领先开源 |
| Code Arena(前端开发盲测) | 未参评 | 全球可用模型第一 | 5.2 新增登顶 |
| 国产算力 Day 0 适配 | 不支持 | 华为昇腾 / 寒武纪等 8 家 | 5.2 新增 |
| 推理力度(effort)控制 | 不支持 | 多档可调 | 5.2 新增,平衡能力 / 速度 / 成本 |
| 开源协议 | MIT | MIT | 一致,可自由商用 |
架构变化:GLM-5.2 引入 IndexShare 稀疏注意力索引共享,将 1M 上下文下的每 token 算力降低约 2.9×,并优化 MTP 投机解码,使长上下文既宽又稳。
怎么选:新项目直接用 GLM-5.2——1M 无损上下文 + 开源 SOTA 的 Coding 能力 + MIT 协议,三者都是硬实力;存量系统若已在用 5.1 也可平滑升级,官方重心已转向 5.2。后续若发布 GLM-5.3 / 6.0,本小节会持续补充各代差异。