📋 编辑总结
GLM-5.2是智谱2026年6月开源旗舰大模型(753B MoE),1M无损上下文,开源SOTA Coding能力,MIT许可证,API $1.40/$4.40/百万tokens。注意:纯文本模型,多模态需GLM-5V-Turbo。 定价:开源免费(MIT);API $1.40/$4.40每百万tokens。编辑评分:⭐ 4.5。

GLM-5.2是什么?

GLM-5.2 是智谱 AI(Z.ai)于 2026 年 6 月上线并开源的第五代基座大语言模型,也是当前国产开源大模型第一梯队的代表。它专为长程任务(Long-Horizon Task)而生——简单说,就是能一次性接住跨越数天、数周甚至数月的超长规划与执行,而不只是处理一轮对话。

在 Artificial Analysis 综合榜单上,GLM-5.2 拿到 51 分,与 Anthropic、OpenAI 一起位居前三,是开源模型里的 SOTA。对中文用户和开发者来说,最值得关注的两点是:真·100 万上下文,以及开源 SOTA 的 Coding 能力。


核心能力

1. 1M 无损超长上下文 GLM-5.2 实现了 Solid 1M 无损上下文(100 万 tokens)。和很多“名义 1M、实际几百 K 就劣化”的模型不同,它在数百 K 之后仍能稳定保持表现,特别适合长代码库、长文档和长链路 Agent 任务。

2. 开源 SOTA 的 Coding 能力 在 Code Arena(百万用户盲测的前端开发评估)上取得全球可用模型第一;在 FrontierSWE、SWE-Marathon、PostTrainBench 等长程软件工程基准上,表现介于 Claude Opus 4.7 与 4.8 之间,是排名最高的开源模型。对“让模型不知疲倦地写软件工程代码”这类场景尤其强。

3. 长程任务执行(Agent) 从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力。过去需要一支团队协作数周的项目(开发、联调、测试、打包),现在能在一次长程任务里跑完。

4. 原生多模态(GLM-5V-Turbo) 同系列的 GLM-5V-Turbo 是多模态 Coding 模型,原生融合视觉与文本,针对视觉编程与 Agent 任务专项优化。

5. 国产算力 Day 0 适配 上线即(Day 0)完成与平头哥、摩尔线程、寒武纪、昆仑芯、沐曦、海光、壁仞等国产算力平台的推理适配,在国产芯片集群上高吞吐、低延迟、大并发稳定运行,对信创与国产替代场景是实打实的优势。


GLM-5.1 和 GLM-5.2 有什么区别?

维度GLM-5.1GLM-5.2
定位突破长程任务(Long-Horizon)概念把 100 万上下文做成真正可用的长程交付能力
上下文较长上下文Solid 1M 无损上下文
Coding代码能力较强开源 SOTA,Code Arena 全球第一
开源协议开源MIT,无地域限制
升级节奏约两个月一版

一句话总结:5.1 把长程任务的“概念”立住了,5.2 把“工程可用”做扎实了——尤其把 1M 上下文从纸面参数变成了真实可用的长程交付能力。


免费吗?怎么用?

  • 开源权重:以最宽松的 MIT 协议开源,任何人都能下载、部署、商用,技术平权无国界。
  • API / 平台:通过智谱 AI 开放平台(Z.ai / bigmodel.cn)调用,新用户有免费额度,重度使用按 token 计费。
  • 智谱清言:C 端对话产品基于 GLM 系列模型,Web 端和 App 都能直接体验。
  • 调用方式:申请 API Key 后用官方 SDK 或 RESTful API 调用,支持 Python、Java 等主流语言。

值不值得用?

适合谁:

  • 需要处理超长代码库、长文档、长链路 Agent 任务的开发者
  • 重视数据可控、想在本地或国产算力私有部署的团队(MIT 协议 + 国产芯片适配)
  • 以中文场景为主、追求性价比的 AI 应用开发者

不太适合:

  • 只想要一个轻量聊天机器人的轻度用户(它更偏“生产级底座”,不是玩具)
  • 强依赖某个闭源生态、离不开商业 API 安全围栏的场景

总体结论: 如果你要的是“能真干活的开源底座”,GLM-5.2 目前是国产模型里最值得优先考虑的之一——1M 上下文 + 开源 SOTA 的 Coding + MIT 协议,这三点是硬实力。

GLM 版本演进对比:5.1 → 5.2 提升了什么

GLM-5.2 于 2026 年 6 月由智谱上线并开源,是 2025 年 4 月发布的 GLM-5.1 的代际升级。两者都采用 MIT 开源协议,但 5.2 在长上下文与 Coding / 长程任务上实现了跨越式提升:

对比维度GLM-5.1(2025.4)GLM-5.2(2026.6)提升说明
上下文窗口200K1M 无损5 倍,且真实可用、数百 K 后不劣化
长程任务单次连续工作约 8 小时1M 上下文稳定支撑长程交付可完整承载大型软件工程项目
Terminal-Bench 2.163.581.0+17.5 分
SWE-bench Pro58.462.1持续领先开源
Code Arena(前端开发盲测)未参评全球可用模型第一5.2 新增登顶
国产算力 Day 0 适配不支持华为昇腾 / 寒武纪等 8 家5.2 新增
推理力度(effort)控制不支持多档可调5.2 新增,平衡能力 / 速度 / 成本
开源协议MITMIT一致,可自由商用

架构变化:GLM-5.2 引入 IndexShare 稀疏注意力索引共享,将 1M 上下文下的每 token 算力降低约 2.9×,并优化 MTP 投机解码,使长上下文既宽又稳。

怎么选:新项目直接用 GLM-5.2——1M 无损上下文 + 开源 SOTA 的 Coding 能力 + MIT 协议,三者都是硬实力;存量系统若已在用 5.1 也可平滑升级,官方重心已转向 5.2。后续若发布 GLM-5.3 / 6.0,本小节会持续补充各代差异。