GLM 5.2 是 Z.ai 推出的大规模推理模型。它支持文本输入和输出,拥有 100 万 token 的上下文窗口,适用于长期智能体工作流、项目级软件工程以及复杂的多步骤自动化任务。
该模型支持 high 和 xhigh 两种推理强度级别,其中 xhigh 对应最大推理力度。它在编码和长期运行任务中的工具使用方面尤为出色,能够在单个任务中贯穿整个开发流程——从需求分析到多平台部署——始终保持工程上下文的一致性,并持续遵循开发规范。
GLM 5.2 是 Z.ai 推出的大规模推理模型。它支持文本输入和输出,拥有 100 万 token 的上下文窗口,适用于长期智能体工作流、项目级软件工程以及复杂的多步骤自动化任务。
该模型支持 high 和 xhigh 两种推理强度级别,其中 xhigh 对应最大推理力度。它在编码和长期运行任务中的工具使用方面尤为出色,能够在单个任务中贯穿整个开发流程——从需求分析到多平台部署——始终保持工程上下文的一致性,并持续遵循开发规范。
| 套餐 | 价格 | 说明 |
|---|---|---|
| API Z.ai 官方接口 | Input $1.40 / Output $4.40 每百万 Tokens | 支持 1M Token 超长上下文,最大输出 128K Tokens。缓存输入价格约 $0.26/百万 Tokens。模型权重采用 MIT 许可证开放。 |
| API OpenRouter 接入 | Input $1.00 / Output $4.00 每百万 Tokens | 通过 OpenRouter 平台调用,提供不同渠道的 API 接入方式,价格以平台实际计费为准。 |
| GLM Coding 订阅方案 | 约 $10–$112/月 | 面向开发者的代码能力订阅服务。Lite 约 $10/月,Pro 约 $30–50/月,Max 约 $80–112/月,不同套餐提供不同使用额度。 |
| 自托管部署(开源权重) | 免费(需自备硬件) | 支持下载开放权重,在自有 GPU 环境中部署运行,无需支付 API 调用费用,适合企业和开发者进行私有化部署。 |
大规模文本推理 — 支持文本输入与输出,具备强大的逻辑推理能力。
百万级上下文窗口 — 1M token 容量,可一次性处理超长文档、完整代码库或多轮对话历史。
多级推理强度调节 — 支持 high 和 xhigh 两种模式,xhigh 对应最大推理深度,按需平衡速度与效果。
智能体工作流支持 — 适用于长期运行的 Agent 任务,可自主规划、调用工具、多步执行。
项目级软件工程 — 从需求分析、编码实现到多平台部署,全程保持上下文一致性与规范遵循。
复杂多步骤自动化 — 擅长处理需要连续决策和工具调用的复合型任务。
软件开发工程师 — 需要处理大型代码库、跨文件重构、全栈开发或从零搭建项目的开发者,可利用其百万上下文和深度推理能力,一次性完成需求到部署的全流程。
AI Agent 开发者 — 构建长期运行的智能体应用(如自动化运维、智能客服、研究助理等),需要模型具备自主规划、工具调用和多步执行能力。
数据科学家与分析师 — 处理超长文档(如科研论文、法律合同、财报)、复杂数据分析或跨文档信息整合,需大容量上下文和精准推理。
技术负责人 / 架构师 — 需要评估大规模工程方案、进行技术选型、审核代码规范、保持项目整体一致性的技术管理者。
自动化流程设计者 — 负责企业级多步骤自动化任务(如 CI/CD 流水线、文档生成、测试与部署联动),需要模型稳定执行复杂工作流。
研究人员与学术工作者 — 需要阅读、总结、对比大量文献,或进行多轮逻辑推导与实验设计的研究人员。
对推理质量要求极高的高级用户 — 不满足于普通模型浅层回答,需要深度思考、严谨推导和高质量输出的用户。
| 模型 | 上下文 | 定价 | API | 发布 | 全球热度 |
|---|---|---|---|---|---|
![]()
GLM 5.2
|
1M | 付费 | YES | 2026-06 |
65/100
|
| 1.3M | $0.075 / $0.250 per 1M | YES | 2026-08 | — | |
| 1M | $1.400 / $4.400 per 1M | YES | 2026-08 |
68/100
|
评论(0)