Skip to main content
GLM-5.2 是智谱 AI 面向长任务时代的旗舰模型,通过 AnyFast 以 OpenAI 兼容接口提供服务。它将真正可用的 1M Token 上下文窗口与开源 SOTA 的编程能力相结合,能够在一次长程任务中完成”从需求到多端可部署产物”的完整开发链路。

核心能力

  • OpenAI 兼容 — 可直接替换 OpenAI SDK,无需修改其他代码
  • 1M 上下文窗口 — Solid 无损 1M 上下文,在长程任务下保持稳定,而非仅扩展名义长度
  • 128K 最大输出 — 单次响应最高可生成 128K Token
  • 思考模式 — 思维链推理(GLM-5.2 开启后为强制思考)
  • 可调推理强度 — 通过 reasoning_effort 调节模型的推理程度
  • 开源 SOTA Coding — 在长程编程基准上排名最高的开源模型,与最强闭源模型处于可比区间
  • Function Call、结构化输出与 MCP — 强大的工具调用、JSON 输出与 MCP 工具/数据源集成
  • 流式输出 — 通过 SSE 实现实时 Token 流式传输

输出规格

快速示例

思考模式

GLM-5.2 支持思维链思考模式。当 thinking.typeenabled(默认值)时,GLM-5.2 会在回答前强制进行思考。将其设为 disabled 可在轻量任务中跳过推理。
Python
reasoning_effort 控制模型的推理程度(仅在思考开启时生效)。GLM-5.2 支持 maxxhighhighmediumlowminimalnone;为保持兼容,none/minimal 会让模型放弃思考,low/medium 映射为 highxhigh 映射为 max。默认:max

参数说明

API 参考

查看 GLM-5.2 的交互式 API Playground。