智谱 AI · 长程任务旗舰文本模型● 可用

GLM-5.2 API 价格与调用指南

GLM-5.2 是智谱面向长程任务、编程 Agent 与项目级工程上下文推出的旗舰文本模型。Roko API 当前通过 OpenAI 兼容的 Chat Completions 端点提供统一接入,并按实际输入、输出和缓存读取 Token 计费。

OpenAI 兼容 按 Token 计费 Chat流式输出
PRICING

GLM 5.2 API 价格

价格直接读取 Roko API 当前模型快照;实时刷新结果优先于构建快照。

GLM 5.2

GLM 5.2

glm-5.2
输入 Token$1.0000 / 1M tokens当前目录价格 · 按实际 Token 计费
输出 Token$3.5000 / 1M tokens当前目录价格 · 按实际 Token 计费
价格快照 正在刷新价格…
OVERVIEW

GLM-5.2 是什么模型?

智谱官方将 GLM-5.2 定位为面向长任务时代的旗舰基座模型,重点优化项目级工程上下文、长程任务稳定性和开发规范遵循。官方介绍强调,它面向从需求拆解、架构设计到开发、测试和交付的完整工程链路,而不只是生成局部代码片段。

官方模型文档公布了文本输入与文本输出、1M 上下文、128K 最大输出,以及思考模式、流式输出、Function Calling、上下文缓存和结构化输出等能力。这些属于上游模型能力;本页的“当前接入信息”和参数表只展示 Roko API 目录已经配置的部分。

评估 GLM-5.2 时,建议用真实仓库任务比较首次通过率、跨文件一致性、重试次数、缓存命中率和每个完成任务的总成本。对于长提示词或重复项目上下文,缓存读取价格通常比单看输入价格更能影响持续运行成本。

USE CASES

GLM-5.2 适合哪些场景?

以下场景来自官方模型定位;是否适合生产环境仍应以当前 Roko API 接入和真实任务评测为准。

01

长周期 Coding Agent

适合需要持续理解目标、规划步骤、修改多个文件并反复验证结果的长链路编程任务。

02

仓库与项目级分析

适合架构梳理、跨模块依赖分析、代码审查和需要保持工程规范一致性的项目级任务。

03

论文与工程复现

适合把模型架构、损失函数和数据管线转化为可运行工程,并持续修复代码与环境问题。

04

重复上下文工作流

适合反复携带稳定项目说明、系统提示或规范文档的任务,可结合缓存用量评估长期成本。

PARAMETERS

GLM 5.2 API 常用参数

仅列出当前 Roko API 接入已经明确支持或公开配置的字段。

参数类型要求说明
modelstring必填固定填写 glm-5.2。
messagesarray必填按顺序传入对话消息;至少包含一条用户消息。
streamboolean可选设为 true 时使用 SSE 流式返回。
QUICKSTART

GLM 5.2 API 调用示例

使用 OpenAI 兼容的 Chat Completions 请求即可接入。 API Key 应保存在服务端环境变量中。

Base URLhttps://api.rokoapi.com/v1
curl https://api.rokoapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [
      {"role": "user", "content": "审查这个代码库的模块边界,列出高风险耦合,并给出可分阶段执行的重构计划"}
    ],
    "stream": true
  }'
PRODUCTION

计费与上线建议

  1. 1

    当前价格读取 Roko API 模型目录;复杂表达式中的输入、输出和缓存读取费率会转换为美元 / 100 万 Token 展示。

  2. 2

    长仓库与长文档会显著增加输入用量,应同时监控普通输入 Token 和缓存读取 Token。

  3. 3

    生产环境建议记录 usage、响应耗时、重试次数和最终采纳结果,用完成任务的总成本评估模型。

  4. 4

    页面不会把官方完整能力自动视为 Roko API 已接入能力,实际可用参数以本页和接口响应为准。

FAQ

GLM 5.2 API 常见问题

GLM 5.2 API 使用哪个模型 ID?

使用 glm-5.2。模型 ID 区分字符,请直接复制本页显示的值。

GLM 5.2 API 怎么计费?

Roko API 当前按 Token 计费:输入 $1.0000 / 1M tokens,输出 $3.5000 / 1M tokens。最终费用以实际 usage 和当前价格配置为准。

GLM 5.2 API 使用哪个接口?

当前通过 OpenAI 兼容的 POST /v1/chat/completions 调用,Base URL 为 https://api.rokoapi.com/v1。

GLM-5.2 适合长程编程任务吗?

智谱官方将其重点定位于长程 Coding Agent 和项目级工程上下文。上线前仍应使用自己的仓库任务验证跨文件一致性、工具链适配和总成本。

GLM-5.2 的官方上下文窗口是多少?

智谱官方模型页公布为 1M 上下文、128K 最大输出。本页只有在 Roko API 模型目录配置相应字段时,才会把它们列为当前接入规格。

GLM-5.2 和 GLM-5.3 应该怎么选?

如果现有客户端依赖 GLM-5.2 的行为或需要稳定迁移,可先保留 5.2;新的高难度纯文本工程任务可同时评估 5.3,并以真实任务成功率、延迟和总成本决定路由。

RELATED

比较同系列或其他文本模型的价格与当前接入能力。

浏览全部文本模型 →