GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。一次任务即可完成“从需求到多端可部署产物”的完整开发链路。
from openai import OpenAI
client = OpenAI(
base_url="https://api.openroute.cn/v1",
api_key="<ONTOROUTE_API_KEY>",
)
completion = client.chat.completions.create(
model="glm-5.2",
messages=[
{
"role": "user",
"content": "Write a one-sentence bedtime story about a unicorn.",
}
],
)
print(completion.choices[0].message.content)价格为人民币(¥)/ 百万 token,按量计费;缓存读取可显著降低重复上下文成本。
| 提供商 | 输入上限 | 输出上限 | 上下文长度 | 工具调用 |
|---|---|---|---|---|
z-ai z-ai/glm-5.2 | 1M | 128K | 1M | 支持 |
| 参数 | 说明 | 默认值 |
|---|---|---|
| tools | 工具 | 由请求决定 |
| presence_penalty | 存在惩罚 | 由请求决定 |
| frequency_penalty | 频率惩罚 | 由请求决定 |
| max_tokens | 最大令牌数 | 由请求决定 |
| top_k | Top K | 由请求决定 |
| top_p | Top P | 由请求决定 |
| temperature | 温度 | 由请求决定 |