智谱AI: GLM 5.2

z-ai/glm-5.2

GLM-5.2 是智谱迄今能力最强的开源模型,面向长程智能体工程打造,并支持真正可用的 1M token 上下文窗口。它能在超长任务中完整保持项目状态,减少反复压缩和丢弃上下文的损耗——任务越长,越能记得住、推得动。

立即体验
输入类型
输出类型
上下文长度
1M
发布时间
2026/06/16
6 家服务商
服务商上下文最大输出价格区间输入(M/Tokens)输出(M/Tokens)缓存(M/Tokens)延迟吞吐稳定性
qianfan-cn
¥3.2
¥11.2
¥0.8
985 ms88tps样本不足
wanqing-cn
¥4.4
¥15.4
¥1.1
2.7 s94.43tps样本不足
bailian-cn-beijing
1M128K
¥4.8
¥16.8
¥1.2
624 ms68tps样本不足
siliconflow-cn
¥4.8
¥16.8
¥1.2
1.7 s82.33tps样本不足
topenrouter-cn
¥4
¥14
¥2
978 ms62.67tps样本不足
fangzhou-cn
¥7.6
¥26.6
¥2
1.9 s82.75tps样本不足

稳定性

通过智能路由聚合多家服务商,保障调用稳定

性能

各服务商渠道监控数据对比

快速开始

查看 API 文档
curl https://api.tokplus.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $TOKGEN_API_KEY" \
  -d '{
    "model": "z-ai/glm-5.2",
    "messages": [
      {"role": "user", "content": "你好,介绍一下你自己"}
    ],
    "stream": true
  }'