Z.AI
GLM-5-Turbo
Faster GLM-5 lane for coding agents that need lower latency
Model facts
- Context window
- 2K tokens
- Maximum output
- 131K tokens
- Cheapest paid input
- $0.72 per 1M tokens
- Cheapest paid output
- $3.2 per 1M tokens
- Open weights
- yes
- Providers
- 17
Capabilities and modalities
reasoning, tool calling, structured output, attachments, temperature control, open weights, text.
Artificial Analysis benchmarks
Compare this model on the full LLM benchmark leaderboard.
| Configuration | AAI | Coding | Math | Output tokens/s |
|---|---|---|---|---|
| default | 39.1 | not measured | not measured | not measured |
Observed price history
- 2026-08-24: $0.72 input / $3.2 output per 1M tokens
API providers
- Z.AI Coding Plan — model id glm-5-turbo; free input / free output per 1M tokens; provider documentation
- Zhipu AI Coding Plan — model id glm-5-turbo; free input / free output per 1M tokens; provider documentation
- 302.AI — model id glm-5-turbo; $0.72 input / $3.2 output per 1M tokens; provider documentation
- ZenMux — model id z-ai/glm-5-turbo; $0.88 input / $3.48 output per 1M tokens; provider documentation
- CrossModel — model id z-ai/glm-5-turbo; $0.9 input / $3.7 output per 1M tokens; provider documentation
- Cortecs — model id glm-5-turbo; $1.19 input / $3.96 output per 1M tokens; provider documentation
- Eden AI — model id zai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Impossibl — model id zai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Kilo Gateway — model id z-ai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Merge Gateway — model id zai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- NanoGPT — model id z-ai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Ofox — model id z-ai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- OpenRouter — model id z-ai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- TensorX — model id z-ai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Venice AI — model id z-ai-glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Vercel AI Gateway — model id zai/glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation
- Z.AI — model id glm-5-turbo; $1.2 input / $4 output per 1M tokens; provider documentation