All AI models · LLM benchmarks · Methodology

Z.AI

GLM 4.5 (Thinking)

Hybrid-reasoning GLM release that made the 4.5 line broadly useful

Model facts

Context window
128K tokens
Maximum output
66K tokens
Cheapest paid input
$0.3 per 1M tokens
Cheapest paid output
$1.3 per 1M tokens
Open weights
yes
Providers
1

Capabilities and modalities

reasoning, temperature control, open weights, text.

Observed price history

  • 2026-08-24: $0.3 input / $1.3 output per 1M tokens

API providers