All AI models · LLM benchmarks · Methodology

Alibaba

Qwen 2.5 7B Instruct Turbo

Efficient Qwen model for fast chat, extraction, and high-volume workloads

Model facts

Context window
33K tokens
Maximum output
33K tokens
Cheapest paid input
$0.3 per 1M tokens
Cheapest paid output
$0.3 per 1M tokens
Open weights
yes
Providers
1

Capabilities and modalities

tool calling, structured output, temperature control, open weights, text.

Observed price history

  • 2026-08-24: $0.3 input / $0.3 output per 1M tokens

API providers

  • Together AI — model id Qwen/Qwen2.5-7B-Instruct-Turbo; $0.3 input / $0.3 output per 1M tokens; provider documentation