All AI models · LLM benchmarks · Methodology

Alibaba

Qwen3 Coder Flash

Qwen coding model for software agents, repository edits, and code reasoning

Model facts

Context window
1M tokens
Maximum output
66K tokens
Cheapest paid input
$0.144 per 1M tokens
Cheapest paid output
$0.574 per 1M tokens
Open weights
yes
Providers
12

Capabilities and modalities

tool calling, structured output, temperature control, open weights, text.

Observed price history

  • 2026-08-24: $0.144 input / $0.574 output per 1M tokens

API providers

  • Alibaba (China) — model id qwen3-coder-flash; $0.144 input / $0.574 output per 1M tokens; provider documentation
  • Merge Gateway — model id qwen/qwen3-coder-flash; $0.144 input / $0.574 output per 1M tokens; provider documentation
  • Kilo Gateway — model id qwen/qwen3-coder-flash; $0.195 input / $0.975 output per 1M tokens; provider documentation
  • OpenRouter — model id qwen/qwen3-coder-flash; $0.195 input / $0.975 output per 1M tokens; provider documentation
  • Alibaba — model id qwen3-coder-flash; $0.3 input / $1.5 output per 1M tokens; provider documentation
  • DevPass (LLM Gateway) — model id qwen3-coder-flash; $0.3 input / $1.5 output per 1M tokens; provider documentation
  • Eden AI — model id qwen/qwen3-coder-flash; $0.3 input / $1.5 output per 1M tokens; provider documentation
  • LLM Gateway (Alibaba Cloud) — model id alibaba/qwen3-coder-flash; $0.3 input / $1.5 output per 1M tokens; provider documentation
  • LLMTR — model id qwen/qwen3-coder-flash; $0.3 input / $1.5 output per 1M tokens; provider documentation
  • NanoGPT — model id qwen/qwen3-coder-flash; $0.3 input / $1.5 output per 1M tokens; provider documentation
  • DigitalOcean — model id qwen3-coder-flash; $0.45 input / $1.7 output per 1M tokens; provider documentation
  • Ofox — model id bailian/qwen3-coder-flash; $0.5 input / $2.5 output per 1M tokens; provider documentation