Alibaba
Qwen3.8 Flash
Qwen vision-language model for visual reasoning, documents, and agent tasks
Model facts
- Context window
- 1M tokens
- Maximum output
- 131K tokens
- Cheapest paid input
- $0.12 per 1M tokens
- Cheapest paid output
- $0.38 per 1M tokens
- Open weights
- no
- Providers
- 19
Capabilities and modalities
reasoning, tool calling, structured output, attachments, temperature control, text, image, video, pdf.
Observed price history
- 2026-08-26: $0.16 input / $0.47 output per 1M tokens
- 2026-08-27: $0.15 input / $0.47 output per 1M tokens
- 2026-08-28: $0.12 input / $0.38 output per 1M tokens
API providers
- Alibaba Token Plan — model id qwen3.8-flash; free input / free output per 1M tokens; provider documentation
- Alibaba Token Plan (China) — model id qwen3.8-flash; free input / free output per 1M tokens; provider documentation
- NaN — model id qwen3.8-flash; free input / free output per 1M tokens; provider documentation
- Vancine — model id qwen3.8-flash; $0.12 input / $0.38 output per 1M tokens; provider documentation
- Alibaba (China) — model id qwen3.8-flash; $0.119 input / $0.401 output per 1M tokens; provider documentation
- CrossModel — model id qwen/qwen3.8-flash; $0.13 input / $0.43 output per 1M tokens; provider documentation
- Alibaba — model id qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- Charm Hyper — model id qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- DevPass (LLM Gateway) — model id qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- Eden AI — model id qwen/qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- Kilo Gateway — model id qwen/qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- LLM Gateway (Alibaba Cloud) — model id alibaba/qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- LLM Gateway (NovitaAI) — model id novita/qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- OpenCode Go — model id qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- OpenRouter — model id qwen/qwen3.8-flash; $0.15 input / $0.47 output per 1M tokens; provider documentation
- EmpirioLabs AI — model id qwen3-8-flash; $0.16 input / $0.47 output per 1M tokens; provider documentation
- NanoGPT — model id alibaba/qwen3.8-flash; $0.16 input / $0.47 output per 1M tokens; provider documentation
- Requesty — model id qwen3.8-flash; $0.16 input / $0.47 output per 1M tokens; provider documentation
- Vercel AI Gateway — model id alibaba/qwen3.8-flash; $0.16 input / $0.47 output per 1M tokens; provider documentation