Alibaba
Qwen3.7 Flash
Lightweight multimodal Qwen model for high-throughput text, image, and video tasks
Model facts
- Context window
- 1M tokens
- Maximum output
- 66K tokens
- Cheapest paid input
- $0.028 per 1M tokens
- Cheapest paid output
- $0.113 per 1M tokens
- Open weights
- no
- Providers
- 12
Capabilities and modalities
reasoning, tool calling, structured output, attachments, temperature control, text, image, video, pdf.
Observed price history
- 2026-08-24: $0.03 input / $0.118 output per 1M tokens
- 2026-09-01: $0.028 input / $0.113 output per 1M tokens
API providers
- AIHubMix — model id qwen3.7-flash; $0.028 input / $0.113 output per 1M tokens; provider documentation
- Alibaba (China) — model id qwen3.7-flash; $0.03 input / $0.118 output per 1M tokens; provider documentation
- DevPass (LLM Gateway) — model id qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- EmpirioLabs AI — model id qwen3-7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- Kilo Gateway — model id qwen/qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- LLM Gateway (Alibaba Cloud) — model id alibaba/qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- NanoGPT — model id qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- OpenRouter — model id qwen/qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- OrcaRouter — model id qwen/qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- Vercel AI Gateway — model id alibaba/qwen3.7-flash; $0.03 input / $0.13 output per 1M tokens; provider documentation
- CrossModel — model id qwen/qwen3.7-flash; $0.04 input / $0.13 output per 1M tokens; provider documentation
- Charm Hyper — model id qwen3.7-flash; $0.2 input / $0.8 output per 1M tokens; provider documentation