All AI models · LLM benchmarks · Methodology

Qwen3-Omni Flash Realtime

Qwen omni model for text, vision, audio, and multimodal agent tasks

Model facts

Context window
66K tokens
Maximum output
16K tokens
Cheapest paid input
$0.23 per 1M tokens
Cheapest paid output
$0.918 per 1M tokens
Open weights
no
Providers
2

Capabilities and modalities

tool calling, temperature control, text, image, audio, video.

Observed price history

  • 2026-08-24: $0.23 input / $0.918 output per 1M tokens

API providers

  • Alibaba (China) — model id qwen3-omni-flash-realtime; $0.23 input / $0.918 output per 1M tokens; provider documentation
  • Alibaba — model id qwen3-omni-flash-realtime; $0.52 input / $1.99 output per 1M tokens; provider documentation