All AI models · LLM benchmarks · Methodology

NVIDIA

Nemotron 3 Nano Omni 30B A3B Reasoning

Open Nemotron omni model combining reasoning with text, vision, and audio

Model facts

Context window
262K tokens
Maximum output
66K tokens
Cheapest paid input
$0.2 per 1M tokens
Cheapest paid output
$0.8 per 1M tokens
Open weights
yes
Providers
3

Capabilities and modalities

reasoning, tool calling, structured output, attachments, temperature control, open weights, text, image, audio, video.

Artificial Analysis benchmarks

Compare this model on the full LLM benchmark leaderboard.

ConfigurationAAICodingMathOutput tokens/s
default15.013.8not measured329.0

Observed price history

  • 2026-08-24: $0.2 input / $0.8 output per 1M tokens

API providers

  • Requesty — model id nemotron-3-nano-omni-30b-a3b-reasoning; free input / free output per 1M tokens; provider documentation
  • Deep Infra — model id nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning; $0.2 input / $0.8 output per 1M tokens; provider documentation
  • Crusoe — model id nvidia/Nemotron-3-Nano-Omni-Reasoning-30B-A3B; $0.3 input / $1.83 output per 1M tokens; provider documentation