All AI models · LLM benchmarks · Methodology

nvidia--llama-3.2-nv-embedqa-1b

Embedding model for semantic search, retrieval, clustering, and ranking pipelines

Model facts

Context window
8K tokens
Maximum output
4K tokens
Cheapest paid input
$0.07 per 1M tokens
Cheapest paid output
free per 1M tokens
Open weights
no
Providers
1

Capabilities and modalities

text.

Observed price history

  • 2026-08-24: $0.07 input / free output per 1M tokens

API providers

  • SAP AI Core — model id nvidia--llama-3.2-nv-embedqa-1b; $0.07 input / free output per 1M tokens; provider documentation