All AI models · LLM benchmarks · Methodology

Mistral

Mistral Small 3.1 24B

Efficient Mistral model for fast chat, extraction, and production assistants

Model facts

Context window
128K tokens
Maximum output
102K tokens
Cheapest paid input
$0.1 per 1M tokens
Cheapest paid output
$0.3 per 1M tokens
Open weights
yes
Providers
5

Capabilities and modalities

tool calling, structured output, attachments, temperature control, open weights, text, image.

Observed price history

  • 2026-08-24: $0.1 input / $0.3 output per 1M tokens

API providers

  • NanoGPT — model id mistral-small-31-24b-instruct; $0.1 input / $0.3 output per 1M tokens; provider documentation
  • watsonx.ai — model id mistralai/mistral-small-3-1-24b-instruct-2503; $0.106 input / $0.318 output per 1M tokens; provider documentation
  • OpenRouter — model id mistralai/mistral-small-3.1-24b-instruct; $0.351 input / $0.555 output per 1M tokens; provider documentation
  • Cloudflare Workers AI — model id @cf/mistralai/mistral-small-3.1-24b-instruct; $0.351 input / $0.555 output per 1M tokens; provider documentation
  • Kilo Gateway (Mistral) — model id mistralai/mistral-small-3.1-24b-instruct; $0.351 input / $0.555 output per 1M tokens; provider documentation