All AI models · LLM benchmarks · Methodology

Meta

Llama 3.1 405B Instruct Turbo

Compact Llama instruction model for fast chat and local deployment

Model facts

Context window
128K tokens
Maximum output
4K tokens
Cheapest paid input
$3.5 per 1M tokens
Cheapest paid output
$3.5 per 1M tokens
Open weights
yes
Providers
1

Capabilities and modalities

tool calling, temperature control, open weights, text.

Observed price history

  • 2026-08-24: $3.5 input / $3.5 output per 1M tokens

API providers

  • Abacus — model id meta-llama/Meta-Llama-3.1-405B-Instruct-Turbo; $3.5 input / $3.5 output per 1M tokens; provider documentation