All AI models · LLM benchmarks · Methodology

Nous Research

Nous: Hermes 3 70B Instruct

Open Llama instruction model for multilingual chat, reasoning, and coding

Model facts

Context window
131K tokens
Maximum output
16K tokens
Cheapest paid input
$0.7 per 1M tokens
Cheapest paid output
$0.7 per 1M tokens
Open weights
no
Providers
1

Capabilities and modalities

structured output, temperature control, text.

Observed price history

  • 2026-08-24: $0.7 input / $0.7 output per 1M tokens

API providers

  • Kilo Gateway — model id nousresearch/hermes-3-llama-3.1-70b; $0.7 input / $0.7 output per 1M tokens; provider documentation