Hermes 3 Llama 3.1 405b
Open Llama instruction model for multilingual chat, reasoning, and coding
Model facts
- Context window
- 128K tokens
- Maximum output
- 16K tokens
- Cheapest paid input
- $1.1 per 1M tokens
- Cheapest paid output
- $3 per 1M tokens
- Open weights
- yes
- Providers
- 1
Capabilities and modalities
open weights, text.
Observed price history
- 2026-08-24: $1.1 input / $3 output per 1M tokens
API providers
- Venice AI — model id hermes-3-llama-3.1-405b; $1.1 input / $3 output per 1M tokens; provider documentation