Hermes 4 - Llama-3.1 405B (Non-reasoning) API Pricing
Nous Research · released 2025-08-27
Pricing
0.100¢ / 1K
0.300¢ / 1K
0.150¢ / 1K
What it actually costs
| Workload | Tokens | Cost |
|---|---|---|
| Short chat reply | 500 in / 300 out | 0.14¢ |
| RAG query | 4,000 in / 500 out | 0.55¢ |
| Long document summary | 50,000 in / 1,000 out | $0.0530 |
| Code review of a 2k-line file | 30,000 in / 2,000 out | $0.0360 |
| 1,000 chat replies/day for 30 days | 30,000 × (500 in / 300 out) | $42.00 |
Cost = (input tokens ÷ 1,000,000 × $1.00) + (output tokens ÷ 1,000,000 × $3.00).
Benchmarks
#357 of 533
#197 of 249
Similar intelligence, lower price
| Model | Intelligence | Blended $/1M |
|---|---|---|
| Llama 3.1 Instruct 8B | 6.9 | $0.028 |
| Gemma 4 E4B (Reasoning) | 8.9 | $0.04 |
| Sarvam 30B (high) | 6.6 | $0.047 |
| Granite 4.2 3B | 9.1 | $0.052 |
| Nova Micro | 5.9 | $0.061 |
Leaderboard neighbours
| Model | Intelligence | Blended $/1M |
|---|---|---|
| Solar Pro 2 (Reasoning) | 7.5 | — |
| Gemini 2.0 Flash-Lite (Feb '25) | 7.4 | — |
| Granite 4.1 30B | 7.4 | — |
| Hermes 4 - Llama-3.1 405B (Non-reasoning) | 7.4 | $1.50 |
| Llama Nemotron Super 49B v1.5 (Non-reasoning) | 7.4 | $0.40 |
| NVIDIA Nemotron 3 Nano 4B | 7.4 | — |
| NVIDIA Nemotron Nano 9B V2 (Reasoning) | 7.4 | $0.07 |
More from Nous Research
| Model | Intelligence | Blended $/1M |
|---|---|---|
| Hermes 4 - Llama-3.1 70B (Reasoning) | 7.9 | — |
| Hermes 4 - Llama-3.1 405B (Reasoning) | 7.5 | $1.50 |
| Hermes 4 - Llama-3.1 70B (Non-reasoning) | 6.7 | — |
| DeepHermes 3 - Mistral 24B Preview (Non-reasoning) | 6.1 | — |
| Hermes 3 - Llama-3.1 70B | 6.0 | $0.70 |
| DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning) | 5.1 | — |
Count tokens & estimate cost for Hermes 4 - Llama-3.1 405B (Non-reasoning) See Hermes 4 - Llama-3.1 405B (Non-reasoning) on the leaderboard
Source: Artificial Analysis · last synced 2026-09-22
FAQ
Who develops Hermes 4 - Llama-3.1 405B (Non-reasoning)?
Hermes 4 - Llama-3.1 405B (Non-reasoning) is developed by Nous Research, released 2025-08-27.
How much does Hermes 4 - Llama-3.1 405B (Non-reasoning) cost per million tokens?
Hermes 4 - Llama-3.1 405B (Non-reasoning) costs $1.00 per 1M input tokens and $3.00 per 1M output tokens ($1.50 blended), per Artificial Analysis's official pricing data.
How does Hermes 4 - Llama-3.1 405B (Non-reasoning) rank on benchmarks?
Hermes 4 - Llama-3.1 405B (Non-reasoning) scores 7.4 on the Artificial Analysis Intelligence Index, ranking #357 of 533 models we track.
Is there a cheaper model with similar intelligence to Hermes 4 - Llama-3.1 405B (Non-reasoning)?
Yes — Llama 3.1 Instruct 8B scores similar intelligence (6.9) at $0.028/1M blended, versus $1.50/1M for Hermes 4 - Llama-3.1 405B (Non-reasoning).
Where does this data come from?
Pricing and benchmark data for Hermes 4 - Llama-3.1 405B (Non-reasoning) comes from Artificial Analysis (artificialanalysis.ai), synced daily. Last synced 2026-09-22.