Hermes 4 - Llama-3.1 405B (Non-reasoning) API Pricing

Nous Research · released 2025-08-27

Pricing

$1.00
input / 1M tokens
0.100¢ / 1K
$3.00
output / 1M tokens
0.300¢ / 1K
$1.50
blended / 1M tokens
0.150¢ / 1K

What it actually costs

WorkloadTokensCost
Short chat reply500 in / 300 out0.14¢
RAG query4,000 in / 500 out0.55¢
Long document summary50,000 in / 1,000 out$0.0530
Code review of a 2k-line file30,000 in / 2,000 out$0.0360
1,000 chat replies/day for 30 days30,000 × (500 in / 300 out)$42.00

Cost = (input tokens ÷ 1,000,000 × $1.00) + (output tokens ÷ 1,000,000 × $3.00).

Benchmarks

7.4
Intelligence
#357 of 533
Coding
15.3
Math
#197 of 249
41
Tokens/sec
0.79s
Time to first token

Similar intelligence, lower price

ModelIntelligenceBlended $/1M
Llama 3.1 Instruct 8B6.9$0.028
Gemma 4 E4B (Reasoning)8.9$0.04
Sarvam 30B (high)6.6$0.047
Granite 4.2 3B9.1$0.052
Nova Micro5.9$0.061

Leaderboard neighbours

ModelIntelligenceBlended $/1M
Solar Pro 2 (Reasoning)7.5
Gemini 2.0 Flash-Lite (Feb '25)7.4
Granite 4.1 30B7.4
Hermes 4 - Llama-3.1 405B (Non-reasoning)7.4$1.50
Llama Nemotron Super 49B v1.5 (Non-reasoning)7.4$0.40
NVIDIA Nemotron 3 Nano 4B7.4
NVIDIA Nemotron Nano 9B V2 (Reasoning)7.4$0.07

More from Nous Research

ModelIntelligenceBlended $/1M
Hermes 4 - Llama-3.1 70B (Reasoning)7.9
Hermes 4 - Llama-3.1 405B (Reasoning)7.5$1.50
Hermes 4 - Llama-3.1 70B (Non-reasoning)6.7
DeepHermes 3 - Mistral 24B Preview (Non-reasoning)6.1
Hermes 3 - Llama-3.1 70B6.0$0.70
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)5.1

Count tokens & estimate cost for Hermes 4 - Llama-3.1 405B (Non-reasoning) See Hermes 4 - Llama-3.1 405B (Non-reasoning) on the leaderboard

Source: Artificial Analysis · last synced 2026-09-22

FAQ

Who develops Hermes 4 - Llama-3.1 405B (Non-reasoning)?

Hermes 4 - Llama-3.1 405B (Non-reasoning) is developed by Nous Research, released 2025-08-27.

How much does Hermes 4 - Llama-3.1 405B (Non-reasoning) cost per million tokens?

Hermes 4 - Llama-3.1 405B (Non-reasoning) costs $1.00 per 1M input tokens and $3.00 per 1M output tokens ($1.50 blended), per Artificial Analysis's official pricing data.

How does Hermes 4 - Llama-3.1 405B (Non-reasoning) rank on benchmarks?

Hermes 4 - Llama-3.1 405B (Non-reasoning) scores 7.4 on the Artificial Analysis Intelligence Index, ranking #357 of 533 models we track.

Is there a cheaper model with similar intelligence to Hermes 4 - Llama-3.1 405B (Non-reasoning)?

Yes — Llama 3.1 Instruct 8B scores similar intelligence (6.9) at $0.028/1M blended, versus $1.50/1M for Hermes 4 - Llama-3.1 405B (Non-reasoning).

Where does this data come from?

Pricing and benchmark data for Hermes 4 - Llama-3.1 405B (Non-reasoning) comes from Artificial Analysis (artificialanalysis.ai), synced daily. Last synced 2026-09-22.