Advertisement
Nous Research

Hermes 4 - Llama-3.1 70B (Non-reasoning)

AI model by Nous Research. Real-time pricing and benchmark data.

Pricing (per 1M tokens)

Input—
Output—

Source: Artificial Analysis

Performance

Output Speed—
Time to First Token—

Median values from Artificial Analysis

Benchmarks

Editorial Analysis

Profile. Hermes 4 - Llama-3.1 70B (Non-reasoning) is a premium-tier model from Nous Research at $undefined/M output tokens. Benchmark scores (see above) suggest it targets workloads where correctness matters more than cost — long-running agents, code generation at scale, and complex multi-step reasoning.

Editorial summary generated from public pricing and benchmark data (Artificial Analysis API). All numbers are sourced — see the Artificial Analysis methodology for benchmark definitions. Last refreshed 2026-10-08.

Compare with similar models

ModelInputOutputSpeed
Hermes 4 - Llama-3.1 70B (Non-reasoning)Current
———
GLM-4.5V (Non-reasoning)
$0.60$1.8042 tok/s
Gemini 3.5 Flash (high)
$1.50$9.00216 tok/s
MiMo-V2.5-Pro
$0.43$0.8741 tok/s
JT-35B-Flash
———
Mercury 2
$0.25$0.75881 tok/s