Nous Research

NHermes 4 405BOPEN

Hermes 4 405B (Nous Research): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
131K
Tokens
Eingabepreis
$1
pro M Tokens
Ausgabepreis
$3
pro M Tokens
Anbieter
Nous Research

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Hermes 4 405B, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.

Intelligence index9
Math index69.7
GPQA72.7%
MMLU-Pro82.9%
Humanity's Last Exam10.3%
Long Context Reasoning20.7%
LiveCodeBench68.6%
SciCode25.2%
AIME 202569.7%
IFBench32.7%
τ²-Bench22.2%
Terminal-Bench Hard11.4%
⚡ Speed37 tokens/sec
⏱ Latency0.74s to first token
💰 Blended price$1.5 / 1M tokens
📈 Value6 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Hermes 4 405B ist ein Open-Weight-AI-Modell von Nous Research. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, für den Fall, dass Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Hermes 4 405B?

Hermes 4 405B ist ein KI-Sprachmodell von Nous Research. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 9 im Artificial Analysis Intelligenzindex.

Ist Hermes 4 405B kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Hermes 4 405B selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 1 $ pro Million Eingabetoken und 3 $ pro Million Ausgabetoken.

Worin ist Hermes 4 405B gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 72.7%, MMLU-Pro 82.9%, Humanity's Last Exam 10.3%, Long Context Reasoning 20.7%, LiveCodeBench 68.6%, SciCode 25.2%, AIME 2025 69.7%, IFBench 32.7%, τ²-Bench 22.2%, Terminal-Bench Hard 11.4%. Es wird besonders verwendet für mathematische Argumentation.

Wie schnell ist Hermes 4 405B?

Es generiert etwa 37 Tokens pro Sekunde, mit einer Median 0.74s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Hermes 4 405B selbst hosten?

Ja. Hermes 4 405B hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Hermes 4 70BNous ResearchHermes 3 405B InstructNous ResearchHermes 3 70B InstructNous Research