Nous Research

NHermes 4 405BOPEN

Hermes 4 405B (Nous Research): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.

Fenêtre de contexte
131K
tokens
Prix d'entrée
$1
par M tokens
Prix de sortie
$3
par M tokens
Fournisseur
Nous Research

Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Hermes 4 405B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.

Intelligence index9
Math index69.7
GPQA72.7%
MMLU-Pro82.9%
Humanity's Last Exam10.3%
Long Context Reasoning20.7%
LiveCodeBench68.6%
SciCode25.2%
AIME 202569.7%
IFBench32.7%
τ²-Bench22.2%
Terminal-Bench Hard11.4%
⚡ Speed37 tokens/sec
⏱ Latency0.74s to first token
💰 Blended price$1.5 / 1M tokens
📈 Value6 intelligence points per $
Données de benchmark par Artificial Analysis

À propos de ce modèle

Hermes 4 405B est un modèle d'IA à poids ouvert de Nous Research. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis à l'heure, pour lorsque vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Hermes 4 405B ?

Hermes 4 405B est un modèle de langage IA de Nous Research. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 9 sur l'indice d'intelligence d'Artificial Analysis.

Hermes 4 405B est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Hermes 4 405B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 1 $ par million de jetons d'entrée et de 3 $ par million de jetons de sortie.

À quoi sert Hermes 4 405B ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 72.7%, MMLU-Pro 82.9%, Humanity's Last Exam 10.3%, Long Context Reasoning 20.7%, LiveCodeBench 68.6%, SciCode 25.2%, AIME 2025 69.7%, IFBench 32.7%, τ²-Bench 22.2%, Terminal-Bench Hard 11.4%. Il est particulièrement utilisé pour raisonnement mathématique.

Quelle est la vitesse de Hermes 4 405B ?

Il génère environ 37 tokens par seconde, avec un délai médian 0.74s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Hermes 4 405B ?

Oui. Hermes 4 405B a des poids ouverts, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Alternatives open-source

Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.

Hermes 4 70BNous ResearchHermes 3 405B InstructNous ResearchHermes 3 70B InstructNous Research