Hermes 4 est un modèle de raisonnement à grande échelle construit sur Meta-Llama-3.1-405B et publié par Nous Research.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Hermes 4 405B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Hermes 4 405B est un modèle d'IA open-weight de Nous Research. Vous pouvez le télécharger et le self-hoster gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Hermes 4 405B est un modèle de langage IA de Nous Research. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 8.8 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Hermes 4 405B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 1 $ par million de jetons d'entrée et de 3 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 72.7%, MMLU-Pro 82.9%, Humanity's Last Exam 10.9%, Long Context Reasoning 22.7%, LiveCodeBench 68.6%, SciCode 25.2%, AIME 2025 69.7%, IFBench 32.7%, τ²-Bench 22.2%, Terminal-Bench Hard 11.4%. Il est particulièrement utilisé pour raisonnement mathématique.
Il génère environ 34 tokens par seconde, avec un délai médian 0.92s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Hermes 4 405B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.