Hermes 4 70B est un modèle de raisonnement hybride de Nous Research, construit sur Meta-Llama-3.1-70B.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Hermes 4 70B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Hermes 4 70B est un modèle d'IA open-weight de Nous Research. Vous pouvez le télécharger et le self-hoster gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Hermes 4 70B est un modèle de langage IA de Nous Research. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 9.9 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Hermes 4 70B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,13 $ par million de jetons d'entrée et de 0,4 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 69.9%, MMLU-Pro 81.1%, Humanity's Last Exam 8.8%, Long Context Reasoning 8%, LiveCodeBench 65.3%, SciCode 34.1%, AIME 2025 68.7%, IFBench 31.3%, τ²-Bench 22.5%, Terminal-Bench Hard 4.5%. Il est particulièrement utilisé pour raisonnement mathématique.
Il génère environ 86.8 tokens par seconde, avec un délai médian 0.6s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Hermes 4 70B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.