Hermes 4 es un modelo de razonamiento a gran escala construido sobre Meta-Llama-3.1-405B y lanzado por Nous Research.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Hermes 4 405B, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning.
Hermes 4 405B es un modelo de IA de open weights de Nous Research. Puede descargarlo y alojarlo usted mismo de forma gratuita; los precios a continuación son precios de lista de API alojadas, rastreados diariamente, para cuando prefiera la conveniencia sobre el autoalojamiento.
Hermes 4 405B es un modelo de lenguaje de IA de Nous Research. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 8.8 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar Hermes 4 405B y no pagar nada por token. Si prefieres una API alojada, los precios son $1 por millón de tokens de entrada y $3 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 72.7%, MMLU-Pro 82.9%, Humanity's Last Exam 10.9%, Long Context Reasoning 22.7%, LiveCodeBench 68.6%, SciCode 25.2%, AIME 2025 69.7%, IFBench 32.7%, τ²-Bench 22.2%, Terminal-Bench Hard 11.4%. Se utiliza particularmente para razonamiento matemático.
Genera aproximadamente 34 tokens por segundo, con una mediana 0.92s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Hermes 4 405B tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.