Hermes 4 405B vs Codestral 2508 comparado — precio por token, ventana de contexto, multimodalidad, apertura y cuál elegir. ¿Puede el modelo de código abierto reemplazar al modelo pagado? Desglose completo de 2026.
Codestral 2508 — perfil completo ›
Precios & especificaciones actualizados desde datos en vivo · olud.ai
Precios de modelos abiertos = proveedor más barato a través de OpenRouter; las tarifas del fabricante oficial pueden ser más altas.
| Especificación | Hermes 4 405B | Codestral 2508 | Ganador |
|---|---|---|---|
| Creador | Nous Research | Mistral AI | – |
| Tipo | Open-weight | Propietario | |
| Ventana de contexto | 131K tokens | 256K tokens | |
| Precio de entrada | $1/M · autoalojamiento gratuito | $0.3/M | |
| Precio de salida | $3/M · autoalojamiento gratuito | $0.9/M | |
| Visión / multimodal | No | No | – |
| Llamada de herramienta / función | No | Sí | |
| Autoalojable | Sí | No (solo API) | |
| Licencia | Open weights | Propietario |
Codestral 2508 es ~3.3× más barato que Hermes 4 405B en tokens de salida ($0.9 vs $3 por M tokens).
| Capacidad | Hermes 4 405B | Codestral 2508 |
|---|---|---|
| Open weights (descargables) | ✓ | ✗ |
| Autoalojable | ✓ | ✗ |
| Funciona completamente sin conexión | ✓ | ✗ |
| Visión / multimodal | ✗ | ✗ |
| Llamada de herramienta / función | ✗ | ✓ |
| Ventana de contexto de 1M+ | ✗ | ✗ |
Puntuaciones de referencia independientes medidas por Artificial Analysis. Más alto es mejor (excepto latencia).
Datos de referencia por Artificial Analysis.
| Criterio | Hermes 4 405B | Codestral 2508 |
|---|---|---|
| Eficiencia de costos | 4.0 | 5.0 |
| Ventana de contexto | 3.5 | 4.0 |
| Apertura | 5.0 | 1.5 |
| Autoalojamiento | 5.0 | 1.0 |
| Multimodalidad | 2.0 | 3.5 |
Las puntuaciones provienen de datos en vivo — precio de salida (costo), longitud de contexto, pesos abiertos vs cerrados (apertura & autoalojamiento) y soporte de visión/herramienta (multimodalidad). La calidad de la tarea en bruto no se puntúa aquí; depende de tu referencia — consulta el veredicto.
Hermes 4 es un modelo de razonamiento a gran escala construido sobre Meta-Llama-3.1-405B y lanzado por Nous Research. Introduce un modo de razonamiento híbrido, donde el modelo puede optar por deliberar internamente con...
El modelo de lenguaje de vanguardia de Mistral para codificación lanzado a finales de julio de 2025. Codestral se especializa en tareas de baja latencia y alta frecuencia como relleno en medio (FIM), corrección de código y generación de pruebas. [Publicación del Blog](https://mistral.ai/ne
Estas variantes se rastrean pero no se comparan aquí — una página por familia mantiene la comparación legible.
Hermes 4 405B es open-weight y competitivo en muchas tareas, pero Codestral 2508 aún puede liderar en el trabajo de razonamiento más difícil y en tareas agenticas. La brecha sigue reduciéndose — evalúe ambos en su caso de uso real antes de decidir.
Sí. Hermes 4 405B tiene open weights, por lo que puede autoalojarlo en sus propias GPUs o ejecutarlo a través de una API de bajo costo. Codestral 2508 es solo API y no puede ser autoalojado.
Elija Hermes 4 405B si desea autoalojarlo, mantener sus datos privados y evitar tarifas por token — es open-weight y funciona en su propio hardware. Elija Codestral 2508 si desea capacidad de vanguardia a través de una API gestionada sin infraestructura para ejecutar.
Explora la tabla de clasificación completa de modelos de código abierto, miles de herramientas y benchmarks en vivo — todo en un solo lugar.
Abre la clasificación →