Modelos de IA · Código Abierto vs Pagados

Step 3.7 Flash Abierto vs INMercury 2 Pago

Step 3.7 Flash vs Mercury 2 comparado — precio por token, ventana de contexto, multimodalidad, apertura y cuál elegir. ¿Puede el modelo de código abierto reemplazar al modelo pagado? Desglose completo de 2026.

Precios & especificaciones actualizados desde datos en vivo · olud.ai

Precios de modelos abiertos = proveedor más barato a través de OpenRouter; las tarifas del fabricante oficial pueden ser más altas.

Step 3.7 FlashAbiertoStepfun
$0.2 /M entrada
$1.15 /M salidaSin tarifas por token si usted se autoalojan
TipoOpen-weight
Ventana de contexto262K tokens
Multimodal
Autoalojado
INMercury 2PagoInception
$0.25 /M entrada
$0.75 /M salidaAPI gestionada (sin infraestructura que ejecutar)
TipoPropietario
Ventana de contexto128K tokens
MultimodalNo
AutoalojadoNo
Elegir Step 3.7 Flash si usted quiere autoalojarse, mantener sus datos privados y evitar tarifas por token — es open-weight y funciona en su propio hardware. Elija Mercury 2 si deseas capacidad de frontera a través de una API gestionada sin infraestructura para ejecutar.

Especificaciones de Step 3.7 Flash vs Mercury 2

EspecificaciónStep 3.7 FlashMercury 2Ganador
CreadorStepfunInception
TipoOpen-weightPropietarioStep 3.7 Flash
Ventana de contexto262K tokens128K tokensStep 3.7 Flash
Precio de entrada$0.2/M · autoalojamiento gratuito$0.25/MStep 3.7 Flash
Precio de salida$1.15/M · autoalojamiento gratuito$0.75/MINMercury 2
Visión / multimodalNoStep 3.7 Flash
Llamada de herramienta / función= Empate
AutoalojableNo (solo API)Step 3.7 Flash
LicenciaOpen weightsPropietarioStep 3.7 Flash

Diferencia de precio & cuándo elegir cada uno

1.5×más barato por token de salida

Mercury 2 es ~1.5× más barato que Step 3.7 Flash en tokens de salida ($0.75 vs $1.15 por M tokens).

Elija Paso 3.7 Flash si…
  • Usted quiere autoalojarse o ejecutar en su nube
  • Necesita la ventana de contexto más larga de 262K
  • Usted prioriza la privacidad de los datos & control
  • Usted está construyendo IA abierta o reproducible
INElija Mercury 2 si…
  • Usted quiere rendimiento de vanguardia a través de una API gestionada
  • Usted quiere el precio de salida más bajo
  • Usted valora la fiabilidad & ecosistema
  • Usted no quiere gestionar infraestructura

Comparación de características

CapacidadStep 3.7 FlashMercury 2
Open weights (descargables)
Autoalojable
Funciona completamente sin conexión
Visión / multimodal
Llamada de herramienta / función
Ventana de contexto de 1M+

Comparativas: Step 3.7 Flash vs Mercury 2

Puntuaciones de referencia independientes medidas por Artificial Analysis. Más alto es mejor (excepto latencia).

Step 3.7 Flash
Mercury 2
Índice de inteligencia
30.3
21.4
Índice de codificación
39.6
31.1
GPQA
80.9%
77%
El Último Examen de la Humanidad
19.9%
15.5%
Razonamiento de Contexto Largo
63.7%
36.3%
SciCode
40%
38.7%
IFBench
67.3%
69.8%
τ²-Bench
98.5%
70.8%
τ-Bench Banking
11.3%
9.9%
Terminal-Bench
39.3%
27.3%
Terminal-Bench Duro
35.6%
26.5%
Velocidad
383.1 tok/s
1082 tok/s
Latencia
0.9s
3.86s
Inteligencia por $
69.2
57.1

Datos de referencia por Artificial Analysis.

¿Cómo puntúan Step 3.7 Flash y Mercury 2?

🏆 Mejor valor & apertura: Step 3.7 Flash (4.7 vs 2.9 / 5)
CriterioStep 3.7 FlashMercury 2
Eficiencia de costos4.55.0
Ventana de contexto4.03.5
Apertura5.01.5
Autoalojamiento5.01.0
Multimodalidad5.03.5

Las puntuaciones provienen de datos en vivo — precio de salida (costo), longitud de contexto, pesos abiertos vs cerrados (apertura & autoalojamiento) y soporte de visión/herramienta (multimodalidad). La calidad de la tarea en bruto no se puntúa aquí; depende de tu referencia — consulta el veredicto.

Qué es cada modelo

Step 3.7 Flash Abierto

Stepfun · Open-weight

Step 3.7 Flash es el último modelo multimodal Mixture-of-Experts de alta eficiencia de StepFun. Combina una base de lenguaje de 196B parámetros con un codificador de visión para comprensión nativa de imágenes y videos, activando aproximadamente 11B parámetros...

Mercury 2 Pago

Inception · Propietario

Mercury 2 es un LLM de razonamiento extremadamente rápido, y el primer LLM de difusión de razonamiento (dLLM). En lugar de generar tokens secuencialmente, Mercury 2 produce y refina múltiples tokens en paralelo, logrando...

Otros modelos en estas familias

Estas variantes se rastrean pero no se comparan aquí — una página por familia mantiene la comparación legible.

Otras variantes rastreadas
Paso 3.5 Flash

Preguntas frecuentes

¿Es Step 3.7 Flash tan bueno como Mercury 2?

Step 3.7 Flash es open-weight y competitivo en muchas tareas, pero Mercury 2 puede seguir liderando en el trabajo de razonamiento más difícil y en tareas agenticas. La brecha sigue reduciéndose: evalúe ambos en su caso de uso real antes de decidir.

¿Puedo ejecutar Paso 3.7 Flash localmente?

Sí. Step 3.7 Flash tiene open weights, por lo que puede autoalojarlo en sus propias GPUs o ejecutarlo a través de una API de bajo costo. Mercury 2 es solo API y no puede ser autoalojado.

Step 3.7 Flash vs Mercury 2 — ¿cuál debería elegir en 2026?

Elija Step 3.7 Flash si desea autoalojarlo, mantener sus datos privados y evitar tarifas por token: es open-weight y se ejecuta en su propio hardware. Elija Mercury 2 si desea capacidad de frontera a través de una API gestionada sin infraestructura para ejecutar.

Las personas también comparan

Explora más IA de código abierto

Explora la tabla de clasificación completa de modelos de código abierto, miles de herramientas y benchmarks en vivo — todo en un solo lugar.

Abre la clasificación →