Modelos de IA · Código Abierto vs Pagados

THInkling Abierto vs GPT-3.5 Turbo (older v0613) Pago

Inkling vs GPT-3.5 Turbo (versión anterior v0613) comparado: precio por token, ventana de contexto, multimodalidad, apertura y cuál elegir. ¿Puede el modelo de código abierto reemplazar al modelo pagado? Desglose completo de 2026.

Precios & especificaciones actualizados desde datos en vivo · olud.ai

Precios de modelos abiertos = proveedor más barato a través de OpenRouter; las tarifas del fabricante oficial pueden ser más altas.

THInklingAbiertoThinkingmachines
$1 /M entrada
$4.05 /M salidaSin tarifas por token si usted se autoalojan
TipoOpen-weight
Ventana de contexto1M tokens
Multimodal
Autoalojado
GPT-3.5 Turbo (older v0613)PagoOpenAI
$1 /M entrada
$2 /M salidaAPI gestionada (sin infraestructura que ejecutar)
TipoPropietario
Ventana de contexto4K tokens
MultimodalNo
AutoalojadoNo
Elegir Inkling si usted quiere autoalojarse, mantener sus datos privados y evitar tarifas por token — es open-weight y funciona en su propio hardware. Elija GPT-3.5 Turbo (older v0613) si deseas capacidad de frontera a través de una API gestionada sin infraestructura para ejecutar.

Especificaciones de Inkling vs GPT-3.5 Turbo (versión anterior v0613)

EspecificaciónInklingGPT-3.5 Turbo (older v0613)Ganador
CreadorThinkingmachinesOpenAI
TipoOpen-weightPropietarioTHInkling
Ventana de contexto1M tokens4K tokensTHInkling
Precio de entrada$1/M · autoalojamiento gratuito$1/M= Empate
Precio de salida$4.05/M · autoalojamiento gratuito$2/MGPT-3.5 Turbo (older v0613)
Visión / multimodalNoTHInkling
Llamada de herramienta / función= Empate
AutoalojableNo (solo API)THInkling
LicenciaOpen weightsPropietarioTHInkling

Diferencia de precio & cuándo elegir cada uno

2.0×más barato por token de salida

GPT-3.5 Turbo (versión anterior v0613) es ~2.0× más barato que Inkling en tokens de salida ($2 vs $4.05 por M tokens).

THElija Inkling si…
  • Usted quiere autoalojarse o ejecutar en su nube
  • Usted necesita la ventana de contexto más larga de 1M
  • Usted prioriza la privacidad de los datos & control
  • Usted está construyendo IA abierta o reproducible
Elija GPT-3.5 Turbo (versión anterior v0613) si…
  • Usted quiere rendimiento de vanguardia a través de una API gestionada
  • Usted quiere el precio de salida más bajo
  • Usted valora la fiabilidad & ecosistema
  • Usted no quiere gestionar infraestructura

Comparación de características

CapacidadInklingGPT-3.5 Turbo (older v0613)
Open weights (descargables)
Autoalojable
Funciona completamente sin conexión
Visión / multimodal
Llamada de herramienta / función
Ventana de contexto de 1M+

Puntos de referencia: Inkling vs GPT-3.5 Turbo (versión anterior v0613)

Puntuaciones de referencia independientes medidas por Artificial Analysis. Más alto es mejor (excepto latencia).

Inkling ofrece 4.8× más inteligencia por dólar.
Inkling
GPT-3.5 Turbo (older v0613)
Índice de inteligencia
40.7
3.6
Índice de codificación
52.1
10.7
GPQA
87.2%
29.7%
El Último Examen de la Humanidad
29.7%
Razonamiento de Contexto Largo
63.3%
SciCode
46.1%
τ-Bench Banking
23.7%
Terminal-Bench
55.1%
MMLU-Pro
46.2%
MATH-500
44.1%
Velocidad
85.2 tok/s
0 tok/s
Latencia
2.06s
0s
Inteligencia por $
23.1
4.8

Datos de referencia por Artificial Analysis.

Cómo puntúan Inkling y GPT-3.5 Turbo (versión anterior v0613)

🏆 Mejor valor & apertura: Inkling (4.8 vs 2.5 / 5)
CriterioInklingGPT-3.5 Turbo (older v0613)
Eficiencia de costos4.04.5
Ventana de contexto5.02.0
Apertura5.01.5
Autoalojamiento5.01.0
Multimodalidad5.03.5

Las puntuaciones provienen de datos en vivo — precio de salida (costo), longitud de contexto, pesos abiertos vs cerrados (apertura & autoalojamiento) y soporte de visión/herramienta (multimodalidad). La calidad de la tarea en bruto no se puntúa aquí; depende de tu referencia — consulta el veredicto.

Qué es cada modelo

Inkling Abierto

Thinkingmachines · Open-weight

Inkling es un modelo de mezcla de expertos multimodal open-weight del Thinking Machines Lab, con 41B de parámetros activos de un total de 975B. Está diseñado para razonamiento de propósito general, codificación, sistemas agentes y uso de herramientas,...

GPT-3.5 Turbo (older v0613) Pago

OpenAI · Propietario

GPT-3.5 Turbo es el modelo más rápido de OpenAI. Puede entender y generar lenguaje natural o código, y está optimizado para tareas de chat y de finalización tradicional. Datos de entrenamiento hasta septiembre de 2021.

Otros modelos en estas familias

Estas variantes se rastrean pero no se comparan aquí — una página por familia mantiene la comparación legible.

Otras variantes rastreadas
Inkling Small

Preguntas frecuentes

¿Es Inkling tan bueno como GPT-3.5 Turbo (versión anterior v0613)?

Inkling es open-weight y competitivo en muchas tareas, pero GPT-3.5 Turbo (versión anterior v0613) puede seguir liderando en el razonamiento más difícil y en trabajos agenticos. La brecha sigue disminuyendo: evalúe ambos en su caso de uso real antes de decidir.

¿Puedo ejecutar Inkling localmente?

Sí. Inkling tiene open weights, por lo que puede autoalojarlo en sus propias GPUs o ejecutarlo a través de una API de bajo costo. GPT-3.5 Turbo (versión anterior v0613) es solo API y no puede ser autoalojado.

Inkling vs GPT-3.5 Turbo (versión anterior v0613) — ¿cuál debería elegir en 2026?

Elija Inkling si desea autoalojarlo, mantener sus datos privados y evitar tarifas por token: es open-weight y funciona en su propio hardware. Elija GPT-3.5 Turbo (versión anterior v0613) si desea capacidad de vanguardia a través de una API gestionada sin infraestructura para ejecutar.

Las personas también comparan

Explora más IA de código abierto

Explora la tabla de clasificación completa de modelos de código abierto, miles de herramientas y benchmarks en vivo — todo en un solo lugar.

Abre la clasificación →