Thinkingmachines

TInklingOPEN

Inkling (Thinkingmachines): precios de API en vivo, ventana de contexto y las mejores alternativas de código abierto, rastreadas diariamente por olud.ai.

Ventana de contexto
1M
tokens
Precio de entrada
$1
por M tokens
Precio de salida
$4.05
por M tokens
Proveedor
Thinkingmachines

Los precios se actualizan automáticamente — verificados cada hora contra los precios de la lista del proveedor.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Puntuaciones de referencia independientes para Inkling, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: xhigh.

2.6×
Más inteligencia por dólar que Claude Opus 5 (Fast).
Con el mismo presupuesto, Inkling ofrece 2.6 veces más capacidad. Los pesos abiertos también significan que puedes autoalojarlo y no pagar nada por token.
Intelligence index40.7
Coding index52.1
GPQA87.2%
Humanity's Last Exam29.7%
Long Context Reasoning63.3%
SciCode46.1%
τ-Bench Banking23.7%
Terminal-Bench55.1%
⚡ Speed85.2 tokens/sec
⏱ Latency2.12s to first token
💰 Blended price$2.572 / 1M tokens
📈 Value15.8 intelligence points per $
Datos de referencia por Artificial Analysis

Acerca de este modelo

Inkling es un modelo de IA de peso abierto de Thinkingmachines. Puedes descargarlo y autoalojarlo de forma gratuita; los precios a continuación son precios de lista de API alojadas, rastreados por hora, para cuando prefieras la comodidad sobre el autoalojamiento.

Preguntas frecuentes

¿Qué es Inkling?

Inkling es un modelo de lenguaje de IA de Thinkingmachines. Es de pesos abiertos: puedes descargarlo y ejecutarlo en tu propio hardware, de forma gratuita. Obtiene 40.7 en el índice de inteligencia Artificial Analysis.

¿Es Inkling gratuito?

Los pesos son gratuitos y abiertos: puedes autoalojar Inkling y no pagar nada por token. Si prefieres una API alojada, los precios de lista son $1 por millón de tokens de entrada y $4.05 por millón de tokens de salida.

¿En qué es bueno Inkling?

Los benchmarks independientes de Artificial Analysis le dan GPQA 87.2%, Humanity's Last Exam 29.7%, Long Context Reasoning 63.3%, SciCode 46.1%, τ-Bench Banking 23.7%, Terminal-Bench 55.1%. Se utiliza particularmente para generación de código.

¿Qué tan rápido es Inkling?

Genera aproximadamente 85.2 tokens por segundo, con una mediana 2.12s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

¿Puedo autoalojar Inkling?

Sí. Inkling tiene pesos abiertos, así que puedes descargarlo y ejecutarlo en tu propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp, sin costo por token.

Modelos relacionados