Thinkingmachines · todos los modelos ›

TInkling (free)OPEN

Inkling es un modelo de mezcla de expertos multimodal open-weight de Thinking Machines Lab, con 41B de parámetros activos de un total de 975B.

1MVentana de contexto · tokens
FreePrecio de entrada · por M tokens
FreePrecio de salida · por M tokens
ThinkingmachinesProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Puntuaciones de benchmarks independientes para Inkling (free), medidas por Artificial Analysis. Cuanto más alto, mejor. Modo de medición: xhigh.

3.8×
Más inteligencia por dólar que Claude Opus 5 (Fast).
Con el mismo presupuesto, Inkling (free) ofrece 3.8 veces más capacidad. Los open weights también significan que puede self-hostearlo y no pagar nada por token.
Intelligence index42.3
Coding index52.1
GPQA87.2%
Humanity's Last Exam31.9%
Long Context Reasoning73.3%
SciCode46.1%
τ-Bench Banking29.1%
Terminal-Bench55.1%
⚡ Speed57.2 tokens/sec
⏱ Latency2.55s to first token
💰 Blended price$1.762 / 1M tokens
📈 Value24 intelligence points per $
vs. modelos medidos aquítop 22%
Puntuaciones más altas que el 78% de los 273 modelos medidos por Artificial Analysis y rastreados aquí.
Datos de referencia por Artificial Analysis

Acerca de este modelo

Inkling (free) es un modelo de IA open-weight de Thinkingmachines. Puede descargarlo y self-hostearlo gratis; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.

Preguntas frecuentes

¿Qué es Inkling (free)?

Inkling (free) es un modelo de lenguaje de IA de Thinkingmachines. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 42.3 en el índice de inteligencia Artificial Analysis.

¿Es gratuito Inkling (free)?

Los pesos son gratuitos y abiertos: puede self-hostear Inkling (free) y no pagar nada por token. Si prefiere una API alojada, los precios de lista son Gratis por millón de tokens de entrada y Gratis por millón de tokens de salida.

¿En qué es bueno Inkling (free)?

Los benchmarks independientes de Artificial Analysis le dan GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Se utiliza particularmente para generación de código.

¿Qué tan rápido es Inkling (free)?

Genera aproximadamente 57.2 tokens por segundo, con una mediana 2.55s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

¿Puedo self-hostear Inkling (free)?

Sí. Inkling (free) tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp, sin costo por token.

Modelos relacionados

Inkling Small (free)ThinkingmachinesInklingThinkingmachinesInkling SmallThinkingmachinesInkling (batch)Thinkingmachines