Inkling Small es un modelo multimodal de mezcla de expertos con open weights de Thinking Machines Lab, con 12B de parámetros activos de un total de 276B.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Inkling Small (free), medidas por Artificial Analysis. Cuanto más alto, mejor.
Inkling Small (free) es un modelo de IA open-weight de Thinkingmachines. Puede descargarlo y autoalojarlo gratis; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera conveniencia sobre autoalojamiento.
Inkling Small (free) es un modelo de lenguaje de IA de Thinkingmachines. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 41.2 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puede autoalojar Inkling Small (free) y no pagar nada por token. Si prefiere una API alojada, los precios de lista son Gratis por millón de tokens de entrada y Gratis por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Se utiliza particularmente para generación de código.
Genera aproximadamente 61.4 tokens por segundo, con una mediana 2.19s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Inkling Small (free) tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.