Inkling Small es un modelo multimodal de mezcla de expertos con open weights de Thinking Machines Lab, con 12B de parámetros activos de un total de 276B.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Inkling Small, medidas por Artificial Analysis. Cuanto más alto, mejor.
Inkling Small es un modelo de IA open-weight de Thinkingmachines. Puede descargarlo y alojarlo usted mismo de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la comodidad sobre el autohospedaje.
Inkling Small es un modelo de lenguaje de IA de Thinkingmachines. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 41.2 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puede autoalojar Inkling Small y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.45 por millón de tokens de entrada y $1.2 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Se utiliza particularmente para generación de código.
Genera aproximadamente 61.3 tokens por segundo, con una mediana 1.86s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Inkling Small tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.