Inkling es un modelo de mezcla de expertos multimodal open-weight de Thinking Machines Lab, con 41B de parámetros activos de un total de 975B.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones independientes de benchmarks para Inkling (batch), medidas por Artificial Analysis. Más alto es mejor. Modo de medición: xhigh.
Inkling (batch) es un modelo de IA open-weight de Thinkingmachines. Usted puede descargarlo y autoalojarlo gratis; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la conveniencia sobre el autoalojamiento.
Inkling (batch) es un modelo de lenguaje de IA de Thinkingmachines. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 42.3 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puede autoalojar Inkling (batch) y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $1 por millón de tokens de entrada y $4.05 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Se utiliza particularmente para generación de código.
Genera aproximadamente 69.8 tokens por segundo, con una mediana 2.42s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Inkling (batch) tiene open weights, por lo que usted puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.