Inkling Small é um modelo multimodal de mistura de especialistas com open-weight do Thinking Machines Lab, com 12B de parâmetros ativos de um total de 276B.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para o Inkling Small, medidas pela Artificial Analysis. Quanto maior, melhor.
Inkling Small é um modelo de IA open-weight da Thinkingmachines. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de API hospedada, monitorados diariamente, para quando você preferir conveniência ao self-hosting.
Inkling Small é um modelo de linguagem de IA da Thinkingmachines. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 41.2 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode fazer self-host do Inkling Small e não pagar nada por token. Se preferir uma API hospedada, os preços de tabela são $0,45 por milhão de tokens de entrada e $1,2 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. É particularmente usado para geração de código.
Ele gera cerca de 61.3 tokens por segundo, com uma mediana 1.86s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. Inkling Small tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.