Inkling é um modelo open-weight multimodal de mistura de especialistas do Thinking Machines Lab, com 41B de parâmetros ativos de um total de 975B.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para Inkling, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: xhigh.
Inkling é um modelo de IA open-weight da Thinkingmachines. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Inkling é um modelo de linguagem de IA da Thinkingmachines. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 42.3 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode fazer self-host do Inkling e não pagar nada por token. Se preferir uma API hospedada, os preços de tabela são $0,95 por milhão de tokens de entrada e $4,05 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. É particularmente usado para geração de código.
Ele gera cerca de 57.2 tokens por segundo, com uma mediana 2.55s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. Inkling tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.