Inkling è un modello open-weight multimodale mixture-of-experts del Thinking Machines Lab, con 41B parametri attivi su 975B totali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi benchmark indipendenti per Inkling (batch), misurati da Artificial Analysis. Più alto è meglio. Modalità di misurazione: xhigh.
Inkling (batch) è un modello AI open-weight di Thinkingmachines. Puoi scaricarlo e ospitarlo da solo (self-host) gratuitamente; i prezzi qui sotto sono i prezzi di listino delle API ospitate, monitorati quotidianamente, per quando preferisci la comodità rispetto al self-hosting.
Inkling (batch) è un modello di linguaggio AI di Thinkingmachines. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 42.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti: puoi eseguire Inkling (batch) in self-hosted senza pagare nulla per token. Se preferisci un'API hosted, i prezzi di listino sono $1 per milione di token in input e $4,05 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.
Genera circa 69.8 token al secondo, con una mediana 2.42s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Inkling (batch) ha open weights, quindi Lei può scaricarlo ed eseguirlo sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza alcun costo per token.