Inkling è un modello open-weight multimodale mixture-of-experts del Thinking Machines Lab, con 41B parametri attivi su 975B totali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Inkling (gratuito), misurati da Artificial Analysis. Più alto è meglio. Modalità di misurazione: xhigh.
Inkling (gratuito) è un modello AI open-weight di Thinkingmachines. Puoi scaricarlo e fare self-host gratuitamente; i prezzi sottostanti sono prezzi di listino API ospitate, monitorati quotidianamente, per quando preferisci la comodità rispetto al self-hosting.
Inkling (free) è un modello di linguaggio AI di Thinkingmachines. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 42.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi fare self-host di Inkling (gratuito) e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono Gratuiti per milione di token di input e Gratuiti per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.
Genera circa 57.2 token al secondo, con una mediana 2.55s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Inkling (gratuito) ha open weights, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.