Inkling è un modello open-weight multimodale mixture-of-experts del Thinking Machines Lab, con 41B parametri attivi su 975B totali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Inkling, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: xhigh.
Inkling è un modello AI open-weight di Thinkingmachines. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.
Inkling è un modello di linguaggio AI di Thinkingmachines. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 42.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi self-hostare Inkling e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0,95 per milione di token in input e $4,05 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.
Genera circa 57.2 token al secondo, con una mediana 2.55s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Inkling ha open weights, quindi può scaricarlo ed eseguirlo sulla sua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.