Inkling Small è un modello multimodale mixture-of-experts open-weight di Thinking Machines Lab, con 12B di parametri attivi su un totale di 276B.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Inkling Small, misurati da Artificial Analysis. Maggiore è meglio.
Inkling Small è un modello AI open-weight di Thinkingmachines. Può scaricarlo e self-hostarlo gratuitamente; i prezzi sotto sono prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisce la comodità al self-hosting.
Inkling Small è un modello di linguaggio AI di Thinkingmachines. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 41.2 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi self-hostare Inkling Small e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0,45 per milione di token in input e $1,2 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.
Genera circa 61.3 token al secondo, con una mediana 1.86s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Inkling Small ha open weights, quindi può essere scaricato e eseguito sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.