Inkling Small è un modello multimodale mixture-of-experts open-weight di Thinking Machines Lab, con 12B di parametri attivi su un totale di 276B.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi benchmark indipendenti per Inkling Small (gratuito), misurati da Artificial Analysis. Più alto è meglio.
Inkling Small (gratuito) è un modello AI open-weight di Thinkingmachines. Puoi scaricarlo e fare self-host gratuitamente; i prezzi sottostanti sono prezzi di listino API ospitate, monitorati quotidianamente, per quando preferisci la comodità rispetto al self-hosting.
Inkling Small (free) è un modello di linguaggio AI di Thinkingmachines. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 41.2 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi fare self-host di Inkling Small (gratuito) e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono Gratuiti per milione di token di input e Gratuiti per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.
Genera circa 61.4 token al secondo, con una mediana 2.19s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Inkling Small (gratuito) ha open weights, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.