Thinkingmachines · tutti i modelli ›

TInkling (batch)OPEN

Inkling è un modello open-weight multimodale mixture-of-experts del Thinking Machines Lab, con 41B parametri attivi su 975B totali.

524KFinestra di contesto · token
$1Prezzo di input · per M token
$4.05Prezzo di output · per M token
ThinkingmachinesFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi benchmark indipendenti per Inkling (batch), misurati da Artificial Analysis. Più alto è meglio. Modalità di misurazione: xhigh.

3.8×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
Con lo stesso budget, Inkling (batch) offre 3,8 volte più capacità. I pesi aperti (open weights) significano anche che puoi ospitarlo da solo (self-host) e non pagare nulla per token.
Intelligence index42.3
Coding index52.1
GPQA87.2%
Humanity's Last Exam31.9%
Long Context Reasoning73.3%
SciCode46.1%
τ-Bench Banking29.1%
Terminal-Bench55.1%
⚡ Speed69.8 tokens/sec
⏱ Latency2.42s to first token
💰 Blended price$1.762 / 1M tokens
📈 Value24 intelligence points per $
vs. modelli misurati quitop 23%
Punteggi superiori a 77% dei 276 modelli misurati da Artificial Analysis e tracciati qui.
I modelli a questo livello costano $1.49 per 1M token (mediana di 19) — questo costa $1.76.
Più economico e migliore su questo indice: Gemini 3.7 Flash · Gemini 3.7 Flash (batch) · DeepSeek V4 Pro 0813 e 15 in più
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Inkling (batch) è un modello AI open-weight di Thinkingmachines. Puoi scaricarlo e ospitarlo da solo (self-host) gratuitamente; i prezzi qui sotto sono i prezzi di listino delle API ospitate, monitorati quotidianamente, per quando preferisci la comodità rispetto al self-hosting.

Domande frequenti

Cos'è Inkling (batch)?

Inkling (batch) è un modello di linguaggio AI di Thinkingmachines. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 42.3 sull'indice di intelligenza Artificial Analysis.

Inkling (batch) è gratuito?

I pesi sono gratuiti e aperti: puoi eseguire Inkling (batch) in self-hosted senza pagare nulla per token. Se preferisci un'API hosted, i prezzi di listino sono $1 per milione di token in input e $4,05 per milione di token in output.

In cosa è bravo Inkling (batch)?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Inkling (batch)?

Genera circa 69.8 token al secondo, con una mediana 2.42s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare Inkling (batch) da solo (self-host)?

Sì. Inkling (batch) ha open weights, quindi Lei può scaricarlo ed eseguirlo sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza alcun costo per token.

Modelli correlati

InklingThinkingmachinesInkling SmallThinkingmachines