Thinkingmachines

TInklingOPEN

Inkling (Thinkingmachines): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da olud.ai.

Finestra di contesto
1M
token
Prezzo di input
$1
per M token
Prezzo di output
$4.05
per M token
Fornitore
Thinkingmachines

I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Inkling, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: xhigh.

2.6×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
Per lo stesso budget, Inkling offre 2.6 volte più capacità. I pesi aperti significano anche che puoi ospitarlo autonomamente e non pagare nulla per token.
Intelligence index40.7
Coding index52.1
GPQA87.2%
Humanity's Last Exam29.7%
Long Context Reasoning63.3%
SciCode46.1%
τ-Bench Banking23.7%
Terminal-Bench55.1%
⚡ Speed85.2 tokens/sec
⏱ Latency2.12s to first token
💰 Blended price$2.572 / 1M tokens
📈 Value15.8 intelligence points per $
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Inkling è un modello AI a peso aperto di Thinkingmachines. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di lista per API ospitate, monitorati ogni ora, per quando preferisci la comodità rispetto all'auto-ospitazione.

Domande frequenti

A cosa serve Inkling?

Inkling è un modello di linguaggio AI di Thinkingmachines. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 40.7 sull'indice di intelligenza Artificial Analysis.

Inkling è gratuito?

I pesi sono gratuiti e aperti — puoi ospitare autonomamente Inkling e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di lista sono $1 per milione di token di input e $4.05 per milione di token di output.

A cosa serve Inkling?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 87.2%, Humanity's Last Exam 29.7%, Long Context Reasoning 63.3%, SciCode 46.1%, τ-Bench Banking 23.7%, Terminal-Bench 55.1%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Inkling?

Genera circa 85.2 token al secondo, con una mediana 2.12s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare autonomamente Inkling?

Sì. Inkling ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sul tuo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati