IBM

IGranite 4.1 8BOPEN

Granite 4.1 8B (IBM): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da OpenSourceAI.tech.

Finestra di contesto
131K
token
Prezzo di input
$0.05
per M token
Prezzo di output
$0.1
per M token
Fornitore
IBM

I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Granite 4.1 8B, misurati da Artificial Analysis. Maggiore è meglio.

17×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5.
Con lo stesso budget, Granite 4.1 8B offre 17 volte più capacità. I pesi aperti significano anche che puoi ospitarlo autonomamente e non pagare nulla per token.
Intelligence index6.7
Coding index9.5
GPQA43.3%
Humanity's Last Exam3.8%
Long Context Reasoning12%
SciCode21.8%
IFBench38.6%
τ²-Bench27.8%
τ-Bench Banking3.1%
Terminal-Bench3.4%
Terminal-Bench Hard0%
⚡ Speed101.3 tokens/sec
⏱ Latency0.44s to first token
💰 Blended price$0.063 / 1M tokens
📈 Value106.3 intelligence points per $
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Granite 4.1 8B è un modello AI a peso aperto di IBM. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di listino delle API ospitate, monitorati ogni ora, per quando preferisci la comodità all'auto-ospitare.

Domande frequenti

Cos'è Granite 4.1 8B?

Granite 4.1 8B è un modello di linguaggio AI di IBM. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 6.7 sull'indice di intelligenza Artificial Analysis.

Granite 4.1 8B è gratuito?

I pesi sono gratuiti e aperti — puoi auto-ospitare Granite 4.1 8B e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono $0,05 per milione di token in input e $0,1 per milione di token in output.

A cosa serve Granite 4.1 8B?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 43.3%, Humanity's Last Exam 3.8%, Long Context Reasoning 12%, SciCode 21.8%, IFBench 38.6%, τ²-Bench 27.8%, τ-Bench Banking 3.1%, Terminal-Bench 3.4%, Terminal-Bench Hard 0%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Granite 4.1 8B?

Genera circa 101.3 token al secondo, con una mediana 0.44s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso auto-ospitare Granite 4.1 8B?

Sì. Granite 4.1 8B ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Alternative open-source

A seconda del tuo carico di lavoro, un modello a peso aperto che puoi ospitare autonomamente potrebbe ridurre drasticamente i costi o rimuovere completamente la tariffazione per token. Le nostre pagine di confronto mettono questo modello a confronto con i più forti contendenti open-source.

Granite 4.0 MicroIBM