Inclusionai · tutti i modelli ›

ILing-3.0-flashOPEN

*Ling-3.0-flash* è un *modello Mixture-of-Experts (MoE) da 124B parametri*, con circa *5.1B parametri attivati per token*.

262KFinestra di contesto · token
$0.02Prezzo di input · per M token
$0.06Prezzo di output · per M token
InclusionaiFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi benchmark indipendenti per Ling-3.0-flash, misurati da Artificial Analysis. Più alto è meglio.

54×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
A parità di budget, Ling-3.0-flash offre 54 volte più capacità. Open weights significa anche che può self-hostarlo e non pagare nulla per token.
Intelligence index37.8
Coding index50.6
GPQA85.5%
Humanity's Last Exam23.7%
Long Context Reasoning67%
SciCode41.1%
τ-Bench Banking27.2%
Terminal-Bench55.4%
⚡ Speed406.5 tokens/sec
⏱ Latency1.84s to first token
💰 Blended price$0.111 / 1M tokens
📈 Value340.5 intelligence points per $
vs. modelli misurati quitop 32%
Punteggi superiori a 68% dei 273 modelli misurati da Artificial Analysis e tracciati qui.
I modelli a questo livello costano $1.56 per 1M token (mediana di 24) — questo costa $0.03.
Nessun modello tracciato qui è sia più economico che migliore su questo indice.
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Ling-3.0-flash è un modello AI open-weight di Inclusionai. Può scaricarlo e self-hostarlo gratuitamente; i prezzi sotto sono prezzi di listino di API hosted, monitorati quotidianamente, per quando preferisce la comodità al self-hosting.

Domande frequenti

Cos'è Ling-3.0-flash?

Ling-3.0-flash è un modello di linguaggio AI di Inclusionai. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 37.8 sull'indice di intelligenza Artificial Analysis.

Ling-3.0-flash è gratuito?

I pesi sono gratuiti e aperti — può self-hostare Ling-3.0-flash e non pagare nulla per token. Se preferisce un'API hosted, i prezzi di listino sono $0.02 per milione di token in input e $0.06 per milione di token in output.

In cosa eccelle Ling-3.0-flash?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 85.5%, Humanity's Last Exam 23.7%, Long Context Reasoning 67%, SciCode 41.1%, τ-Bench Banking 27.2%, Terminal-Bench 55.4%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Ling-3.0-flash?

Genera circa 406.5 token al secondo, con una mediana 1.84s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Può self-hostare Ling-3.0-flash?

Sì. Ling-3.0-flash ha open weights, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati