*Ling-3.0-flash* è un *modello Mixture-of-Experts (MoE) da 124B parametri*, con circa *5.1B parametri attivati per token*.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi benchmark indipendenti per Ling-3.0-flash, misurati da Artificial Analysis. Più alto è meglio.
Ling-3.0-flash è un modello AI open-weight di Inclusionai. Può scaricarlo e self-hostarlo gratuitamente; i prezzi sotto sono prezzi di listino di API hosted, monitorati quotidianamente, per quando preferisce la comodità al self-hosting.
Ling-3.0-flash è un modello di linguaggio AI di Inclusionai. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 37.8 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — può self-hostare Ling-3.0-flash e non pagare nulla per token. Se preferisce un'API hosted, i prezzi di listino sono $0.02 per milione di token in input e $0.06 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 85.5%, Humanity's Last Exam 23.7%, Long Context Reasoning 67%, SciCode 41.1%, τ-Bench Banking 27.2%, Terminal-Bench 55.4%. È particolarmente utilizzato per generazione di codice.
Genera circa 406.5 token al secondo, con una mediana 1.84s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Ling-3.0-flash ha open weights, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.