Inclusionai · tous les modèles ›

ILing-3.0-flashOPEN

*Ling-3.0-flash* est un *modèle Mixture-of-Experts (MoE) de 124B paramètres*, avec environ *5,1B paramètres activés par token*.

262KFenêtre de contexte · tokens
$0.02Prix d'entrée · par M tokens
$0.06Prix de sortie · par M tokens
InclusionaiFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de benchmark indépendants pour Ling-3.0-flash, mesurés par Artificial Analysis. Plus le score est élevé, mieux c'est.

54×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Ling-3.0-flash offre 54 fois plus de capacités. Les open weights signifient également que vous pouvez le self-host et ne rien payer par token.
Intelligence index37.8
Coding index50.6
GPQA85.5%
Humanity's Last Exam23.7%
Long Context Reasoning67%
SciCode41.1%
τ-Bench Banking27.2%
Terminal-Bench55.4%
⚡ Speed406.5 tokens/sec
⏱ Latency1.84s to first token
💰 Blended price$0.111 / 1M tokens
📈 Value340.5 intelligence points per $
vs. modèles mesurés icitop 32%
Scores plus élevés que 68% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $1.56 par 1M de tokens (médiane de 24) — celui-ci coûte $0.03.
Aucun modèle suivi ici n'est à la fois moins cher et meilleur sur cet indice.
Données de benchmark par Artificial Analysis

À propos de ce modèle

Ling-3.0-flash est un modèle d'IA open-weight de Inclusionai. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix catalogue de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Ling-3.0-flash ?

Ling-3.0-flash est un modèle de langage IA de Inclusionai. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 37.8 sur l'indice d'intelligence d'Artificial Analysis.

Ling-3.0-flash est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez self-host Ling-3.0-flash et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont de 0,02 $ par million de tokens d'entrée et 0,06 $ par million de tokens de sortie.

Dans quoi Ling-3.0-flash excelle-t-il ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 85.5%, Humanity's Last Exam 23.7%, Long Context Reasoning 67%, SciCode 41.1%, τ-Bench Banking 27.2%, Terminal-Bench 55.4%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Ling-3.0-flash ?

Il génère environ 406.5 tokens par seconde, avec un délai médian 1.84s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je self-host Ling-3.0-flash ?

Oui. Ling-3.0-flash a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés