Thinkingmachines · tous les modèles ›

TInklingOPEN

Inkling est un modèle open-weight multimodal mélange d'experts du Thinking Machines Lab, avec 41B de paramètres actifs sur 975B au total.

1MFenêtre de contexte · tokens
$0.95Prix d'entrée · par M tokens
$4.05Prix de sortie · par M tokens
ThinkingmachinesFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Inkling, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : xhigh.

3.8×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Inkling offre 3,8 fois plus de capacité. Les open weights signifient également que vous pouvez l'auto-héberger et ne rien payer par token.
Intelligence index42.3
Coding index52.1
GPQA87.2%
Humanity's Last Exam31.9%
Long Context Reasoning73.3%
SciCode46.1%
τ-Bench Banking29.1%
Terminal-Bench55.1%
⚡ Speed57.2 tokens/sec
⏱ Latency2.55s to first token
💰 Blended price$1.762 / 1M tokens
📈 Value24 intelligence points per $
vs. modèles mesurés icitop 22%
Scores plus élevés que 78% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $1.35 par 1M de tokens (médiane de 16) — celui-ci coûte $1.72.
Moins cher et meilleur sur cet indice : GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) et 15 de plus
Données de benchmark par Artificial Analysis

À propos de ce modèle

Inkling est un modèle d'IA open-weight de Thinkingmachines. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

À quoi est bon Inkling ?

Inkling est un modèle de langage IA de Thinkingmachines. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 42.3 sur l'indice d'intelligence d'Artificial Analysis.

Inkling est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez self-host Inkling et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont de 0,95 $ par million de tokens d'entrée et 4,05 $ par million de tokens de sortie.

À quoi est bon Inkling ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse d'Inkling ?

Il génère environ 57.2 tokens par seconde, avec un délai médian 2.55s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Inkling ?

Oui. Inkling a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Inkling (free)ThinkingmachinesInkling Small (free)ThinkingmachinesInkling SmallThinkingmachinesInkling (batch)Thinkingmachines