Thinkingmachines · tous les modèles ›

TInkling (batch)OPEN

Inkling est un modèle open-weight multimodal mélange d'experts du Thinking Machines Lab, avec 41B de paramètres actifs sur 975B au total.

524KFenêtre de contexte · tokens
$1Prix d'entrée · par M tokens
$4.05Prix de sortie · par M tokens
ThinkingmachinesFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de benchmark indépendants pour Inkling (batch), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : xhigh.

3.8×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Inkling (batch) offre 3.8 fois plus de capacité. Les open weights signifient également que vous pouvez le self-host et ne rien payer par jeton.
Intelligence index42.3
Coding index52.1
GPQA87.2%
Humanity's Last Exam31.9%
Long Context Reasoning73.3%
SciCode46.1%
τ-Bench Banking29.1%
Terminal-Bench55.1%
⚡ Speed69.8 tokens/sec
⏱ Latency2.42s to first token
💰 Blended price$1.762 / 1M tokens
📈 Value24 intelligence points per $
vs. modèles mesurés icitop 23%
Scores plus élevés que 77% des 276 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $1.49 par 1M de tokens (médiane de 19) — celui-ci coûte $1.76.
Moins cher et meilleur sur cet indice : Gemini 3.7 Flash · Gemini 3.7 Flash (batch) · DeepSeek V4 Pro 0813 et 15 de plus
Données de benchmark par Artificial Analysis

À propos de ce modèle

Inkling (batch) est un modèle d'IA open-weight de Thinkingmachines. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Inkling (batch) ?

Inkling (batch) est un modèle de langage IA de Thinkingmachines. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 42.3 sur l'indice d'intelligence d'Artificial Analysis.

Inkling (batch) est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez auto-héberger Inkling (batch) et ne rien payer par jeton. Si vous préférez une API hébergée, les prix indiqués sont de 1 $ par million de jetons en entrée et 4,05 $ par million de jetons en sortie.

Dans quoi Inkling (batch) excelle-t-il ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.

À quelle vitesse Inkling (batch) est-il ?

Il génère environ 69.8 tokens par seconde, avec un délai médian 2.42s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Pouvez-vous self-host Inkling (batch) ?

Oui. Inkling (batch) a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Modèles associés

InklingThinkingmachinesInkling SmallThinkingmachines