Thinkingmachines · tous les modèles ›

TInkling SmallOPEN

Inkling Small est un modèle multimodal à mélange d'experts avec open weights de Thinking Machines Lab, avec 12B de paramètres actifs sur 276B au total.

524KFenêtre de contexte · tokens
$0.45Prix d'entrée · par M tokens
$1.2Prix de sortie · par M tokens
ThinkingmachinesFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Inkling Small, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

12×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Inkling Small offre 12 fois plus de capacités. Les open weights signifient également que vous pouvez le self-host et ne rien payer par token.
Intelligence index41.2
Coding index52.9
GPQA89.5%
Humanity's Last Exam33.3%
Long Context Reasoning69.3%
SciCode48.7%
τ-Bench Banking18.8%
Terminal-Bench55.1%
⚡ Speed61.3 tokens/sec
⏱ Latency1.86s to first token
💰 Blended price$0.525 / 1M tokens
📈 Value78.5 intelligence points per $
vs. modèles mesurés icitop 25%
Scores plus élevés que 75% des 276 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $1.41 par 1M de tokens (médiane de 20) — celui-ci coûte $0.64.
Moins cher et meilleur sur cet indice : Gemini 3.7 Flash (batch) · GPT-5.6 Luna · GPT-5.6 Luna (batch) et 8 de plus
Données de benchmark par Artificial Analysis

À propos de ce modèle

Inkling Small est un modèle d'IA open-weight de Thinkingmachines. Vous pouvez le télécharger et le self-hosted gratuitement ; les prix ci-dessous sont les prix de liste des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Inkling Small ?

Inkling Small est un modèle de langage IA de Thinkingmachines. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 41.2 sur l'indice d'intelligence d'Artificial Analysis.

Inkling Small est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez self-host Inkling Small et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont de 0,45 $ par million de tokens d'entrée et 1,2 $ par million de tokens de sortie.

Qu'est-ce que Inkling Small sait bien faire ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse d'Inkling Small ?

Il génère environ 61.3 tokens par seconde, avec un délai médian 1.86s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je héberger Inkling Small moi-même ?

Oui. Inkling Small a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

InklingThinkingmachinesInkling (batch)Thinkingmachines