Thinkingmachines · tous les modèles ›

TInkling Small (free)OPEN

Inkling Small est un modèle multimodal à mélange d'experts avec open weights de Thinking Machines Lab, avec 12B de paramètres actifs sur 276B au total.

1MFenêtre de contexte · tokens
FreePrix d'entrée · par M tokens
FreePrix de sortie · par M tokens
ThinkingmachinesFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Inkling Small (free), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

12×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Inkling Small (free) offre 12 fois plus de capacités. Les open weights signifient également que vous pouvez le self-host et ne rien payer par jeton.
Intelligence index41.2
Coding index52.9
GPQA89.5%
Humanity's Last Exam33.3%
Long Context Reasoning69.3%
SciCode48.7%
τ-Bench Banking18.8%
Terminal-Bench55.1%
⚡ Speed61.4 tokens/sec
⏱ Latency2.19s to first token
💰 Blended price$0.525 / 1M tokens
📈 Value78.5 intelligence points per $
vs. modèles mesurés icitop 24%
Scores plus élevés que 76% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Données de benchmark par Artificial Analysis

À propos de ce modèle

Inkling Small (free) est un modèle d'IA open-weight de Thinkingmachines. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix publics de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Inkling Small (free) ?

Inkling Small (free) est un modèle de langage IA de Thinkingmachines. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 41.2 sur l'indice d'intelligence d'Artificial Analysis.

Est-ce que Inkling Small (free) est gratuit ?

Les poids sont gratuits et ouverts — vous pouvez self-host Inkling Small (free) et ne rien payer par jeton. Si vous préférez une API hébergée, les prix publics sont gratuits par million de jetons d'entrée et gratuits par million de jetons de sortie.

Dans quoi Inkling Small (free) est-il bon ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse d'Inkling Small (free) ?

Il génère environ 61.4 tokens par seconde, avec un délai médian 2.19s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je self-héberger Inkling Small (gratuit) ?

Oui. Inkling Small (gratuit) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Inkling (free)ThinkingmachinesInklingThinkingmachinesInkling SmallThinkingmachinesInkling (batch)Thinkingmachines