Thinkingmachines · tous les modèles ›

TInkling (free)OPEN

Inkling est un modèle open-weight multimodal mélange d'experts du Thinking Machines Lab, avec 41B de paramètres actifs sur 975B au total.

1MFenêtre de contexte · tokens
FreePrix d'entrée · par M tokens
FreePrix de sortie · par M tokens
ThinkingmachinesFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Inkling (free), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : xhigh.

3.8×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Inkling (free) offre 3,8 fois plus de capacités. Les open weights signifient également que vous pouvez le self-host et ne rien payer par jeton.
Intelligence index42.3
Coding index52.1
GPQA87.2%
Humanity's Last Exam31.9%
Long Context Reasoning73.3%
SciCode46.1%
τ-Bench Banking29.1%
Terminal-Bench55.1%
⚡ Speed57.2 tokens/sec
⏱ Latency2.55s to first token
💰 Blended price$1.762 / 1M tokens
📈 Value24 intelligence points per $
vs. modèles mesurés icitop 22%
Scores plus élevés que 78% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Données de benchmark par Artificial Analysis

À propos de ce modèle

Inkling (free) est un modèle d'IA open-weight de Thinkingmachines. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix publics de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Inkling (free) ?

Inkling (free) est un modèle de langage IA de Thinkingmachines. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 42.3 sur l'indice d'intelligence d'Artificial Analysis.

Est-ce que Inkling (free) est gratuit ?

Les poids sont gratuits et ouverts — vous pouvez self-host Inkling (free) et ne rien payer par jeton. Si vous préférez une API hébergée, les prix publics sont gratuits par million de jetons d'entrée et gratuits par million de jetons de sortie.

Dans quoi Inkling (free) est-il bon ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse d'Inkling (free) ?

Il génère environ 57.2 tokens par seconde, avec un délai médian 2.55s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je self-host Inkling (free) ?

Oui. Inkling (free) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Modèles associés

Inkling Small (free)ThinkingmachinesInklingThinkingmachinesInkling SmallThinkingmachinesInkling (batch)Thinkingmachines