Inkling Small est un modèle multimodal à mélange d'experts avec open weights de Thinking Machines Lab, avec 12B de paramètres actifs sur 276B au total.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Inkling Small, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Inkling Small est un modèle d'IA open-weight de Thinkingmachines. Vous pouvez le télécharger et le self-hosted gratuitement ; les prix ci-dessous sont les prix de liste des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Inkling Small est un modèle de langage IA de Thinkingmachines. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 41.2 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont libres et ouverts — vous pouvez self-host Inkling Small et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont de 0,45 $ par million de tokens d'entrée et 1,2 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.
Il génère environ 61.3 tokens par seconde, avec un délai médian 1.86s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Inkling Small a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.