Thinkingmachines

TInklingOPEN

Inkling (Thinkingmachines): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.

Fenêtre de contexte
1M
tokens
Prix d'entrée
$1
par M tokens
Prix de sortie
$4.05
par M tokens
Fournisseur
Thinkingmachines

Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Inkling, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : xhigh.

2.6×
Plus d'intelligence par dollar que Claude Opus 5.
Pour le même budget, Inkling offre 2.6 fois plus de capacité. Les poids ouverts signifient également que vous pouvez l'héberger vous-même et ne rien payer par jeton.
Intelligence index40.7
Coding index52.1
GPQA87.2%
Humanity's Last Exam29.7%
Long Context Reasoning63.3%
SciCode46.1%
τ-Bench Banking23.7%
Terminal-Bench55.1%
⚡ Speed85.2 tokens/sec
⏱ Latency2.05s to first token
💰 Blended price$2.572 / 1M tokens
📈 Value15.8 intelligence points per $
Données de benchmark par Artificial Analysis

À propos de ce modèle

Inkling est un modèle d'IA à poids ouverts de Thinkingmachines. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis à l'heure, pour quand vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce qu'Inkling ?

Inkling est un modèle de langage IA de Thinkingmachines. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 40.7 sur l'indice d'intelligence d'Artificial Analysis.

Est-ce qu'Inkling est gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Inkling et ne rien payer par token. Si vous préférez une API hébergée, les prix de liste sont de 1 $ par million de tokens d'entrée et de 4,05 $ par million de tokens de sortie.

À quoi sert Inkling ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 87.2%, Humanity's Last Exam 29.7%, Long Context Reasoning 63.3%, SciCode 46.1%, τ-Bench Banking 23.7%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse d'Inkling ?

Il génère environ 85.2 tokens par seconde, avec un délai médian 2.05s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Inkling ?

Oui. Inkling a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Alternatives open-source

Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.