Inkling (Thinkingmachines): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.
Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.
Scores de référence indépendants pour Inkling, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : xhigh.
Inkling est un modèle d'IA à poids ouverts de Thinkingmachines. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis à l'heure, pour quand vous préférez la commodité à l'auto-hébergement.
Inkling est un modèle de langage IA de Thinkingmachines. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 40.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Inkling et ne rien payer par token. Si vous préférez une API hébergée, les prix de liste sont de 1 $ par million de tokens d'entrée et de 4,05 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 87.2%, Humanity's Last Exam 29.7%, Long Context Reasoning 63.3%, SciCode 46.1%, τ-Bench Banking 23.7%, Terminal-Bench 55.1%. Il est particulièrement utilisé pour génération de code.
Il génère environ 85.2 tokens par seconde, avec un délai médian 2.05s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Inkling a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.
Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.