Inkling Small ist ein open-weight multimodales Mixture-of-Experts-Modell von Thinking Machines Lab, mit 12B aktiven Parametern von insgesamt 276B.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Inkling Small (kostenlos), gemessen von Artificial Analysis. Höher ist besser.
Inkling Small (kostenlos) ist ein Open-Weight-KI-Modell von Thinkingmachines. Sie können es kostenlos herunterladen und selbst hosten; Die folgenden Preise sind Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.
Inkling Small (free) ist ein KI-Sprachmodell von Thinkingmachines. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 41.2 im Artificial Analysis Intelligenzindex.
Die Gewichte sind frei und offen – Sie können Inkling Small (free) selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei Free pro Million Eingabe-Tokens und Free pro Million Ausgabe-Tokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 61.4 Tokens pro Sekunde, mit einer Median 2.19s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Inkling Small (free) hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem eigenen Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können – ohne Kosten pro Token.