Inkling ist ein Open-Weight-Multimodal-Mischmodell von Thinking Machines Lab, mit 41B aktiven Parametern von insgesamt 975B.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Inkling (batch), gemessen von Artificial Analysis. Höher ist besser. Messmodus: xhigh.
Inkling (batch) ist ein Open-Weight-KI-Modell von Thinkingmachines. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die täglich verfolgten Listenpreise für die gehostete API, falls Sie Bequemlichkeit dem Selbsthosting vorziehen.
Inkling (batch) ist ein KI-Sprachmodell von Thinkingmachines. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 42.3 im Artificial Analysis Intelligenzindex.
Die Gewichte sind frei und offen – Sie können Inkling (batch) selbst hosten und zahlen nichts pro Token. Falls Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 1 $ pro Million Input-Token und 4,05 $ pro Million Output-Token.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 69.8 Tokens pro Sekunde, mit einer Median 2.42s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Inkling (batch) hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können – ohne Kosten pro Token.