Thinkingmachines · alle Modelle ›

TInklingOPEN

Inkling ist ein Open-Weight-Multimodal-Mischmodell von Thinking Machines Lab, mit 41B aktiven Parametern von insgesamt 975B.

1MKontextfenster · Tokens
$0.95Eingabepreis · pro M Tokens
$4.05Ausgabepreis · pro M Tokens
ThinkingmachinesAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Inkling, gemessen von Artificial Analysis. Höher ist besser. Messmodus: xhigh.

3.8×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für dasselbe Budget bietet Inkling 3,8-mal mehr Leistung. Open weights bedeuten auch, dass Sie es selbst hosten können und nichts pro Token bezahlen müssen.
Intelligence index42.3
Coding index52.1
GPQA87.2%
Humanity's Last Exam31.9%
Long Context Reasoning73.3%
SciCode46.1%
τ-Bench Banking29.1%
Terminal-Bench55.1%
⚡ Speed57.2 tokens/sec
⏱ Latency2.55s to first token
💰 Blended price$1.762 / 1M tokens
📈 Value24 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 22%
Scores höher als 78% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $1.35 pro 1M Tokens (Median von 16) — dieses kostet $1.72.
Günstiger und besser in diesem Index: GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) und 15 mehr
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Inkling ist ein Open-Weight-KI-Modell von Thinkingmachines. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Inkling?

Inkling ist ein KI-Sprachmodell von Thinkingmachines. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 42.3 im Artificial Analysis Intelligenzindex.

Ist Inkling kostenlos?

Die Gewichte sind frei und offen – Sie können Inkling selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0,95 pro Million Input-Token und $4,05 pro Million Output-Token.

Wofür ist Inkling gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 87.2%, Humanity's Last Exam 31.9%, Long Context Reasoning 73.3%, SciCode 46.1%, τ-Bench Banking 29.1%, Terminal-Bench 55.1%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Inkling?

Es generiert etwa 57.2 Tokens pro Sekunde, mit einer Median 2.55s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Inkling selbst hosten?

Ja. Inkling hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Inkling (free)ThinkingmachinesInkling Small (free)ThinkingmachinesInkling SmallThinkingmachinesInkling (batch)Thinkingmachines