Thinkingmachines · alle Modelle ›

TInkling SmallOPEN

Inkling Small ist ein open-weight multimodales Mixture-of-Experts-Modell von Thinking Machines Lab, mit 12B aktiven Parametern von insgesamt 276B.

524KKontextfenster · Tokens
$0.45Eingabepreis · pro M Tokens
$1.2Ausgabepreis · pro M Tokens
ThinkingmachinesAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Inkling Small, gemessen von Artificial Analysis. Höher ist besser.

12×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für das gleiche Budget bietet Inkling Small die 12-fache Leistungsfähigkeit. Open weights bedeuten auch, dass Sie es selbst hosten können und nichts pro Token bezahlen.
Intelligence index41.2
Coding index52.9
GPQA89.5%
Humanity's Last Exam33.3%
Long Context Reasoning69.3%
SciCode48.7%
τ-Bench Banking18.8%
Terminal-Bench55.1%
⚡ Speed61.3 tokens/sec
⏱ Latency1.86s to first token
💰 Blended price$0.525 / 1M tokens
📈 Value78.5 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 25%
Scores höher als 75% der 276 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $1.41 pro 1M Tokens (Median von 20) — dieses kostet $0.64.
Günstiger und besser in diesem Index: Gemini 3.7 Flash (batch) · GPT-5.6 Luna · GPT-5.6 Luna (batch) und 8 mehr
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Inkling Small ist ein Open-Weight-KI-Modell von Thinkingmachines. Sie können es kostenlos herunterladen und selbst hosten; die unten angegebenen Preise sind die täglich aktualisierten Listenpreise der gehosteten APIs, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Inkling Small?

Inkling Small ist ein KI-Sprachmodell von Thinkingmachines. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 41.2 im Artificial Analysis Intelligenzindex.

Ist Inkling Small kostenlos?

Die Gewichte sind kostenlos und offen – Sie können Inkling Small selbst hosten und nichts pro Token bezahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,45 $ pro Million Eingabe-Token und 1,2 $ pro Million Ausgabe-Token.

Was kann Inkling Small gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 89.5%, Humanity's Last Exam 33.3%, Long Context Reasoning 69.3%, SciCode 48.7%, τ-Bench Banking 18.8%, Terminal-Bench 55.1%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Inkling Small?

Es generiert etwa 61.3 Tokens pro Sekunde, mit einer Median 1.86s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Inkling Small selbst hosten?

Ja. Inkling Small hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

InklingThinkingmachinesInkling (batch)Thinkingmachines