Thinkingmachines

TInklingOPEN

Inkling (Thinkingmachines): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von olud.ai.

Kontextfenster
1M
Tokens
Eingabepreis
$1
pro M Tokens
Ausgabepreis
$4.05
pro M Tokens
Anbieter
Thinkingmachines

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Inkling, gemessen von Artificial Analysis. Höher ist besser. Messmodus: xhigh.

2.6×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für dasselbe Budget bietet Inkling 2,6-mal mehr Leistung. Offene Gewichte bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index40.7
Coding index52.1
GPQA87.2%
Humanity's Last Exam29.7%
Long Context Reasoning63.3%
SciCode46.1%
τ-Bench Banking23.7%
Terminal-Bench55.1%
⚡ Speed85.2 tokens/sec
⏱ Latency2.12s to first token
💰 Blended price$2.572 / 1M tokens
📈 Value15.8 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Inkling ist ein KI-Modell mit offenen Gewichten von Thinkingmachines. Sie können es kostenlos herunterladen und selbst hosten; die unten angegebenen Preise sind die Listenpreise für gehostete APIs, die stündlich verfolgt werden, für den Fall, dass Sie Bequemlichkeit über Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Inkling?

Inkling ist ein KI-Sprachmodell von Thinkingmachines. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 40.7 im Artificial Analysis Intelligenzindex.

Ist Inkling kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Inkling selbst hosten und nichts pro Token zahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 1 $ pro Million Eingabetokens und 4,05 $ pro Million Ausgabetokens.

Wofür ist Inkling gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 87.2%, Humanity's Last Exam 29.7%, Long Context Reasoning 63.3%, SciCode 46.1%, τ-Bench Banking 23.7%, Terminal-Bench 55.1%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Inkling?

Es generiert etwa 85.2 Tokens pro Sekunde, mit einer Median 2.12s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Inkling selbst hosten?

Ja. Inkling hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle