Inclusionai · alle Modelle ›

ILing-3.0-flashOPEN

*Ling-3.0-flash* ist ein *124B-Parameter-Mixture-of-Experts (MoE)-Modell* mit etwa *5,1B aktivierten Parametern pro Token*.

262KKontextfenster · Tokens
$0.02Eingabepreis · pro M Tokens
$0.06Ausgabepreis · pro M Tokens
InclusionaiAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Ling-3.0-flash, gemessen von Artificial Analysis. Höher ist besser.

54×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für das gleiche Budget bietet Ling-3.0-flash die 54-fache Leistungsfähigkeit. Open weights bedeuten auch, dass Sie es selbst hosten und nichts pro Token bezahlen können.
Intelligence index37.8
Coding index50.6
GPQA85.5%
Humanity's Last Exam23.7%
Long Context Reasoning67%
SciCode41.1%
τ-Bench Banking27.2%
Terminal-Bench55.4%
⚡ Speed406.5 tokens/sec
⏱ Latency1.84s to first token
💰 Blended price$0.111 / 1M tokens
📈 Value340.5 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 32%
Scores höher als 68% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $1.56 pro 1M Tokens (Median von 24) — dieses kostet $0.03.
Kein hier verfolgtes Modell ist sowohl günstiger als auch besser in diesem Index.
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Ling-3.0-flash ist ein Open-Weight-KI-Modell von Inclusionai. Sie können es kostenlos herunterladen und selbst hosten; die unten stehenden Preise sind Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Ling-3.0-flash?

Ling-3.0-flash ist ein KI-Sprachmodell von Inclusionai. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 37.8 im Artificial Analysis Intelligenzindex.

Ist Ling-3.0-flash kostenlos?

Die Gewichte sind frei und offen – Sie können Ling-3.0-flash selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0,02 pro Million Input-Token und $0,06 pro Million Output-Token.

Worin ist Ling-3.0-flash gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 85.5%, Humanity's Last Exam 23.7%, Long Context Reasoning 67%, SciCode 41.1%, τ-Bench Banking 27.2%, Terminal-Bench 55.4%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Ling-3.0-flash?

Es generiert etwa 406.5 Tokens pro Sekunde, mit einer Median 1.84s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Ling-3.0-flash selbst hosten?

Ja. Ling-3.0-flash hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können – ohne Kosten pro Token.

Verwandte Modelle