Inception

IMercury 2API

Mercury 2 ist ein extrem schnelles reasoning LLM und das erste reasoning diffusion LLM (dLLM).

Kontextfenster
128K
Tokens
Eingabepreis
$0.25
pro M Tokens
Ausgabepreis
$0.75
pro M Tokens
Anbieter
Inception

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Open-Source-Alternativen → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Mercury 2, gemessen von Artificial Analysis. Höher ist besser.

Intelligence index21.4
Coding index31.1
GPQA77%
Humanity's Last Exam15.5%
Long Context Reasoning36.3%
SciCode38.7%
IFBench69.8%
τ²-Bench70.8%
τ-Bench Banking9.9%
Terminal-Bench27.3%
Terminal-Bench Hard26.5%
⚡ Speed937.6 tokens/sec
⏱ Latency4.15s to first token
💰 Blended price$0.375 / 1M tokens
📈 Value57.1 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Mercury 2 ist ein kommerzielles KI-Modell von Inception. Die folgenden Spezifikationen werden automatisch verfolgt: Die Preise werden stündlich aus öffentlichen Listenpreisen aktualisiert, sodass die Zahlen auf dieser Seite die aktuellen Kosten für die Nutzung des Modells über seine API widerspiegeln.

Häufig gestellte Fragen

Was ist Mercury 2?

Mercury 2 ist ein KI-Sprachmodell von Inception. Es ist ein proprietäres Modell, das über eine API verfügbar ist. Es erzielt 21.4 im Artificial Analysis Intelligenzindex.

Ist Mercury 2 kostenlos?

Mercury 2 ist nicht kostenlos: Es kostet 0,25 $ pro Million Eingabetokens und 0,75 $ pro Million Ausgabetokens. Open-Weight-Alternativen können ohne Kosten pro Token selbst gehostet werden.

Worin ist Mercury 2 gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 77%, Humanity's Last Exam 15.5%, Long Context Reasoning 36.3%, SciCode 38.7%, IFBench 69.8%, τ²-Bench 70.8%, τ-Bench Banking 9.9%, Terminal-Bench 27.3%, Terminal-Bench Hard 26.5%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Mercury 2?

Es generiert etwa 937.6 Tokens pro Sekunde, mit einer Median 4.15s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Verwandte Modelle