Inception

IMercury 2API

Mercury 2 è un LLM di ragionamento estremamente veloce e il primo LLM di diffusione per il ragionamento (dLLM).

Finestra di contesto
128K
token
Prezzo di input
$0.25
per M token
Prezzo di output
$0.75
per M token
Fornitore
Inception

I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.

Vedi alternative open-source → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Mercury 2, misurati da Artificial Analysis. Maggiore è meglio.

Intelligence index21.4
Coding index31.1
GPQA77%
Humanity's Last Exam15.5%
Long Context Reasoning36.3%
SciCode38.7%
IFBench69.8%
τ²-Bench70.8%
τ-Bench Banking9.9%
Terminal-Bench27.3%
Terminal-Bench Hard26.5%
⚡ Speed937.6 tokens/sec
⏱ Latency4.15s to first token
💰 Blended price$0.375 / 1M tokens
📈 Value57.1 intelligence points per $
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Mercury 2 è un modello AI commerciale di Inception. Le specifiche qui sotto sono tracciate automaticamente: i prezzi vengono aggiornati ogni ora dai prezzi pubblici, quindi i numeri su questa pagina riflettono il costo attuale di utilizzo del modello tramite la sua API.

Domande frequenti

Cos'è Mercury 2?

Mercury 2 è un modello di linguaggio AI di Inception. È un modello proprietario, disponibile tramite un'API. Ottiene 21.4 sull'indice di intelligenza Artificial Analysis.

Mercury 2 è gratuito?

Mercury 2 non è gratuito: costa $0.25 per milione di token di input e $0.75 per milione di token di output. Le alternative a peso aperto possono essere ospitate autonomamente senza costi per token.

In cosa è bravo Mercury 2?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 77%, Humanity's Last Exam 15.5%, Long Context Reasoning 36.3%, SciCode 38.7%, IFBench 69.8%, τ²-Bench 70.8%, τ-Bench Banking 9.9%, Terminal-Bench 27.3%, Terminal-Bench Hard 26.5%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Mercury 2?

Genera circa 937.6 token al secondo, con una mediana 4.15s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Modelli correlati