Inception

IMercury 2API

Mercury 2 é um LLM de raciocínio extremamente rápido e o primeiro LLM de difusão de raciocínio (dLLM).

Janela de contexto
128K
tokens
Preço de entrada
$0.25
por M tokens
Preço de saída
$0.75
por M tokens
Fornecedor
Inception

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Veja alternativas de código aberto → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Mercury 2, medidas pela Artificial Analysis. Quanto maior, melhor.

Intelligence index21.4
Coding index31.1
GPQA77%
Humanity's Last Exam15.5%
Long Context Reasoning36.3%
SciCode38.7%
IFBench69.8%
τ²-Bench70.8%
τ-Bench Banking9.9%
Terminal-Bench27.3%
Terminal-Bench Hard26.5%
⚡ Speed937.6 tokens/sec
⏱ Latency4.15s to first token
💰 Blended price$0.375 / 1M tokens
📈 Value57.1 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Mercury 2 é um modelo de IA comercial da Inception. As especificações abaixo são rastreadas automaticamente: os preços são atualizados a cada hora a partir de preços públicos, então os números nesta página refletem o custo atual de uso do modelo através de sua API.

Perguntas frequentes

O que é o Mercury 2?

Mercury 2 é um modelo de linguagem de IA da Inception. É um modelo proprietário, disponível através de uma API. Ele pontua 21.4 no índice de inteligência Artificial Analysis.

O Mercury 2 é gratuito?

O Mercury 2 não é gratuito: custa $0.25 por milhão de tokens de entrada e $0.75 por milhão de tokens de saída. Alternativas de peso aberto podem ser auto-hospedadas sem custo por token.

Para que o Mercury 2 é bom?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 77%, Humanity's Last Exam 15.5%, Long Context Reasoning 36.3%, SciCode 38.7%, IFBench 69.8%, τ²-Bench 70.8%, τ-Bench Banking 9.9%, Terminal-Bench 27.3%, Terminal-Bench Hard 26.5%. É particularmente usado para geração de código.

Quão rápido é o Mercury 2?

Ele gera cerca de 937.6 tokens por segundo, com uma mediana 4.15s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Modelos relacionados