Modelli AI · Open-Source vs a Pagamento

Step 3.7 Flash Aperto vs INMercury 2 Pagato

Passo 3.7 Flash vs Mercury 2 a confronto — prezzo per token, finestra di contesto, multimodalità, apertura e quale scegliere. Può il modello open-source sostituire quello a pagamento? Analisi completa del 2026.

Prezzi & specifiche aggiornati dai dati in tempo reale · olud.ai

Prezzi dei modelli aperti = fornitore più economico tramite OpenRouter; i tassi ufficiali del produttore possono essere più alti.

Step 3.7 FlashApertoStepfun
$0.2 /M input
$1.15 /M outputNessuna tassa per token se si self-host
TipoOpen-weight
Finestra di contesto262K token
Multimodale
Self-host
INMercury 2PagatoInception
$0.25 /M input
$0.75 /M outputAPI gestita (nessuna infrastruttura da gestire)
TipoProprietario
Finestra di contesto128K token
MultimodaleNo
Self-hostNo
Scegli Step 3.7 Flash se vuoi auto-ospitare, mantenere i tuoi dati privati e saltare le spese per token — è open-weight e funziona sul tuo hardware. Scegli Mercury 2 se vuoi capacità avanzate tramite un'API gestita senza infrastruttura da eseguire.

Passo 3.7 Flash vs Mercury 2 specifiche

SpecStep 3.7 FlashMercury 2Vincitore
CreatoreStepfunInception
TipoOpen-weightProprietarioStep 3.7 Flash
Finestra di contesto262K token128K tokenStep 3.7 Flash
Prezzo di input$0.2/M · auto-ospitato gratuito$0.25/MStep 3.7 Flash
Prezzo di output$1.15/M · auto-ospitato gratuito$0.75/MINMercury 2
Visione / multimodaleNoStep 3.7 Flash
Chiamata di strumenti / funzioni= Pareggio
Auto-ospitatoNo (solo API)Step 3.7 Flash
LicenzaOpen weightsProprietarioStep 3.7 Flash

Differenza di prezzo & quando scegliere ciascuno

1.5×più economico per token di output

Mercury 2 è ~1.5× più economico di Passo 3.7 Flash sui token di output ($0.75 vs $1.15 per M token).

Scegli Step 3.7 Flash se…
  • Vuole self-hostare o eseguire nel suo cloud
  • Hai bisogno della finestra di contesto più lunga di 262K
  • Dà priorità alla privacy dei dati & al controllo
  • Sta costruendo AI open o riproducibili
INScegli Mercury 2 se…
  • Vuole prestazioni all'avanguardia tramite un'API gestita
  • Vuole il prezzo di output più basso
  • Valuta l'affidabilità & l'ecosistema
  • Non vuole gestire l'infrastruttura

Confronto delle caratteristiche

CapacitàStep 3.7 FlashMercury 2
Open weights (scaricabili)
Auto-ospitato
Funziona completamente offline
Visione / multimodale
Chiamata di strumenti / funzioni
Finestra di contesto 1M+

Benchmark: Passo 3.7 Flash vs Mercury 2

Punteggi di benchmark indipendenti misurati da Artificial Analysis. Maggiore è meglio (eccetto la latenza).

Step 3.7 Flash
Mercury 2
Indice di intelligenza
30.3
21.4
Indice di codifica
39.6
31.1
GPQA
80.9%
77%
L'Ultimo Esame dell'Umanità
19.9%
15.5%
Ragionamento su contesti lunghi
63.7%
36.3%
SciCode
40%
38.7%
IFBench
67.3%
69.8%
τ²-Bench
98.5%
70.8%
τ-Bench Banking
11.3%
9.9%
Terminal-Bench
39.3%
27.3%
Terminal-Bench Hard
35.6%
26.5%
Velocità
383.1 tok/s
1082 tok/s
Latenza
0.9s
3,86s
Intelligenza per $
69.2
57.1

Dati di benchmark di Artificial Analysis.

Come si comportano Passo 3.7 Flash e Mercury 2

🏆 Miglior valore & apertura: Step 3.7 Flash (4.7 vs 2.9 / 5)
CriterioStep 3.7 FlashMercury 2
Costo-efficacia4.55.0
Finestra di contesto4.03.5
Apertura5.01.5
Auto-ospitato5.01.0
Multimodalità5.03.5

I punteggi provengono da dati in tempo reale — prezzo di output (costo), lunghezza del contesto, pesi aperti vs chiusi (apertura & auto-ospitato) e supporto per visione/strumenti (multimodalità). La qualità del compito grezzo non è valutata qui; dipende dal tuo benchmark — vedi il verdetto.

Cosa è ciascun modello

Step 3.7 Flash Aperto

Stepfun · Open-weight

Step 3.7 Flash è l'ultimo modello multimodale Mixture-of-Experts ad alta efficienza di StepFun. Abbina un backbone linguistico da 196B parametri con un codificatore visivo per la comprensione nativa di immagini e video, attivando circa 11B di parametri...

Mercury 2 Pagato

Inception · Proprietario

Mercury 2 è un LLM di ragionamento estremamente veloce, e il primo LLM di diffusione per il ragionamento (dLLM). Invece di generare token in sequenza, Mercury 2 produce e affina più token in parallelo, raggiungendo...

Altri modelli in queste famiglie

Queste varianti sono monitorate ma non confrontate qui — una pagina per famiglia mantiene il confronto leggibile.

Altre varianti monitorate
Step 3.5 Flash

Domande frequenti

È Passo 3.7 Flash buono come Mercury 2?

Passo 3.7 Flash è open-weight e competitivo in molte attività, ma Mercury 2 potrebbe ancora essere migliore nei compiti di ragionamento più difficili e nel lavoro agentico. Il divario continua a ridursi — confronti entrambi nel tuo caso d'uso reale prima di decidere.

Posso eseguire Passo 3.7 Flash localmente?

Sì. Passo 3.7 Flash ha open weights, quindi può essere self-hosted sulle proprie GPU o eseguito tramite un'API a basso costo. Mercury 2 è solo API e non può essere self-hosted.

Passo 3.7 Flash vs Mercury 2 — quale dovrei scegliere nel 2026?

Scegli Passo 3.7 Flash se desidera self-host, mantenere i propri dati privati e saltare le spese per token — è open-weight e funziona sul proprio hardware. Scegli Mercury 2 se desidera capacità avanzata tramite un'API gestita senza infrastruttura da eseguire.

Le persone confrontano anche

Esplora più AI open-source

Esplora la classifica completa dei modelli open-source, migliaia di strumenti e benchmark dal vivo — tutto in un unico posto.

Apri la classifica →