Intelligenza, prezzo e velocità — in quattro grafici
L'intero panorama dei modelli letto in un'unica schermata: chi ottiene il punteggio più alto, quanto costa per milione di token e quanto velocemente risponde. Ogni punto è una misurazione pubblicata da Artificial Analysis, aggiornata qui ogni mattina. Nulla su questa pagina è la nostra opinione.
L'indice di intelligenza composito, top 16. Le varianti dello stesso modello con diversi sforzi di ragionamento vengono conteggiate una sola volta.
Ogni punto è un modello — le varianti di sforzo di ragionamento appaiono separatamente qui, perché il compromesso tra di esse è esattamente ciò che questo grafico mostra. A sinistra è più economico, più in alto è più intelligente — quindi il miglior valore si trova in alto a sinistra. Il prezzo è il tasso misto di Artificial Analysis, tre token di input per un token di output. La scala orizzontale è logaritmica perché i prezzi spaziano su un fattore di ottocento.
Il miglior indice di intelligenza disponibile in un dato giorno, dal primo modello nel set fino ad oggi. La linea sale sempre: fa un passo ogni volta che un modello supera ogni predecessore. Ventisette passi finora.
Una barra per azienda: il loro modello con il punteggio più alto, qualunque sia il costo. Questo è il grafico che risponde « chi è realmente competitivo » senza dover leggere una tabella di seicento righe.
Token di output al secondo contro l'indice di intelligenza. Un modello può essere brillante e lento, oppure veloce e superficiale — qui è dove si manifesta il compromesso.
Token di output medi al secondo, top 14. La velocità è misurata su un numero molto inferiore di modelli rispetto all'intelligenza, quindi leggi questo come una lista ristretta, non come un ranking completo.