Intelligence, prix et vitesse — en quatre graphiques
L'ensemble du paysage des modèles lu sur un écran : qui obtient le meilleur score, ce que cela coûte par million de tokens, et à quelle vitesse cela répond. Chaque point est une mesure publiée par Artificial Analysis, actualisée ici chaque matin. Rien sur cette page n'est notre opinion.
L'indice d'intelligence composite, top 16. Les variantes du même modèle avec différents efforts de raisonnement sont comptées une fois.
Chaque point est un modèle — les variantes d'effort de raisonnement apparaissent séparément ici, car le compromis entre elles est exactement ce que ce graphique montre. À gauche, c'est moins cher, plus haut, c'est plus intelligent — donc le meilleur rapport qualité-prix se trouve en haut à gauche. Le prix est le taux combiné d'Artificial Analysis, trois tokens d'entrée pour un token de sortie. L'échelle horizontale est logarithmique car les prix s'étendent sur un facteur de huit cents.
Le meilleur indice d'intelligence disponible à un jour donné, du premier modèle de l'ensemble jusqu'à aujourd'hui. La ligne ne fait que monter : elle monte chaque fois qu'un modèle bat tous ses prédécesseurs. Vingt-sept étapes jusqu'à présent.
Une barre par entreprise : leur modèle le mieux noté, quel qu'en soit le prix. C'est le graphique qui répond à « qui est réellement compétitif » sans lire un tableau de six cents lignes.
Sortie de tokens par seconde contre l'indice d'intelligence. Un modèle peut être brillant et lent, ou rapide et superficiel — c'est ici que le compromis se manifeste.
Tokens de sortie médians par seconde, top 14. La vitesse est mesurée sur beaucoup moins de modèles que l'intelligence, donc considérez cela comme une liste restreinte, pas un classement complet.