Startseite › Medienmodelle

Medienmodelle: wo steht Open-Source?

Menschenpräferenz-Rankings für Bild-, Video- und Sprachmodelle — open-weight Modelle im direkten Vergleich mit der proprietären Frontier. Kein Marketing, kein Benchmark-Theater: echte Menschen haben die Ausgaben blind verglichen und abgestimmt.

Lade…
Ich möchte…
Lade Rankings…
So wird das eingestuft: das sind ELO-Punkte aus blindem menschlichen Vorzug — Menschen werden zwei Ausgaben gezeigt aus demselben Prompt, ohne zu wissen, welches Modell sie erzeugt hat, und wählen das, das sie bevorzugen. Es ist der einzige ehrliche Weg, Medienmodelle zu bewerten: kein automatisierter Benchmark kann dir sagen, ob ein Bild gut ist. Ein höherer ELO bedeutet, dass es häufiger bevorzugt wurde. Die Stimmen Spalte zeigt, wie viele Vergleiche die Punktzahl unterstützen — ein Modell mit wenigen Stimmen hat eine weniger zuverlässige Position.

Open-Weight bedeutet, dass das Modell heruntergeladen und auf deiner eigenen Hardware ausgeführt werden kann. Die Ranking-API sagt nicht ob ein Modell offen ist, daher identifizieren wir sie nach Modellfamilie. Wo wir es nicht bestätigen können, markieren wir das Modell unbestätigt Statt zu raten — und die "besten open-weight" Zahlen oben zählen nur Modelle, die wir tatsächlich bestätigen können. Wir würden lieber open-source untertreiben, als Sie in die Irre zu führen. Einen Fehler entdeckt?

Rankings von Artificial Analysis.