KI-Modelle · Open-Source vs Bezahlt

Hermes 4 405B Offen vs GPT-3.5 Turbo (ältere v0613) Bezahlt

Hermes 4 405B vs GPT-3.5 Turbo (ältere v0613) im Vergleich — Preis pro Token, Kontextfenster, Multimodalität, Offenheit und welche Wahl zu treffen ist. Kann das Open-Source-Modell das kostenpflichtige ersetzen? Vollständige Aufschlüsselung 2026.

Preise & Spezifikationen aus Live-Daten aktualisiert · olud.ai

Offene Modellpreise = günstigster Anbieter über OpenRouter; offizielle Herstellerpreise können höher sein.

Hermes 4 405BOffenNous Research
$1 /M Eingabe
$3 /M AusgabeKeine pro-Token Gebühren, wenn Sie selbst hosten
TypOpen-Weight
Kontextfenster131K Tokens
MultimodalNein
Selbst gehostetJa
GPT-3.5 Turbo (ältere v0613)BezahltOpenAI
$1 /M Eingabe
$2 /M AusgabeVerwaltete API (keine Infrastruktur erforderlich)
TypProprietär
Kontextfenster4K Tokens
MultimodalNein
Selbst gehostetNein
Wählen Hermes 4 405B wenn Sie selbst hosten, Ihre Daten privat halten und pro-Token-Gebühren vermeiden möchten — es ist Open-Weight und läuft auf Ihrer eigenen Hardware. Wählen Sie GPT-3.5 Turbo (ältere v0613) wenn Sie Grenzfähigkeiten über eine verwaltete API mit null Infrastruktur zum Ausführen wünschen.

Hermes 4 405B vs GPT-3.5 Turbo (ältere v0613) Spezifikationen

SpezifikationHermes 4 405BGPT-3.5 Turbo (ältere v0613)Gewinner
HerstellerNous ResearchOpenAI
TypOpen-WeightProprietärHermes 4 405B
Kontextfenster131K Tokens4K TokensHermes 4 405B
Eingabepreis$1/M · kostenloses Selbst-Hosting$1/M= Unentschieden
Ausgabepreis$3/M · kostenloses Selbst-Hosting$2/MGPT-3.5 Turbo (ältere v0613)
Vision / multimodalNeinNein
Tool / FunktionsaufrufNeinJaGPT-3.5 Turbo (ältere v0613)
Selbst gehostetJaNein (nur API)Hermes 4 405B
LizenzOpen weightsProprietärHermes 4 405B

Preisdifferenz & wann man jeweils wählen sollte

1.5×günstiger pro Ausgabe-Token

GPT-3.5 Turbo (ältere v0613) ist ~1.5× günstiger als Hermes 4 405B bei Ausgabetoken ($2 vs $3 pro M Tokens).

Wählen Sie Hermes 4 405B, wenn…
  • Sie selbst hosten oder in Ihrer Cloud ausführen möchten
  • Sie benötigen das längere 131K Kontextfenster
  • Sie Datenprivatsphäre & Kontrolle priorisieren
  • Sie offene oder reproduzierbare KI entwickeln
Wählen Sie GPT-3.5 Turbo (ältere v0613), wenn…
  • Sie Spitzenleistung über eine verwaltete API wünschen
  • Sie den niedrigeren Ausgabepreis möchten
  • Sie Zuverlässigkeit & Ökosystem schätzen
  • Sie keine Infrastruktur verwalten möchten

Funktionsvergleich

FähigkeitHermes 4 405BGPT-3.5 Turbo (ältere v0613)
Offene Gewichte (herunterladbar)
Selbst gehostet
Läuft vollständig offline
Vision / multimodal
Tool / Funktionsaufruf
1M+ Kontextfenster

Benchmarks: Hermes 4 405B vs GPT-3.5 Turbo (ältere v0613)

Unabhängige Benchmark-Ergebnisse gemessen von Artificial Analysis. Höher ist besser (außer Latenz).

Hermes 4 405B
GPT-3.5 Turbo (ältere v0613)
Intelligenzindex
8.8
3.6
Mathematikindex
15.3
GPQA
53.6%
29.7%
MMLU-Pro
72.9%
46.2%
Die letzte Prüfung der Menschheit
4.2%
Langzeit-Kontext-Argumentation
20%
LiveCodeBench
54.6%
SciCode
34.6%
AIME 2025
15.3%
IFBench
34.8%
τ²-Bench
26.6%
Terminal-Bench Hard
9.8%
Kodierungsindex
10.7
MATH-500
44.1%
Geschwindigkeit
33 tok/s
0 tok/s
Latenz
0.83s
0s
Intelligenz pro $
5.9
4.8

Benchmark-Daten von Artificial Analysis.

Wie Hermes 4 405B und GPT-3.5 Turbo (ältere v0613) abschneiden

🏆 Bester Wert & Offenheit: Hermes 4 405B (3.9 vs 2.5 / 5)
KriteriumHermes 4 405BGPT-3.5 Turbo (ältere v0613)
Kosten-Effizienz4.04.5
Kontextfenster3.52.0
Offenheit5.01.5
Selbst-Hosting5.01.0
Multimodalität2.03.5

Die Bewertungen stammen aus Live-Daten — Ausgabepreis (Kosten), Kontextlänge, offene vs. geschlossene Gewichte (Offenheit & Selbst-Hosting) und Unterstützung für Vision/Tools (Multimodalität). Die Rohqualität der Aufgaben wird hier nicht bewertet; sie hängt von Ihrem Benchmark ab — siehe das Urteil.

Was jedes Modell ist

Hermes 4 405B Offen

Nous Research · Open-Weight

Hermes 4 ist ein groß angelegtes Denkmodell, das auf Meta-Llama-3.1-405B basiert und von Nous Research veröffentlicht wurde. Es führt einen hybriden Denkmodus ein, in dem das Modell wählen kann, ob es intern...

GPT-3.5 Turbo (ältere v0613) Bezahlt

OpenAI · Proprietär

GPT-3.5 Turbo ist das schnellste Modell von OpenAI. Es kann natürliche Sprache oder Code verstehen und generieren und ist für Chat- und traditionelle Abschlussaufgaben optimiert. Trainingsdaten bis September 2021.

Andere Modelle in diesen Familien

Diese Varianten werden verfolgt, aber hier nicht verglichen — eine Seite pro Familie hält den Vergleich lesbar.

Andere verfolgte Varianten
Hermes 4 70B

Häufig gestellte Fragen

Ist Hermes 4 405B so gut wie GPT-3.5 Turbo (ältere v0613)?

Hermes 4 405B ist open-weight und wettbewerbsfähig in vielen Aufgaben, aber GPT-3.5 Turbo (ältere v0613) könnte bei den schwierigsten Denk- und Agentenarbeiten weiterhin führend sein. Die Lücke wird immer kleiner — benchmarken Sie beide in Ihrem tatsächlichen Anwendungsfall, bevor Sie entscheiden.

Kann ich Hermes 4 405B lokal ausführen?

Ja. Hermes 4 405B hat offene Gewichte, sodass Sie es auf Ihren eigenen GPUs selbst hosten oder über eine kostengünstige API ausführen können. GPT-3.5 Turbo (ältere v0613) ist nur API und kann nicht selbst gehostet werden.

Hermes 4 405B vs GPT-3.5 Turbo (ältere v0613) — welche sollte ich 2026 wählen?

Wählen Sie Hermes 4 405B, wenn Sie selbst hosten, Ihre Daten privat halten und Gebühren pro Token vermeiden möchten — es ist open-weight und läuft auf Ihrer eigenen Hardware. Wählen Sie GPT-3.5 Turbo (ältere v0613), wenn Sie fortschrittliche Fähigkeiten über eine verwaltete API ohne Infrastruktur zum Ausführen wünschen.

Menschen vergleichen auch

Entdecken Sie weitere Open-Source-AI

Durchsuchen Sie die vollständige Open-Source-Modell-Rangliste, tausende von Tools und Live-Benchmarks — alles an einem Ort.

Öffnen Sie die Rangliste →