gpt-oss-120b est un modèle de langage open-weight de 117B paramètres Mixture-of-Experts (MoE) d'OpenAI conçu pour des cas d'utilisation de production à haute réflexion, agentique et généraliste.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de benchmark indépendants pour gpt-oss-120b, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : high.
gpt-oss-120b est un modèle d'IA open-weight de OpenAI. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
gpt-oss-120b est un modèle de langage IA de OpenAI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 24.1 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger gpt-oss-120b et ne rien payer par token. Si vous préférez une API hébergée, les prix sont de 0,04 $ par million de tokens d'entrée et de 0,17 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 78.2%, MMLU-Pro 80.8%, Humanity's Last Exam 19.6%, Long Context Reasoning 51%, LiveCodeBench 87.8%, SciCode 38.9%, AIME 2025 93.4%, IFBench 69%, τ²-Bench 65.8%, τ-Bench Banking 12.8%, Terminal-Bench 26.2%, Terminal-Bench Hard 23.5%. Il est particulièrement utilisé pour génération de code.
Il génère environ 167.3 tokens par seconde, avec un délai médian 0.53s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. gpt-oss-120b a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.