Hy3 est un modèle Mixture-of-Experts de 295B de paramètres de Tencent (21B actifs, 192 experts avec routage top-8) conçu pour le raisonnement, les flux de travail agentiques et l'utilisation en production dans le monde réel.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Hy3, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Hy3 est un modèle d'IA open-weight de Tencent. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Hy3 est un modèle de langage IA de Tencent. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 42.2 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Hy3 et ne rien payer par jeton. Si vous préférez une API hébergée, les prix catalogue sont de $0.08 par million de jetons d'entrée et $0.33 par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 89.7%, Humanity's Last Exam 33.5%, Long Context Reasoning 74.7%, SciCode 47.6%, τ-Bench Banking 22.9%, Terminal-Bench 64.4%. Il est particulièrement utilisé pour génération de code.
Il génère environ 70.5 tokens par seconde, avec un délai médian 1.8s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Hy3 a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.