MiniMax-M3 est un modèle de fondation multimodal de MiniMax.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de benchmark indépendants pour MiniMax M3 (batch), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
MiniMax M3 (batch) est un modèle d'IA open-weight de MiniMax. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.
MiniMax M3 (batch) est un modèle de langage IA de MiniMax. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 45.4 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont libres et ouverts — vous pouvez auto-héberger MiniMax M3 (batch) et ne rien payer par jeton. Si vous préférez une API hébergée, les prix indiqués sont de 0,3 $ par million de jetons en entrée et 1,2 $ par million de jetons en sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 92.9%, Humanity's Last Exam 39%, Long Context Reasoning 80.3%, SciCode 45.4%, IFBench 82.9%, τ²-Bench 88.9%, τ-Bench Banking 15.3%, Terminal-Bench 65.2%, Terminal-Bench Hard 42.4%. Il est particulièrement utilisé pour génération de code.
Il génère environ 106.8 tokens par seconde, avec un délai médian 0.94s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. MiniMax M3 (batch) a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.