Reka Flash 3 est un modèle de langage large à usage général, ajusté aux instructions, avec 21 milliards de paramètres, développé par Reka.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de benchmark indépendants pour Reka Flash 3, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Reka Flash 3 est un modèle d'IA open-weight par Rekaai. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Reka Flash 3 est un modèle de langage IA de Rekaai. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 3.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Reka Flash 3 et ne rien payer par token. Si vous préférez une API hébergée, les prix sont de 0,1 $ par million de tokens d'entrée et de 0,2 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 52.9%, MMLU-Pro 66.9%, Humanity's Last Exam 4.4%, Long Context Reasoning 0%, LiveCodeBench 43.5%, SciCode 26.7%, MATH-500 89.3%, AIME 51%, AIME 2025 33.7%, IFBench 30.4%, τ²-Bench 0%, Terminal-Bench Hard 0%. Il est particulièrement utilisé pour raisonnement mathématique.
Il génère environ 88.2 tokens par seconde, avec un délai médian 1.33s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Reka Flash 3 a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.