Reka Flash 3 é um modelo de linguagem grande de propósito geral, ajustado por instruções, com 21 bilhões de parâmetros, desenvolvido pela Reka.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para Reka Flash 3, medidas pela Artificial Analysis. Quanto maior, melhor.
Reka Flash 3 é um modelo de IA open-weight da Rekaai. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são os preços de lista da API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Reka Flash 3 é um modelo de linguagem de IA da Rekaai. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 3.7 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode auto-hospedar Reka Flash 3 e não pagar nada por token. Se você preferir uma API hospedada, os preços de lista são $0.1 por milhão de tokens de entrada e $0.2 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 52.9%, MMLU-Pro 66.9%, Humanity's Last Exam 4.4%, Long Context Reasoning 0%, LiveCodeBench 43.5%, SciCode 26.7%, MATH-500 89.3%, AIME 51%, AIME 2025 33.7%, IFBench 30.4%, τ²-Bench 0%, Terminal-Bench Hard 0%. É particularmente usado para raciocínio matemático.
Ele gera cerca de 88.2 tokens por segundo, com uma mediana 1.33s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. Reka Flash 3 tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.