Moonshot AI · todos os modelos ›

MKimi K3OPEN

O Kimi K3 é um modelo de raciocínio multimodal open-weight com 2.8T de parâmetros da Moonshot AI.

1MJanela de contexto · tokens
$3Preço de entrada · por M tokens
$15Preço de saída · por M tokens
Moonshot AIFornecedor

Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para o Kimi K3, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: max.

Intelligence index59.7
Coding index76.2
GPQA93.5%
Humanity's Last Exam46.9%
Long Context Reasoning82.7%
SciCode58.7%
τ-Bench Banking46%
Terminal-Bench85%
⚡ Speed37.9 tokens/sec
⏱ Latency5.48s to first token
💰 Blended price$6 / 1M tokens
📈 Value10 intelligence points per $
vs. modelos medidos aquitop 3%
Pontuações mais altas que 97% dos 273 modelos medidos pela Artificial Analysis e rastreados aqui.
Modelos neste nível custam $3 por 1M de tokens (mediana de 6) — este custa $6.
Mais barato e melhor neste índice: Claude Opus 5 (batch) · GPT-5.6 Sol · Grok 4.6 e 1 a mais
Dados de benchmark por Artificial Analysis

Sobre este modelo

Kimi K3 é um modelo de IA open-weight da Moonshot AI. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços públicos de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.

Perguntas frequentes

O que é o Kimi K3?

Kimi K3 é um modelo de linguagem de IA da Moonshot AI. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 59.7 no índice de inteligência Artificial Analysis.

O Kimi K3 é gratuito?

Os pesos são gratuitos e abertos — você pode auto-hospedar o Kimi K3 e não pagar nada por token. Se preferir uma API hospedada, os preços listados são $3 por milhão de tokens de entrada e $15 por milhão de tokens de saída.

Para que o Kimi K3 é bom?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 93.5%, Humanity's Last Exam 46.9%, Long Context Reasoning 82.7%, SciCode 58.7%, τ-Bench Banking 46%, Terminal-Bench 85%. É particularmente usado para geração de código.

Quão rápido é o Kimi K3?

Ele gera cerca de 37.9 tokens por segundo, com uma mediana 5.48s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso auto-hospedar o Kimi K3?

Sim. O Kimi K3 possui open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Modelos relacionados

Kimi K2.6Moonshot AIKimi K2.5Moonshot AIKimi K2.7 CodeMoonshot AIKimi K2 0905Moonshot AIKimi K2 0711Moonshot AIKimi K2 ThinkingMoonshot AI