Meta · todos os modelos ›

MLlama 3.3 70B InstructOPEN

O modelo de linguagem grande multilíngue (LLM) Meta Llama 3.3 é um modelo generativo pré-treinado e ajustado por instruções em 70B (texto em/texto out).

131KJanela de contexto · tokens
$0.71Preço de entrada · por M tokens
$0.71Preço de saída · por M tokens
MetaFornecedor

Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Llama 3.3 70B Instruct, medidas pela Artificial Analysis. Quanto maior, melhor.

2.2×
Mais inteligência por dólar do que Claude Opus 5 (Fast).
Para o mesmo orçamento, o Llama 3.3 70B Instruct oferece 2,2 vezes mais capacidade. Open weights também significam que você pode fazer self-host e não pagar nada por token.
Intelligence index9.3
Coding index11.9
Math index7.7
GPQA49.8%
MMLU-Pro71.3%
Humanity's Last Exam3.6%
Long Context Reasoning15.7%
LiveCodeBench28.8%
SciCode26%
MATH-50077.3%
AIME30%
AIME 20257.7%
IFBench47.1%
τ²-Bench26.6%
Terminal-Bench4.9%
Terminal-Bench Hard3%
⚡ Speed86.2 tokens/sec
⏱ Latency0.62s to first token
💰 Blended price$0.671 / 1M tokens
📈 Value13.9 intelligence points per $
vs. modelos medidos aquitop 85%
Pontuações mais altas que 15% dos 273 modelos medidos pela Artificial Analysis e rastreados aqui.
Modelos neste nível custam $0.2 por 1M de tokens (mediana de 26) — este custa $0.71.
Mais barato e melhor neste índice: GLM 5.3 Flash · Gemini 3.7 Flash (batch) · GPT-5.6 Luna e 81 a mais
Dados de benchmark por Artificial Analysis

Sobre este modelo

Llama 3.3 70B Instruct é um modelo de IA open-weight da Meta. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.

Perguntas frequentes

O que é o Llama 3.3 70B Instruct?

Llama 3.3 70B Instruct é um modelo de linguagem de IA da Meta. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 9.3 no índice de inteligência Artificial Analysis.

O Llama 3.3 70B Instruct é gratuito?

Os pesos são gratuitos e abertos — você pode fazer self-host do Llama 3.3 70B Instruct e não pagar nada por token. Se preferir uma API hospedada, os preços de tabela são $0.71 por milhão de tokens de entrada e $0.71 por milhão de tokens de saída.

Para que serve o Llama 3.3 70B Instruct?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. É particularmente usado para geração de código.

Quão rápido é o Llama 3.3 70B Instruct?

Ele gera cerca de 86.2 tokens por segundo, com uma mediana 0.62s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso auto-hospedar o Llama 3.3 70B Instruct?

Sim. Llama 3.3 70B Instruct tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Modelos relacionados

Muse Spark 1.2MetaMuse Spark 1.1MetaMuse Spark 1.2 ContributorMetaLlama 3.1 8B InstructMetaMuse Glimmer 30BMetaLlama 4 MaverickMeta