O modelo de linguagem grande multilíngue (LLM) Meta Llama 3.3 é um modelo generativo pré-treinado e ajustado por instruções em 70B (texto em/texto out).
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para Llama 3.3 70B Instruct, medidas pela Artificial Analysis. Quanto maior, melhor.
Llama 3.3 70B Instruct é um modelo de IA open-weight da Meta. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Llama 3.3 70B Instruct é um modelo de linguagem de IA da Meta. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 9.3 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode fazer self-host do Llama 3.3 70B Instruct e não pagar nada por token. Se preferir uma API hospedada, os preços de tabela são $0.71 por milhão de tokens de entrada e $0.71 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. É particularmente usado para geração de código.
Ele gera cerca de 86.2 tokens por segundo, com uma mediana 0.62s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. Llama 3.3 70B Instruct tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.