El modelo de lenguaje grande multilingüe (LLM) Meta Llama 3.3 es un modelo generativo preentrenado y ajustado por instrucciones en 70B (texto en/texto fuera).
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Llama 3.3 70B Instruct, medidas por Artificial Analysis. Más alto es mejor.
Llama 3.3 70B Instruct es un modelo de IA open-weight de Meta. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.
Llama 3.3 70B Instruct es un modelo de lenguaje de IA de Meta. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 9.3 en el índice de inteligencia Artificial Analysis.
Los pesos son libres y abiertos — puede autoalojar Llama 3.3 70B Instruct y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.71 por millón de tokens de entrada y $0.71 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. Se utiliza particularmente para generación de código.
Genera aproximadamente 86.2 tokens por segundo, con una mediana 0.62s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Llama 3.3 70B Instruct tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.