Llama 4 Scout 17B Instruct (16E) es un modelo de lenguaje de mezcla de expertos (MoE) desarrollado por Meta, activando 17 mil millones de parámetros de un total de 109B.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Llama 4 Scout, medidas por Artificial Analysis. Cuanto más alto, mejor.
Llama 4 Scout es un modelo de IA open-weight de Meta. Puede descargarlo y alojarlo usted mismo de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la comodidad sobre el autohospedaje.
Llama 4 Scout es un modelo de lenguaje de IA de Meta. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 10.3 en el índice de inteligencia Artificial Analysis.
Los pesos son libres y abiertos — puede autoalojar Llama 4 Scout y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.11 por millón de tokens de entrada y $0.34 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 58.7%, MMLU-Pro 75.2%, Humanity's Last Exam 3.8%, Long Context Reasoning 30.3%, LiveCodeBench 29.9%, SciCode 17%, MATH-500 84.4%, AIME 28.3%, AIME 2025 14%, IFBench 39.5%, τ²-Bench 15.5%, τ-Bench Banking 3.3%, Terminal-Bench 3.7%, Terminal-Bench Hard 1.5%. Se utiliza particularmente para generación de código.
Genera aproximadamente 137.4 tokens por segundo, con una mediana 0.56s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Llama 4 Scout tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.