Llama 4 Maverick (Meta): precios de API en vivo, ventana de contexto y las mejores alternativas de código abierto, rastreadas diariamente por olud.ai.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Llama 4 Maverick, medidas por Artificial Analysis. Cuanto más alto, mejor.
Llama 4 Maverick es un modelo de IA open-weight de Meta. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.
Llama 4 Maverick es un modelo de lenguaje de IA de Meta. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 14.5 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puedes alojar Llama 4 Maverick y no pagar nada por token. Si prefieres una API alojada, los precios de lista son $0.2 por millón de tokens de entrada y $0.8 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 67.1%, MMLU-Pro 80.9%, Humanity's Last Exam 4.9%, Long Context Reasoning 50%, LiveCodeBench 39.7%, SciCode 33.1%, MATH-500 88.9%, AIME 39%, AIME 2025 19.3%, IFBench 43%, τ²-Bench 17.8%, τ-Bench Banking 3.7%, Terminal-Bench 7.9%, Terminal-Bench Hard 6.8%. Se utiliza particularmente para generación de código.
Genera aproximadamente 101.8 tokens por segundo, con una mediana 0.58s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Llama 4 Maverick tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.