Llama 3.1 8B Instruct (Meta): precios de API en vivo, ventana de contexto y las mejores alternativas de código abierto, rastreadas diariamente por OpenSourceAI.tech.
Los precios se actualizan automáticamente — verificados cada hora contra los precios de la lista del proveedor.
Puntuaciones de referencia independientes para Llama 3.1 8B Instruct, medidas por Artificial Analysis. Cuanto más alto, mejor.
Llama 3.1 8B Instruct es un modelo de IA de peso abierto de Meta. Puedes descargarlo y autoalojarlo de forma gratuita; los precios a continuación son precios de lista de API alojadas, rastreados por hora, para cuando prefieras la comodidad sobre el autoalojamiento.
Llama 3.1 8B Instruct es un modelo de lenguaje de IA de Meta. Es de pesos abiertos: puedes descargarlo y ejecutarlo en tu propio hardware, de forma gratuita. Obtiene 7.6 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar Llama 3.1 8B Instruct y no pagar nada por token. Si prefieres una API alojada, los precios son $0.05 por millón de tokens de entrada y $0.08 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 25.9%, MMLU-Pro 47.6%, Humanity's Last Exam 5.1%, Long Context Reasoning 15.7%, LiveCodeBench 11.6%, SciCode 13.2%, MATH-500 51.9%, AIME 7.7%, AIME 2025 4.3%, IFBench 28.6%, τ²-Bench 16.4%, τ-Bench Banking 1.6%, Terminal-Bench 1.5%, Terminal-Bench Hard 0.8%. Se utiliza particularmente para generación de código.
Genera aproximadamente 614.7 tokens por segundo, con una mediana 0.22s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Llama 3.1 8B Instruct tiene pesos abiertos, así que puedes descargarlo y ejecutarlo en tu propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.
Dependiendo de tu carga de trabajo, un modelo de peso abierto que puedes alojar tú mismo puede reducir costos drásticamente o eliminar por completo la fijación de precios por token. Nuestras páginas de comparación ponen este modelo lado a lado con los competidores de código abierto más fuertes.