El mismo trabajo cuesta 245× más dependiendo del modelo que elija.
Los precios de salida de 190 modelos de IA van desde $0.03 hasta $15.00 por millón de tokens. En un mes de trabajo de agente ordinario, esa es la diferencia entre seis centavos y trece dólares con cincuenta — por una salida que la mayoría de los equipos nunca compara.
TL;DR — la versión corta
Los precios de salida de los 190 modelos que rastreamos van desde $0.03 hasta $15.00 por millón de tokens — una diferencia de 500×. La mediana es $0.87.
En una carga de trabajo concreta — 2 millones de tokens de entrada y 500,000 tokens de salida, aproximadamente un mes ocupado de uso de agente — la factura va desde 6 centavos hasta $13.50. Misma tarea, 245× el precio.
Trece modelos no cuestan nada, y 59 están por debajo de cincuenta centavos. El extremo caro está casi vacío: exactamente dos modelos cuestan más de $10.
Los precios de los modelos se cotizan por millón de tokens, una unidad de la que nadie tiene intuición. Así que los números pasan de largo: $0.60 y $6.00 ambos se leen como “suficientemente baratos”, y eliges según puntuaciones de referencia o según el nombre que viste por última vez.
Aquí está lo que cuesta ese hábito.
Una diferencia de 500×, en el mismo estante
En los 190 modelos comerciales que evaluamos, la salida va desde $0.03 por millón de tokens (Mistral Nemo) hasta $15.00 (Kimi K3). La mediana es $0.87.
Estos no son productos diferentes como lo son una bicicleta y un coche. Todos son APIs de texto a texto, la mayoría manejará perfectamente tu tarea de resumen, y aparecen uno al lado del otro en el mismo menú desplegable de cualquier framework que uses.
Donde realmente se agrupan los modelos
La forma merece una segunda mirada. El mercado tiene un centro amplio en $1–3 — ahí es donde compiten 59 modelos, y donde están la mayoría de los valores predeterminados. Debajo se asienta una población grande y silenciosa: 72 modelos con precio inferior a un dólar, trece de ellos gratuitos.
Por encima de $3, el estante se vacía rápido. Veinte modelos entre $3 y $10, y precisamente dos por encima: Kimi K3 a $15.00 y Command R+ de Cohere a $10.00.
Cómo se ve en una factura real
El precio por millón solo se vuelve real cuando lo asocias a un trabajo. Toma un mes de uso moderado de agente: 2 millones de tokens de entrada y 500,000 tokens de salida — unos miles de resúmenes de documentos, o un desarrollador usando un asistente de codificación con regularidad.
| Modelo | Proveedor | Ese mes cuesta |
|---|---|---|
| Mistral Nemo | Mistral AI | $0.06 |
| Llama 3.1 8B Instruct | Meta | $0.14 |
| el modelo mediano | — | $0.97 |
| Qwen3.6 Max Preview | Alibaba | $5.68 |
| Kimi K3 | Moonshot AI | $13.50 |
Seis centavos contra trece dólares con cincuenta centavos. Si esa carga de trabajo es una funcionalidad de producto que usan diez mil usuarios, las mismas dos filas son $600 contra $135,000.
Tres hábitos que cuestan dinero sin motivo
- Un modelo para todo. Clasificación, enrutamiento, extracción y formateo no son razonamiento. Enviarlos a un modelo insignia es pagar precios de razonamiento por trabajo de búsqueda.
- Ignorar la división entrada/salida. La salida suele costar de tres a cinco veces la entrada. Una instrucción que pide un documento reescrito en lugar de un diff puede multiplicar silenciosamente la factura.
- Nunca volver a verificar. Registramos cientos de cambios de precio por semana. El modelo que evaluó en marzo puede costar el doble — o la mitad — que el que tiene al lado hoy.
Cómo elegir sin hojas de cálculo
Ordene por precio, filtre por la ventana de contexto que realmente necesita y comience desde abajo en lugar de arriba. Ejecute sus instrucciones reales contra el modelo más barato que podría funcionar, luego suba solo cuando falle visiblemente. La mayoría de los equipos se detienen dos o tres escalones más abajo de donde empezaron.
Nuestra model leaderboard enumera los 190 con precios de entrada y salida en vivo, ventanas de contexto y soporte para llamadas a herramientas, y las head-to-head pages ponen dos lado a lado. Todo es de lectura gratuita y no requiere cuenta.
Método
190 modelos comerciales con precios de lista publicados, recopilados de las páginas de precios de los proveedores a través de OpenRouter y actualizados a diario; las cifras aquí son las del 7 de agosto de 2026. Los precios están en dólares estadounidenses por millón de tokens. “Gratis” significa un precio de salida de cero en el nivel gratuito que publica el proveedor — esos niveles tienen límites de velocidad que no modelamos.
El ejemplo mensual es aritmético sobre los precios de lista: 2 × precio de entrada más 0.5 × precio de salida. Ignora descuentos por caché, precios por lote y acuerdos de uso comprometido, todos los cuales modifican las facturas reales. Los modelos open-weight self-hosted se excluyen aquí porque su costo es hardware, no tokens — para esos, consulte nuestras local AI páginas.