Precios en vivo por token para cada modelo principal — propietario y de peso abierto — en un solo lugar. Ve los costos de un vistazo en el gráfico, calcula tu factura mensual, compara modelos lado a lado y descubre cuánto costaría ejecutar la misma carga de trabajo en tu propio hardware: para modelos de peso abierto, nada más que electricidad.
Precios extraídos de datos en vivo · rastreados a lo largo del tiempo · olud.ai
Las barras se escalan al modelo más caro mostrado. Menor es más barato.
Cada precio arriba es lo que un proveedor cobra por ejecutar un modelo para ti. Pero los modelos de peso abierto — DeepSeek, Llama, Qwen, Mistral, Gemma — son gratuitos para descargar y ejecutar en tu propia GPU. Después del hardware, el costo marginal por token es básicamente electricidad. Para cargas de trabajo constantes y de alto volumen, eso cambia completamente las matemáticas.
Para cada modelo de pago popular, aquí está el modelo de peso abierto al que la gente cambia, y dónde leer sobre él:
Método. Los precios son por millón de tokens, extraídos de la API de OpenRouter y actualizados diariamente. El costo “mezclado” pondera la entrada y salida 3:1, un proxy común de un solo número. El costo de autoalojamiento es marginal (electricidad) y excluye hardware — las cifras reales dependen de tu GPU, utilización y precio de la energía. El historial de movimientos de precios se registra desde el lanzamiento, por lo que la sección de movimientos se irá completando en las próximas semanas.
El precio te dice cuánto cuesta un modelo. La clasificación te dice si es bueno — modelos de pesos abiertos clasificados por uso en el mundo real.
Abre la clasificación →