Inclusionai · todos los modelos ›

ILing-3.0-flashOPEN

*Ling-3.0-flash* es un *modelo de Mezcla de Expertos (MoE) de 124B parámetros*, con aproximadamente *5.1B parámetros activados por token*.

262KVentana de contexto · tokens
$0.02Precio de entrada · por M tokens
$0.06Precio de salida · por M tokens
InclusionaiProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Puntuaciones independientes de benchmarks para Ling-3.0-flash, medidas por Artificial Analysis. Más alto es mejor.

54×
Más inteligencia por dólar que Claude Opus 5 (Fast).
Con el mismo presupuesto, Ling-3.0-flash ofrece 54 veces más capacidad. Los open weights también significan que puede autoalojarlo y no pagar nada por token.
Intelligence index37.8
Coding index50.6
GPQA85.5%
Humanity's Last Exam23.7%
Long Context Reasoning67%
SciCode41.1%
τ-Bench Banking27.2%
Terminal-Bench55.4%
⚡ Speed406.5 tokens/sec
⏱ Latency1.84s to first token
💰 Blended price$0.111 / 1M tokens
📈 Value340.5 intelligence points per $
vs. modelos medidos aquítop 32%
Puntuaciones más altas que el 68% de los 273 modelos medidos por Artificial Analysis y rastreados aquí.
Los modelos en este nivel cuestan $1.56 por 1M de tokens (mediana de 24) — este cuesta $0.03.
Ningún modelo rastreado aquí es más barato y mejor en este índice.
Datos de referencia por Artificial Analysis

Acerca de este modelo

Ling-3.0-flash es un modelo de open weights de Inclusionai. Puede descargarlo y autoalojarlo gratis; los precios a continuación son precios de lista de API alojadas, rastreados diariamente, para cuando prefiera la comodidad sobre el autoalojamiento.

Preguntas frecuentes

¿Qué es Ling-3.0-flash?

Ling-3.0-flash es un modelo de lenguaje de IA de Inclusionai. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 37.8 en el índice de inteligencia Artificial Analysis.

¿Es Ling-3.0-flash gratuito?

Los pesos son gratuitos y abiertos: puede autoalojar Ling-3.0-flash y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.02 por millón de tokens de entrada y $0.06 por millón de tokens de salida.

¿En qué es bueno Ling-3.0-flash?

Los benchmarks independientes de Artificial Analysis le dan GPQA 85.5%, Humanity's Last Exam 23.7%, Long Context Reasoning 67%, SciCode 41.1%, τ-Bench Banking 27.2%, Terminal-Bench 55.4%. Se utiliza particularmente para generación de código.

¿Qué tan rápido es Ling-3.0-flash?

Genera aproximadamente 406.5 tokens por segundo, con una mediana 1.84s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

¿Puedo autoalojar Ling-3.0-flash?

Sí. Ling-3.0-flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp, sin costo por token.

Modelos relacionados