*Ling-3.0-flash* es un *modelo de Mezcla de Expertos (MoE) de 124B parámetros*, con aproximadamente *5.1B parámetros activados por token*.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones independientes de benchmarks para Ling-3.0-flash, medidas por Artificial Analysis. Más alto es mejor.
Ling-3.0-flash es un modelo de open weights de Inclusionai. Puede descargarlo y autoalojarlo gratis; los precios a continuación son precios de lista de API alojadas, rastreados diariamente, para cuando prefiera la comodidad sobre el autoalojamiento.
Ling-3.0-flash es un modelo de lenguaje de IA de Inclusionai. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 37.8 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puede autoalojar Ling-3.0-flash y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.02 por millón de tokens de entrada y $0.06 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 85.5%, Humanity's Last Exam 23.7%, Long Context Reasoning 67%, SciCode 41.1%, τ-Bench Banking 27.2%, Terminal-Bench 55.4%. Se utiliza particularmente para generación de código.
Genera aproximadamente 406.5 tokens por segundo, con una mediana 1.84s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Ling-3.0-flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp, sin costo por token.