Ling 3.0 Flash
InclusionAI🇨🇳
inclusionai/ling-3.0-flashLing 3.0 Flash is InclusionAI's (Ant Group) successor to Ling 2.6 Flash, a hybrid-reasoning Mixture-of-Experts model (~124B total, ~5.1B active) combining Kimi Delta Attention with Multi-Head Latent Attention for efficient long-range memory. It supports both thinking and non-thinking modes with a native 262K context, suited for fast general-purpose coding and agentic tasks.
Tarifa de coste
0.1x
Contexto
262K
Lanzamiento
23 jul 2026
Entrada
Text
Salida
Text
Compatibilidad
RazonamientoLlamada a herramientasSalidas estructuradas
En qué destaca
Las categorías en las que este modelo obtiene la mejor clasificación.
No se encontraron categorías mejor clasificadas.
Rendimiento
Latencia y rendimiento medianos medidos en solicitudes recientes.
Rendimiento323 tok/s
Latencia