Ling 3.0 Flash
InclusionAI🇨🇳
inclusionai/ling-3.0-flashLing 3.0 Flash is InclusionAI's (Ant Group) successor to Ling 2.6 Flash, a hybrid-reasoning Mixture-of-Experts model (~124B total, ~5.1B active) combining Kimi Delta Attention with Multi-Head Latent Attention for efficient long-range memory. It supports both thinking and non-thinking modes with a native 262K context, suited for fast general-purpose coding and agentic tasks.
Taxa de custo
0.1x
Contexto
262K
Lançamento
23 de jul. de 2026
Entrada
Text
Saída
Text
Suporte
RaciocínioChamada de ferramentasSaídas estruturadas
Melhor em
As categorias em que este modelo tem o melhor desempenho.
Nenhuma categoria de destaque encontrada.
Desempenho
Latência e vazão medianas medidas em solicitações recentes.
Vazão323 tok/s
Latência