Ling 3.0 Flash
InclusionAI🇨🇳
inclusionai/ling-3.0-flashLing 3.0 Flash is InclusionAI's (Ant Group) successor to Ling 2.6 Flash, a hybrid-reasoning Mixture-of-Experts model (~124B total, ~5.1B active) combining Kimi Delta Attention with Multi-Head Latent Attention for efficient long-range memory. It supports both thinking and non-thinking modes with a native 262K context, suited for fast general-purpose coding and agentic tasks.
Taux de coût
0.1x
Contexte
262K
Date de sortie
23 juil. 2026
Entrée
Text
Sortie
Text
Prise en charge
RaisonnementAppel d'outilsSorties structurées
Meilleur en
Les catégories où ce modèle se classe le mieux.
Aucune catégorie classée en tête trouvée.
Performances
Latence et débit médians mesurés sur les requêtes récentes.
Débit352 tok/s
Latence