Model dossier

inclusionAI: Ling 3.0 Flash

*Ling-3.0-flash* is a *124B-parameter Mixture-of-Experts (MoE) model*, with approximately *5.1B parameters activated per token*. The model is designed with *token efficiency and production-scale agentic inference* as key priorities, enabling developers...

Context262,144
Max output32,768
Pricing viewTVP price

inclusionAI: Ling 3.0 Flash

Model ID
inclusionai/ling-3.0-flash
Canonical slug
inclusionai/ling-3.0-flash-20260723
Knowledge cutoff
n/a
Created
7/23/2026
texttoolsstructured
text->texttext
Context262,144
Max output32,768
TokenizerOther