inclusionAI: Ling 3.0 Flash

*Ling-3.0-flash* is a *124B-parameter Mixture-of-Experts (MoE) model*, with approximately *5.1B parameters activated per token*. The model is designed with *token efficiency and production-scale agentic inference* as key priorities, enabling developers...

inclusionAI: Ling 3.0 Flash — inclusionAI. Context window 262,144 tokens. API pricing (per 1M tokens): Input $0.021, Output $0.063. License: Proprietary.

Benchmarks · API pricing (per 1M tokens)

ProviderinclusionAI
API model IDinclusionai/ling-3.0-flash
TierFrontier
Context window262,144 tokens
Max output32,768 tokens
LicenseProprietary
API pricing (per 1M tokens) · Input$0.021
API pricing (per 1M tokens) · Output$0.063
Compare in the full catalog