Ling 3.0 Flash
InclusionAI · 1 configuration
Intelligence20.1
Input / 1M$0.08
Output / 1M$0.22
Context262.1K
Tariff: InclusionAI · Source: artificial-analysis · USD per million tokens
Thinking configuration
What does more thinking buy you?
Compare this model’s measured thinking configurations.
Scroll the chart ↔ · tap a point for details
Efficient frontier: best measured score at each cost1 measured configurations · 0 without both values
Selected: thinking thinking · Click a point to switch configuration
*Ling-3.0-flash* is a *124B-parameter Mixture-of-Experts (MoE) model*, with approximately *5.1B parameters activated per token*. The model is designed with *token efficiency and production-scale agentic inference* as key priorities, enabling developers...
Intelligence IndexArtificial Analysis composite index, not a percentage. Different versions of the index are not directly comparable.
20.1 pointsGPQA DiamondGraduate-level scientific questions. Measures specialist reasoning rather than web-search quality.
85.5 %Humanity’s Last ExamDifficult questions across many disciplines, compared under the same evaluation setup.
23.7 %SciCodeCode generation for scientific research problems.
42.0 %Terminal-Bench 2.1Agent tasks in a terminal environment. Results also depend on the evaluation harness.
55.4 %Omniscience accuracyFactual accuracy in Artificial Analysis's Omniscience evaluation.
18.2 %Specifications from the catalog
Inputtext
Outputtext
Tool callingYes
Structured outputNo
Speed325.4 tok/s
First token3.04 s
Maximum output32.8K
Catalog listing date2026-07-23