Qwen3.8 Max (0902)
New language model evaluation results available — Intelligence Index: 45
Latest updates from supported sources.
New language model evaluation results available — Intelligence Index: 45
New language model evaluation results available — Intelligence Index: 26
New language model evaluation results available — Intelligence Index: 21
New language model evaluation results available — Intelligence Index: 16
New language model evaluation results available — Intelligence Index: 3
New language model evaluation results available
New language model evaluation results available — Intelligence Index: 40
New language model evaluation results available — Intelligence Index: 25
Artificial Analysis Intelligence Index methodology — Category weights are unchanged from v4.2: Agents 30%, Coding 20%, General 30%, Scientific Reasoning 20%.
New article published — We are upgrading Terminal-Bench to 4.0 and adding AutomationBench-AA, an agentic workflow automation benchmark with a private test set. This is a continuation of our rollout of Intelligence Index v5.
New language model evaluation results available — Intelligence Index: 13
New article published — OpenBMB releases MiniCPM5-2B
New article published — We are accelerating elements of our upcoming v5 release with interim updates to keep pace with the frontier. Index v4.2 has more complex and realistic tasks, and more private test sets to prevent gaming
New article published — GPT-6 Astra ties leadership with Claude Fable 5.1 in both of our flagship Indices, at lower cost. Astra equals Fable 5.1 in the Intelligence Index at ~40% of the cost, and in the Coding Agent Index at ~60% of the cost.
New language model evaluation results available — Intelligence Index: 53
New language model evaluation results available — Intelligence Index: 53
New language model evaluation results available — Intelligence Index: 51
New language model evaluation results available — Intelligence Index: 50
New language model evaluation results available — Intelligence Index: 46
New language model evaluation results available — Intelligence Index: 45