Overall Intelligence Leaderboard

Multi-source blend of general intelligence benchmarks into a single AISOTA score.

Data as of 2026-09-2850 models
#ModelArtificial AnalysisLiveBenchAISOTA Score
1SOTAclaude-fable-5-1-max-effort—98.498.4
2claude-fable-5-max-effort—96.896.8
3gpt-6-astra-max—95.295.2
4muse-spark-1.3-xhigh—93.593.5
5claude-opus-5-5-xhigh-effort—91.991.9
6gpt-5.6-sol-max—90.390.3
7deepseek-v4.1-flash-max—88.788.7
8gpt-5.5-xhigh—87.187.1
9claude-opus-5-max-effort—85.585.5
10gemini-3.7-flash-high—83.983.9
11gpt-6-sol-max—82.382.3
12smaug-agentic—80.680.6
13qwen3.8-max—79.079.0
14kimi-k3—77.477.4
15grok-4.6—75.875.8
16muse-spark-1.2-xhigh—74.274.2
17gpt-5.4-xhigh—72.672.6
18gpt-5.6-terra-max—71.071.0
19grok-4.7-xhigh—69.469.4
20deepseek-v4-pro-0813—67.767.7
21smaug-flash—66.166.1
22gemini-3.1-pro-preview-high—64.564.5
23deepseek-v4-flash-vision-exp—62.962.9
24smaug-mini—61.361.3
25gemini-3.8-flash-high—59.759.7
26qwen3.8-flash-next—58.158.1
27claude-opus-4-8-max-effort—56.556.5
28grok-4.5—54.854.8
29claude-opus-4-7-xhigh-effort—53.253.2
30glm-5.3—51.651.6
31claude-sonnet-5-xhigh-effort—50.050.0
32union-alpha—48.448.4
33muse-spark-1.1-xhigh—46.846.8
34qwen3.8-27b—45.245.2
35gemini-3.5-flash-high—43.543.5
36gpt-5.2-2025-12-11-high—41.941.9
37claude-opus-4-6-thinking-auto-high-effort—40.340.3
38deepseek-v4-flash-0731—38.738.7
39gemini-3.6-flash-high—37.137.1
40qwen3.7-max—35.535.5
41gpt-5.2-codex—33.933.9
42gpt-5.6-luna-max—32.332.3
43claude-sonnet-4-6-thinking-auto-medium-effort—30.630.6
44glm-5.2—29.029.0
45claude-opus-4-5-20251101-thinking-64k-high-effort—27.427.4
46inkling-xhigh—25.825.8
47deepseek-v4-pro—24.224.2
48gpt-6-luna-max—22.622.6
49glm-5.3-flash—21.021.0
50kimi-k2.6-thinking—19.419.4