综合能力排行榜

融合多平台综合评测,汇成一个 AISOTA 综合分。

数据截止 2026-09-1350 个模型
排名模型Artificial AnalysisLiveBenchAISOTA 分
1SOTAClaude Fable 5.1 (max with fallback)2 sources95.098.296.6
2GPT-6 Astra (max)2 sources90.094.792.3
3Claude Fable 5 (with fallback)2 sources80.096.588.3
4gpt-5.5-xhigh87.787.7
5Claude Opus 5 (max)2 sources85.086.085.5
6gemini-3.7-flash-high84.284.2
7Muse Spark 1.3 (max)2 sources75.093.084.0
8smaug-agentic82.582.5
9qwen3.8-max80.780.7
10GPT-5.6 Sol (max)2 sources70.091.280.6
11muse-spark-1.2-xhigh75.475.4
12gpt-5.4-xhigh73.773.7
13Grok 4.6 (high)2 sources60.077.268.6
14smaug-flash68.468.4
15Kimi K3 (max)2 sources55.078.967.0
16gemini-3.1-pro-preview-high66.766.7
17deepseek-v4-flash-vision-exp64.964.9
18smaug-mini63.263.2
19GPT-5.6 Terra (max)2 sources50.071.961.0
20DeepSeek V4.1 Flash (max)2 sources30.089.559.8
21qwen3.8-flash-next59.659.6
22GLM-5.3 (max)2 sources65.052.658.8
23claude-opus-4-8-max-effort57.957.9
24grok-4.556.156.1
25claude-opus-4-7-xhigh-effort54.454.4
26claude-sonnet-5-xhigh-effort50.950.9
27Gemini 3.8 Flash (high)2 sources40.061.450.7
28muse-spark-1.1-xhigh49.149.1
29gemini-3.5-flash-high45.645.6
30DeepSeek V4 Pro 0813 (max)2 sources20.070.245.1
31gpt-5.2-2025-12-11-high43.943.9
32claude-opus-4-6-thinking-auto-high-effort42.142.1
33deepseek-v4-flash-073140.440.4
34gemini-3.6-flash-high38.638.6
35qwen3.7-max36.836.8
36gpt-5.2-codex35.135.1
37Qwen3.8 2.4T A95B35.035.0
38GLM-5.3-Flash2 sources45.022.833.9
39claude-sonnet-4-6-thinking-auto-medium-effort31.631.6
40Qwen3.8 27B (xhigh)2 sources15.047.431.2
41glm-5.229.829.8
42GPT-5.6 Luna (max)2 sources25.033.329.1
43claude-opus-4-5-20251101-thinking-64k-high-effort28.128.1
44deepseek-v4-pro24.624.6
45kimi-k2.6-thinking21.121.1
46gpt-5.4-nano-xhigh19.319.3
47ox-alpha-max17.517.5
48qwen3.6-plus15.815.8
49kimi-k2.7-code14.014.0
50Inkling2 sources0.026.313.2