模型榜
全球主流模型在不同维度上的排名。每个榜都注明数据来源和更新日期,名次变化与上一期对比。
数据来源:Artificial Analysis,通过其官方数据 API 获取,每日更新。分数与方法论以该站为准。
Agent榜
工具调用与长任务能力指数单位:分- 1Claude Fable 5.1Max Effort
Anthropic · 海外 · 文本
57.9 - 2Claude Opus 5Max Effort
Anthropic · 海外 · 文本
56.5 - 3Qwen3.8 Max0902
Alibaba · 国内 · 文本
56.0 - 4Muse Spark 1.3max
Meta · 海外 · 文本
55.5 - 5Qwen3.8-Flash-Next
Alibaba · 国内 · 文本
53.6 - 6ZGLM-5.3max
Z AI · 国内 · 文本
53.1 - 7SGrok 4.6high
SpaceXAI · 海外 · 文本
53.0 - 8OGPT-6 Astramax
OpenAI · 海外 · 文本
51.0 - 9ZGLM 5.3 Flash
Z AI · 国内 · 文本
50.9 - 10Claude Fable 5Max Effort, Opus 4.8 Fallback
Anthropic · 海外 · 文本
50.7 - 11OGPT-5.6 Solmax
OpenAI · 海外 · 文本
50.2 - 12Qwen3.8 2.4T A95B
Alibaba · 国内 · 文本
50.1 - 13KKimi K3max
Kimi · 国内 · 文本
50.0 - 14DeepSeek V4 Flash VisionReasoning, Max Effort
DeepSeek · 国内 · 文本
47.5 - 15Qwen3.8 27Bxhigh
Alibaba · 国内 · 文本
45.8 - 16Claude Sonnet 5Max Effort
Anthropic · 海外 · 文本
43.6 - 17Muse Spark 1.2xhigh
Meta · 海外 · 文本
43.2 - 18OGPT-5.6 Terramax
OpenAI · 海外 · 文本
43.2 - 19OGPT-5.6 Lunamax
OpenAI · 海外 · 文本
42.1 - 20Claude Opus 4.8Max Effort
Anthropic · 海外 · 文本
41.9 - 21DeepSeek V4 Pro 0813Reasoning, Max Effort
DeepSeek · 国内 · 文本
41.3 - 22SGrok 4.5high
SpaceXAI · 海外 · 文本
41.2 - 23DeepSeek V4 Flash 0731Reasoning, Max Effort
DeepSeek · 国内 · 文本
41.0 - 24Gemini 3.8 Flashhigh
Google · 海外 · 文本
40.2 - 25IK2 Horizon 375B A23B
Institute of Foundation Models · 国内 · 文本
40.0 - 26Claude Opus 4.7Max Effort
Anthropic · 海外 · 文本
38.6 - 27ZGLM-5.2max
Z AI · 国内 · 文本
38.4 - 28OGPT-5.5xhigh
OpenAI · 海外 · 文本
36.4 - 29Gemini 3.7 Flashhigh
Google · 海外 · 文本
35.2 - 30IK2 Horizon MoVA 36B A4B
Institute of Foundation Models · 国内 · 文本
33.5 - 31Claude Sonnet 4.6Max Effort
Anthropic · 海外 · 文本
31.8 - 32MQuasar 438Bmax, based on GLM-5.2
Multiverse Computing · 海外 · 文本
31.4 - 33MMiniMax-M3
MiniMax · 国内 · 文本
29.5 - 34Gemini 3.6 Flashhigh
Google · 海外 · 文本
29.0 - 35ILing-3.0-flash-VL
InclusionAI · 国内 · 文本
28.7 - 36ILing-3.0-flash-Fin
InclusionAI · 国内 · 文本
27.9 - 37DeepSeek V4 Pro 0424Reasoning, Max Effort
DeepSeek · 国内 · 文本
26.3 - 38IK2 Horizon 7B
Institute of Foundation Models · 国内 · 文本
26.1 - 39Gemini 3.5 Flashhigh
Google · 海外 · 文本
26.0 - 40Muse Spark 1.1xhigh
Meta · 海外 · 文本
25.8 - 41THy3
Tencent · 国内 · 文本
24.1 - 42ZGLM-5.1Reasoning
Z AI · 国内 · 文本
23.9 - 43NNex-N2-Probased on Qwen3.5-397B-A17B
Nex AGI · 国内 · 文本
23.7 - 44TInklingxhigh
Thinking Machines · 海外 · 文本
22.5 - 45Qwen3.7 Max
Alibaba · 国内 · 文本
22.5 - 46DeepSeek V4 Flash 0420Reasoning, Max Effort
DeepSeek · 国内 · 文本
22.2 - 47MiMo-V2.5-Pro
Xiaomi · 国内 · 文本
21.3 - 48KKimi K2.7 Code
Kimi · 国内 · 文本
21.0 - 49KKimi K2.6
Kimi · 国内 · 文本
20.5 - 50Nemotron 3 Ultra 550B A55BReasoning
NVIDIA · 海外 · 文本
20.1
Artificial Analysis · 更新于 2026-09-24 · 名次变化与上一期相比,“新”为本期新上榜 · 仅收录每个维度前 50 名 · 在 Artificial Analysis 查看完整榜单