跳到正文

AIHOT LEADERBOARD

AI 模型排行榜

只用第三方评测机构给所有模型统一跑的成绩,换算到同一条能力刻度上:编程 40%、科研 20%、专业办公 20%、知识问答 15%、真人盲选 5%。

35 项评测 · 7 家机构 · 10/10 08:06 更新

数据同步自 AIHOT 官方模型榜 ↗,沿用官方排名与评分。

综合榜 30 个模型

名次模型
01Claude Opus 5.5Anthropic73.9
02Gemini 4 ArgonGoogle73.5
03Claude Fable 5.1Anthropic72.2
04Claude Sonnet 5.5Anthropic71.4
05GPT-6 AstraOpenAI71.3
06Claude Fable 5Anthropic69.9
07GPT-6.1 SolOpenAI69.0
08Claude Opus 5Anthropic68.9
09GPT-5.6 SolOpenAI65.9
10GPT-6 SolOpenAI65.6
11Muse Spark 1.3Meta65.6
12Gemini 3.8 FlashGoogle64.4
13Kimi K3Moonshot AI开源权重 ↗63.2
14Claude Opus 4.8Anthropic63.0
15MiMo-V2.6-ProXiaomi62.9
16Gemini 3.7 FlashGoogle62.8
17GLM-5.3Z.ai开源权重 ↗62.4
18GPT-5.5OpenAI62.3
19Claude Opus 4.7Anthropic62.1
20GPT-5.6 TerraOpenAI62.1
21Grok 4.7xAI61.6
22Grok 4.6xAI61.2
23Muse Spark 1.2Meta61.1
24Step 5 PreviewStepFun60.5
25DeepSeek V4.1 FlashDeepSeek开源权重 ↗60.4
26Claude Haiku 5.5Anthropic60.1
27DeepSeek V4 Pro 0813DeepSeek开源权重 ↗58.8
28Claude Sonnet 5Anthropic58.7
29Qwen3.8 MaxAlibaba58.6
30Muse Spark 1.1Meta58.5

AIHOT 评分把各家评测换算到同一条能力刻度上:50 分是参照组模型的平均水平,每 15 分约是一个标准差。评分不是正确率。 价格为 API 参考报价,原始出处见模型详情。