跳到正文

AIHOT LEADERBOARD

AI 模型排行榜

事实准确、长文理解、语言与按要求作答、识破错误前提,看模型知道多少、答得多稳。

6 项评测 · 4 家机构 · 10/11 14:06 更新

数据同步自 AIHOT 官方模型榜 ↗,沿用官方排名与评分。

知识问答榜 30 个模型

名次模型
01GPT-6 AstraOpenAI74.7
02Claude Fable 5.1Anthropic74.5
03Claude Fable 5Anthropic73.6
04Claude Opus 5.5Anthropic72.7
05Gemini 4 ArgonGoogle72.4
06Claude Opus 5Anthropic71.9
07GPT-6.1 SolOpenAI71.8
08Gemini 3.8 FlashGoogle71.1
09Muse Spark 1.3Meta68.1
10Kimi K3Moonshot AI开源权重 ↗68.0
11GPT-5.6 SolOpenAI65.6
12Claude Opus 4.8Anthropic65.5
13Gemini 3.7 FlashGoogle65.3
14GPT-6 SolOpenAI64.0
15Claude Sonnet 5.5Anthropic63.5
16GPT-5.5OpenAI63.3
17Gemini 3.1 Pro PreviewGoogle63.3
18Grok 4.6xAI62.5
19GLM-5.3Z.ai开源权重 ↗62.4
20Muse Spark 1.2Meta62.3
21Claude Opus 4.7Anthropic62.2
22Grok 4.7xAI62.1
23Gemini 3.6 FlashGoogle61.0
24Grok 4.5xAI60.7
25Gemini 3.5 FlashGoogle60.6
26Step 5 PreviewStepFun60.0
27GPT-5.6 TerraOpenAI59.8
28DeepSeek V4.1 FlashDeepSeek开源权重 ↗59.8
29Qwen3.7 MaxAlibaba59.7
30MiMo-V2.6-ProXiaomi开源权重 ↗59.6

AIHOT 评分把各家评测换算到同一条能力刻度上:50 分是参照组模型的平均水平,每 15 分约是一个标准差。评分不是正确率。分类评分是模型在这个领域的能力,只列这个领域测得够多的模型。 价格为 API 参考报价,原始出处见模型详情。