跳到正文

AIHOT LEADERBOARD

AI 模型排行榜

职业交付件、业务流程、金融、法律、投行咨询长任务、客服、数据分析与医疗编码,看专业工作能不能交付。

10 项评测 · 4 家机构 · 10/10 08:06 更新

数据同步自 AIHOT 官方模型榜 ↗,沿用官方排名与评分。

专业办公榜 30 个模型

名次模型
01Gemini 4 ArgonGoogle76.4
02Claude Opus 5.5Anthropic71.3
03Claude Sonnet 5.5Anthropic70.5
04Claude Fable 5.1Anthropic70.1
05Claude Opus 5Anthropic68.9
06Claude Fable 5Anthropic68.7
07Muse Spark 1.3Meta68.3
08GPT-6 AstraOpenAI67.2
09Gemini 3.7 FlashGoogle65.9
10Grok 4.6xAI65.8
11GPT-6.1 SolOpenAI65.8
12Gemini 3.8 FlashGoogle65.2
13MiMo-V2.6-ProXiaomi65.2
14Grok 4.7xAI64.4
15Kimi K3Moonshot AI开源权重 ↗63.8
16Qwen3.8 MaxAlibaba63.5
17GPT-6 SolOpenAI62.9
18MiMo V 2.6 FlashXiaomi62.8
19GLM-5.3Z.ai开源权重 ↗62.7
20GPT-5.6 SolOpenAI62.7
21GLM-5.3 FlashZ.ai开源权重 ↗62.7
22Claude Opus 4.7Anthropic62.6
23Claude Opus 4.8Anthropic62.4
24Qwen3.8 Flash NextAlibaba62.2
25Muse Spark 1.2Meta62.1
26Step 5 PreviewStepFun61.8
27GPT-5.6 TerraOpenAI61.6
28DeepSeek V4.1 FlashDeepSeek开源权重 ↗61.1
29GPT-5.5OpenAI60.9
30Grok 4.5xAI60.7

AIHOT 评分把各家评测换算到同一条能力刻度上:50 分是参照组模型的平均水平,每 15 分约是一个标准差。评分不是正确率。分类评分是模型在这个领域的能力,只列这个领域测得够多的模型。 价格为 API 参考报价,原始出处见模型详情。