Qwen3.8 Max
Alibaba · 上线 2026-07-19 · 官方数据 10/10 08:06
综合评分
58.6
第 29 名 · 覆盖 100%
API 参考价格 / 百万 Token
输入 ¥12 · 输出 ¥36
缓存 ¥1.5
厂商价格出处 ↗分类成绩
编程 · 54.7 分 · 第 38 名
科研 · 62.2 分 · 第 21 名
专业办公 · 63.5 分 · 第 16 名
知识问答 · 56.8 分 · 第 33 名
编程评测证据
- ProgramBench ↗0.0%
Vals AI · 来源默认配置
- Terminal-Bench 4.0 ↗34.3%
Vals AI · 来源默认配置
- Terminal-Bench 4.0 ↗18.7%
Artificial Analysis · 来源默认配置
- Vibe Code Bench v1.1 ↗64.7%
Vals AI · 来源默认配置
- Vibe Code Bench 1–100 ↗12.8%
Vals AI · 来源默认配置
- SciCode ↗53.2%
Artificial Analysis · 来源默认配置
- LiveBench Coding ↗72.9%
LiveBench · 来源默认配置
- Code Migration ↗24.0%
Vals AI · 来源默认配置
- CyberBench Patch v1.1 ↗57.1%
Vals AI · 来源默认配置
科研评测证据
- CritPt ↗20.0%
Artificial Analysis · 来源默认配置
- Terminal-Bench Science ↗12.9%
Vals AI · 来源默认配置
- FrontierMath T1–3 ↗74.7%
Epoch AI · xHigh 推理
- Mystery Game Puzzles ↗38.0%
Epoch AI · xHigh 推理
- LiveBench Reasoning ↗88.2%
LiveBench · 来源默认配置
- MysteryMechanism ↗23.9%
Vals AI · 来源默认配置
- Humanity's Last Exam ↗43.0%
Artificial Analysis · 来源默认配置
- Chess Puzzles ↗29.0%
Epoch AI · xHigh 推理
专业办公评测证据
- Harvey 法律 Agent 基准 ↗10.4%
Vals AI · 来源默认配置
- APEX-Agents ↗63.3%
Mercor · xHigh 推理 · loop_truncated_tools_agent · apex-agents:v1.1:loop_truncated_tools_agent
- τ³-Banking ↗46.7%
Mercor · xHigh 推理
- GDPval-AA ↗1,604.7
Artificial Analysis · 来源默认配置
- LiveBench Data Analysis ↗78.4%
LiveBench · 来源默认配置
- AA-Briefcase ↗1,386.6
Artificial Analysis · 来源默认配置
- AutomationBench-AA ↗49.2%
Artificial Analysis · 来源默认配置
- Finance Agent ↗50.6%
Vals AI · 来源默认配置
- MedCode ↗40.7%
Vals AI · 来源默认配置
知识问答评测证据
- LiveBench IF ↗74.1%
LiveBench · 来源默认配置
- LiveBench Language ↗79.7%
LiveBench · 来源默认配置
- SimpleQA Verified ↗45.8%
Epoch AI · xHigh 推理
- MLCR-AA ↗19.4%
Artificial Analysis · 来源默认配置
- AA-LCR ↗78.3%
Artificial Analysis · 来源默认配置
- AA-Omniscience ↗3.4
Artificial Analysis · 来源默认配置
- BullshitBench v2 ↗27.0%
BullshitBench · Max 推理
真人盲选评测证据
- Arena Text ↗1,483.3
LMArena · 来源默认配置
同步自 AIHOT 官方模型详情 ↗,保留官方评分和原始评测出处。