Claude Haiku 5.5
Anthropic · 上线 2026-10-07 · 官方数据 10/10 08:06
综合评分
60.1
第 26 名 · 覆盖 93%
API 参考价格 / 百万 Token
输入 — · 输出 —
缓存 —
分类成绩
编程 · 62.5 分 · 第 14 名
科研 · 62.4 分 · 第 19 名
专业办公 · 60.1 分 · 第 32 名
知识问答 · 51.2 分 · 第 46 名
编程评测证据
- ProgramBench ↗2.5%
Vals AI · Max 推理
- Vibe Code Bench v1.1 ↗90.4%
Vals AI · Max 推理
- CyberBench Patch v1.1 ↗89.3%
Vals AI · Max 推理
- Terminal-Bench 4.0 ↗35.4%
Vals AI · Max 推理
- Terminal-Bench 4.0 ↗32.8%
Artificial Analysis · Max 推理
- Vibe Code Bench 1–100 ↗20.4%
Vals AI · Max 推理
- Code Migration ↗44.6%
Vals AI · Max 推理
- LiveBench Coding ↗77.9%
LiveBench · Max 推理
- SciCode ↗55.0%
Artificial Analysis · Max 推理
科研评测证据
- MysteryMechanism ↗35.1%
Vals AI · Max 推理
- Terminal-Bench Science ↗20.0%
Artificial Analysis · Max 推理
- FrontierMath T1–3 ↗75.1%
Epoch AI · Max 推理
- CritPt ↗18.9%
Artificial Analysis · Max 推理
- Terminal-Bench Science ↗10.0%
Vals AI · Max 推理
- Humanity's Last Exam ↗44.4%
Artificial Analysis · Max 推理
- Mystery Game Puzzles ↗30.0%
Epoch AI · Max 推理
- LiveBench Reasoning ↗84.6%
LiveBench · Max 推理
专业办公评测证据
- AA-Briefcase ↗1,577.1
Artificial Analysis · Max 推理
- GDPval-AA ↗1,618.1
Artificial Analysis · Max 推理
- τ³-Banking ↗43.0%
Mercor · Max 推理
- APEX-Agents ↗56.1%
Mercor · Max 推理 · loop_truncated_tools_agent · apex-agents:v1.1:loop_truncated_tools_agent
- MedCode ↗51.5%
Vals AI · Max 推理
- Finance Agent ↗54.1%
Vals AI · Max 推理
- Harvey 法律 Agent 基准 ↗1.3%
Vals AI · Max 推理
- AutomationBench-AA ↗35.4%
Artificial Analysis · Max 推理
- LiveBench Data Analysis ↗51.8%
LiveBench · Max 推理
知识问答评测证据
- MLCR-AA ↗63.3%
Artificial Analysis · Max 推理
- AA-LCR ↗82.7%
Artificial Analysis · Max 推理
- AA-Omniscience ↗10.7
Artificial Analysis · Max 推理
- LiveBench IF ↗54.7%
LiveBench · Max 推理
- LiveBench Language ↗62.6%
LiveBench · Max 推理
- SimpleQA Verified ↗23.8%
Epoch AI · Max 推理
同步自 AIHOT 官方模型详情 ↗,保留官方评分和原始评测出处。