GPT-5.6 Terra
OpenAI · 上线 2026-07-09 · 官方数据 10/10 08:06
综合评分
62.1
第 20 名 · 覆盖 96%
API 参考价格 / 百万 Token
输入 ¥13.38 · 输出 ¥80.31
缓存 ¥1.34
厂商价格出处 ↗分类成绩
编程 · 61.4 分 · 第 18 名
科研 · 66.0 分 · 第 11 名
专业办公 · 61.6 分 · 第 27 名
知识问答 · 59.8 分 · 第 27 名
编程评测证据
- ProgramBench ↗0.5%
Vals AI · Max 推理
- Terminal-Bench 4.0 ↗35.4%
Artificial Analysis · Max 推理
- CyberBench Patch v1.1 ↗87.5%
Vals AI · Max 推理
- Code Migration ↗47.8%
Vals AI · Max 推理
- Vibe Code Bench v1.1 ↗74.6%
Vals AI · Max 推理
- Terminal-Bench 4.0 ↗22.7%
Vals AI · Max 推理
- Vibe Code Bench 1–100 ↗14.8%
Vals AI · Max 推理
- LiveBench Coding ↗78.2%
LiveBench · Max 推理
- SciCode ↗55.0%
Artificial Analysis · Max 推理
科研评测证据
- Chess Puzzles ↗54.0%
Epoch AI · Max 推理
- FrontierMath T1–3 ↗86.0%
Epoch AI · Max 推理
- CritPt ↗30.0%
Artificial Analysis · Max 推理
- LiveBench Reasoning ↗90.6%
LiveBench · Max 推理
- Mystery Game Puzzles ↗35.0%
Epoch AI · Max 推理
- Terminal-Bench Science ↗13.8%
Artificial Analysis · Max 推理
- Terminal-Bench Science ↗10.0%
Vals AI · Max 推理
- Humanity's Last Exam ↗42.9%
Artificial Analysis · Max 推理
专业办公评测证据
- LiveBench Data Analysis ↗79.3%
LiveBench · Max 推理
- APEX-Agents ↗58.2%
Mercor · Max 推理 · loop_truncated_tools_agent · apex-agents:v1.1:loop_truncated_tools_agent
- AutomationBench-AA ↗59.6%
Artificial Analysis · Max 推理
- τ³-Banking ↗38.8%
Mercor · Max 推理
- Finance Agent ↗54.4%
Vals AI · Max 推理
- AA-Briefcase ↗1,334
Artificial Analysis · Max 推理
- GDPval-AA ↗1,451.2
Artificial Analysis · Max 推理
- Harvey 法律 Agent 基准 ↗0.8%
Vals AI · Max 推理
- MedCode ↗43.4%
Vals AI · xHigh 推理
知识问答评测证据
- MLCR-AA ↗31.7%
Artificial Analysis · Max 推理
- LiveBench Language ↗82.9%
LiveBench · Max 推理
- BullshitBench v2 ↗54.0%
BullshitBench · Max 推理
- AA-LCR ↗83.0%
Artificial Analysis · Max 推理
- LiveBench IF ↗64.6%
LiveBench · Max 推理
- SimpleQA Verified ↗43.2%
Epoch AI · Max 推理
- AA-Omniscience ↗0.1
Artificial Analysis · Max 推理
真人盲选评测证据
- Arena Text ↗1,465.8
LMArena · xHigh 推理
同步自 AIHOT 官方模型详情 ↗,保留官方评分和原始评测出处。