模型:Claude Opus 5
外观
| 名称 | Claude Opus 5 |
|---|---|
| 厂商 | Anthropic |
| 发布日期 | 2026-07-24 |
| 上下文 | 1M |
| 最大输出 | 128000 |
| 价格 | $5/$25 |
| 定位 | 推理破局旗舰 |
claude-opus-5claude96.5长程任务、推理、性价比
模型content/models/claude-opus-5.md
一句话点评
Benchmark 全面登顶的「ADHD 模型」——分数碾压、体感两极,长程任务全场最佳。
社区反馈 · 编程
两极分化:SWE-bench 97% 领跑、长程出色;但「RL-fried 易犯错」帖获 110 赞。社区发现 medium effort + /doctor 精简配置可大幅改善体感。
社区反馈 · 推理
核心卖点:ARC-AGI-3 以 30.16% 刷新历史纪录(约为第二名 4 倍);亦有用户指出「推理方向对,执行方式跑偏」。
社区反馈 · 中文
中文社区讨论聚焦编程与性价比,中文创作/理解专项反馈较少,无明显负面。
升级共识
长程 agentic 编程值得升级;简单编码/日常任务建议 medium effort,或留在 Opus 4.6。
榜单与实测落差
SWE-bench 97% 登顶,日常却被批「ADHD 模型」——典型「分数高、体感差」。根因是 overthink 在极限测试中加分、在简单任务中成为负担;medium effort + /doctor 可缓解。
数据来源
本页由仓库 content/models/claude-opus-5.md 初始化。后续修订通过公开审核队列发布。