跳转到内容

模型:Claude Opus 5

来自封神榜 Wiki
名称 Claude Opus 5
厂商 Anthropic
发布日期 2026-07-24
上下文 1M
最大输出 128000
价格 $5/$25
定位 推理破局旗舰

claude-opus-5claude96.5长程任务、推理、性价比

模型content/models/claude-opus-5.md

一句话点评

Benchmark 全面登顶的「ADHD 模型」——分数碾压、体感两极,长程任务全场最佳。

社区反馈 · 编程

两极分化:SWE-bench 97% 领跑、长程出色;但「RL-fried 易犯错」帖获 110 赞。社区发现 medium effort + /doctor 精简配置可大幅改善体感。

社区反馈 · 推理

核心卖点:ARC-AGI-3 以 30.16% 刷新历史纪录(约为第二名 4 倍);亦有用户指出「推理方向对,执行方式跑偏」。

社区反馈 · 中文

中文社区讨论聚焦编程与性价比,中文创作/理解专项反馈较少,无明显负面。

升级共识

长程 agentic 编程值得升级;简单编码/日常任务建议 medium effort,或留在 Opus 4.6。

榜单与实测落差

SWE-bench 97% 登顶,日常却被批「ADHD 模型」——典型「分数高、体感差」。根因是 overthink 在极限测试中加分、在简单任务中成为负担;medium effort + /doctor 可缓解。

数据来源

本页由仓库 content/models/claude-opus-5.md 初始化。后续修订通过公开审核队列发布。