来了!Opus 5 模型发布,价格跟 Opus 4.8 相同
在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。
Opus 5 在 Agent 编程终端任务中拿到 43.3%,高于 Fable 5 的 33.7% 和 GPT-5.6 Sol 的 34.4%;在电脑操作上达到 70.6%,业务流程任务也从 Opus 4.8 的 17.0% 提升到 26.0%。
另外,它在新型问题求解上取得 30.2%,明显领先 GPT-5.6 Sol 的 7.8% 和 Opus 4.8 的 1.5%。
搞笑的是 Agentic coding 这个分数上 Opus 5 得分 53.4% 居然标注了大于 Fable 5 的 53.5%,不会是让 Opus 5 做的图吧。
终于有个能用的模型了!
要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样
详情:anthropic.com/news/claude-opus-5
- 公众号:歸藏的AI工具箱
- 发布时间:2026-07-25T01:20:33+08:00
- 微信链接:https://mp.weixin.qq.com/s/u0kroqWKPxQkYbxLiJKhRA
- RSS ID:3540975510-2247497545_1
- Feed ID:MP_WXS_3540975510
- Glance 当前首页可见:是
来了!Opus 5 模型发布,价格跟 Opus 4.8 相同
在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。
Opus 5 在 Agent 编程终端任务中拿到 43.3%,高于 Fable 5 的 33.7% 和 GPT-5.6 Sol 的 34.4%;在电脑操作上达到 70.6%,业务流程任务也从 Opus 4.8 的 17.0% 提升到 26.0%。
另外,它在新型问题求解上取得 30.2%,明显领先 GPT-5.6 Sol 的 7.8% 和 Opus 4.8 的 1.5%。
搞笑的是 Agentic coding 这个分数上 Opus 5 得分 53.4% 居然标注了大于 Fable 5 的 53.5%,不会是让 Opus 5 做的图吧。
终于有个能用的模型了!
要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样
详情:anthropic.com/news/claude-opus-5