来了!Opus 5 模型发布,价格跟 Opus 4.8 相同

在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。

Opus 5 在 Agent 编程终端任务中拿到 43.3%,高于 Fable 5 的 33.7% 和 GPT-5.6 Sol 的 34.4%;在电脑操作上达到 70.6%,业务流程任务也从 Opus 4.8 的 17.0% 提升到 26.0%。

另外,它在新型问题求解上取得 30.2%,明显领先 GPT-5.6 Sol 的 7.8% 和 Opus 4.8 的 1.5%。

搞笑的是 Agentic coding 这个分数上 Opus 5 得分 53.4% 居然标注了大于 Fable 5 的 53.5%,不会是让 Opus 5 做的图吧。

终于有个能用的模型了!

要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样

详情:anthropic.com/news/claude-opus-5


来了!Opus 5 模型发布,价格跟 Opus 4.8 相同

在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。

Opus 5 在 Agent 编程终端任务中拿到 43.3%,高于 Fable 5 的 33.7% 和 GPT-5.6 Sol 的 34.4%;在电脑操作上达到 70.6%,业务流程任务也从 Opus 4.8 的 17.0% 提升到 26.0%。

另外,它在新型问题求解上取得 30.2%,明显领先 GPT-5.6 Sol 的 7.8% 和 Opus 4.8 的 1.5%。

搞笑的是 Agentic coding 这个分数上 Opus 5 得分 53.4% 居然标注了大于 Fable 5 的 53.5%,不会是让 Opus 5 做的图吧。

终于有个能用的模型了!

要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样

详情:anthropic.com/news/claude-opus-5