哈喽,大家好,我是刘小排。
Opus 5出来已经超过24小时了,好多朋友让我测评一下。嗯,我已经狂蹬了24小时了,24小时就使用了周额度的72%。
非常幸运,昨天突然出现了Opus 5,因为正好我有一个新产品开始启动了,我和它完成了产品定位、技术架构、竞品分析和MVP拆解。同样的任务,上周我用GPT-5.6,一直觉得不够游刃有余。
一天之内了使用了28亿 Token的Opus 5,以下是我的感受:
- Opus 5 大多数能力超过降智回归后的Fable 5(也就是现在我们普通屁民能用到的Fable 5),价格比Fable 5更便宜。我没有理由继续用Fable 5了。
- Opus 5对GPT-5.6 Sol 并不是全方位碾压!复杂后端逻辑、架构设计,Opus 5 不如 GPT-5.6 Sol。
- Opus 5更适合执行有及时反馈的任务,比如跟你一边讨论一边干活;GPT-5.6 Sol更适合长时间无人托管的长程任务。Opus 5 在 Claude Code 里非常像一个可以讨论方案的同事。这是GPT-5.6系列模型一直没有做到的。
- Opus 5的思考力度尽量不要选择Max,用Extra就非常好了。Anthropic自己也承认,Max很容易“想多了”。
- Opus 5有点“过于主动”,太积极,容易扩大任务范围,容易“好心办大事”。我不确定这是好事还是坏事,不过目前我是尽量限制他,不要花时间研究我没提到的任务。
- Opus 5偶尔会给出逻辑完整、语气自信,但因果判断错误的分析;Opus 4.8和Fable 5并不容易出这个问题。
- Opus 5更像有产品感、会沟通的、有深厚技术背景的资深产品经理;GPT‑5.6 Sol更像执行力强、适合压测和审查、只会干活、没有感情、没有生活的的工程机器。
- 总评
- 产品开发综合体验:Opus 5 胜过 GPT-5.6 Sol。
- 纯编码的工程执行力:GPT-5.6 Sol 仍略胜 Opus 5。
- 模型总体能力:同一级别,暂时没有谁全面赢。
按照我的使用场景,我做了一个简明扼要的分类
我知道你可能会在评论区问我:如果只选一个,选哪一个?
我自己想了很久,发现难以回答。
我发现,AI工程师正在分化:一种负责陪你创造,一种负责帮你执行。
注:可能还有一种,负责审美。(一件很多人没注意到的小事:Kimi K3的前端审美仍然是世界第一,超过Opus 5和Fable 5)
你的感受如何呢?欢迎评论区讨论
