Opus 5 和 GPT-5.6 Sol 到底谁更强?
根据 @刘小排 28亿token的测试,感受如下:
- Opus 5 大多数能力超过降智回归后的Fable 5(也就是现在我们普通屁民能用到的Fable 5),价格比Fable 5更便宜。我没有理由继续用Fable 5了。
- Opus 5对GPT-5.6 Sol 并不是全方位碾压!复杂后端逻辑、架构设计,Opus 5 不如 GPT-5.6 Sol。
- Opus 5更适合执行有及时反馈的任务,比如跟你一边讨论一边干活;GPT-5.6 Sol更适合长时间无人托管的长程任务。Opus 5 在 Claude Code 里非常像一个可以讨论方案的同事。这是GPT-5.6系列模型一直没有做到的。
- Opus 5的思考力度尽量不要选择Max,用Extra就非常好了。Anthropic自己也承认,Max很容易“想多了”。
- Opus 5有点“过于主动”,太积极,容易扩大任务范围,容易“好心办大事”。我不确定这是好事还是坏事,不过目前我是尽量限制他,不要花时间研究我没提到的任务。
- Opus 5偶尔会给出逻辑完整、语气自信,但因果判断错误的分析;Opus 4.8和Fable 5并不容易出这个问题。
- Opus 5更像有产品感、会沟通的、有深厚技术背景的资深产品经理;GPT‑5.6 Sol更像执行力强、适合压测和审查、只会干活、没有感情、没有生活的的工程机器。
总评:
- 产品开发综合体验:Opus 5 胜过 GPT-5.6 Sol。
- 纯编码的工程执行力:GPT-5.6 Sol 仍略胜 Opus 5。
- 模型总体能力:同一级别,暂时没有谁全面赢。
评论 (0)
还没有评论,来发第一条吧