Opus 5 和 GPT-5.6 Sol 哪家强?

哈喽,大家好,我是刘小排。

Opus 5出来已经超过24小时了,好多朋友让我测评一下。嗯,我已经狂蹬了24小时了,24小时就使用了周额度的72%。

非常幸运,昨天突然出现了Opus 5,因为正好我有一个新产品开始启动了,我和它完成了产品定位、技术架构、竞品分析和MVP拆解。同样的任务,上周我用GPT-5.6,一直觉得不够游刃有余。

Opus 5 和 GPT-5.6 Sol 哪家强?
Opus 5 和 GPT-5.6 Sol 哪家强?

一天之内了使用了28亿 Token的Opus 5,以下是我的感受:

  1. Opus 5 大多数能力超过降智回归后的Fable 5(也就是现在我们普通屁民能用到的Fable 5),价格比Fable 5更便宜。我没有理由继续用Fable 5了。
  2. Opus 5对GPT-5.6 Sol 并不是全方位碾压!复杂后端逻辑、架构设计,Opus 5 不如 GPT-5.6 Sol。
  3. Opus 5更适合执行有及时反馈的任务,比如跟你一边讨论一边干活;GPT-5.6 Sol更适合长时间无人托管的长程任务。Opus 5 在 Claude Code 里非常像一个可以讨论方案的同事。这是GPT-5.6系列模型一直没有做到的。
  4. Opus 5的思考力度尽量不要选择Max,用Extra就非常好了。Anthropic自己也承认,Max很容易“想多了”。
  5. Opus 5有点“过于主动”,太积极,容易扩大任务范围,容易“好心办大事”。我不确定这是好事还是坏事,不过目前我是尽量限制他,不要花时间研究我没提到的任务。
  6. Opus 5偶尔会给出逻辑完整、语气自信,但因果判断错误的分析;Opus 4.8和Fable 5并不容易出这个问题。
  7. Opus 5更像有产品感、会沟通的、有深厚技术背景的资深产品经理;GPT‑5.6 Sol更像执行力强、适合压测和审查、只会干活、没有感情、没有生活的的工程机器。
  8. 总评
  • 产品开发综合体验:Opus 5 胜过 GPT-5.6 Sol。
  • 纯编码的工程执行力:GPT-5.6 Sol 仍略胜 Opus 5。
  • 模型总体能力:同一级别,暂时没有谁全面赢。

按照我的使用场景,我做了一个简明扼要的分类

任务
推荐模型
产品idea讨论
Opus 5
MVP设计
Opus 5
 竞品调研分析
 Opus 5
快速实现从idea到产品
Opus 5
前端体验
Opus 5
大型陌生代码库理解
Opus 5
 文案类工作
 Opus 5
 脑洞
 Opus 5
复杂后端架构
GPT-5.6 Sol
Debug
GPT-5.6 Sol
代码审查
GPT-5.6 Sol
 浏览器自动化
 GPT-5.6 Sol
 不容出错的严谨任务
 GPT-5.6 Sol
无人值守Agent任务
GPT-5.6 Sol
 对既定目标的长时间Loop
 GPT-5.6 Sol

我知道你可能会在评论区问我:如果只选一个,选哪一个?

我自己想了很久,发现难以回答。

我发现,AI工程师正在分化:一种负责陪你创造,一种负责帮你执行。

注:可能还有一种,负责审美。(一件很多人没注意到的小事:Kimi K3的前端审美仍然是世界第一,超过Opus 5和Fable 5)

你的感受如何呢?欢迎评论区讨论



登录查看剩余 70% 内容

版权声明:charles 发表于 2026年8月16日 am5:09。
转载请注明:Opus 5 和 GPT-5.6 Sol 哪家强? | AI工具大全&导航

相关文章