• 请不要在回答技术问题时复制粘贴 AI 生成的内容
Frankcox
V2EX  ›  程序员

打脸食言了, Opus 5.5 确实有其强大之处

  •  
  •   Frankcox · 1h 38m ago · 476 views
    我之前在 v 站发过好几次反对 Claude 的评论,因为在去年人在海外仍然被 Claude 封号,再加上达里奥的各种神必发言,而且后来 gpt 还出了相当优秀的 gpt-image-2 ,所以我转向 chatgpt 快将近一年了,并且还说不理解为什么一群人顶着封号仍然强行用 claude 。

    但是最近 RMB 汇率略走强,我外行卡恰好有些剩余的钱,codex 的额度也跑差不多,于是我就充了一个 claude pro ,用了下来发现 claude 确实很强,算是打脸我之前的言论了。

    我是在做一个研究项目,不是纯写代码,还有系统设计+数据分析。对比用 codex 时就发现,sol ,甚至 Astra 对于数据分析这里相当一般,它发现不了我的实验统计公式实际是有问题的,即使我在 prompt 里明确让其评审我的实验结构设计;而是把大量精力放到代码,尤其是防御性编程部分,加了一堆莫名其妙的退出机制。

    而在我用上 Opus 5.5 之后,仅仅让它评审一下实验结果和架构设计,它就明确发现了之前 codex 车轱辘来回转都分析不出来的实验设计问题。而且在之后的实验代码部分,opus 的实验代码设计也是明显能感觉贴近人的思维模式,并且具有一定的主动性,不盲从。而 codex 的 sol 和 Astra 的感受则是它只会在你给定足够清晰的指令后完成命令,即使在你明确指定它分析问题时,codex 也是在不反对你的核心内容的情况下,不痛不痒给你一些零散的问题点。
    5 replies  •  2026-09-25 17:51:54 +08:00
    Zhuzhuchenyan
        1
    Zhuzhuchenyan  
       57 mins ago   ❤️ 1
    OpenAI 模型的强项就是指令遵循,代价就是对使用者的能力要求比较高,很难跳出使用者的框架
    相比之下 Claude 的系列模型发散能力更强,对模糊指令的完成度会更好一些。
    dongzhimin
        2
    dongzhimin  
       50 mins ago
    @Zhuzhuchenyan 是的,没有任何一家的指令遵循能赶上 OpenAI 。Claude 有时候能感觉到会读心,有些东西不容易表达或者漏表达的它会提及并实现出来。
    dongzhimin
        3
    dongzhimin  
       47 mins ago
    强指令遵循遵循是很难做的,特别是上下文变长的情况下。虽然我日常用 Claude max ,但是不得不承认 OpenAI 的底蕴和实力是在这的。最大的反例就是 Gemini ,模型根本不听话,指东打西,指令遵循赶不上一堆开源模型,3.8 flash 可能 AA 评分单项测评还能看,但是实际根本没法使用。
    Frankcox
        4
    Frankcox  
    OP
       43 mins ago
    @Zhuzhuchenyan 这么看,对于探索性的发散任务交给 Claude ,具体的代码调整交给 OpenAI 会好一些。
    morewe
        5
    morewe  
       19 mins ago
    双持是最好的,能订阅的上的情况,确实没必要跟自己过不去。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2477 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 38ms · UTC 10:11 · PVG 18:11 · LAX 03:11 · JFK 06:11
    ♥ Do have faith in what you're doing.