实测 GPT-6 Astra 踩坑:过度防御直接把代码写成了屎山

3 小时 48 分钟前
 solitude23456
这几天深度测了下 GPT-6 Astra ( Ultra 模式)在复杂工程下的表现,体验非常糟糕。

核心问题在于它的过度防御机制:为了所谓的安全和容错,满篇都是死板的硬编码和极端复杂的正则校验,干活速度奇慢。写独立脚本问题不大,但在多 Agent 协同和底层链路互调场景下,它的限制策略几乎引发了逻辑降智,生成的代码死板且到处报错,死活跑不起来。

后来换了个思路,拿中转站充了 100 块的 Opus 5.5 (验过模型指纹没问题),放开思维链让它跑。就一个下午的时间,之前跑不通的底层调用逻辑全给理顺改通了。

日常玩具模型吹得再响,真正拉到复杂业务架构和底层代码重构里,现阶段还是 Claude 的架构理解力和落地能力更顶。
259 次点击
所在节点    分享发现
4 条回复
solitude23456
3 小时 43 分钟前
动不动就糊一堆反人类的正则表达式,宁可错杀一千也不放过一个,代码根本跑不通,TMD 越测越上火!!!!!
dm87497
3 小时 36 分钟前
astra 测过降智没
solitude23456
3 小时 34 分钟前
@dm87497 测了 没降智。降不降也无所谓了 o➗也不当人了现在
165924
几秒前
我之前一个项目已经被 astra 写死了,全是防御叠甲,完全不可维护。就干脆让 opus 重写了一遍,确认业务没问题后再让 astra 找问题补防御(并且补完还得让 opus 过一遍)😭

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1247824

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX