Fable5 的各种夸奖帖子很多了,我却遇到了它解决不好的问题,最后还是自己动手干?

7 月 6 日
 plmsuper8

让它优化 Agent 的 Deep Think 功能,给定测试集和一个可以跑通的原型基础,让它持续优化。

没采用让人介入的流程,就是想全权放手,试试 SOTA AI 自己迭代能做成啥样;

结果嘛……烧完周额度,迭代了七八轮,它看到测试效果不好就不断堆叠、追加新特性,系统复杂度迅速上升到不忍直视的程度,而且还有针对测试题作弊的倾向。最后还没能达到目标。

我就好奇,会不会是这问题本身没法解决?自己花了半个周末咔咔砍掉冗余,然后回到原本的流程:仔细分析,把思路和 AI 讨论清楚,再逐步实施,终于是把性能稳定提升了。

其实我知道 Fable 作为新一代 AI 效果是很好的,网上基本没有抱怨它性能不足的,只有抱怨被限制的。

但该说是不能期望太高吗? Dario 你们尽管吹,又是神话又是眩晕瘫坐的,到头来还是应该回到工具定位,去辅助人呐。

1323 次点击
所在节点    Claude
0 条回复

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1225294

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX