探讨:测试驱动开发(TDD)是否是目前提高 AI 编程准确率的唯一解?

5 月 28 日
 fds2003

各位 V 友,大模型写代码最怕的就是遇到隐藏的 boundary 逻辑错误,单纯靠 Linter 根本看不出来。

分享一下 Antigravity 2.0 在沙箱中自动闭环 TDD 的原理(编写用例 -> 捕获断言报错堆栈 -> 反馈修改 -> 重测通过)。有了单元测试作为客观判定锚点,Agent 在自主开发时的正确率明显高上了一大截。

欢迎来踩和讨论: https://aidevhub.net/blog/google-antigravity-tdd-self-correcting-loop

1245 次点击
所在节点    分享创造
2 条回复
lancevps
5 月 28 日
如果有非常完善的用例才有用,AI 自己生成的用例没有用,连最基本的等价类都做不好。
fds2003
5 月 29 日
人类写规格和核心测试(输入),AI 去写实现代码(输出)

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1216257

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX