深度使用过两个模型,发现 Claude 喜欢输出很多文档,你不限制它,它就每次都要输出新文档
而 GPT5.6 则是不断做大量测试,一个小需求也要大量过度测试
而 GPT5.6 则是不断做大量测试,一个小需求也要大量过度测试
1
ccpp132 9h 36m ago
是同样的 harness 吗,感觉这个主要是按提示词
|