Qwen3.7 编码排名超过了智谱 GLM5.1,有人用过吗?实际体验怎么样

5 月 27 日
 heyitsme

7878 次点击
所在节点    程序员
32 条回复
DinnyXu
5 月 27 日
可以关注抖音的一个博主,ID:Token 就是词元,这个博主我最近刷到的,会用各个模型进行多维度测试,挺有意思的
Poko
5 月 27 日
@MK47 不科学啊,qoder 不是阿里自家的么,本身主要使用的就是 qwen 模型
ndxxx
5 月 27 日
逆天,原汤化原食居然化不开🤣

@dabbit
MK47
5 月 27 日
@Poko 用指定模型 谁用他自家的
keshawnvan
5 月 27 日
和 GLM5.1 差不多,明显强于 DeepSeek 。
比 Opus4.6 是肯定不如的。
easing
5 月 27 日
3.7 max 还可以,比之前的 3.6 好很多了
me262
5 月 27 日
我用 qoderwork 和 9 楼一样的情况
catazshadow
5 月 27 日
国产做题家只能搞出做题 AI ,问题一变就呆若智障了
webszy
5 月 28 日
参考遥遥领先的宣传语:地球上性能最强悍的 SUV
saySilence
5 月 28 日
到 Trae 里面看看哪个模型排队时间长就知道谁厉害了
zhu327808
5 月 28 日
在 system prompt 里面加上这一句:

Reasoning effort is set to xhigh. Please think carefully through the task, validate key assumptions, consider plausible alternatives, and prioritize correctness, consistency, and clarity in the final answer.

然后 coding 的体感非常不错, 整体比 GLM 5.1 快, 实际效果应该算是国产第一了

以上 prompt 来源于 https://qwen.ai/blog?id=qwen3.7
Rorysky
5 月 30 日
@zhu327808 大模型测评很难客观,你看上面很多人说的效果甚至不如 kimi k2.5

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1215786

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX