智谱发布最新旗舰模型 GLM-5.2

6 月 14 日
 d3George

GLM-5.2 相比 5.1 ,官方和已公开信息里最明确的提升方向是:更强的编程能力、更可用的超长上下文、更稳的长程任务表现,以及更深的推理强度选项

附一张对比表格:

维度 GLM-5.1 GLM-5.2
旗舰定位 最新旗舰,长程任务显著提升。 新旗舰,官方称其为迄今最强开源模型。
上下文 200K 。 1M 可用上下文。x+1
长程任务 可持续自主工作长达 8 小时。 延续并强调 long-horizon tasks 继续领先。ifeng+1
编程能力 对齐 Claude Opus 4.6 ,面向 Agentic Coding 优化。 更强 coding 能力,复杂工程任务建议用更高思考强度。x+1
推理控制 支持 thinking 模式。 明确有 High / Max 两档思考强度。
8783 次点击
所在节点    程序员
37 条回复
chenliangngng
6 月 15 日
能对标 Opus4.6 的话,那就很流弊了
Bisn
6 月 15 日
群众里面有坏人,有没有大佬私发 1 个体验卡
d3George
6 月 15 日
@chenliangngng 代码能力够强了,但是不是多模态的。
d3George
6 月 15 日
@till 那肯定还不行
d3George
6 月 15 日
@Bisn 体验卡也用不上 5.1 5.2
yh7gdiaYW
6 月 15 日
@d3George 满血的 opus 4.6 放在今天仍是巅峰水平( fable 这玩意儿没体验过不评价)
ronel
6 月 15 日
现在用起来已经很慢了, 吐字 1s 感觉 10 个目测( vscode + claudecode )
d3George
6 月 15 日
@yh7gdiaYW 我信你,但是咱用不上啊,至今为止我只在 cursor 和 gihub copilot 的套餐上用过一段时间。
d3George
6 月 15 日
@ronel 不如用 cursor
wzw
6 月 15 日
@yh7gdiaYW 满血是 max 吗? opus4.8 max 还不如 4.6 吗?
yanguangs
6 月 15 日
今天使用了半天.

glm5.2 发现和使用 agent 的能力 优于 gpt5.5 和 claude code

但是智谱离谱的限流,导致基本不想用于长时间的任务额外会有很多重试的耗时.
一个 api 重试 3~4 次就是半分钟, 一个 coding 任务差不多至少 100 次 api 调用.
yanguangs
6 月 15 日
我在使用 GLM Coding Plan ,数小时内完成过去需要数周的开发工作,赠送你 1 张 7 天 AI Coding 体验卡,一起来用吧: https://bigmodel.cn/activity/trial-card/XGNKDERVZZ
d3George
6 月 15 日
@yanguangs 尽量少在 14:00 - 18:00 用
ayamatsuura
6 月 15 日
我测了一下,感觉像个弱智一样。。。
Brodess
6 月 16 日
垃圾模型水军还挺多,用掺水的中转站用傻了吧还对标 opus4.6
darklowly
6 月 16 日
GLM 5.2 还是可以的, 但是我感觉比 claude 贵呢。2 天就把一周的额度用完了
darklowly
6 月 16 日
btw: 是 5x 的海外账号

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1220302

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX