智谱 GLM5.2 发布时,6 月中旬,铺天盖地的新闻说昇腾芯片首日适配,0 day 适配。 我们用了某私有云的昇腾+大模型服务,一直催他们更新到 GLM5.2 ,一直不更新。 截止今天 7 月 31 号,告诉我说昇腾还没适配,宣发说的那只是能跑,不能实际用。 还得等他们适配后来更新,具体时间不知道
智谱 GLM5.2 发布时,6 月中旬,铺天盖地的新闻说昇腾芯片首日适配,0 day 适配。 我们用了某私有云的昇腾+大模型服务,一直催他们更新到 GLM5.2 ,一直不更新。 截止今天 7 月 31 号,告诉我说昇腾还没适配,宣发说的那只是能跑,不能实际用。 还得等他们适配后来更新,具体时间不知道
1
052678 6h 28m ago
感觉和吗去掉
|
2
LxnChan 6h 22m ago 华子一直是这样的,前几年卖客户的 Atlas 服务器,卖之前吹的天花乱坠的说我们这个卡怎么怎么好,性能吊打 nvidia 消费级显卡,编解码性能怎么怎么高。到客户现场了装上了发现什么都用不了,编解码要用华子自己的 bsp 内核,那问华子要一份吧,编译过不去,问说为什么编译过不去,说技术支持得另加钱。一个项目拖了两年多,最后我跑路了也没交付。
|
3
sir283 6h 21m ago
有真实宣传的案例吗?
|
4
wat4me 6h 13m ago
销售吹牛大家应该都遇到过,最后研发兜底,至于什么时候兜住就不一定了
|
5
94 6h 12m ago
所谓 “0 day 适配” 一直都是能运行起来,不是说能投入生产...
互联网出生的运营就容易搞这些噱头去铺天盖地的宣传。 |
6
HeyWeGo 6h 6m ago
工作几年了?宣传归宣传,实装归实装,不知道海外是不是这样,至少我所在行业,你用 ppt 就能搞定钱的来源问题。至于落地,软件嘛,迭代升级!好像国内电动车也是这样吧,ota ?
|
8
superkkk 5h 53m ago via Android
ppt 做得好你就真信了?
|
9
skuuhui 5h 51m ago
比起这个,我很难想相信 2026 年的今天还有人相信这些。。。。
|
10
Meteora626 5h 39m ago
能跑就能实际用,无非是 token 速度没有优化后的快,你这提供商不靠谱。
而且 glm5.2 只是名字新,架构依然是老架构,都不用改算子动内核,又不是 kimi k3 这种,除非你这提供商连 glm4.7 5.1 都不支持 |
11
ChoiYoonJung 5h 19m ago 昇腾,是那个
伪造苏丹政府文件, 半路劫走中兴客户, 中兴发布会拉电闸, 窃听中兴内部会议现场被抓获, 地震抢修剪中兴网线, 南海信号干扰器, 制造车祸撞停中兴投标车, AI 路测 AI 碰撞测试 AI 造车 的华为出的吗,虚假宣传算个事吗? |
12
Muniesa 5h 16m ago
vllm ascend 文档里这不是可以跑吗,能跑不能实际用是啥意思?速度慢? https://docs.vllm.ai/projects/ascend/en/latest/tutorials/models/GLM5.2.html
|
13
ndxxx 5h 16m ago via Android 华为就是一坨狗屎,但是靠它吃饭的人,已经被调教的自适应的低认知用户还是很多的。
作为普通人看到马路上静置的一坨屎的正常反应是,绕开这坨屎,顺便骂一句😁 |
15
DeYiAo OP @Muniesa 对,速度慢到没法用。 正常能跑应该是 int8 量化才能是正常用的状态。
去年 DeepSeek R1 的时候也是,将近半年的时间没适配量化,只能忍受每秒 10tokens 的速度,用户都在吐槽。 |
16
digitv 5h 9m ago
昇腾本身就是 case by case 的适配的,这都需要很强的 infra 团队的,你要说他诈骗那也不至于,ds 和智谱官方也是实打实跑起来的,昇腾这玩意目前只有大厂能玩得起
|
18
magicZ 5h 3m ago
他们自己开发的 mindie ,狗日的,真难安装,真难用啊,技术支持也难找,去年我是真推进不动了,今年好了半死不活维护,推荐用 vllm 了(但是推理输出很慢啊)
|
19
DeYiAo OP @digitv “ds 和智谱官方也是实打实跑起来的” 不知道你这个信息是怎么得到的,我自己实际在用,为了怕是我们厂商水平不行,我还问了其他有几百张昇腾卡的朋友, 情况是一样的:
即:你在新闻上看到昇腾适配 XXX 的时候,大约还需要再等 3 ~ 6 个月,才能真正得到这个适配,也许永远得不到。 |
20
Miaosful 4h 58m ago 我们公司用的澎湃跑的 glm ,速度快的很,你们相信 hw 就得付出对应的智商税
|
21
DeYiAo OP @Miaosful 等不及我们换阿里平头哥 PPU 了,现在两个都用,PPU 跑起来还是勉强可用的,GLM5.2 10 用户能到 30 ~ 40 tokens 每秒
对比起来结果很震撼, 一台 PPU 约等于 8 台昇腾 910B 组网。 反正对于 GLM5 是这样的。 |
22
uxstone 4h 50m ago
滑 伪
|
23
yang59324 4h 38m ago
@magicZ 同感,早起买他们卡的是售前帮联系还有人支持处理问题,响应速度很快,后期还没过保咨询一个问题比农民工讨薪还难,三托五拖的一个问题排查好几天,后面我都懒得问他们了
|
24
rootOfAdmin 4h 19m ago
@ndxxx 又看到你了,还真是高强度冲浪。你的标签,又鲜亮了一点点
|
25
ndxxx 4h 11m ago via Android
@rootOfAdmin 哈哈,承让了👺
|
27
menghuitangchao 2h 59m ago
这个厂家的一贯做法,小刀大浪吹做过一期节目对比昇腾和英文大的参数的,昇腾很多参数给不完整
|
28
yeatmeret 1h 45m ago @ChoiYoonJung 华子确实是一坨,也是 996 35 岁裁员文化的主要推动者甚至是发明者,真的恶心人
|
31
jacketma 56 mins ago
据传梁文峰风投会议时泄露的谈话中,他也说到 950 的卡四张约等于一张 N 卡,产量还不足,ds 只能淘一些水货来补充算力。从 OP 遇到的问题推测,和梁说的情况交叉印证,实际状态大差不差的
|