编程效果对比 本地 Qwen3.8-27B vs Deepseek

7 小时 44 分钟前
 ashong

提示词

需要一个 svg 动画页面, 内容为一只鹈鹕骑自行车。要求:
- 鹈鹕生动形象
- 关节运动要自然、不生硬

除了 Deepseek 网页版,其他都是用 Deepseek Harness.

Qwen 模型均来自 unsloth

模型 缓存量化(ctk:ctv) 耗时 轮数 平均输出速度 t/s 缓存命中率% 总输入 总输出 预览 费用(元)
Deepseek 网页 - 12 分 32 秒 2 - - - - https://dspage.previewship.net/ 0
Deepseek Flash - 38 分 27 秒 1 123 99 11.9M 266K https://dsflash.previewship.net/ 1.93
Qwen3.8 27B Q5_K_M q8_0:q4_0 5 分 52 秒 1 77 98 95.5K 26.5K https://q5kmq8q4.previewship.net/ 0.02
Qwen3.8 27B Q5_K_M q8_0:q8_0 23 分 20 秒 1 69 98 818K 111K https://q5kmq8q8.previewship.net/ 0.09
Qwen3.8 27B Q4_K_M q8_0:q8_0 16 分 13 秒 1 63 94 631K 67.7K https://q4kmq8q8.previewship.net/ 0.06
Qwe3.8 27B UD_Q4_K_XL q8_0:q8_0 16 分 59 秒 1 58 94 131K 57.8K https://udq4kxlq8q8.previewship.net/ 0.06

电费按 0.5 元/度计算

提示词语义比较模糊, 所以思考时长会多一些

本地环境

硬件:7900xtx

系统:ubuntu 26.04

软件: llama.cpp + vulkan

更喜欢哪一个结果?

1638 次点击
所在节点    程序员
23 条回复
woodfizky
7 小时 32 分钟前
dsflash 怎么是倒着蹬啊(恼
而且自作主张给你加了倍速调节。。
towser
7 小时 30 分钟前
看起来 27b 运行的还可以,超过我的预期
ashong
7 小时 29 分钟前
@woodfizky 迷惑啊, 等谷期再用 Pro 版试一下
sentinelK
7 小时 26 分钟前
这种纯视觉效果的 deepseek 吃了没视觉能力的亏,没法重复验证。
我的实际运行体验,确实 qwen3.8-27B 至少是能生产的。只是 256k 上下文稍短。

如果不是要跑 Minimax H3 总是倒腾显存,我就让 sglang+27B-fp8 常驻显存了
1258
7 小时 25 分钟前
flash 想的太多了吧
ashong
7 小时 24 分钟前
@towser 能力可以,配合 dsh 比 opencode 效果好一些
yagamil
7 小时 23 分钟前
运行起来 A 卡和 N 卡去吧大吗?
是不是只要显存大就行了?
ashong
7 小时 20 分钟前
@sentinelK 模型不支持,harness 自动下载安装了 pillow 截图,对比像素,其实之所以用了这么长时间就是验证耗时太长, 实际生成也就 10 分钟, 后续的验证修改了个寂寞
ashong
7 小时 18 分钟前
@yagamil 没 N 卡, 只有一张 7900xtx , 显存肯定越大越好
sentinelK
7 小时 17 分钟前
@ashong 有种说法是说,多模态模型对于视觉的理解,和第三方理解并文字化后输入,理解程度是指数级别的差距,但是不太懂这块,所以不敢下结论。

我的体感上确实多模态模型对于图片的认知会更好。比如我用 qwen3.8-27B 去给 H3 理解图片素材并喂提示词,效果远强于纯文本模型。
sentinelK
7 小时 13 分钟前
@yagamil 可以参照我的经验帖: https://www.v2ex.com/t/1235518
wjxd
5 小时 39 分钟前
@ashong 我的是 7900xt ,昨天也试了这个 qwen3.8 ud q4 k m 的版本,你是用什么加载模型?是 window 环境还是 linux 环境啊?
wjxd
5 小时 37 分钟前
@ashong 忽略。我没仔细看帖子最后。。。
Seanfuck
4 小时 47 分钟前
最后一个好。Qwen 明显比 Deepseek 强。
honjow
3 小时 55 分钟前
同 7900xtx 。op 感觉用哪个量化最均衡啊
coefu
3 小时 49 分钟前
鹈鹕很 Q 。
xuhengjs
2 小时 30 分钟前
要不,用 deepseek 最新的 flash-vision-exp 试试?
ashong
2 小时 11 分钟前
@honjow Q5_K_M
jhytxy
2 小时 5 分钟前
建议量化模型至少还是用到 q6

q5 离原版差的比较远
honjow
1 小时 28 分钟前
@ashong #18 上下文能开多少啊。我试了很多次都达不到 77tps 这个速度

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1236180

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX