两台 dgx-spark 部署满血 deepseek v4 flash 完全指南,稳定 60~70tok/s 单流

8 月 7 日
 dbow
前天看 x 上有人做成这事, 觉得很不错, 下单买了两台, 6 万 8, nvidia 原厂 dgx spark 带并连线
实测两台刚好能拿捏 deepseek v4 flash 0731 ,vibe coding 单流 60–70 tok/s 的体验足以覆盖日常 ;不是“能跑起来”的演示水平,而是可以当主力开发机稳定干活。
主要是为了本地化隐私部署, 经常会跟 ai 聊很多机密信息, 不放心, 靠硬件出 token 得好几年才能回本.
欢迎交流
github: https://github.com/maliubiao/dgx-spark-2-deepseek-flash-0731
8689 次点击
所在节点    Local LLM
66 条回复
yoshiyuki
8 月 7 日
但是你的 agent 说到底是联网的, 信息潜在的泄漏点太多了
Lazymio
8 月 7 日
6 万 8 是京东自营的?感觉买贵了。
SayHelloHi
8 月 7 日
@dbow

老铁咨询下,DXG 使用 comfyui 体验如何?

也想入手
wyntalgeer
8 月 7 日
感谢,已 star
dbow
8 月 7 日
@SayHelloHi 跑一个 deepseek v4 flash 90%计算资源就用光了, 暂时还没试过别的东西.
Insolitude
8 月 7 日
可以帮忙用 llama-benchy ( https://github.com/eugr/llama-benchy )测一下吗?之前用两台 spark 测过预览版的 deepseekv4 flash ,当时跑起来还蛮吃力的,想看看现在性能怎么样


"""
| model | test | t/s (total) | t/s (req) | peak t/s | peak t/s (req) | ttfr (ms) | est_ppt (ms) | e2e_ttft (ms) |
|:------------------------------|------------:|----------------:|----------------:|-------------:|-----------------:|------------------:|------------------:|------------------:|
| deepseek-ai/DeepSeek-V4-Flash | pp2048 (c1) | 955.27 ± 193.11 | 955.27 ± 193.11 | | | 2257.64 ± 530.54 | 2251.15 ± 530.54 | 2257.64 ± 530.54 |
| deepseek-ai/DeepSeek-V4-Flash | tg32 (c1) | 38.67 ± 1.58 | 38.67 ± 1.58 | 39.93 ± 1.63 | 39.93 ± 1.63 | | | |
| deepseek-ai/DeepSeek-V4-Flash | pp2048 (c2) | 919.38 ± 159.59 | 586.78 ± 244.14 | | | 3948.41 ± 1160.98 | 3941.91 ± 1160.98 | 3948.41 ± 1160.98 |
| deepseek-ai/DeepSeek-V4-Flash | tg32 (c2) | 39.08 ± 20.50 | 25.04 ± 9.26 | 58.67 ± 3.09 | 29.79 ± 3.35 | | | |
| deepseek-ai/DeepSeek-V4-Flash | pp2048 (c4) | 924.07 ± 122.40 | 358.73 ± 142.02 | | | 6692.54 ± 2550.41 | 6686.05 ± 2550.41 | 6692.54 ± 2550.41 |
| deepseek-ai/DeepSeek-V4-Flash | tg32 (c4) | 18.68 ± 2.40 | 10.41 ± 5.84 | 71.33 ± 4.03 | 19.42 ± 1.32 | | | |

llama-benchy (0.3.7)
date: 2026-05-18 16:43:49 | latency mode: api
"""
mouyase
8 月 7 日
《不是“能跑起来”的演示水平,而是可以当主力开发机稳定干活。》

您也 AI 化了。
dbow
8 月 7 日
@mouyase ai 写的文档, 我复制了一句过来, 哈哈
Nasdaq
8 月 7 日
请教老哥,功耗/发热怎么样?我也想搞 2 台玩玩。
defunct9
8 月 7 日
新模型发布这么快,花 6 万 8 ,合适么?
Tink
8 月 7 日
好像还不错啊
ferch
8 月 7 日
这很好呀,能自己本地玩了
dbow
8 月 7 日
@Nasdaq agent 跑起来 gpu 70 度左右
asdjgfr
8 月 7 日
省着点用,10 年之后我要捡垃圾自己部署一个😆
Nasdaq
8 月 7 日
@dbow #12 继续请教您,部署起来困难吗?还是说能让 cc/cx 直接托管一键部署?
lizhenda
8 月 7 日
等新模型发布了,硬件不够用了怎么办?
ysz1121
8 月 7 日
6.8w 充 deepseek 官方,是不是能用一年?
shyrock2026
8 月 7 日
op 这个速度是开的 200k 上下文还是 1m 呢?
dbow
8 月 7 日
@Nasdaq 全交给 ai
dbow
8 月 7 日

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1232688

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX