coefu

coefu

V2EX member #616381, joined on 2023-02-28 17:15:35 +08:00
Per coefu's settings, the topics list is hidden
Deals info, including closed deals, is not hidden
coefu's recent replies
你懂个 der 的 RSI 。
14h 57m ago
Replied to a topic by 1258 程序员 qwen3.8 27B 被低估了
@yudoo 虽然都是一些空话套话,但是知道怎么提升自己的知识储备,也是修炼的一环。

我的经验就是,保持持续学习的心态,也就是求知欲。对领域有兴趣了,自然而然地就能自发找到途径。
1 day ago
Replied to a topic by LightHiding777 职场话题 我感觉不想再做开发了
搞的好像你想就能继续一样。

过去那套分工明确的流程,不会再有了,也不会再有过去只需要根据文档用点“脑力” coding 转换文档的轻松工作了。
1 day ago
Replied to a topic by vedal 职场话题 日本硕士回国能找到工作吗
@passive 他还搁这许愿了,🫠
@wakarimasen 太真实,一度吹捧的我以为自己都能和 Hinton 坐一桌了。😂
3 days ago
Replied to a topic by king888 程序员 兄弟们,赛博鸡蛋香吗 🧺🥚🥚🥚
用 api+闭源 agent ,意味着做的东西就没有商业价值,乐色。
4 days ago
Replied to a topic by zzutmebwd Local LLM pro6000 部署 Qwen 3.8 flash next nvfp4
@catazshadow 早说了,我空出来一套万兆系列,2 张 10GB pcie 卡和一个 10GB switch 。

100+ B 参数的,就 qwen3.8 flash next 最能打了。
4 days ago
Replied to a topic by zzutmebwd Local LLM pro6000 部署 Qwen 3.8 flash next nvfp4
@catazshadow 彻底疯狂了,🤪。

https://huggingface.co/ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF ,我推荐你用这个。

我的 64G umem 环境里,之前完全跑不动的 Q4 (首字 5min 才出来,0.5 tok/s )。

用了 llama.cpp 的 lazy 模式,首字 20s 不到,初始 20+ tok/s ,到 20w context 的时候还有 7 ~ 8 tok/s ,结果 llama.cpp 直接 context shift 了,同一个 slot 没有出现 context oom ,直接又从 9w 开始轮转,用上了 swap ,swap 蹭蹭涨,但是 tg 还有 10 tok/s 。

只能说 ,太屌了。

我之前 qwen3.8 27B 干的活儿,让 flash 找了好多 bug ,甚至很多深度 bug ,影响整个项目方向的 bug 都找得出来。

GPQA-D & scicode 的 benchmark 含金量是真的高,GPQA-D flash 比 27B 只高 2.5 分左右,能指导后者工作。GPQA-D 的 90 分,是个真正能力分水岭。27B 只有 89.2 ,flash 91.7 ,Fable 5 92.6 。这个 Q3 91.41 。
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   4337 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 10ms · UTC 00:59 · PVG 08:59 · LAX 17:59 · JFK 20:59
♥ Do have faith in what you're doing.