V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  cwcc  ›  全部回复第 2 页 / 共 54 页
回复总数  1076
1  2  3  4  5  6  7  8  9  10 ... 54  
❮ ❯
5 月 20 日
回复了 YanSeven 创建的主题 › Claude Code › claude code 突然日文跟我对话
我用 Copilot 的 Claude 模型也是会有这个问题,感觉像是模型的问题。
@YanSeven 显卡+主机不好移动啊。
5 月 17 日
回复了 Karlbaey 创建的主题 › 问与答 › 国内的企业是压根不在乎域名吗
@tars13344 结果阿里还把饿了么改名淘宝闪购了 https://i.imgur.com/c1Q76Cd.png
5 月 17 日
回复了 Karlbaey 创建的主题 › 问与答 › 国内的企业是压根不在乎域名吗
感觉 pointer 开发 web 应用更加习惯,如果使用 web 开发桌面应用的话 pointer 能省则省。
4 月 30 日
回复了 crocoBaby 创建的主题 › 职场话题 › 庆幸之前选择了广度而不是深度
DeepSeek 叫 DeepSeek ,不叫 WideSeek ,说明了什么。
不是算力的问题,是显存太紧张了,只能跑个 7b 左右的才能达到每秒 70-100tok 的速度,跑更大模型受限的情况瓶颈基本全在 PCIe 带宽和显存上。

真要横向比较的话,我自己的 36G 的 MacBook Pro 能跑 qwen3.6035b-a3b 模型,每秒能到 30token ,但长上下文直接把内存撑爆死机;相比我的 5060Ti 只能直接跑小模型,或者 CPU 混合计算下利用 64G 的 RAM 能以很慢的速度跑很大的模型也不会爆内存死机。总之各有各的瓶颈,你得知道自己的硬件瓶颈在哪里。
说白了还是要解决一个 Agent 的根本问题:有限的显存空间和膨胀的上下文之间的问题。不过模型的拆分确实能更好地解决一个复杂项目下上下文爆炸的问题,不管是大模型还是小模型。这点我甚至感觉可以通过优化现有的 Copilot 、Copilot 、Roo Code 等 prompt 和 tool call 实现,比如加入 subagent 、优化子项目流程、自动 compact context 等。
4 月 28 日
回复了 jununhsu 创建的主题 › 职场话题 › 想问问十点多上班的,上午真的能干活吗
早上班早下班比晚上班晚下班其实更舒服,早点睡就好了。
@cnrting #45 那么问题来了,找境外工作躺平是不是呢? https://i.imgur.com/agAJ0Rd.png
4 月 27 日
回复了 bearbest 创建的主题 › 情感问题 › 对象躺得太平了怎么办?
蹲了半天 v 友的答案,我来说下我的心得吧。

我也和对象在一起很多年了,还没结婚,就是嫌办婚礼麻烦,还有得让两家父母和老人见面,又是比较远的异地,所以一直拖着。说实话除了节假日会一起去远处旅游之外,其他的和楼主几乎是一样的,平日没什么事情。

工作日基本都是各忙各的,也没有什么机会一起吃喝,只有周末,但周末往往就是在家里蹲,玩游戏、看视频。

我自己的长期生活动力:10 年内攒钱去一次南极。
我自己的短期生活动力:写开源代码,积累知识和成就感、小假期旅游
对象长期的生活动力:买房子。
对象短期的生活动力:考各种证、职称、跳槽到轻松的公司。

还有一个点:乍一看都很平常,我们日常过得也都挺单一的,但偶尔还是会费心搞搞宠物、被同事约野餐或出去逛逛,或者一两个月叫朋友来家里搓麻将等。这些属于外力介入,除了上面的生活动力基本上是满足自己的,有外力干涉一下生活(非贬义)会感觉不那么无聊。

另外,我感觉你可以试着强迫两个人一起,减少手机、电脑的使用,或者强制断开互联网一天或几天,看看两个人会找什么事情、想做什么事情。人不可能一直发呆的,没有电子设备消耗能量的话,不可能一直“躺平”的。
4 月 27 日
回复了 bearbest 创建的主题 › 情感问题 › 对象躺得太平了怎么办?
+1 。
搞安全的人弄杀毒软件反而很闹心,自己写个马,马上就被删掉了。https://i.imgur.com/agAJ0Rd.png https://i.imgur.com/n119Wvk.png
@cat9life 只试过 qwen3.6-27b ,但太慢了。gemma4 没试过,有时间摸鱼可以测测。
@Seanfuck qwen3.6-27b 在 M3 Pro 的 Mac 上太慢了,不到 8 token/s ,基本不可用。
https://github.com/ggml-org/llama.cpp/discussions/4167

Mac 跑大模型天梯图。

目前我自己用下来兼顾速度和效果的感觉也就最新的 qwen3.6-35b-a3b 了,需要微调一下模型的参数。
4 月 25 日
回复了 exploretheworld 创建的主题 › 程序员 › 你们一个月上班要用多少 token?
我其实更好奇这些大模型提供商会不会全量记录 input 和 output ,想到这数据量可能特别大,似乎又不太现实。
4 月 21 日
回复了 beasnail 创建的主题 › 生活 › 我不喜欢女同事,但是很喜欢她养的小狗...
你说的小狗,它真是小狗吗?
4 月 17 日
回复了 hellodigua 创建的主题 › 程序员 › 2026 年了,这个世界还存在互联网精神🥹
哎,我前段时间也想做你类似的操作,但 org 被一个很明显是 AI 生成的几乎没有什么用的项目给占了,而且好几年没更新过。然后也是给开发者回信,对方很果断地拒绝了这一行为,并且说无论免费还是我出多少钱也不愿意。
1  2  3  4  5  6  7  8  9  10 ... 54  
❮ ❯
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2374 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 45ms · UTC 04:19 · PVG 12:19 · LAX 21:19 · JFK 00:19
♥ Do have faith in what you're doing.