这里为什么感觉没人讨论国产模型。我发现 qwen 和豆包系列模型问题好多,生产直接没法用

5 小时 10 分钟前
 rizon
对话类产品。
生产环境过去一直在用豆包,但是豆包 ttft 越来越大已经没法用了,所以想换 qwen 。
而且豆包还有概率出现脱靶问题和工具调用幻觉问题

结果 qwen3.7 plus 输出总是半截就中断,概率非常大没法用。
换成 3.8 max ,先是专属 endpoint 输出内容缺少 role ,这事我就排查了很久。
然后换成 dashscope 域继续用想着没事了,结果发现模型带图时输出质量严重下滑,区分不出注释内容和对话内容的角色概念。

搞得我现在一个没得用。做角色扮演对话还有什么好的选择吗
1651 次点击
所在节点    程序员
28 条回复
dryadent
32 分钟前
因为我没在生产环境用啊,gpt 6 都一堆问题,更何况这些蒸馏的
crackself
31 分钟前
v 友要生产力的,逗乐子看郭德纲于谦比国模更具性价比
rizon
26 分钟前
@maocat 哈,是有这个问题,所以按说还得加自定义代理功能。另外我后面打算支持在服务器终端上跑,这样延迟测试也更准一些
rizon
24 分钟前
@dryadent
@crackself 哎,没得选啊,实时对话产品延迟敏感, 还有成本问题。如果有好的低延迟、低成本的 gpt 模型选择就好了。
pmer
21 分钟前
要区分下具体模型,至少 seedance2.0/2.5 能打的,它是属于豆包系列模型(对外品牌名称)
ReinXD
20 分钟前
@rizon 那也应该选 deepseek 不是 qwen ,qwen infra 水平真得不敢恭维
ovtfkw
19 分钟前
k3 呢 直接不是说吊打 opus 吗 现在如何了
f1ynnv2
4 分钟前
豆包只在用语音识别

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1240649

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX