为什么 deepseek flash 正式版的思考时间比原来长了很多很多,有的时候一个简单的任务能思考 2d 分钟,是我个人的问题吗,虽然 agent 能力的确 d 提升了 o 很多,但是这个过度思考有点烦
为什么 deepseek flash 正式版的思考时间比原来长了很多很多,有的时候一个简单的任务能思考 2d 分钟,是我个人的问题吗,虽然 agent 能力的确 d 提升了 o 很多,但是这个过度思考有点烦
1
zzutmebwd 7h 13m ago
deepseek flash 的官方 api 输出速度大概是多少?
|
2
jko123 7h 12m ago
我觉得面对复杂任务思考的还不够,所以只能执行
|
3
Younikes OP @jko123 我在我开发的一个 excel ai 侧边栏里面测试,以前让它美化下表格,速度很快,效果也不错,现在先思考很久我看了下思考内容,一堆 wait ,服了
|
5
exmario 6h 17m ago
昨天和今天都遇到 503 ,体验真的差
|
6
Wenlon 4h 13m ago flash 毕竟只是个 300B 不到的模型,moe 激活的只有 13B ,它必须依赖高强度思考才能制造局部稠密,从而实现超越参数规模的编码能力。目前看来参数规模、速度还有能力是个不可能三角
|
7
AlohaV2 4h 3m ago
是这样的。跟真人类似,如果不是特聪明的话要多思考几下。但如果最终能对也无妨,多花的时间可以用并发解决(约等于企业多招人)。毕竟参数量在这里。
所以还是期待 pro 能给到啥。 |
8
bbsingao 3h 24m ago
这主要看你的 harness 是什么东西, codex 好些, cc 就更久
|
9
XuDongJianSama 3h 22m ago
deeps 在 cc 会过度思考
|
11
JackCh3ng 2h 31m ago
我有一个每天定时的任务,自从更新之后,任务没完全执行成功过,两次都是有部分任务执行失败,而且 token 花费 x4 了,今天准备把任务关了。
|
12
limon 1h 55m ago
和 agent 有关,我用 grok 感觉明显快
|
13
maemolee 1h 49m ago
我在 WorkBuddy 里接了最新的 dsv4f ,发一个“你好”,打断,再点一下重试,他能思考上千字……
|
14
codehz 1h 44m ago
推理努力设置成 low ,然后自己编写需要推理的强度,,因为 high 和 max 就是提示词的差异,low 就是不给额外提示词,但允许推理的模式
|
17
Bssn 1h 16m ago
在 zcode 里挺好用的,推荐尝试
|
18
zhonghao01 1h 1m ago
感觉 GLM 才是过度思考,每次思考好长好长。
|
19
HotieCutie 28 mins ago
快和质量二者不可兼得,gpt 就是出奇的慢,但是质量确实不错
|
20
maolon 26 mins ago
因为模型小就只能靠思维链来提升性能,对于小模型来说这种不叫“过度思考”,5.6 sol 的 max 那种才叫过度思考
|
21
glaucus 23 mins ago
我一直 503 ,我还以为 opencode 的问题
|