ds 视觉模型来了

8 小时 34 分钟前
 linvscode

https://mp.weixin.qq.com/s/UGMfvPMwBIB4oFYZZejekA

在纯文本能力( Agent 、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash 正式版持平

在需要视觉理解的 Agent Benchmark 上,DeepSeek-V4-Flash-Vision-Exp 相比 DeepSeek-V4-Flash 实现了大幅跃升,多模态 Agent 能力已接近 Opus-4.8 。

在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens ,计费价格与 V4-Flash 模型一致。

749 次点击
所在节点    问与答
6 条回复
volvo007
7 小时 33 分钟前
啊?!等大佬们评测了
PrinceofInj
7 小时 12 分钟前
那是不是可以把输入的文字截图发给他会省一些 Token 🐶
mqnu00
6 小时 27 分钟前
@PrinceofInj 天才!
wangxiaoer
6 小时 24 分钟前
@PrinceofInj #2 真特么天才啊
passive
6 小时 8 分钟前
@PrinceofInj #2

还是发二维码吧🐶
linvscode
4 小时 20 分钟前
@PrinceofInj 天才!

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1236246

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX