→熙← 发表于 2026-8-21 17:08

确实实装了

inpachi 发表于 2026-8-21 17:09

相关文档也更新了

hugosol 发表于 2026-8-21 17:11

看到了,和flash价格一样

cscbzcbz 发表于 2026-8-21 17:12

如果不如现在的v4flash,可以作为子代理仅识图吗?或者mcp接过去?

misuzu0723 发表于 2026-8-21 17:12

时间: 2026-08-21
DeepSeek-V4-Flash-Vision-Exp 发布
今天,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。

Terminal Bench 2.1: 83.9
NL2Repo: 57.7
DeepSWE: 59.3
DSBench-Hard: 63.6
AutomationBench (Public): 25.7
ApexBench (Pass@1): 36.5
Agents' Last Exam: 27.3
Chartography: 64.3 (p0.95); 63.3 (p1.0)
ZeroBench (Pass@5): 35.0
* 对于公开基准测试集中的 Code Agent 文本任务,DeepSeek 系列模型使用 DeepSeek Harness 极简模式作为框架进行测试,并使用 max 档位,topp=0.95,temperature=1.0;在 ApexBench 与 Agents' Last Exam 测评中,文本模型 DeepSeek-V4-Flash 会忽略其中的多模态元素

在纯文本能力(Agent、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash 正式版持平。

看起来性能和4F齐平,那可以直接拿来替换4F了

cscbzcbz 发表于 2026-8-21 17:13

分比flash还高,我错了

绝地潜兵 发表于 2026-8-21 17:14

这下真的耽误AGI训练了

jinuzuktII 发表于 2026-8-21 17:15

只有官方api有吗,opc呢

neptunehs 发表于 2026-8-21 17:16

期待opencode下了free的flash是为了换这个
但愿

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

ivly 发表于 2026-8-21 17:16

上线了,你们不试试app或者网页吗。
我直接更新app之后,快速模式直接上传图片就识图了。

—— 来自 OnePlus PKX110, Android 16, 鹅球 v4.0-alpha

hugosol 发表于 2026-8-21 17:16

别又是极简模式下和flash持平吧

舞以 发表于 2026-8-21 17:18

等梁文谷测一下

王兰花秀丽 发表于 2026-8-21 17:19

文字方面明明是全面提升,竟然叫持平吗...    Re:Source

overflowal 发表于 2026-8-21 17:22

王兰花秀丽 发表于 2026-8-21 17:19
文字方面明明是全面提升,竟然叫持平吗...    Re:Source

对他们来说这是标准差范围吧

phorcys02 发表于 2026-8-21 17:22

不是持平flash,是 超过了flash比pro都只差一点了...

nxmonitor 发表于 2026-8-21 17:24

不是,这个分数全都比Flash高啊,这还持平?

LeoDT 发表于 2026-8-21 17:24

hugosol 发表于 2026-8-21 17:16
别又是极简模式下和flash持平吧

说实话极简模式挺好的,写代码本来就只要bash就能写了,应该再激进一点什么tool什么mcp的全都弄成bash命令,全写bash,Code Mode这不就有了么。

ycjiang1337 发表于 2026-8-21 17:25

misuzu0723 发表于 2026-8-21 16:37
光靠这个打不死,opus5能做类似的
https://deepdemos.top/demo/claude-opus-5-9d3ec162
目前支持路由的基 ...

你这完全不是一个东西啊,而且opus5什么臭鱼烂虾

—— 来自 HUAWEI SGT-AL50, Android 16, 鹅球 v3.4.97-alpha

舞以 发表于 2026-8-21 17:25

不会真的涨价腾空算力,一切都会好起来吧
梁子真这么实诚么?

goranger 发表于 2026-8-21 17:25

这两天各种灰度的都以为是pro,结果是多模态吗

neptunehs 发表于 2026-8-21 17:27

舞以 发表于 2026-8-21 17:25
不会真的涨价腾空算力,一切都会好起来吧
梁子真这么实诚么?

主要是也就腾了一周的算力吧 又是多模态又是灰测?

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

小野賢章 发表于 2026-8-21 17:27

我准备我我这几天写的html玩具全都用flash-vision重新跑一下,看看是pro厉害,还是带视觉厉害

nxmonitor 发表于 2026-8-21 17:28

本帖最后由 nxmonitor 于 2026-8-21 17:31 编辑

goranger 发表于 2026-8-21 17:25
这两天各种灰度的都以为是pro,结果是多模态吗

明显是另一个基模,多模态可能有训练,但是没有识图接口,Flash没有这么大的知识量,也没这么低的TPS

wesdrtfg 发表于 2026-8-21 17:29

感觉开放之后,梁子打开后台一看,不会收集了一堆涩图的对话数据吧

goranger 发表于 2026-8-21 17:29

分数

王兰花秀丽 发表于 2026-8-21 17:29

这个Chartography是什么榜单 这是唯一一个多模态相关的测试集 但是没找到具体是哪个测试集    Re:Source

Milarvoz 发表于 2026-8-21 17:30

https://mp.weixin.qq.com/s/UGMfvPMwBIB4oFYZZejekA

files api也上线了

—— 来自 samsung SM-S9380, Android 16, 鹅球 v4.0

tk553521 发表于 2026-8-21 17:30

真耽误了AGI了吗

80后卢瑟 发表于 2026-8-21 17:30

本帖最后由 80后卢瑟 于 2026-8-21 17:31 编辑

https://api-docs.deepseek.com/zh-cn/guides/vision

图片会根据其尺寸换算成 token,并与文本 token 一起计费。在进入模型前,每张图片都会被自动缩放:
[*]总像素小于约 384×384 的图片会被保持长宽比放大;
[*]更大的图片会被保持长宽比缩小,缩小后的总像素约相当于 800×800 的图片。
因此,每张图片消耗的 token 数存在上限(384 个):例如 2000×2000 和 5000×5000 的图片,经缩放后消耗的 token 数是相同的。单个请求包含多张图片时,每张图片独立按同一规则计算,不存在额外的计算方式。

木水风铃 发表于 2026-8-21 17:30

啊这,多模态那可以瑟瑟吗

—— 来自 鹅球 v3.3.96

小野賢章 发表于 2026-8-21 17:30

deepswe能上涨5分,说明多模态解决实际问题确实有帮助呀

squallx 发表于 2026-8-21 17:32

🤔这么看来灰测🐟是装瞎的 这V4FV搞不好奇偶是灰测模型蒸出来的

cscbzcbz 发表于 2026-8-21 17:32

goranger 发表于 2026-8-21 17:29
分数

只有Cybergym低了一分,价格还不变,这不会又吧服务器占满

80后卢瑟 发表于 2026-8-21 17:32

王兰花秀丽 发表于 2026-8-21 17:29
这个Chartography是什么榜单 这是唯一一个多模态相关的测试集 但是没找到具体是哪个测试集    Re:Source ...

https://surgehq.ai/benchmarks/chartography

zy450 发表于 2026-8-21 17:33

在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型一致

lactone 发表于 2026-8-21 17:33

这个vision开源吗?

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha

王兰花秀丽 发表于 2026-8-21 17:33

80后卢瑟 发表于 2026-8-21 17:32
https://surgehq.ai/benchmarks/chartography

我找到这个了,问题是这个最高只有45%,计算方式不一样吗    Re:Source

cscbzcbz 发表于 2026-8-21 17:33

梁叔叔评价可以提一级了嘛

tonyunreal 发表于 2026-8-21 17:34

v模型极简模式和anchored-standard都能触发we思维链,和flash 0731一样

phorcys02 发表于 2026-8-21 17:34

这下看起来 8.13 的 v4pro,不是变成 纯小丑🤡 了嘛....
哈基梁最好早点把新pro端出来,不然这个价格配合这个性能, v4pro 就要当好几个月小丑王了
页: 251 252 253 254 255 256 257 258 259 260 [261] 262 263 264 265 266 267 268 269 270
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼