确实实装了
相关文档也更新了
看到了,和flash价格一样
如果不如现在的v4flash,可以作为子代理仅识图吗?或者mcp接过去?
时间: 2026-08-21
DeepSeek-V4-Flash-Vision-Exp 发布
今天,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。
Terminal Bench 2.1: 83.9
NL2Repo: 57.7
DeepSWE: 59.3
DSBench-Hard: 63.6
AutomationBench (Public): 25.7
ApexBench (Pass@1): 36.5
Agents' Last Exam: 27.3
Chartography: 64.3 (p0.95); 63.3 (p1.0)
ZeroBench (Pass@5): 35.0
* 对于公开基准测试集中的 Code Agent 文本任务,DeepSeek 系列模型使用 DeepSeek Harness 极简模式作为框架进行测试,并使用 max 档位,topp=0.95,temperature=1.0;在 ApexBench 与 Agents' Last Exam 测评中,文本模型 DeepSeek-V4-Flash 会忽略其中的多模态元素
在纯文本能力(Agent、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash 正式版持平。
看起来性能和4F齐平,那可以直接拿来替换4F了
分比flash还高,我错了
这下真的耽误AGI训练了
只有官方api有吗,opc呢
期待opencode下了free的flash是为了换这个
但愿
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
上线了,你们不试试app或者网页吗。
我直接更新app之后,快速模式直接上传图片就识图了。
—— 来自 OnePlus PKX110, Android 16, 鹅球 v4.0-alpha
别又是极简模式下和flash持平吧
等梁文谷测一下
文字方面明明是全面提升,竟然叫持平吗... Re:Source
王兰花秀丽 发表于 2026-8-21 17:19
文字方面明明是全面提升,竟然叫持平吗... Re:Source
对他们来说这是标准差范围吧
不是持平flash,是 超过了flash比pro都只差一点了...
不是,这个分数全都比Flash高啊,这还持平?
hugosol 发表于 2026-8-21 17:16
别又是极简模式下和flash持平吧
说实话极简模式挺好的,写代码本来就只要bash就能写了,应该再激进一点什么tool什么mcp的全都弄成bash命令,全写bash,Code Mode这不就有了么。
misuzu0723 发表于 2026-8-21 16:37
光靠这个打不死,opus5能做类似的
https://deepdemos.top/demo/claude-opus-5-9d3ec162
目前支持路由的基 ...
你这完全不是一个东西啊,而且opus5什么臭鱼烂虾
—— 来自 HUAWEI SGT-AL50, Android 16, 鹅球 v3.4.97-alpha
不会真的涨价腾空算力,一切都会好起来吧
梁子真这么实诚么?
这两天各种灰度的都以为是pro,结果是多模态吗
舞以 发表于 2026-8-21 17:25
不会真的涨价腾空算力,一切都会好起来吧
梁子真这么实诚么?
主要是也就腾了一周的算力吧 又是多模态又是灰测?
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
我准备我我这几天写的html玩具全都用flash-vision重新跑一下,看看是pro厉害,还是带视觉厉害
本帖最后由 nxmonitor 于 2026-8-21 17:31 编辑
goranger 发表于 2026-8-21 17:25
这两天各种灰度的都以为是pro,结果是多模态吗
明显是另一个基模,多模态可能有训练,但是没有识图接口,Flash没有这么大的知识量,也没这么低的TPS
感觉开放之后,梁子打开后台一看,不会收集了一堆涩图的对话数据吧
分数
这个Chartography是什么榜单 这是唯一一个多模态相关的测试集 但是没找到具体是哪个测试集 Re:Source
https://mp.weixin.qq.com/s/UGMfvPMwBIB4oFYZZejekA
files api也上线了
—— 来自 samsung SM-S9380, Android 16, 鹅球 v4.0
真耽误了AGI了吗
本帖最后由 80后卢瑟 于 2026-8-21 17:31 编辑
https://api-docs.deepseek.com/zh-cn/guides/vision
图片会根据其尺寸换算成 token,并与文本 token 一起计费。在进入模型前,每张图片都会被自动缩放:
[*]总像素小于约 384×384 的图片会被保持长宽比放大;
[*]更大的图片会被保持长宽比缩小,缩小后的总像素约相当于 800×800 的图片。
因此,每张图片消耗的 token 数存在上限(384 个):例如 2000×2000 和 5000×5000 的图片,经缩放后消耗的 token 数是相同的。单个请求包含多张图片时,每张图片独立按同一规则计算,不存在额外的计算方式。
啊这,多模态那可以瑟瑟吗
—— 来自 鹅球 v3.3.96
deepswe能上涨5分,说明多模态解决实际问题确实有帮助呀
🤔这么看来灰测🐟是装瞎的 这V4FV搞不好奇偶是灰测模型蒸出来的
goranger 发表于 2026-8-21 17:29
分数
只有Cybergym低了一分,价格还不变,这不会又吧服务器占满
王兰花秀丽 发表于 2026-8-21 17:29
这个Chartography是什么榜单 这是唯一一个多模态相关的测试集 但是没找到具体是哪个测试集 Re:Source ...
https://surgehq.ai/benchmarks/chartography
在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型一致
这个vision开源吗?
—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
80后卢瑟 发表于 2026-8-21 17:32
https://surgehq.ai/benchmarks/chartography
我找到这个了,问题是这个最高只有45%,计算方式不一样吗 Re:Source
梁叔叔评价可以提一级了嘛
v模型极简模式和anchored-standard都能触发we思维链,和flash 0731一样
这下看起来 8.13 的 v4pro,不是变成 纯小丑🤡 了嘛....
哈基梁最好早点把新pro端出来,不然这个价格配合这个性能, v4pro 就要当好几个月小丑王了