找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-21 17:08 | 显示全部楼层
确实实装了
回复

使用道具 举报

     
发表于 2026-8-21 17:09 | 显示全部楼层
相关文档也更新了
回复

使用道具 举报

     
发表于 2026-8-21 17:11 | 显示全部楼层
看到了,和flash价格一样
回复

使用道具 举报

     
发表于 2026-8-21 17:12 | 显示全部楼层
如果不如现在的v4flash,可以作为子代理仅识图吗?或者mcp接过去?
回复

使用道具 举报

     
发表于 2026-8-21 17:12 | 显示全部楼层
时间: 2026-08-21
DeepSeek-V4-Flash-Vision-Exp 发布
今天,全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台,这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。

Terminal Bench 2.1: 83.9
NL2Repo: 57.7
DeepSWE: 59.3
DSBench-Hard: 63.6
AutomationBench (Public): 25.7
ApexBench (Pass@1): 36.5
Agents' Last Exam: 27.3
Chartography: 64.3 (p0.95); 63.3 (p1.0)
ZeroBench (Pass@5): 35.0
* 对于公开基准测试集中的 Code Agent 文本任务,DeepSeek 系列模型使用 DeepSeek Harness 极简模式作为框架进行测试,并使用 max 档位,topp=0.95,temperature=1.0;在 ApexBench 与 Agents' Last Exam 测评中,文本模型 DeepSeek-V4-Flash 会忽略其中的多模态元素

在纯文本能力(Agent、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash 正式版持平。

看起来性能和4F齐平,那可以直接拿来替换4F了

评分

参与人数 1战斗力 -2 收起 理由
chilming -2 这次识图是路由的谁

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-21 17:13 | 显示全部楼层
分比flash还高,我错了
回复

使用道具 举报

发表于 2026-8-21 17:14 来自手机 | 显示全部楼层
这下真的耽误AGI训练了
回复

使用道具 举报

发表于 2026-8-21 17:15 | 显示全部楼层
只有官方api有吗,opc呢
回复

使用道具 举报

     
发表于 2026-8-21 17:16 来自手机 | 显示全部楼层
期待opencode下了free的flash是为了换这个
但愿

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-21 17:16 来自手机 | 显示全部楼层
上线了,你们不试试app或者网页吗。
我直接更新app之后,快速模式直接上传图片就识图了。

—— 来自 OnePlus PKX110, Android 16, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-21 17:16 | 显示全部楼层
别又是极简模式下和flash持平吧
回复

使用道具 举报

     
发表于 2026-8-21 17:18 | 显示全部楼层
等梁文谷测一下
回复

使用道具 举报

     
发表于 2026-8-21 17:19 | 显示全部楼层
文字方面明明是全面提升,竟然叫持平吗...    Re:Source
回复

使用道具 举报

发表于 2026-8-21 17:22 | 显示全部楼层
王兰花秀丽 发表于 2026-8-21 17:19
文字方面明明是全面提升,竟然叫持平吗...    Re:Source

对他们来说这是标准差范围吧
回复

使用道具 举报

     
发表于 2026-8-21 17:22 | 显示全部楼层
不是持平flash,是 超过了flash  比pro都只差一点了...
回复

使用道具 举报

     
发表于 2026-8-21 17:24 来自手机 | 显示全部楼层
不是,这个分数全都比Flash高啊,这还持平?
回复

使用道具 举报

     
发表于 2026-8-21 17:24 | 显示全部楼层
hugosol 发表于 2026-8-21 17:16
别又是极简模式下和flash持平吧

说实话极简模式挺好的,写代码本来就只要bash就能写了,应该再激进一点什么tool什么mcp的全都弄成bash命令,全写bash,Code Mode这不就有了么。
回复

使用道具 举报

     
发表于 2026-8-21 17:25 来自手机 | 显示全部楼层
misuzu0723 发表于 2026-8-21 16:37
光靠这个打不死,opus5能做类似的
https://deepdemos.top/demo/claude-opus-5-9d3ec162
目前支持路由的基 ...

你这完全不是一个东西啊,而且opus5什么臭鱼烂虾

—— 来自 HUAWEI SGT-AL50, Android 16, 鹅球 v3.4.97-alpha
回复

使用道具 举报

     
发表于 2026-8-21 17:25 | 显示全部楼层
不会真的涨价腾空算力,一切都会好起来吧
梁子真这么实诚么?
回复

使用道具 举报

     
发表于 2026-8-21 17:25 | 显示全部楼层
这两天各种灰度的都以为是pro,结果是多模态吗
回复

使用道具 举报

     
发表于 2026-8-21 17:27 来自手机 | 显示全部楼层
舞以 发表于 2026-8-21 17:25
不会真的涨价腾空算力,一切都会好起来吧
梁子真这么实诚么?

主要是也就腾了一周的算力吧 又是多模态又是灰测?

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-21 17:27 | 显示全部楼层
我准备我我这几天写的html玩具全都用flash-vision重新跑一下,看看是pro厉害,还是带视觉厉害
回复

使用道具 举报

     
发表于 2026-8-21 17:28 来自手机 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-8-21 17:31 编辑
goranger 发表于 2026-8-21 17:25
这两天各种灰度的都以为是pro,结果是多模态吗


明显是另一个基模,多模态可能有训练,但是没有识图接口,Flash没有这么大的知识量,也没这么低的TPS
回复

使用道具 举报

     
发表于 2026-8-21 17:29 来自手机 | 显示全部楼层
感觉开放之后,梁子打开后台一看,不会收集了一堆涩图的对话数据吧
回复

使用道具 举报

     
发表于 2026-8-21 17:29 | 显示全部楼层
分数

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-21 17:29 | 显示全部楼层
这个Chartography是什么榜单 这是唯一一个多模态相关的测试集 但是没找到具体是哪个测试集    Re:Source
回复

使用道具 举报

     
发表于 2026-8-21 17:30 来自手机 | 显示全部楼层
https://mp.weixin.qq.com/s/UGMfvPMwBIB4oFYZZejekA

files api也上线了

—— 来自 samsung SM-S9380, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-21 17:30 | 显示全部楼层
真耽误了AGI了吗
回复

使用道具 举报

     
发表于 2026-8-21 17:30 | 显示全部楼层
本帖最后由 80后卢瑟 于 2026-8-21 17:31 编辑

https://api-docs.deepseek.com/zh-cn/guides/vision

图片会根据其尺寸换算成 token,并与文本 token 一起计费。
在进入模型前,每张图片都会被自动缩放:
  • 总像素小于约 384×384 的图片会被保持长宽比放大;
  • 更大的图片会被保持长宽比缩小,缩小后的总像素约相当于 800×800 的图片。
因此,每张图片消耗的 token 数存在上限(384 个):例如 2000×2000 和 5000×5000 的图片,经缩放后消耗的 token 数是相同的。单个请求包含多张图片时,每张图片独立按同一规则计算,不存在额外的计算方式。

回复

使用道具 举报

     
发表于 2026-8-21 17:30 来自手机 | 显示全部楼层
啊这,多模态那可以瑟瑟吗

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-8-21 17:30 | 显示全部楼层
deepswe能上涨5分,说明多模态解决实际问题确实有帮助呀
回复

使用道具 举报

     
发表于 2026-8-21 17:32 | 显示全部楼层
🤔这么看来灰测🐟是装瞎的 这V4FV搞不好奇偶是灰测模型蒸出来的
回复

使用道具 举报

     
发表于 2026-8-21 17:32 | 显示全部楼层

只有Cybergym低了一分,价格还不变,这不会又吧服务器占满
回复

使用道具 举报

     
发表于 2026-8-21 17:32 | 显示全部楼层
王兰花秀丽 发表于 2026-8-21 17:29
这个Chartography是什么榜单 这是唯一一个多模态相关的测试集 但是没找到具体是哪个测试集    Re:Source ...

https://surgehq.ai/benchmarks/chartography
回复

使用道具 举报

     
发表于 2026-8-21 17:33 | 显示全部楼层
在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型一致
回复

使用道具 举报

     
发表于 2026-8-21 17:33 来自手机 | 显示全部楼层
这个vision开源吗?

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-8-21 17:33 | 显示全部楼层
80后卢瑟 发表于 2026-8-21 17:32
https://surgehq.ai/benchmarks/chartography

我找到这个了,问题是这个最高只有45%,计算方式不一样吗    Re:Source
回复

使用道具 举报

     
发表于 2026-8-21 17:33 | 显示全部楼层
梁叔叔评价可以提一级了嘛
回复

使用道具 举报

     
发表于 2026-8-21 17:34 | 显示全部楼层
v模型极简模式和anchored-standard都能触发we思维链,和flash 0731一样
回复

使用道具 举报

     
发表于 2026-8-21 17:34 | 显示全部楼层
这下看起来 8.13 的 v4pro,不是变成 纯小丑🤡 了嘛....
哈基梁最好早点把新pro端出来,不然这个价格配合这个性能, v4pro 就要当好几个月小丑王了
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-24 17:14 , Processed in 0.143789 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表