找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-22 09:50 | 显示全部楼层
qwased 发表于 2026-8-22 09:47
自有硬件了不能保持24小时占用60%以上感觉都是爆亏也不知道硬件涨价还能涨多久,不涨了的话折旧一点吓人 ...

极客湾的云飞在直播里说手机涨价可能要持续到29年,虽然不知道真的假的,不过硬件应该也有参考价值吧
回复

使用道具 举报

     
发表于 2026-8-22 09:52 来自手机 | 显示全部楼层
last_regret 发表于 2026-8-22 09:49
网页版没有flash-vision-exp吧。开联网搜索后网页版能识别卡迪公,不能识别野兽;chatbox的flash-vision- ...

网页版当然更新了,识图模式就是。昨天api更新4v的时候识图模式一起挂了一会,然后联网搜索就上线了,怎么可能没更新模型。
回复

使用道具 举报

     
发表于 2026-8-22 09:54 来自手机 | 显示全部楼层
本帖最后由 tillnight 于 2026-8-22 09:57 编辑
last_regret 发表于 2026-8-22 09:49
网页版没有flash-vision-exp吧。开联网搜索后网页版能识别卡迪公,不能识别野兽;chatbox的flash-vision- ...


另外chatbox是没有适配ds的api的联网搜索功能的,只能用chat接口,所以无法调用自带的搜索。在agent时代chatbox已经不太能用了。你现在测的识别人物功能谁家都得靠搜索功能来做的,本身的世界知识够也很容易幻觉。这本身是个工程实现问题,比如识图好用的豆包,他的基座模型肯定是一个比v4 flash小的量化模型,不然豆包不会舍得给c端免费用,但是他识图是sota的,显然依赖的是搜索的联网数据库数据。
回复

使用道具 举报

     
发表于 2026-8-22 09:58 来自手机 | 显示全部楼层
tillnight 发表于 2026-8-22 09:54
另外chatbox是没有适配ds的api的联网搜索功能的,只能用chat接口。在agent时代chatbox已经不太能用了。你 ...

那我回去试试,手机上只有chatbox
回复

使用道具 举报

发表于 2026-8-22 10:02 | 显示全部楼层
怎么说,周六日是梁谷还是梁峰还是和周1-5一样划分
回复

使用道具 举报

     
发表于 2026-8-22 10:03 | 显示全部楼层
搜索对于认人这种场景基本没用吧,本来就认不出来难道还能用关键词搜几十张男的一一比对吗    Re:Source
回复

使用道具 举报

     
发表于 2026-8-22 10:10 | 显示全部楼层
jinuzuktII 发表于 2026-8-22 10:02
怎么说,周六日是梁谷还是梁峰还是和周1-5一样划分

试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。
回复

使用道具 举报

     
发表于 2026-8-22 10:10 来自手机 | 显示全部楼层
认人这个根本不是识图能力而是世界知识…
回复

使用道具 举报

     
发表于 2026-8-22 10:12 | 显示全部楼层
这个匿名的glm模型很有意思,思考强度开到max就是雷霆巨大思考,输出2wtoken思考半小时
开到high就是很dsv4flash的风格
开到low并不是不思考,而是把思考内容通过文件读写注释写到文件里面,然后再读文件强行思考

你这low何意味啊
回复

使用道具 举报

发表于 2026-8-22 10:13 | 显示全部楼层
LeoDT 发表于 2026-8-22 10:10
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。 ...

啊,梁叔叔太狠了
回复

使用道具 举报

     
发表于 2026-8-22 10:18 | 显示全部楼层
LeoDT 发表于 2026-8-22 10:10
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。 ...

啊 被ds骗了
回复

使用道具 举报

     
发表于 2026-8-22 10:21 | 显示全部楼层
我去,官方他这缓存保存超过12个小时!牛哇!
回复

使用道具 举报

     
发表于 2026-8-22 10:29 | 显示全部楼层
问个问题,4080s 16G 本地部署小的视觉模型,是Qwen2.5-VL:14b,Qwen3-VL:8b,还是Qwen3.5:9b,主要是识别画面里的内容,描述越清楚越好
回复

使用道具 举报

发表于 2026-8-22 10:32 来自手机 | 显示全部楼层
周末也搞峰谷吗?梁子这么搞你就没意思了。
回复

使用道具 举报

     
发表于 2026-8-22 10:46 来自手机 | 显示全部楼层
笑死,给大肥鱼识图塞了三张港产片利智和吴家丽穿和服的电影截图,无一例外被鉴定为艺妓回忆录的章子怡。

大肥鱼究竟有多喜欢章子怡。
回复

使用道具 举报

发表于 2026-8-22 10:48 | 显示全部楼层
本帖最后由 自由之紫roy 于 2026-8-22 10:57 编辑

我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说又涨了2000。换了cpu,换了gpu,换了ssd,换了电源,相当于都换掉了。
-----------------------------------------------------------------

目前设备是
万兆交换机和路由器,2000M电信宽带有公网ip
1、绿联4800p 4*14T 512G*2 ssd缓存 ups 备份数据,docker下载,照片服务器 万兆网卡

2、8840HX 64G 5600ddr5 5070ti 12G 笔记本  玩玩2k路径光追3a也足够了,日常就是远程操作端
3、macmini m4pro 24G 2Tssd,万兆网卡,主要放hermes,openclaw,codex等agent harness,远程用笔记本调用
4、新pc也是万兆网卡,做量化因子训练,挖掘,回测等,需要高精度的权重模型,附带圆一个电影梦想
目前的配置应该是足够折腾好久了,如果后续觉得要升级,还能加一块pro5000 72g 原生pcie 8x,可以跑更大模型

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-8-22 11:00 | 显示全部楼层
自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...

真壕啊,羡慕
回复

使用道具 举报

     
发表于 2026-8-22 11:04 | 显示全部楼层
自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...

可以研究网剧一条龙变现了
回复

使用道具 举报

     
发表于 2026-8-22 11:05 | 显示全部楼层
自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...

想知道这个跑minimax  h3 15秒需要多久出,真眼馋啊    Re:Source
回复

使用道具 举报

     
发表于 2026-8-22 11:07 | 显示全部楼层
另外这几天蹬了gemini 3.7flash差不多30%的周限额,感觉哈基米用来许愿编程还是比flash0731笨很多,一个启动WSL对应项目+保活的脚本他先把之前flash0731一轮就做好的改坏了,我发现了之后聊了两轮才成功自己独立思考改回去flash0731的做法
回复

使用道具 举报

发表于 2026-8-22 11:12 | 显示全部楼层
王兰花秀丽 发表于 2026-8-22 11:05
想知道这个跑minimax  h3 15秒需要多久出,真眼馋啊    Re:Source

比5090 32G慢15%,比4090快20%,就是质量高的纹理,长工作流不会爆
回复

使用道具 举报

发表于 2026-8-22 11:24 | 显示全部楼层
本帖最后由 jinuzuktII 于 2026-8-22 11:31 编辑

波峰时段我这种非生产力用户蹬不起v4,先用gemini反代玩DSH吧……
回复

使用道具 举报

     
发表于 2026-8-22 11:29 来自手机 | 显示全部楼层
我前几天刚通过ollama加载qwen2.5-vl-7B模型给DSH开了眼,现在就有官方多模态模型了

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-22 11:33 | 显示全部楼层
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次怀疑是不是自己选错api模型了。
你们碰到这种情况了吗。
回复

使用道具 举报

     
发表于 2026-8-22 11:36 | 显示全部楼层
唠叨 发表于 2026-8-22 11:33
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次 ...

没错,我有几次也是猛蹬后发现额度没少,权当额度重置福利了
回复

使用道具 举报

     
发表于 2026-8-22 11:53 | 显示全部楼层
唠叨 发表于 2026-8-22 11:33
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次 ...

国算这个延迟特别高,感觉一天才正真更新一次
今天国算特别顺滑,不知道是优化了部署和硬件,还是就是周末需求少了
回复

使用道具 举报

     
发表于 2026-8-22 11:56 来自手机 | 显示全部楼层
有楼友知道OpenCode go到底怎么计费的吗
我查了opencode自己和支付宝的记录都只有六月份的5刀支付,但go的api我到现在都还能正常用
回复

使用道具 举报

发表于 2026-8-22 12:02 | 显示全部楼层
囧Smith 发表于 2026-8-22 11:56
有楼友知道OpenCode go到底怎么计费的吗
我查了opencode自己和支付宝的记录都只有六月份的5刀支付,但go的a ...

楼里好像不止你一个人的opencode go碰到这种问题

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-22 12:03 来自手机 | 显示全部楼层
我设置的信用卡自动扣费怎么每个月都没算错

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-22 12:49 来自手机 | 显示全部楼层
asier 发表于 2026-8-22 09:31
https://agentrouter.org/register?aff=gUnC
发现sol5.6烧得好快

问题又是程序员特供啊

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-22 13:06 | 显示全部楼层
昨晚8点好像又更新了呀,现在直接把仓库clone下来用pnpm自己安装的
回复

使用道具 举报

发表于 2026-8-22 13:20 来自手机 | 显示全部楼层
本帖最后由 xiaohanne 于 2026-8-22 13:29 编辑

实测算了一下gpt plus的额度被砍了20%,和网传数据基本一致。
回复

使用道具 举报

     
发表于 2026-8-22 13:53 | 显示全部楼层
最近我codex都会弹提示建议我用更快更便宜的模型
o➗不会也在整蛊了吧

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-22 13:56 | 显示全部楼层
这两天基本干一样的活,codex 100刀套餐周额度直接干掉40%肉眼可见的比以前掉的快了
回复

使用道具 举报

     
发表于 2026-8-22 14:04 | 显示全部楼层
装最大方的,然后偷偷砍额度
在网页/app和codex里都弹提示建议换更便宜的模型
o➗也被用户影响到训练agi了?

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-22 14:12 | 显示全部楼层
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不多,蹬的越多蹬的越爽
现在被培养出来的对甜点模型的庞大需求无处可去了,到哪炸哪,OAI都顶不住,嘴上说luna管够实际上慢的要死
回复

使用道具 举报

发表于 2026-8-22 14:19 | 显示全部楼层
qwased 发表于 2026-8-22 14:12
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不 ...

把我炸到自己高价买机器了。。。这真是dsv4flash惯出来的
回复

使用道具 举报

     
发表于 2026-8-22 14:21 | 显示全部楼层
自由之紫roy 发表于 2026-8-22 14:19
把我炸到自己高价买机器了。。。这真是dsv4flash惯出来的

老哥你这个配置跑 v4f  能有多少 pp和tg...长上下文的
回复

使用道具 举报

     
发表于 2026-8-22 14:23 | 显示全部楼层
qwased 发表于 2026-8-22 14:12
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不 ...

刚才梁文谷又找回前阵子跟flash pair programming的感觉了,快速迭代反复验证太爽了。sol/luna试用的这一周总结下来就是这效率根本就是浪费时间,我刷网页等它的时间明显增多,而且context焦虑过于严重,经常handoff,以前被flash惯出来的工作流完全没法用。

plus的20刀肯定是压不住flash随便用,但是用量考虑真订100刀的话还不如全给flash了。
回复

使用道具 举报

发表于 2026-8-22 14:27 | 显示全部楼层
phorcys02 发表于 2026-8-22 14:21
老哥你这个配置跑 v4f  能有多少 pp和tg...长上下文的

本地模型会越做越好的。明年的27b完全超过现在的v4flash0731毫无问题的
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-24 16:26 , Processed in 0.152947 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表