找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
发表于 2026-8-16 12:11 | 显示全部楼层
小野賢章 发表于 2026-8-16 09:37
nginx 本地3081端口代理3080,再用 cloudflared tunnel 连接到 nginx,可以手机访问了

这页面适配移动端, ...

大概就是拿网页版改的吧,移动端布局也是
回复

使用道具 举报

     
发表于 2026-8-16 12:12 | 显示全部楼层
半江瑟瑟半江红 发表于 2026-8-16 11:28
笑死我了,昨天我把D指导PRO在创造模式下整的一个烂货的json文件发给GPT分析,它都发现这肥鱼有点ADHD
结论 ...

可以看看V4发布时的论文,D老师注意力机制有三点,其中一个滑动窗口就是分配更多注意给最新的信息,另外两个是**加强超长上下文时的注意力的,理论上来说可以在一定程度上减少幻觉。
回复

使用道具 举报

     
发表于 2026-8-16 12:16 | 显示全部楼层
本帖最后由 tonyunreal 于 2026-8-16 13:31 编辑

dsh-anchored-standard模式
今天的pro给我的是中文思考链,看起来呆呆的


更新:和旧会话搏斗了一个半小时
下一个会话上来就是we need,没绷住

再更新:还是纯的一比,服了
回复

使用道具 举报

     
发表于 2026-8-16 12:19 | 显示全部楼层
让DSHj建立了nchored模式,跑了与极简模式下相同的任务(第三方评估一个codex的工作),让他自己评价:
2. 本次模式表现出的能力提升(有证据)
从“文档结论”推进到“重跑验证” 上次的评估主要基于 Codex 文档和源码阅读;本次实际重建了 0813(0/0)、Codex 699(0 Error / 20 Warning),并跑通 Codex 699 主机测试。现在能明确说:Codex 699 的 20 个 warning 属实、host tests 只在它自己定义的寄存器契约下 PASS。

抓出了上一版自身产物的 3 个不一致 极简模式上一版报告声称“VID/PID 沿用 0813 开发值”,但 V1 代码实际是 0x0573/0x1573,不是 0813 的 0x1234/0x5678。本次在 V2 修正。 同时发现并修正:

HID GET_REPORT 返回 {0,0},与 V1 报告描述符 Report ID 1 不一致(R-2 方向);
EP0 SentStall 清标志后无条件 return,可能吞掉同时到达的新 SETUP(R-1 方向)。
源码级证据链更完整 本次确认了 0813 的真实反馈闭环(SOF 测量 DMA 帧率 → IIR → slew),并确认 Codex 699 的 lx_feedback.c 退化为 nominal 常量反馈;确认了 Codex 硬件契约大面积 VERIFY-BOARD、VID/PID FFFF:2060 等问题。这些是上次报告中部分提及但未逐条坐实的内容。

保持了判断的一致性,没有为改而改 本次没有推翻“冻结 0813、bounded rewrite、V2 只作研究候选”的正确结论,而是在上一版基础上做增量修正,符合“单变量、可归因”原则。
回复

使用道具 举报

     
发表于 2026-8-16 12:19 来自手机 | 显示全部楼层
LeoDT 发表于 2026-8-16 12:12
可以看看V4发布时的论文,D老师注意力机制有三点,其中一个滑动窗口就是分配更多注意给最新的信息,另外 ...

原来如此,怪不得我用d指导和5.6sol对同一目标进行grill,一开始d指导跟个脑瘫一样,后面随着grill轮次增加逐渐能达到5.6水平了

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-16 12:22 | 显示全部楼层
罗莉控 发表于 2026-8-16 12:19
让DSHj建立了nchored模式,跑了与极简模式下相同的任务(第三方评估一个codex的工作),让他自己评价:
2.  ...

一句话总结
本次 Anchored Standard (experimental) 模式相对极简模式:战略判断持平,执行深度、证据链完整度、对自身产物的纠错能力明显提升
回复

使用道具 举报

     
发表于 2026-8-16 13:58 来自手机 | 显示全部楼层
上下文长了好像又是let me了,实际表现还好

—— 来自 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-16 14:10 | 显示全部楼层
虽然arg很好玩,但梁子还是赶紧搞一个正常的小版本出来吧
回复

使用道具 举报

     
发表于 2026-8-16 14:14 来自手机 | 显示全部楼层
用户会自己解决的。🐶
回复

使用道具 举报

     
发表于 2026-8-16 14:22 | 显示全部楼层
本帖最后由 Lorraine_Kinney 于 2026-8-16 15:16 编辑

我又测试了下,好像之前的提示词有问题,会让DSH直接扫原图转成SVG,但是有时候确实是让它一笔一笔复刻的
找了下之前的测试别人的提示词,增加了一些变数,就是变为临摹,画作变为伦勃朗的夜巡
用纯 SVG 复刻伦勃朗的《夜巡》,越还原越好,画法你自由发挥。仅几点小限制:
必须用"笔触"作画:短弧线/锥形描边模拟古典油画罩染与晕涂法(sfumato),笔触沿面部轮廓与体积方向排布,禁止大面积平涂与照片级渐变;笔触颜色要有邻近色抖动与深浅分层,明暗过渡柔和无硬边,远看成画、近看见笔。
要求 必须联网搜索原片进行参考。

WSL DSH PM 插件


相同提示词,GPT5.6 SOL MAX


为啥画画画这么好?


本来想试试克利斯蒂娜的世界吗,结果说版权没过期不让复刻,就变成了这样



本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-16 14:25 来自手机 | 显示全部楼层
原生极简模式,一直用到750k的上下文都什么问题

—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-8-16 14:41 来自手机 | 显示全部楼层
Lorraine_Kinney 发表于 2026-8-16 14:22
我又测试了下,好像之前的提示词有问题,会让DSH直接扫原图转成SVG,但是有时候确实是让它一笔一笔复刻的
...

灰度版本的svg能力似乎就很逆天
回复

使用道具 举报

发表于 2026-8-16 15:03 来自手机 | 显示全部楼层
看b站说harness乱删东西,现在解决问题没?编程相比其他国内的trae和qoder如何?

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-16 15:08 来自手机 | 显示全部楼层
魔法师lain 发表于 2026-8-16 15:03
看b站说harness乱删东西,现在解决问题没?编程相比其他国内的trae和qoder如何?

—— 来自 HUAWEI ALT-AL ...

怎么个乱删东西?很多情况下智能体乱动文件都是用户自己没约束好

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-16 15:11 | 显示全部楼层
魔法师lain 发表于 2026-8-16 15:03
看b站说harness乱删东西,现在解决问题没?编程相比其他国内的trae和qoder如何?

—— 来自 HUAWEI ALT-AL ...

不要随便用full access模式啊(虽然我偷懒经常用
回复

使用道具 举报

发表于 2026-8-16 15:12 来自手机 | 显示全部楼层
魔法师lain 发表于 2026-8-16 15:03
看b站说harness乱删东西,现在解决问题没?编程相比其他国内的trae和qoder如何?

—— 来自 HUAWEI ALT-AL ...

开沙盒权限啊,不要全放行
回复

使用道具 举报

发表于 2026-8-16 15:18 来自手机 | 显示全部楼层
如果是想让dsh自己改自己,那就把它的安装目录和配置目录加到工作区里面
回复

使用道具 举报

     
发表于 2026-8-16 15:32 | 显示全部楼层
今天在win上复现了we need思维链,不得不说真的有很大区别,没有那么多左右脑互搏的思考了,效率比先前高了不少,甚至比我使用flash在codex上还要快
回复

使用道具 举报

     
发表于 2026-8-16 15:33 来自手机 | 显示全部楼层
半江瑟瑟半江红 发表于 2026-8-16 11:28
笑死我了,昨天我把D指导PRO在创造模式下整的一个烂货的json文件发给GPT分析,它都发现这肥鱼有点ADHD
结论 ...

扯个题外话,写作这块Pro是真的不如flash,开了极简用一样的skill写文他就是不如flash,不要加任何限制的情况下他有时候甚至能写出r1那种癫味儿来
回复

使用道具 举报

发表于 2026-8-16 15:33 来自手机 | 显示全部楼层
乱删东西一般不是他真的要删,而是他写删除命令的时候,因为种种原因写错了。可能是他自己写错了,也可能是在Windows运行下命令解析的毛病。
回复

使用道具 举报

     
发表于 2026-8-16 15:35 来自手机 | 显示全部楼层
qz66618 发表于 2026-8-16 15:32
今天在win上复现了we need思维链,不得不说真的有很大区别,没有那么多左右脑互搏的思考了,效率比先前高了 ...

we need和let's根本上是杀掉了but wait 看到这玩意才是真的鬼打墙启动
回复

使用道具 举报

     
发表于 2026-8-16 15:44 | 显示全部楼层
把DSH迁移到WSL了,报错少了好多
回复

使用道具 举报

     
发表于 2026-8-16 15:53 | 显示全部楼层
迁移到wsl+anchored standard好多了,终于不用每一次思考几分钟,统计数据量toolcall和llm的用时现在**开
回复

使用道具 举报

     
发表于 2026-8-16 16:00 | 显示全部楼层
另外我感觉是不是AI时代安装什么东西基本都不考虑人工安装时候的可操作性了,感觉我自己弄的插件和别人用AI写的一些小项目让AI来装都会一直提示踩坑,想让AI修成人工也能方便的部署也没啥效果
回复

使用道具 举报

发表于 2026-8-16 16:05 | 显示全部楼层
用了风神那个dsh-routing-suite 主观体感上 flash 变强了,干活快了好多,出错也少

希望官方赶紧更新吧…
回复

使用道具 举报

     
发表于 2026-8-16 16:22 来自手机 | 显示全部楼层
LeoDT 发表于 2026-8-16 09:48
pro这个状态确实验证我之前的担心,如果D老师坚持开源路线,就不应该像O/A两家针对harness训模型,希望他 ...

和这个也啥没关系,Kimi 和智谱也都提到了后训练单一环境的问题
区别只是别人是解决完发布的,ds4 是发现之后一时修不好迫不得已先发了

—— 来自 Xiaomi 24072PX77C, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-16 16:30 来自手机 | 显示全部楼层
不问问ai一般出现这种问题要多久才能修好?

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-16 16:32 来自手机 | 显示全部楼层
蹬到0.1收尾,用中转站去了
回复

使用道具 举报

     
发表于 2026-8-16 16:40 | 显示全部楼层
就是脑裂了,we need执行力强,let me规划能力强,但是中间胼胝体有问题,就现在这个样子了……
回复

使用道具 举报

     
发表于 2026-8-16 16:41 | 显示全部楼层
所以现在是赛博精神病阶段……
回复

使用道具 举报

     
发表于 2026-8-16 16:46 来自手机 | 显示全部楼层
lactone 发表于 2026-8-16 16:30
不问问ai一般出现这种问题要多久才能修好?

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99 ...

Gpt认为最少一两天,最多几周,除非你丢了检查点。但是现在看起来他们真把七月那么好的检查点直接丢了?
回复

使用道具 举报

     
发表于 2026-8-16 16:50 来自手机 | 显示全部楼层
tillnight 发表于 2026-8-16 16:46
Gpt认为最少一两天,最多几周,除非你丢了检查点。但是现在看起来他们真把七月那么好的检查点直接丢了? ...

就这种草台班子我觉得很有可能

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-8-16 16:52 来自手机 | 显示全部楼层
let's和let me有啥区别
回复

使用道具 举报

     
发表于 2026-8-16 16:53 来自手机 | 显示全部楼层
阿刚 发表于 2026-8-16 15:33
扯个题外话,写作这块Pro是真的不如flash,开了极简用一样的skill写文他就是不如flash,不要加任何限制的 ...

Flash参数量还是太少了

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-16 16:54 | 显示全部楼层
灰度版说不定就是这样的,当时抽签抽到了let me 的灰度版可能以为就是预览版,因为性能差
回复

使用道具 举报

     
发表于 2026-8-16 16:56 | 显示全部楼层
tillnight 发表于 2026-8-16 16:46
Gpt认为最少一两天,最多几周,除非你丢了检查点。但是现在看起来他们真把七月那么好的检查点直接丢了? ...

修的必要不大吧,flash已经足够好,是能够干活的模型,对企业来说本地部署压力也不大
deepseek人本来就少,现在还在大规模招人,算力资源也不够。而且即使修好了,涨价以后即使修完pro性价比也一般,性能上也有更好的代替
所以理性的做法是把有限的资源投到dsh和下一个版本的模型上


回复

使用道具 举报

     
发表于 2026-8-16 16:58 | 显示全部楼层
灰测版比现在还要强很多吧,而且你说内部测试的模型丢了也就算了,放出来测试的肯定有特殊之处吧    Re:Source
回复

使用道具 举报

     
发表于 2026-8-16 16:58 来自手机 | 显示全部楼层
小野賢章 发表于 2026-8-16 16:54
灰度版说不定就是这样的,当时抽签抽到了let me 的灰度版可能以为就是预览版,因为性能差 ...

现在复现的思维链只是能达到官方跑分水平。灰测的明显要更强,仍然不是一个level。
回复

使用道具 举报

     
发表于 2026-8-16 17:02 来自手机 | 显示全部楼层
cscbzcbz 发表于 2026-8-16 16:56
修的必要不大吧,flash已经足够好,是能够干活的模型,对企业来说本地部署压力也不大
deepseek人本来就少 ...

V4基模又不可能丢了,还得用起码大半年呢。后面的小版本还要更多模态,正常来说肯定要回滚回没有过拟合的检查点继续训练吧,总不能在现在这个过拟合产物上继续迭代吧。不修不也得修,起码也得回滚。不会没有正常的检查点回滚吧,哪怕不是灰测的。
回复

使用道具 举报

     
发表于 2026-8-16 17:03 | 显示全部楼层
现在还没能复现灰测的i'll和i'am思维链,所以现在的模型还不能说就是和灰测一样的模型。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-25 03:44 , Processed in 0.193474 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表