找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-8 00:57 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-8-8 01:05 编辑

怎么还吹上了,还敢国外代工不就是擦边吗还怎么样?你看同样造芯片的平头哥还去不去代工了?前几页漏油分析是没问题啊,就这风格……
回复

使用道具 举报

发表于 2026-8-8 01:01 | 显示全部楼层
唉,我草,我从字节的TRAE迁移到了OpenCode,配合V4F正式版好用得很呐,原本用的是啥玩意哦
回复

使用道具 举报

     
发表于 2026-8-8 01:04 | 显示全部楼层
羊寢 发表于 2026-8-7 18:44
还是夏瑾啊,前几天有更新的

不知道是不是用的open code,还是什么原因感觉有点不如之前好用

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-8 01:05 | 显示全部楼层
绝地潜兵 发表于 2026-8-8 01:01
唉,我草,我从字节的TRAE迁移到了OpenCode,配合V4F正式版好用得很呐,原本用的是啥玩意哦 ...

这东西比qoder还拉,根本没法用的程度,也不知道前几个月强制员工用后面怎么了……
回复

使用道具 举报

发表于 2026-8-8 01:10 来自手机 | 显示全部楼层
当年中美都批准了老黄收购Mellanox现在想想也是神奇,没这个的话老黄NVL72/144那些大节点内部的通信能力完全比不了华为,现在老黄优势会少一些。
回复

使用道具 举报

     
发表于 2026-8-8 01:10 来自手机 | 显示全部楼层
绝地潜兵 发表于 2026-8-8 01:01
唉,我草,我从字节的TRAE迁移到了OpenCode,配合V4F正式版好用得很呐,原本用的是啥玩意哦 ...

不如再试试zcode

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0

评分

参与人数 1战斗力 +1 收起 理由
zxdrtyhn + 1 zcode是真不错

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-8 01:11 | 显示全部楼层
字节之前都吹是未来的中国谷歌,这下llm领域真是卧龙凤雏了。
张一鸣说的批话和谷歌人员流失不好说哪个更让人难绷。
回复

使用道具 举报

发表于 2026-8-8 01:16 | 显示全部楼层
还有更垃圾的cherry agent,联网搜索都要你消费它家的API才肯干活,绝绝子
回复

使用道具 举报

     
发表于 2026-8-8 01:18 | 显示全部楼层
codex让我觉得好用的还是那个桌面端,但是桌面端有严重的长时间运行之后卡爆整个电脑,必须重启的问题
希望dsh出来之后有好用的第三方桌面端
回复

使用道具 举报

发表于 2026-8-8 01:42 | 显示全部楼层
goranger 发表于 2026-8-7 23:42
我那个回复应该有误,应该是主要是通过go套餐调用就行后边我发了图

论坛助手,iPhone ...

哦,那就好,我在用reasonix,差点想换opencode了
回复

使用道具 举报

     
发表于 2026-8-8 06:21 | 显示全部楼层
本帖最后由 80后卢瑟 于 2026-8-8 06:27 编辑
13号 发表于 2026-8-8 00:21
没有恶意。 但是我都用pi了, 啥我不会自己搞定啊, 搞不定我直接打开pi让他自己给我推荐工具自己装上了 ...

单纯图省事的东西,会比较方便。就像你自己有一个配置列表,你也可以一键 apply 你自己的插件列表和 skills 一样。

想省事就用默认推荐,想高度定制就自己设置列表一键安装
回复

使用道具 举报

     
发表于 2026-8-8 08:11 | 显示全部楼层
因为多卡互联的进步,现在训超大模型在硬件上应该是没问题的。
但现在模型尺寸应该不是唯一重要维度了,去年的思考模式、今年的Agent能力
而且思考模式今年也在发展,思考长度换智商需要长的上下文长度,现在普遍1M的情况下各家不同的注意力机制也带来了不同的效果和实现成本。
可以说如果没有先进的技术底座,模型就算很大也只是很贵罢了。
回复

使用道具 举报

     
发表于 2026-8-8 08:34 来自手机 | 显示全部楼层
脸宽 发表于 2026-8-8 01:04
不知道是不是用的open code,还是什么原因感觉有点不如之前好用

论坛助手,iPhone ...

flash正式版确实甲变厚了不少
可能是这个原因导致的
回复

使用道具 举报

     
发表于 2026-8-8 10:48 | 显示全部楼层
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?
或者单纯使用体验上,想要比较好的生态以及扩展能力,然后又要保证至少比肩Claude Code的工作能力的agent?
回复

使用道具 举报

     
发表于 2026-8-8 10:50 来自手机 | 显示全部楼层
焚尘 发表于 2026-8-8 10:48
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?或者单纯使用体验上,想要 ...

那你一句比肩claudecode就杀死比赛了
本来我还想推荐一下zcode的,但这玩意其实还不如opencode

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-8 10:50 | 显示全部楼层
codex 之前我用得少的时候天天重置,这周我把月额度蹬完了,然后一直没有重置
回复

使用道具 举报

     
发表于 2026-8-8 11:38 | 显示全部楼层
焚尘 发表于 2026-8-8 10:48
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?
或者单纯使用体验上,想要 ...

如果用的v4f可以用reasonix先过渡一下等专武,其它模型其实codex也可以,不是非得用cc的
回复

使用道具 举报

     
发表于 2026-8-8 12:07 | 显示全部楼层
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存?

论坛助手,iPhone
回复

使用道具 举报

发表于 2026-8-8 12:12 来自手机 | 显示全部楼层
本帖最后由 来都来了 于 2026-8-8 12:55 编辑

想多了,持续学习八成就是类似Claude,给你本地整一个MD文档,平时的错题本都记到里面。

错题本这个东西,刚开始的效果都挺好。但是随着你用的时间越来越久,错题本里的内容越来越多,AI的注意力也会下降。在长对话中,无视错题本的情况是非常多见的。

我的设想是,云端大模型加本地小模型,也许是一个可行的方案。本地小模型就相当于绘画时用的Lora一样,其内容会覆盖在大模型之上。本地小模型自动进行训练,实现长期存储的效果,在运行时要求本地有一定的算力,不要求太高,但是集显或亮机卡肯定不行,如果能实现3060级别的显卡流畅运行的话,应该是个很有竞争力的方案。
回复

使用道具 举报

发表于 2026-8-8 12:13 | 显示全部楼层
CCauchy 发表于 2026-8-8 12:07
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存 ...

不知道怎么搞,都说是探索中了    Re:Source
回复

使用道具 举报

     
发表于 2026-8-8 12:19 来自手机 | 显示全部楼层
CCauchy 发表于 2026-8-8 12:07
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存 ...

这是明年的核心技术,现在有人能拿出来话堪比V4f正式版去年年中问世。
回复

使用道具 举报

     
发表于 2026-8-8 12:21 来自手机 | 显示全部楼层
焚尘 发表于 2026-8-8 10:48
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?
或者单纯使用体验上,想要 ...

那只有Pi了,但很多东西要自己配

—— 来自 HUAWEI NOH-AN00, Android 12, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-8 12:26 | 显示全部楼层
张一鸣不纯种汉奸吗?蒸馏本来就是正常行为到他嘴里变成啥十恶不赦的事情了。
就像老美抵制新疆棉,这时候一个中国服装企业跳出来说本公司任何产品绝不使用新疆棉,别人怎么看?

评分

参与人数 7战斗力 +7 收起 理由
那牛喝多 + 1 好评加鹅
蜗塞塞 + 1
德尔惠净水器 + 1
果壳中的松鼠 + 1 好评加鹅
zhanglei1943 + 1
squallx + 1 没毛病
王兰花秀丽 + 1 好评加鹅

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-8 12:44 来自手机 | 显示全部楼层
CCauchy 发表于 2026-8-8 12:07
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存 ...

我是觉得只要一天还要缓存上下文 而不是自由高速存储 那就一天没有agi
可能是我啥都不懂的错觉就是了

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-8 12:59 | 显示全部楼层
neptunehs 发表于 2026-8-8 12:44
我是觉得只要一天还要缓存上下文 而不是自由高速存储 那就一天没有agi
可能是我啥都不懂的错觉就是了

呃,前者是一种功能,后者是一种实现方式,看不懂

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-8 13:03 | 显示全部楼层
也许应该有一种印象层/模糊记忆层,用来指导模型何时去精读之前的上下文,这样就没有上下文窗口的概念了,才能真正解决上下文腐败,大概几mb大小,可以跨会话继承,也没有微调的概念了(可以先破甲再共享了,塞点重口的东西

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-8 13:57 | 显示全部楼层
为什么现在才说张一鸣是汉奸,前两年抖音收购第一时间给美国跪下不就已经定性了吗
回复

使用道具 举报

     
发表于 2026-8-8 14:02 来自手机 | 显示全部楼层
英伟达免费API更新flash0731了,现在没多少人发现速度还挺快
回复

使用道具 举报

     
发表于 2026-8-8 14:13 来自手机 | 显示全部楼层
Luminous脑壳痛 发表于 2026-8-8 13:57
为什么现在才说张一鸣是汉奸,前两年抖音收购第一时间给美国跪下不就已经定性了吗 ...

火星公民张一鸣,没错,这次是双重验证
回复

使用道具 举报

发表于 2026-8-8 14:24 | 显示全部楼层
张一鸣自家的seed没少拿他家coding plan付费用户的数据炼
还好意思提不让蒸馏的事
是怕被别人看穿就算蒸也是一坨翔吧
回复

使用道具 举报

     
发表于 2026-8-8 14:43 | 显示全部楼层
来都来了 发表于 2026-8-8 12:12
想多了,持续学习八成就是类似Claude,给你本地整一个MD文档,平时的错题本都记到里面。

错题本这个东西, ...

为什么要用md啊。
推理路由的相关路径会在概率分布上呈现出来,也就是向量梯度。那么把用户特征记下来就好了。没必要整全部上下文,前AI时代都能处理用户画像然后用算法推送。只是用户画像精准,本质是需求分析,不代表模型可以持续学习。
回复

使用道具 举报

     
发表于 2026-8-8 14:44 | 显示全部楼层
持续学习和记忆系统什么的其实已经有点过时了,因为大家发现这玩意做得太傻瓜式反而不好用,塞进来的大部分不是你想要的东西
我个人更想要的是可以主动控制agent加载哪方面的记忆,简单地说就是上下文管理,然后更进一步就是怎么构造更高质量的上下文
回复

使用道具 举报

发表于 2026-8-8 14:48 来自手机 | 显示全部楼层
梁鸽说的“持续学习”应该是类似训练阶段吧,模型自主训练

模型自己在学习.jpg

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-8 14:54 | 显示全部楼层
现在的新模型就能摆脱之前的各种skill,因为真正有价值的工作轨迹都被后训练塞进去了,梁鸽的意思是这一步,乃至涉及到知识本身的变化都能持续自主完成?
感觉挺难的,和llm架构本身都有冲突,能搞出来说明ds牛逼呗
回复

使用道具 举报

     
发表于 2026-8-8 15:11 来自手机 | 显示全部楼层
现在deepseek的网页端和app基本没法用了现在搜索资料和简单对话用哪个app好一点,千问?

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-8 15:14 来自手机 | 显示全部楼层
很久就在那边l 发表于 2026-8-8 14:02
英伟达免费API更新flash0731了,现在没多少人发现速度还挺快

顺便据说amd也有了 也是一天多少免费额度来着

不过我不知道怎么搞

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-8 15:45 来自手机 | 显示全部楼层
Flash被蹬智障了吧让他写个冒险加人的故事坚持要把人直接加进来
回复

使用道具 举报

发表于 2026-8-8 15:54 | 显示全部楼层
你还说别,你要说Zcode是DS的伪专武还真没问题,毕竟5.2的底模是ds3.2,你就说是不是ds系列的吧
回复

使用道具 举报

     
发表于 2026-8-8 15:55 来自手机 | 显示全部楼层
蛋黄酱Release 发表于 2026-8-8 15:11
现在deepseek的网页端和app基本没法用了现在搜索资料和简单对话用哪个app好一点,千问?

—— 来自 vivo V ...

Rikkahub或者chatbox接个tavily的api

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-8 16:07 | 显示全部楼层
gpt也能试试?现在说是开放对面用户的额度了?
但是如果只是低级模型加上限制推理预算的话效果不知道满不满意。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-25 14:00 , Processed in 0.215636 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表