找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] 正式版 v4 flash 已上线,pro 8月初|DeepSeek v4讨论专楼

 火.. [复制链接]
     
发表于 2026-8-6 12:59 | 显示全部楼层
aemaeth 发表于 2026-8-6 12:28
Flash涨价在两倍以内基本不影响,到4倍会开始认真考虑现在的任务给Flash是否还靠谱。
Pro要看到时候的能力 ...

K3很慢的,如果V4PRO的速度和之前一样那还是比K3有优势
回复

使用道具 举报

     
发表于 2026-8-6 13:02 来自手机 | 显示全部楼层
知乎为了咩鳖,在ds涨价消息下都开始吹muse spark了,这还能说啥

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-6 13:02 来自手机 | 显示全部楼层
中国人 发表于 2026-8-6 12:21
感觉速度变慢了,看了下之前有用过火山方舟,坛友有用火山方舟的吗,火山方舟的dsv4flash用起来咋样啊 ...

还行吧,但是偶尔会触发速率限制,给的额度也不多,不打算续了。
回复

使用道具 举报

     
发表于 2026-8-6 13:06 | 显示全部楼层
Facebook的muse 1.2来了, 同意共享数据给Meta训练的话, 比DS 4Flash还便宜一点点. 性能和DS 4Flash, GPT Luna平手. 但是DS有Opencode GO的翻倍使用入口. 其实这玩意直接开源的话, 不少欧美公司会用的. 就和Llama真的统治了很久一样. 现在不开源, 大家的反应都是你谁啊.
回复

使用道具 举报

     
发表于 2026-8-6 13:06 来自手机 | 显示全部楼层
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-6 13:12 | 显示全部楼层
考虑到长远目标各家的竞争重心其实还是放在前沿模型,国内算力紧缺的现阶段烧算力供养Flash这样的模型确实是不划算的。确实可以官方不提供Flash只提供Pro,Flash自己部署玩去。
回复

使用道具 举报

     
发表于 2026-8-6 13:19 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-8-6 13:20 编辑
lactone 发表于 2026-8-6 13:06
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了

—— 来自 HON ...

从之前的谈话记录里,显然他搞错了其他公司的infra能力,第三方缓存价格普遍10倍以上,就算官方涨100%都不一定能便宜,所以自然都是转发
回复

使用道具 举报

     
发表于 2026-8-6 13:22 | 显示全部楼层
当然这个能力已经占据了公司私有化部署的市场了,之前很多地方都是部署GLM5.2的,哪怕不能直接赚到钱对其他模型厂商都是打击
回复

使用道具 举报

发表于 2026-8-6 13:22 | 显示全部楼层
nxmonitor 发表于 2026-8-6 13:19
从之前的谈话记录里,显然他搞错了其他公司的infra能力,第三方缓存价格普遍10倍以上,就算官方涨100%都不 ...

不是说可以帮忙优化部署吗?
回复

使用道具 举报

     
发表于 2026-8-6 13:23 来自手机 | 显示全部楼层
本帖最后由 lactone 于 2026-8-6 13:24 编辑

我觉得性价比只要能打掉不重置的luna就好

主要还是opencode这个大单太吃算力了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-6 13:26 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-8-6 13:30 编辑
wandeeees 发表于 2026-8-6 13:22
不是说可以帮忙优化部署吗?

只有第三方来优化部署,很多地方比如硅基流动就靠部署调优开源模型赚钱,然而DeepSeek自己又不做的,所以永远达不到这个水平
回复

使用道具 举报

     
发表于 2026-8-6 13:31 | 显示全部楼层
哎,感觉今天也没有了,看明天吧    Re:Source
回复

使用道具 举报

     
发表于 2026-8-6 13:36 | 显示全部楼层
luna和DS比我觉得还是DS强,而且不是一星半点

感觉可能是语言问题
同一个需求luna老听不懂我在说啥得换到sol,ds就能听懂
回复

使用道具 举报

     
发表于 2026-8-6 13:40 | 显示全部楼层
luna那个max性能纯烂炒,官方都建议直接low档位当杂活模型。

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-6 13:42 | 显示全部楼层
luna 的上下文会比想象中的少,我用自己的框架使用时发现它一直在压缩画布上下文这些
推上也有人对比过 lunamax 和 solmid 比,solmid 明显幻觉更少
吹 luna 的先看看做的工作是什么    Re:Source
回复

使用道具 举报

     
发表于 2026-8-6 13:44 来自手机 | 显示全部楼层
一般市民 发表于 2026-8-6 13:12
考虑到长远目标各家的竞争重心其实还是放在前沿模型,国内算力紧缺的现阶段烧算力供养Flash这样的模型确实 ...

没有便宜的flash吸引大量用户当agent用,怎么收集数据训练下一代模型?现在各家都没放弃轻量模型已经能说明问题了
回复

使用道具 举报

     
发表于 2026-8-6 13:47 来自手机 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-8-6 13:48 编辑
jojog 发表于 2026-8-6 13:36
luna和DS比我觉得还是DS强,而且不是一星半点

感觉可能是语言问题


更多的是因为不稳定,输出结果的质量差距很大,还有就是上下文压缩…
回复

使用道具 举报

     
发表于 2026-8-6 13:49 | 显示全部楼层
lactone 发表于 2026-8-6 13:06
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了

—— 来自 HON ...

也就是大公司会自己部署吧,其他感觉也没这个必要,还不如薅梁子羊毛
回复

使用道具 举报

发表于 2026-8-6 13:52 | 显示全部楼层
藤子赶紧自己部署v4f吧,workbuddy天天崩不怕用户投诉吗
回复

使用道具 举报

     
发表于 2026-8-6 13:52 | 显示全部楼层
本帖最后由 crow_wine 于 2026-8-6 13:54 编辑



v4f 被我蹬狂怒了,第一次见这种狂怒形态,隔一个字有一个 (!!

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-8-6 13:55 来自手机 | 显示全部楼层
crow_wine 发表于 2026-8-6 13:52
v4f 被我蹬狂怒了,第一次见这种狂怒形态,隔一个字有一个 (!!

上下文过多了,压缩下或新开对话吧

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-6 13:59 | 显示全部楼层
目前DS还有一个问题是多模态,从之前的官网Chat App来看这次Pro有可能会有。
至少对真实做东西来说是挺重要的一个能力,还是前面说的,在“做,审,改”循环里面,结合工具,视觉review自己做出来的东西长啥样对成品很重要。
至于除此之外说luna max和ds v4f的差别,我的感觉是除了价格真的没什么差别,都在一个档位上,在这种情况下,你Prompt和Harness对结果的影响远高于模型本身的能力。
价格上来说,其实也算是接近的,还是前面说的,DS V4如果涨价到原来的4倍,那么luna max开始值得优先考虑。如果涨价只是翻倍,那么luna可能还是冷板凳,只有偶尔特殊任务出个场。
回复

使用道具 举报

     
发表于 2026-8-6 14:01 | 显示全部楼层
spaceblue 发表于 2026-8-6 12:59
K3很慢的,如果V4PRO的速度和之前一样那还是比K3有优势

是比K3有优势,但我会选择GLM5.2,因为烧不起,K3真的烧不起
回复

使用道具 举报

     
发表于 2026-8-6 14:08 | 显示全部楼层
中国人 发表于 2026-8-6 12:21
感觉速度变慢了,看了下之前有用过火山方舟,坛友有用火山方舟的吗,火山方舟的dsv4flash用起来咋样啊 ...

不知道火山换没换正式版,不过我火山到期了没续所以没办法测了
回复

使用道具 举报

     
发表于 2026-8-6 14:10 | 显示全部楼层
目前几个项目重构效果来说

K3max glm 5.2都不错

如果说在fable没用的情况下,基本就让k3和sol抓来干活了

glm 5.2 debug

还有慢无所谓的,只要精准处理问题就行

fable 刚发布那会,那个速度才叫折磨,但是做完不需要返工,这才没毛病
回复

使用道具 举报

     
发表于 2026-8-6 14:12 来自手机 | 显示全部楼层
noword 发表于 2026-8-6 13:55
上下文过多了,压缩下或新开对话吧

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha ...

和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事

—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha
回复

使用道具 举报

发表于 2026-8-6 14:21 | 显示全部楼层
crow_wine 发表于 2026-8-6 14:12
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事

都积压在上下文里,出现情绪化的表现也是有影响的,AI 也是有趋利避害的行为的
有的会积极,有的就暴躁了
回复

使用道具 举报

     
发表于 2026-8-6 14:25 | 显示全部楼层
crow_wine 发表于 2026-8-6 14:12
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事

正常,这说明你在让它做不适合它的任务,用v4f查bug不一定是个好主意,除非是那种你本身能一眼看出bug大概在什么地方,只需要简单改一改那种。但如果本身涉及屎山问题,竞态,你得小心v4f的幻觉水平是偏高的。你可能该换GLM5.2,或者干脆上Kimi或者Sol。
回复

使用道具 举报

     
发表于 2026-8-6 14:25 | 显示全部楼层
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?
回复

使用道具 举报

     
发表于 2026-8-6 14:27 来自手机 | 显示全部楼层
一般市民 发表于 2026-8-6 14:25
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?

这一点挺容易复现的,让他自己从零写个手机APP,到debug阶段就可以看见这种哈气反应了

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-6 14:29 , Processed in 0.175455 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表