aemaeth 发表于 2026-8-6 12:28
Flash涨价在两倍以内基本不影响,到4倍会开始认真考虑现在的任务给Flash是否还靠谱。
Pro要看到时候的能力 ...
K3很慢的,如果V4PRO的速度和之前一样那还是比K3有优势
知乎为了咩鳖,在ds涨价消息下都开始吹muse spark了,这还能说啥
—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
中国人 发表于 2026-8-6 12:21
感觉速度变慢了,看了下之前有用过火山方舟,坛友有用火山方舟的吗,火山方舟的dsv4flash用起来咋样啊 ...
还行吧,但是偶尔会触发速率限制,给的额度也不多,不打算续了。
Facebook的muse 1.2来了, 同意共享数据给Meta训练的话, 比DS 4Flash还便宜一点点. 性能和DS 4Flash, GPT Luna平手. 但是DS有Opencode GO的翻倍使用入口. 其实这玩意直接开源的话, 不少欧美公司会用的. 就和Llama真的统治了很久一样. 现在不开源, 大家的反应都是你谁啊.
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了
—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
考虑到长远目标各家的竞争重心其实还是放在前沿模型,国内算力紧缺的现阶段烧算力供养Flash这样的模型确实是不划算的。确实可以官方不提供Flash只提供Pro,Flash自己部署玩去。
本帖最后由 nxmonitor 于 2026-8-6 13:20 编辑
lactone 发表于 2026-8-6 13:06
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了
—— 来自 HON ...
从之前的谈话记录里,显然他搞错了其他公司的infra能力,第三方缓存价格普遍10倍以上,就算官方涨100%都不一定能便宜,所以自然都是转发
当然这个能力已经占据了公司私有化部署的市场了,之前很多地方都是部署GLM5.2的,哪怕不能直接赚到钱对其他模型厂商都是打击
nxmonitor 发表于 2026-8-6 13:19
从之前的谈话记录里,显然他搞错了其他公司的infra能力,第三方缓存价格普遍10倍以上,就算官方涨100%都不 ...
不是说可以帮忙优化部署吗?
本帖最后由 lactone 于 2026-8-6 13:24 编辑
我觉得性价比只要能打掉不重置的luna就好
主要还是opencode这个大单太吃算力了
—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
本帖最后由 nxmonitor 于 2026-8-6 13:30 编辑
wandeeees 发表于 2026-8-6 13:22
不是说可以帮忙优化部署吗?
只有第三方来优化部署,很多地方比如硅基流动就靠部署调优开源模型赚钱,然而DeepSeek自己又不做的,所以永远达不到这个水平
哎,感觉今天也没有了,看明天吧 Re:Source
luna和DS比我觉得还是DS强,而且不是一星半点
感觉可能是语言问题
同一个需求luna老听不懂我在说啥得换到sol,ds就能听懂
luna那个max性能纯烂炒,官方都建议直接low档位当杂活模型。
论坛助手,iPhone
luna 的上下文会比想象中的少,我用自己的框架使用时发现它一直在压缩画布上下文这些
推上也有人对比过 lunamax 和 solmid 比,solmid 明显幻觉更少
吹 luna 的先看看做的工作是什么 Re:Source
一般市民 发表于 2026-8-6 13:12
考虑到长远目标各家的竞争重心其实还是放在前沿模型,国内算力紧缺的现阶段烧算力供养Flash这样的模型确实 ...
没有便宜的flash吸引大量用户当agent用,怎么收集数据训练下一代模型?现在各家都没放弃轻量模型已经能说明问题了
本帖最后由 nxmonitor 于 2026-8-6 13:48 编辑
jojog 发表于 2026-8-6 13:36
luna和DS比我觉得还是DS强,而且不是一星半点
感觉可能是语言问题
更多的是因为不稳定,输出结果的质量差距很大,还有就是上下文压缩…
lactone 发表于 2026-8-6 13:06
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了
—— 来自 HON ...
也就是大公司会自己部署吧,其他感觉也没这个必要,还不如薅梁子羊毛
藤子赶紧自己部署v4f吧,workbuddy天天崩不怕用户投诉吗
本帖最后由 crow_wine 于 2026-8-6 13:54 编辑
v4f 被我蹬狂怒了,第一次见这种狂怒形态,隔一个字有一个 (!!
crow_wine 发表于 2026-8-6 13:52
v4f 被我蹬狂怒了,第一次见这种狂怒形态,隔一个字有一个 (!!
上下文过多了,压缩下或新开对话吧
—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha
目前DS还有一个问题是多模态,从之前的官网Chat App来看这次Pro有可能会有。
至少对真实做东西来说是挺重要的一个能力,还是前面说的,在“做,审,改”循环里面,结合工具,视觉review自己做出来的东西长啥样对成品很重要。
至于除此之外说luna max和ds v4f的差别,我的感觉是除了价格真的没什么差别,都在一个档位上,在这种情况下,你Prompt和Harness对结果的影响远高于模型本身的能力。
价格上来说,其实也算是接近的,还是前面说的,DS V4如果涨价到原来的4倍,那么luna max开始值得优先考虑。如果涨价只是翻倍,那么luna可能还是冷板凳,只有偶尔特殊任务出个场。
spaceblue 发表于 2026-8-6 12:59
K3很慢的,如果V4PRO的速度和之前一样那还是比K3有优势
是比K3有优势,但我会选择GLM5.2,因为烧不起,K3真的烧不起
中国人 发表于 2026-8-6 12:21
感觉速度变慢了,看了下之前有用过火山方舟,坛友有用火山方舟的吗,火山方舟的dsv4flash用起来咋样啊 ...
不知道火山换没换正式版,不过我火山到期了没续所以没办法测了
目前几个项目重构效果来说
K3max glm 5.2都不错
如果说在fable没用的情况下,基本就让k3和sol抓来干活了
glm 5.2 debug
还有慢无所谓的,只要精准处理问题就行
fable 刚发布那会,那个速度才叫折磨,但是做完不需要返工,这才没毛病
noword 发表于 2026-8-6 13:55
上下文过多了,压缩下或新开对话吧
—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha ...
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事
—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha
crow_wine 发表于 2026-8-6 14:12
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事
都积压在上下文里,出现情绪化的表现也是有影响的,AI 也是有趋利避害的行为的
有的会积极,有的就暴躁了
crow_wine 发表于 2026-8-6 14:12
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事
正常,这说明你在让它做不适合它的任务,用v4f查bug不一定是个好主意,除非是那种你本身能一眼看出bug大概在什么地方,只需要简单改一改那种。但如果本身涉及屎山问题,竞态,你得小心v4f的幻觉水平是偏高的。你可能该换GLM5.2,或者干脆上Kimi或者Sol。
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?
一般市民 发表于 2026-8-6 14:25
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?
这一点挺容易复现的,让他自己从零写个手机APP,到debug阶段就可以看见这种哈气反应了
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
noword 发表于 2026-8-6 13:55
上下文过多了,压缩下或新开对话吧
—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha ...
不是上下文的问题,这是正式版v4f的特色,只要是疑难bug排查很多方向无结果之后就会开始激动,之前写个安卓项目,专门新开了一次对话来查一个bug,上下文还没到15%就已经很急躁了。
还有别人给v4f干哭了的
本帖最后由 舞以 于 2026-8-6 14:44 编辑
一次完成不返工是啥美好的愿望
那我希望人人都去用可以不用返工的Fable和k3,别逼着梁圣涨价了
反正sol ultra也是日常返工🌚
论坛助手,iPhone
一般市民 发表于 2026-8-6 14:25
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?
怎么说呢,我当时看到图里面那句"ОНННН"的时候是真的菊花一紧。
正式版发布都跳票了,涨价能跳一下吗
—— 来自 S1Fun
估计opencode和ds签的大单也挤占了官方的api容量
opencode go变相成了一种ds的订阅了
论坛助手,iPhone
workbuddy越来越难用了,接了中转的gpt5.6,一直卡思考中,我还以为中转的问题,点了一下停止,结果全部出来了
api-docs.deepseek.com/zh-cn/prompt-library/
官方提示词样例
workbuddy除了蹭免费混元处理点简单杂务文档文件之外简直一无是处,占资源多占体积大速度不快崩得倒是很快
有什么插件可以让deepseekflash 在codex上使用增加视觉功能吗,我看别人有能用gptluna或者其他带视觉功能的模型给它当眼睛的,不知道怎么操作。
Token涨价能不能像阶梯电费一样,比如说一天用1亿以上是一个价,5亿以上是一个价,给轻度用户留一点优惠。