spaceblue 发表于 2026-8-6 12:59

aemaeth 发表于 2026-8-6 12:28
Flash涨价在两倍以内基本不影响,到4倍会开始认真考虑现在的任务给Flash是否还靠谱。
Pro要看到时候的能力 ...

K3很慢的,如果V4PRO的速度和之前一样那还是比K3有优势

lactone 发表于 2026-8-6 13:02

知乎为了咩鳖,在ds涨价消息下都开始吹muse spark了,这还能说啥

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99

justwul 发表于 2026-8-6 13:02

中国人 发表于 2026-8-6 12:21
感觉速度变慢了,看了下之前有用过火山方舟,坛友有用火山方舟的吗,火山方舟的dsv4flash用起来咋样啊 ...

还行吧,但是偶尔会触发速率限制,给的额度也不多,不打算续了。

泰坦失足 发表于 2026-8-6 13:06

Facebook的muse 1.2来了, 同意共享数据给Meta训练的话, 比DS 4Flash还便宜一点点. 性能和DS 4Flash, GPT Luna平手. 但是DS有Opencode GO的翻倍使用入口. 其实这玩意直接开源的话, 不少欧美公司会用的. 就和Llama真的统治了很久一样. 现在不开源, 大家的反应都是你谁啊.

lactone 发表于 2026-8-6 13:06

我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99

一般市民 发表于 2026-8-6 13:12

考虑到长远目标各家的竞争重心其实还是放在前沿模型,国内算力紧缺的现阶段烧算力供养Flash这样的模型确实是不划算的。确实可以官方不提供Flash只提供Pro,Flash自己部署玩去。

nxmonitor 发表于 2026-8-6 13:19

本帖最后由 nxmonitor 于 2026-8-6 13:20 编辑

lactone 发表于 2026-8-6 13:06
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了

—— 来自 HON ...
从之前的谈话记录里,显然他搞错了其他公司的infra能力,第三方缓存价格普遍10倍以上,就算官方涨100%都不一定能便宜,所以自然都是转发

nxmonitor 发表于 2026-8-6 13:22

当然这个能力已经占据了公司私有化部署的市场了,之前很多地方都是部署GLM5.2的,哪怕不能直接赚到钱对其他模型厂商都是打击

wandeeees 发表于 2026-8-6 13:22

nxmonitor 发表于 2026-8-6 13:19
从之前的谈话记录里,显然他搞错了其他公司的infra能力,第三方缓存价格普遍10倍以上,就算官方涨100%都不 ...

不是说可以帮忙优化部署吗?

lactone 发表于 2026-8-6 13:23

本帖最后由 lactone 于 2026-8-6 13:24 编辑

我觉得性价比只要能打掉不重置的luna就好

主要还是opencode这个大单太吃算力了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99

nxmonitor 发表于 2026-8-6 13:26

本帖最后由 nxmonitor 于 2026-8-6 13:30 编辑

wandeeees 发表于 2026-8-6 13:22
不是说可以帮忙优化部署吗?
只有第三方来优化部署,很多地方比如硅基流动就靠部署调优开源模型赚钱,然而DeepSeek自己又不做的,所以永远达不到这个水平

王兰花秀丽 发表于 2026-8-6 13:31

哎,感觉今天也没有了,看明天吧    Re:Source

jojog 发表于 2026-8-6 13:36

luna和DS比我觉得还是DS强,而且不是一星半点

感觉可能是语言问题
同一个需求luna老听不懂我在说啥得换到sol,ds就能听懂

舞以 发表于 2026-8-6 13:40

luna那个max性能纯烂炒,官方都建议直接low档位当杂活模型。

论坛助手,iPhone

Awanano 发表于 2026-8-6 13:42

luna 的上下文会比想象中的少,我用自己的框架使用时发现它一直在压缩画布上下文这些
推上也有人对比过 lunamax 和 solmid 比,solmid 明显幻觉更少
吹 luna 的先看看做的工作是什么    Re:Source

qwased 发表于 2026-8-6 13:44

一般市民 发表于 2026-8-6 13:12
考虑到长远目标各家的竞争重心其实还是放在前沿模型,国内算力紧缺的现阶段烧算力供养Flash这样的模型确实 ...

没有便宜的flash吸引大量用户当agent用,怎么收集数据训练下一代模型?现在各家都没放弃轻量模型已经能说明问题了

nxmonitor 发表于 2026-8-6 13:47

本帖最后由 nxmonitor 于 2026-8-6 13:48 编辑

jojog 发表于 2026-8-6 13:36
luna和DS比我觉得还是DS强,而且不是一星半点

感觉可能是语言问题


更多的是因为不稳定,输出结果的质量差距很大,还有就是上下文压缩…

卡普空 发表于 2026-8-6 13:49

lactone 发表于 2026-8-6 13:06
我感觉梁子本来搞dsv4f就是为了推自有部署,现在都在薅羊毛,自己部署没几个,所以就涨价了

—— 来自 HON ...

也就是大公司会自己部署吧,其他感觉也没这个必要,还不如薅梁子羊毛

tsubasa9 发表于 2026-8-6 13:52

藤子赶紧自己部署v4f吧,workbuddy天天崩不怕用户投诉吗

crow_wine 发表于 2026-8-6 13:52

本帖最后由 crow_wine 于 2026-8-6 13:54 编辑



v4f 被我蹬狂怒了,第一次见这种狂怒形态,隔一个字有一个 (!!

noword 发表于 2026-8-6 13:55

crow_wine 发表于 2026-8-6 13:52
v4f 被我蹬狂怒了,第一次见这种狂怒形态,隔一个字有一个 (!!

上下文过多了,压缩下或新开对话吧

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha

aemaeth 发表于 2026-8-6 13:59

目前DS还有一个问题是多模态,从之前的官网Chat App来看这次Pro有可能会有。
至少对真实做东西来说是挺重要的一个能力,还是前面说的,在“做,审,改”循环里面,结合工具,视觉review自己做出来的东西长啥样对成品很重要。
至于除此之外说luna max和ds v4f的差别,我的感觉是除了价格真的没什么差别,都在一个档位上,在这种情况下,你Prompt和Harness对结果的影响远高于模型本身的能力。
价格上来说,其实也算是接近的,还是前面说的,DS V4如果涨价到原来的4倍,那么luna max开始值得优先考虑。如果涨价只是翻倍,那么luna可能还是冷板凳,只有偶尔特殊任务出个场。

aemaeth 发表于 2026-8-6 14:01

spaceblue 发表于 2026-8-6 12:59
K3很慢的,如果V4PRO的速度和之前一样那还是比K3有优势

是比K3有优势,但我会选择GLM5.2,因为烧不起,K3真的烧不起

半江瑟瑟半江红 发表于 2026-8-6 14:08

中国人 发表于 2026-8-6 12:21
感觉速度变慢了,看了下之前有用过火山方舟,坛友有用火山方舟的吗,火山方舟的dsv4flash用起来咋样啊 ...

不知道火山换没换正式版,不过我火山到期了没续所以没办法测了

zris 发表于 2026-8-6 14:10

目前几个项目重构效果来说

K3max glm 5.2都不错

如果说在fable没用的情况下,基本就让k3和sol抓来干活了

glm 5.2 debug

还有慢无所谓的,只要精准处理问题就行

fable 刚发布那会,那个速度才叫折磨,但是做完不需要返工,这才没毛病

crow_wine 发表于 2026-8-6 14:12

noword 发表于 2026-8-6 13:55
上下文过多了,压缩下或新开对话吧

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha ...

和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事

—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha

ov_efly 发表于 2026-8-6 14:21

crow_wine 发表于 2026-8-6 14:12
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事


都积压在上下文里,出现情绪化的表现也是有影响的,AI 也是有趋利避害的行为的
有的会积极,有的就暴躁了

aemaeth 发表于 2026-8-6 14:25

crow_wine 发表于 2026-8-6 14:12
和上下文没太大关系,让它查bug查久了没结果就会这样。特别情绪化
这几天蹬了十几亿长上下文都没事


正常,这说明你在让它做不适合它的任务,用v4f查bug不一定是个好主意,除非是那种你本身能一眼看出bug大概在什么地方,只需要简单改一改那种。但如果本身涉及屎山问题,竞态,你得小心v4f的幻觉水平是偏高的。你可能该换GLM5.2,或者干脆上Kimi或者Sol。

一般市民 发表于 2026-8-6 14:25

坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?

半江瑟瑟半江红 发表于 2026-8-6 14:27

一般市民 发表于 2026-8-6 14:25
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?

这一点挺容易复现的,让他自己从零写个手机APP,到debug阶段就可以看见这种哈气反应了

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

serj005 发表于 2026-8-6 14:29

noword 发表于 2026-8-6 13:55
上下文过多了,压缩下或新开对话吧

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha ...

不是上下文的问题,这是正式版v4f的特色,只要是疑难bug排查很多方向无结果之后就会开始激动,之前写个安卓项目,专门新开了一次对话来查一个bug,上下文还没到15%就已经很急躁了。
还有别人给v4f干哭了的

舞以 发表于 2026-8-6 14:35

本帖最后由 舞以 于 2026-8-6 14:44 编辑

一次完成不返工是啥美好的愿望

那我希望人人都去用可以不用返工的Fable和k3,别逼着梁圣涨价了

反正sol ultra也是日常返工🌚

论坛助手,iPhone

aemaeth 发表于 2026-8-6 14:42

一般市民 发表于 2026-8-6 14:25
坊间传闻Flash在逼近模型能力极限的时候就会开始哈气,看来挺真的?


怎么说呢,我当时看到图里面那句"ОНННН"的时候是真的菊花一紧。

风萧飒 发表于 2026-8-6 14:46

正式版发布都跳票了,涨价能跳一下吗

—— 来自 S1Fun

舞以 发表于 2026-8-6 14:52

估计opencode和ds签的大单也挤占了官方的api容量
opencode go变相成了一种ds的订阅了

论坛助手,iPhone

不让用大写 发表于 2026-8-6 15:01

workbuddy越来越难用了,接了中转的gpt5.6,一直卡思考中,我还以为中转的问题,点了一下停止,结果全部出来了

秦南心 发表于 2026-8-6 15:04

api-docs.deepseek.com/zh-cn/prompt-library/
官方提示词样例

jasoncoop 发表于 2026-8-6 15:07

workbuddy除了蹭免费混元处理点简单杂务文档文件之外简直一无是处,占资源多占体积大速度不快崩得倒是很快

zypyong 发表于 2026-8-6 15:10

有什么插件可以让deepseekflash 在codex上使用增加视觉功能吗,我看别人有能用gptluna或者其他带视觉功能的模型给它当眼睛的,不知道怎么操作。

来都来了 发表于 2026-8-6 15:11

Token涨价能不能像阶梯电费一样,比如说一天用1亿以上是一个价,5亿以上是一个价,给轻度用户留一点优惠。
页: 128 129 130 131 132 133 134 135 136 137 [138] 139 140 141 142 143 144 145 146 147
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼