qz66618 发表于 2026-8-6 22:03
可信度不高
这人是个财经记者,料有但是别的地方不太行。东西应该是真的,但是也有草台基金管理人把预览版写上去的可能性
灰测来说是大概率大于fable,不知道为什么都不敢说。当然前端不如,但fable前端还不如k3呢。但还是那句话,现在给人用的fable到底是真实能力的几成也没人说的好,各有各的赢法
其实就我个人观点,憋着不发pro只有以下可能性:
1、能力太强,目前定价太低预计服务器要down,一边先筹备借算力一边想其他办法(比如大幅涨价分流)。目前看有这个迹象。
2、差一点sota,想憋了真核弹发,这半个月还在继续后训练。
3、犹豫要不要放多模态,可能性很低。
1和2实际不矛盾。至于什么等专用agent工具这种,我是不信的,这flash不也是没等就发了吗。
tillnight 发表于 2026-8-6 22:14
其实就我个人观点,憋着不发pro只有以下可能性:
1、能力太强,目前定价太低预计服务器要down,一边先筹备 ...
同意,k3的指标估计不是梁圣在乎的,但是“DeepSeek回到sota竞争”对ds这个实验室意义重大。
论坛助手,iPhone
最有可能的是明天其实没发,harness还在内测
fp8量化不是ds创新的吧,应该早就有了?
—— 来自 鹅球 v3.3.96
魔神赵日天 发表于 2026-8-6 22:23
fp8量化不是ds创新的吧,应该早就有了?
—— 来自 鹅球 v3.3.96
卡上很早就有,真用的第一个好像是V3
从 4.6 到 fable(外用)其实没差太多
而且 fable 这个东西一直以来不都是小码拿来 yy 反人类不可战胜的东西,真正经用过的有多少,为了吹自己来捧一个纸老虎做基线吗 Re:Source
魔神赵日天 发表于 2026-8-6 22:23
fp8量化不是ds创新的吧,应该早就有了?
—— 来自 鹅球 v3.3.96
v4的最大创新是压缩注意力,现阶段投入生产的最激进注意力方案,内存算力消耗是同等规模美国模型的十分之一
tillnight 发表于 2026-8-6 22:14
其实就我个人观点,憋着不发pro只有以下可能性:
1、能力太强,目前定价太低预计服务器要down,一边先筹备 ...
也有可能是给国内的友商一条活路,还可以省推理服务器的钱
也有可能等Kimi融资完给个面子,不然灰测的检查点拿出来K3会一点声音都没有…
综合看下来感觉疑点甚多,劝坛友还是放平心态,维护好自己今夜的睡眠质量
首先,比较炸裂的那个0.3%差距提法。很狡猾地把前提限制在编程能力,但编程问题已经不是难问题了,也很少有纯比编程能力了。
至于定价,目前opus5在平台的price/M在5刀/25刀,v4f high在平台上0.09刀/0.18刀,本身差不多就是百1的价格差,但可否持续,我感觉并不乐观。下面讲 。
算力闭环的说法应该是可靠的,华为入场配合dsv4一起优化的,他们现在算力应该卡在华为的卡生产力跟不上他们的需求。
模型赛道商业化现金流潜力最强、有望率先实现规模化盈利的厂商。
可能需要分析一下,印象中他们v3的时候已经开始盈利了,如今在这里的说法又变成“有望率先实现盈利”。
之前知乎有人质疑他们盈利的问题,他们还专门写了一篇长文加以解释,指出v3的纸面成本利润率是545%,但因为低定价政策,还有夜间折扣,实际上没那么多。
如果没有春秋笔法的话,v4的固化长期折扣配合当前的定价是亏本的,要涨价了才能盈利。
我感觉v4f涨完价就要配合pro正式版了,应该agent效果会好很多,0731更新了一版好很多,虽然处理复杂难度上仍有差距,但已经要比pro pre版效果提升明显。
梁文锋一开始根本不想上市,他给员工发的期权也都是中看不中吃。但是有利的一面之外,弊端也很明显,因为不上市所以被挖角太严重了,到必须转变策略,靠变现稳定军心时候了。
趁着普遍好评的暖风,合理涨价提高投资者预期,助力赶快上市,是他们的合理策略。
k3团队此前高调庆功,说就明好消息确实鼓舞人心,不然下一版如果竞争力不足或者拿不出有力卖点,就可能跟minmax的前车之鉴那样,股价再也上不来了。
AI模型是面对全球市场的产品,定价肯定是受全球市场定价影响的。更何况国内AI公司算力还受限
我个人觉得pro定价可能会参考kimi k3,也许会更低一点。flash估计会参考gpt5.6 luna
ds之前说的利润是毛利吧
—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
有没有可能,明天只是涨价,不放模型,邮件里一个字都没提模型。是不是全世界穷鬼蹬梁子服务器梁子受不了了,要用哈耶克的大手来惩罚穷鬼。
都不一定是明天只涨价不发pro怕不是降级为梁%
—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
别说fable了 哪怕只比sol差0.3这价格也能揍死openai了
虽然A/更恶心但是反正都得死先揍死scam altman我没意见
肥波级还行,真是0.3%那也斩杀了吧
不能真打爆fable吧,规模差太远了。不能过分乐观
我用flash已经够了,就这一个月估计也要两三百了,不要涨价好不好,梁仔
晚上怎么这么卡?美国到底有多少人在蹬啊……
我觉得真是是肥波级,少一手多模态
opencode的人说可以在租来的GPU上复现deepseek的价格https://p.sda1.dev/34/523f7a7c8a9e443aad060913b317ba36/image.jpg
—— 来自 鹅球 v3.3.96
v4f在不同agent下的任务成功率、消耗时间、使用成本对比,包括claudecode,codex,opencode,oh my pi
感觉坛友太焦虑了,v4f再怎么说也就是个不到300b的开源模型,部署成本高不了哪里去。这么大的需求,等第三方云厂商都铺开部署了就问题不大了。梁子涨价感觉也是把人逼去第三方,不要耽误叔叔训练agi。而且官方涨价了第三方才有动力部署,毕竟梁叔叔的infra一般厂商卷不过
格局这么高?手把手指导https://p.sda1.dev/34/a4bcfcdc049db9b44412c30d5090a73f/image.jpg
—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha
本来梁子就说不靠API赚钱,这也不奇怪
一切都说得通了
ds员工辟谣那个泄露的文件了
—— 来自 鹅球 v3.5.99
crow_wine 发表于 2026-8-7 00:13
格局这么高?手把手指导
—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha
我看了一下他说是和opencode合作的一个team复制的,总之只算成本应该真的贵不到哪里去
本帖最后由 脸宽 于 2026-8-7 00:40 编辑
opencode真给我蹬爽了,按照自己的想法设计了一个文字挂机游戏,蹬了两个亿
在这个过程中发现数值分析对于一个游戏太重要了。这个过程我不断的让ai帮我调整。
ds对比其他家明显优势的就是缓存命中价格,其他家缓存价格能控制在官方api的三倍以内,一样不会影响他模型的推广
所以这次涨价明显就是单纯的算力不足,哪儿来那么多奇奇怪怪的阴谋论,他妈的一到晚上就被西半球穷鬼们蹬得流口水涨涨价怎么了?
再不涨以后旗舰模型跟不上了吧
能换智商也是划算的买卖
qz66618 发表于 2026-8-7 00:23
ds员工辟谣那个泄露的文件了
—— 来自 鹅球 v3.5.99
什么文件
—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99-alpha
本帖最后由 goranger 于 2026-8-7 01:02 编辑
https://cdn3.ldstatic.com/optimized/4X/5/4/f/54f514aa5117028f7013a47df1c091c79a9d6bcf_2_605x500.png
nxmonitor 发表于 2026-8-6 21:09
还有luna这个模型,真觉得好用就去用,一用一个不吱声,一群中转站贩子在里面浑水摸鱼…… ...
中转站大部分都把luna屏蔽了.
按某个中转站站长的:"跑40b+ token的 luna,就收入200多块, 做慈善哪"
phorcys02 发表于 2026-8-7 02:50
中转站大部分都把luna屏蔽了.
按某个中转站站长的:"跑40b+ token的 luna,就收入200多块, 做慈善哪"
...
实际上是,把 luna 当成其他模型卖更赚钱 23333
phorcys02 发表于 2026-8-7 02:50
中转站大部分都把luna屏蔽了.
按某个中转站站长的:"跑40b+ token的 luna,就收入200多块, 做慈善哪"
...
难怪我这的中转都没了 求推荐个有的
phorcys02 发表于 2026-8-7 02:50
中转站大部分都把luna屏蔽了.
按某个中转站站长的:"跑40b+ token的 luna,就收入200多块, 做慈善哪"
...
luna没办法掺水,其他模型就难说了
—— 来自 Xiaomi 23127PN0CC, Android 16, 鹅球 v4.0-alpha
昨晚8点收到的邮件,看看今天会不会调价吧
gpt网页版5.6更新了。
Flash正式版发布前几个小时gpt也是公布降价,有感觉了吗?
—— 来自 OnePlus PJZ110, Android 16, 鹅球 v4.0