找回密码
 立即注册
搜索
查看: 11545|回复: 48

[科技] 梁子deepseek的盈利很像一个骗局

[复制链接]
     
发表于 2026-8-1 08:23 来自手机 | 显示全部楼层 |阅读模式
此帖将于2026-08-31 08:12自动关闭
v4f无论性能速度远强于本地部署,拼命蹬一天花费还比不上5090的电费,他是不是为了融资自掏腰包用幻方去补贴ds了,不然价格怎么低到藤子opencode甘愿做他的管道也不去本地部署。梁子开大会还吹水10个月回本,是不是想把投资人骗进来当猪杀啊。除了特殊需求,本地部署现在一点意义都没有了,显卡是不是要开始降价了。

评分

参与人数 5战斗力 -8 收起 理由
jrz -2 **
zutama -2
d888536e -2
StrangerJ -1 别串了
sdfzzha -1

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-1 08:27 | 显示全部楼层
你蹬第三方部署的V4f应该也蹬不掉5090的电费。
V4f激活参数只有13b,运算量是不大的,实际上你5090本地部署一个Qwen27b,单位token的运算量要大得多。
回复

使用道具 举报

     
发表于 2026-8-1 08:29 | 显示全部楼层
真想融资早融资了,你不会以为国内的企业不想投吧?A处和O处都融资几轮了,D真想融资,去年DS时刻就是最好的融资时刻,人声鼎沸,性能巅峰
回复

使用道具 举报

     
发表于 2026-8-1 08:32 | 显示全部楼层
施人诚 发表于 2026-8-1 08:29
真想融资早融资了,你不会以为国内的企业不想投吧?A处和O处都融资几轮了,D真想融资,去年DS时刻就是最好 ...

这倒不是,有950了还能把融资转换成可以按3年折旧的资产,去年上市总不能拿去幻方炒股吧。
回复

使用道具 举报

     
发表于 2026-8-1 08:49 来自手机 | 显示全部楼层
有些人需要本地部署啊。

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-8-1 08:55 来自手机 | 显示全部楼层
机关单位企事业内网都需要本地部署的。

—— 来自 HUAWEI HOP-AL10, Android 16, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-1 08:55 | 显示全部楼层
激活只有13b,kv cache比qwen 27b还小,规模上来之后挺推理成本便宜的。本地moe很贵是显存门槛高了,数据中心没显存门槛限制,可以认为成本实际是13b模型,再考虑稀疏注意力的优化,我觉得实际成本跟qwen系列的9b模型相当。再加上超大缓存(硬盘缓存?)可以认为预处理几乎不耗时,按照5090推理解码 200 t/s 速度,单张每天大概是16M输出可以卖32块钱,电费按单卡600瓦每天才14.4度点按10块钱算吧,这都卖到电费的三倍价格了,每天净利润22块,一年22*365大概8000,三年2万4回本卡钱
回复

使用道具 举报

     
发表于 2026-8-1 08:58 来自手机 | 显示全部楼层
显卡是不是要开始降价了

这句话没绷住
回复

使用道具 举报

     
发表于 2026-8-1 08:58 | 显示全部楼层
一开始把价格定得比较高,团队里大家不是很高兴。后来我把价格又降下来了,
降到四分之一,大家就很开心。

现在真有人整天用游戏显卡跑大模型吗
回复

使用道具 举报

发表于 2026-8-1 09:02 | 显示全部楼层
icer 发表于 2026-8-1 08:55
激活只有13b,kv cache比qwen 27b还小,规模上来之后挺推理成本便宜的。本地moe很贵是显存门槛高了,数据中 ...

梁圣说定价以推理服务器9个月回本为标准
回复

使用道具 举报

     
发表于 2026-8-1 09:08 | 显示全部楼层
mitzvah 发表于 2026-8-1 09:02
梁圣说定价以推理服务器9个月回本为标准

再来一个dspark三倍速解码,差不多了
回复

使用道具 举报

     
发表于 2026-8-1 09:09 来自手机 | 显示全部楼层
这个计算在数学上是对的,但在现实商业运作中是一个典型的“理想化毛估估”,存在大量致命漏洞,绝对不可行。

我们可以把这位博主(赵纯想)的账本拆解开来看看:

✅ 数学计算正确的部分

· 收入算得对: 1200万机器 ÷ 4.5万日收入 = 266天(约9个月)。这个除法没有算错。
· 电费算得对: 14.5kw × 24小时 × 365天 = 127,020度电。按国内工商业电价约0.4-0.5元/度算,确实在 5万元 左右。(这个电费相比机器成本确实可以忽略)。

---

❌ 现实中完全行不通的“隐藏成本”

这就像说“只要每天卖出1000个包子就能买房”,却忽略了面粉进货、房租、人工、办证和有没有顾客。

1. 最大的坑:看不见的“基础设施投入”(远超1200万)

· 数据中心/机房租赁: 这种级别的服务器无法放在普通办公室。你需要租用工业级机柜、专线网络、恒温恒湿空调。一年机柜租赁费加网费至少需要 几十万到上百万。
· 电力增容: 14.5千瓦瞬间启动,普通办公楼根本带不动,需要单独拉专线、做变压器增容,这又是一笔几十万的硬件基建费。
· 运维成本: 服务器24小时疯狂运转,显卡和风扇极易损坏。8张D300 GPU 若坏掉一张,换卡维修的费用就是几十万起步,且需要专业的技术运维人员。

2. 最大的硬伤:模型能不能 “跑起来” 是存疑的

· 跑不动/没意义: 他提到的“Kimi K3”(1.4TB参数)是一个巨大的MoE(混合专家)大模型。D300(基于Hopper架构)的显存虽然号称2.3TB,但显存带宽和互联带宽往往无法支撑如此巨大的模型快速推理。
· GPU之间的通信瓶颈: 8张卡切分1.4TB模型,产生巨大的数据通信。如果物理带宽跑不满,真实推理速度会慢到让人抓狂,可能一天根本产不出能卖的 Token。

3. 最致命的商业逻辑:“谁来买?怎么卖?”

· 一天 4.5万 收入 = 每分钟产出 31元 = 每天产出 1700万 Token。
· 请问你的客户在哪里?目前国内大模型的 API 市场除了几家巨头,绝大部分小型 AI 公司处于惨烈价格战甚至赔本赚吆喝的阶段。
· 如果你没有大客户包月单子,这 1700万 Token 根本卖不出去,甚至只要有几个竞争对手把价格打下来,你的 4.5万 收入立马缩水成 4000 元。

4. 隐形的“折旧与生命周期”

· 这台机器一天24小时满载跑,寿命可能不到 2-3 年就会报废或性能严重下降。届时残值极低。9个月回本的前提是“机器9个月后依然能原价卖出”,这在科技圈是不可能的。

---

💡 总结建议

这位博主(据说是月之暗面创始人)发这个帖子,大概率是在玩梗、调侃当前大模型的算力成本,而不是真的建议你去买。

如果你真有 1200万 预算:

1. 直接去云厂商(阿里云、腾讯云、火山引擎)租用算力,不用操心物理维护,坏了云端自动换。
2. 买股票(NVDA)或者买机器拿来做模型训练微调(这比跑推理更能产生价值),而不是纯靠卖 Token 做“印钞机”。

结论:这是理想状态下的数学童话,现实中绝对是亏本生意。deepseek给的答复

评分

参与人数 4战斗力 -8 收起 理由
zutama -2
zmsws801 -2
yxch -2 问AI用不着你
gammatau -2

查看全部评分

回复

使用道具 举报

发表于 2026-8-1 09:10 | 显示全部楼层
骗局又咋了?便宜够用就完事了。
真塌房了等塌了再说,怎么天天有人在这臆想贷款骂小梁。

或者您是尊敬的投资人,刚投了几十个亿,心里有点慌来来泥潭求坛友心理按摩?
回复

使用道具 举报

     
发表于 2026-8-1 09:11 | 显示全部楼层
此外,数据中心开的地方应该峰电6毛,谷电6分。
回复

使用道具 举报

     
发表于 2026-8-1 09:12 | 显示全部楼层
显卡不满载才是浪费钱,你简单理解成这些ai公司是买了一堆显卡在那挖矿就行,挖矿是有回本周期的

超节点和NVlink72这类显卡互相通信的玩意,成本比本地部署可低太多
回复

使用道具 举报

     
 楼主| 发表于 2026-8-1 09:12 来自手机 | 显示全部楼层
icer 发表于 2026-8-1 08:55
激活只有13b,kv cache比qwen 27b还小,规模上来之后挺推理成本便宜的。本地moe很贵是显存门槛高了,数据中 ...

那么便宜为什么藤子opencode这些甘愿做梁子的管道rbq自己也不去本地部署,才13b激活,本地随便一张16g的卡就可以跑了啊
回复

使用道具 举报

     
发表于 2026-8-1 09:17 来自手机 | 显示全部楼层
龙骑士尹志平 发表于 2026-8-1 09:12
那么便宜为什么藤子opencode这些甘愿做梁子的管道rbq自己也不去本地部署,才13b激活,本地随便一张16g的 ...

opencode在go里的d指导没折扣,opencode相当于倒手就赚,为啥不当二道贩子?zen里免费的flash就当广告吸引用户了
腾讯也是如此,它更想推广自己的agent和混元3,4flash当个广告效应那直接用官方的就行了

—— 来自 HUAWEI WGRR-W19, Android 12, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-1 09:19 | 显示全部楼层
龙骑士尹志平 发表于 2026-8-1 09:12
那么便宜为什么藤子opencode这些甘愿做梁子的管道rbq自己也不去本地部署,才13b激活,本地随便一张16g的 ...
没有官方的infra工程师协助的话,本地部署别家的大模型成本不可能有本家的低,基本上对所有模型厂来说都是如此
对自己的模型,肯定比别人玩的溜啊,不然你工程师白招了,别人还可以用价格战部署你的开源模型直接把你直接打死,这现实吗
回复

使用道具 举报

发表于 2026-8-1 09:19 | 显示全部楼层
龙骑士尹志平 发表于 2026-8-1 09:12
那么便宜为什么藤子opencode这些甘愿做梁子的管道rbq自己也不去本地部署,才13b激活,本地随便一张16g的 ...

真正的工程技巧没开源呗

回复

使用道具 举报

发表于 2026-8-1 09:25 来自手机 | 显示全部楼层
梁同志的工程绝活没开源啊
一招鲜吃遍天,它 inference 就是倍数的便宜,大可以本伤人,可叹🌸没能同步,硬件还需积累,内功不足啊

— from S1 Next Goose v4.0-alpha
回复

使用道具 举报

头像被屏蔽
发表于 2026-8-1 09:34 | 显示全部楼层
提示: 作者被禁止或删除 内容自动屏蔽
回复

使用道具 举报

     
发表于 2026-8-1 09:47 | 显示全部楼层
照你这么说,难道现在的gpt pro和claude max 套餐不是骗局?匀成tokens比ds还便宜
回复

使用道具 举报

发表于 2026-8-1 09:48 | 显示全部楼层
各种内部用的东西都有开源一部分,deepEP,deepGEMM,3FS。但是外部没水平用好那么办法了。水平问题
还有就是专用的stack和通用的stack肯定效率不一样的    Re:Source
回复

使用道具 举报

     
发表于 2026-8-1 10:01 | 显示全部楼层
Lorraine_Kinney 发表于 2026-8-1 09:47
照你这么说,难道现在的gpt pro和claude max 套餐不是骗局?匀成tokens比ds还便宜 ...

套餐不就是卖家赌你不用,你赌卖家不跑吗?

美国那边卖家还可以赌美国国运,那是真拿纳税人的钱补贴用满套餐的人啊
回复

使用道具 举报

     
发表于 2026-8-1 10:04 | 显示全部楼层
icer 发表于 2026-8-1 08:55
激活只有13b,kv cache比qwen 27b还小,规模上来之后挺推理成本便宜的。本地moe很贵是显存门槛高了,数据中 ...

这个规模的模型200t/s是单线程,并发加dspark之类的还能多几倍
回复

使用道具 举报

     
发表于 2026-8-1 10:15 | 显示全部楼层
龙骑士尹志平 发表于 2026-8-1 09:12
那么便宜为什么藤子opencode这些甘愿做梁子的管道rbq自己也不去本地部署,才13b激活,本地随便一张16g的 ...

说明藤子和其他厂的AI infra还不行,这里面随便一项工程优化少了,回本期限就延长几倍甚至会亏了,暂时能想到的有硬盘KV缓存、dspark。硬盘缓存这一项应该可以省很多。可能其他厂家推d4f缓存优化做的没那么好。从ds的缓存命中率可以看出来他们infra有独家秘方的。
本地单卡16g甚至不要显卡,加上大内存是可以跑的,13b激活是从284b动态选取的,每个token都选一次,284b权重加载到内存,然后动态加载到显存处理,是可行的。实际上只要内存频率够高、通道数够多就能跑的,解码速度基本上等于激活权重/带宽,显卡计算优势还是体现在预填充阶段。
回复

使用道具 举报

发表于 2026-8-1 10:26 来自手机 | 显示全部楼层
本地部署没意义的都来了,你政府企业随便把自己的内部涉密资料给其他公司处理?然后等着人家随便拿捏你的命脉?

—— 来自 HUAWEI HBN-AL00, Android 12, 鹅球 v3.4.98
回复

使用道具 举报

     
发表于 2026-8-1 10:36 | 显示全部楼层
不过最近可能会出gpt 6 万一luna性能增长但不涨价压力还是不小
回复

使用道具 举报

     
发表于 2026-8-1 10:37 | 显示全部楼层
本帖最后由 ayanamilin 于 2026-8-1 10:39 编辑

泥潭梁文峰信徒很多,你说这话人家肯定不爱听。

如果一个供应商的算力集群全部部署 DeepSeek 模型、按照 DeepSeek API 定价卖 token,是很难很难盈利的。但另一方面,如果你的集群利用率不高,更不可能盈利。与其让 GPU 空转,不如拿一部分资源出来部署 DeepSeek 的模型,靠极低定价赚点用户(只要你部署 DeepSeek V4 flash,就会有龙虾/hermes/AI rp用户找上门来)。再加上 DeepSeek 是开源模型里部署成本、性能、用户知名度和认可度都名列前茅的,所以很多供应商都会部署 DeepSeek,就当赔本赚吆喝了。

DeepSeek 本质上还是个 lab,组织结构精简,没有产品压力,光靠卖 token 能获得可观的利润。这套商业模式换别的厂家是根本跑不通的。
回复

使用道具 举报

     
发表于 2026-8-1 10:40 | 显示全部楼层
colice 发表于 2026-8-1 10:26
本地部署没意义的都来了,你政府企业随便把自己的内部涉密资料给其他公司处理?然后等着人家随便拿捏你的命 ...

最近就有OPENAI提出给日本大学研究人员申请免费用GPT,感觉目的性就很明显。
回复

使用道具 举报

发表于 2026-8-1 10:42 来自手机 | 显示全部楼层
不是,DS 当然跟其他公司不一样,大头是梁同志量化挣的钱,资金和盈利压力怎么可能一样
但这和 DS 的 Infra 工程能力能把词元价格打下来不矛盾啊

— from S1 Next Goose v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-1 10:46 | 显示全部楼层
说明你缺乏常识,你本地部署的怎么和超大batch比成本

梁子维持低价的原因是要保持服务器满载,只要满载他就不会亏。

他价格要是定得高了用的人少了反而可能亏。
回复

使用道具 举报

     
发表于 2026-8-1 10:47 | 显示全部楼层
本帖最后由 ayanamilin 于 2026-8-1 10:55 编辑
icer 发表于 2026-8-1 10:15
说明藤子和其他厂的AI infra还不行,这里面随便一项工程优化少了,回本期限就延长几倍甚至会亏了,暂时能 ...

HBM4 2TBps

DDR5 H2D 带宽 < 100GBps

2TBps / 100GBps = 20

MoE 是动态路由的,以 DeepSeek V3 为例每层从 256 个专家里选 8 个,这 8 个专家只有在开始计算前才能确定。如果每层都要把权重从显存搬进去搬出来的话,带来的延迟要乘以 58 才等于单 token 计算的延迟。

虽然民间确实有人这么玩,但终究只是在玩。工业界是懒得这么干的。

还有 DS 的缓存命中率高是因为他们比较良心,驱逐做得少,不像 A\ 五分钟就给你驱逐了。
回复

使用道具 举报

发表于 2026-8-1 10:50 | 显示全部楼层
太蠢了,你要不去问下ai    Re:Source
回复

使用道具 举报

     
发表于 2026-8-1 10:54 | 显示全部楼层
ayanamilin 发表于 2026-8-1 10:47
HBM4 2TBps

DDR5 H2D 带宽 < 100GBps

DS的缓存是存硬盘里的,自然清出压力没存HBM里的大。
回复

使用道具 举报

     
发表于 2026-8-1 10:59 | 显示全部楼层
sellboy 发表于 2026-8-1 10:54
DS的缓存是存硬盘里的,自然清出压力没存HBM里的大。

严格来说是层级存储 HBM -> DRAM -> SSD,这套做法也不是 DeepSeek 独有的。

一般的厂家只会做 HBM -> DRAM 这两层。DeepSeek 不太在意成本,所以缓存做得很实,有时候缓存能停留 24 小时。
回复

使用道具 举报

     
发表于 2026-8-1 11:54 来自手机 | 显示全部楼层
本地部署肯定比不过梁子啊,作为当地支柱和国家重点扶持项目,给点电力补贴,提供点国家算力支持,他自己的成本就下去了。
回复

使用道具 举报

     
发表于 2026-8-1 12:36 来自手机 | 显示全部楼层
kimi k3的回复,几个硬伤我说一下:

1. "10个月回本"你理解反了。 梁文锋原话是API定价的内部参考线:采购一批服务器,十个月收回硬件成本。服务器行业常规按3-5年摊销,10个月回本意味着硬件层面6倍毛利——这是定价上限,不是利润承诺。他后面还说了:现在提价一倍收入可能翻倍,但主动不提,愿意把效率收益让给用户。你管这叫杀猪盘?杀猪盘是这么定价的?

2. V4F便宜是因为结构便宜。 284B总参数激活只有13B,单token运算量比你5090本地跑个Qwen 27B还小。H20单台就能部署。人家便宜是MoE架构+FP4量化+工程优化抠出来的成本优势,不是幻方烧钱补贴。幻方不缺钱,DeepSeek也不需要烧钱——10个月硬件回本说明这生意本身就是赚的。

3. "为了融资造势"时间线对不上。 融资已经落定了,超500亿、首轮,梁文锋个人出了200亿。要骗也是骗之前造势,哪有融完资再开大会骗的?而且真想圈钱,2025年初DS时刻人声鼎沸的时候不融,拖到现在?融资目的他自己说得明白:消除人员流失风险,团队稳定是唯一不能退让的底线。

4. "本地部署没意义"这句倒是唯一沾边的。 月token消耗几百块钱的人,调API确实比买卡划算。但这恰恰说明人家定价是可持续的,不是倾销。你指望显卡因此降价,还不如指望国产算力跟上——梁文锋自己说了,主流卡都不卖给中国,还得用国产卡跑赢美国,这才是正事。

总结:低价=效率,不是补贴;回本=定价纪律,不是话术。

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0

评分

参与人数 3战斗力 -2 收起 理由
Onelooker -2 你是Kimi吗?
gammatau -2
秦南心 + 2

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-1 12:49 来自手机 | 显示全部楼层
所以火箭要用水洗煤在泥潭还真能讨论几十楼是吧……
回复

使用道具 举报

     
发表于 2026-8-1 12:54 | 显示全部楼层
opencode zen里的flash就是本地部署在海外的,吵架前能不能先搞搞清楚

论坛助手,iPhone
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-24 17:14 , Processed in 0.264331 second(s), 9 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表