找回密码
 立即注册
搜索
查看: 2157|回复: 19

[硬件] 苹果悄悄上架了M5 ultra和M6

[复制链接]
     
发表于 2026-8-26 09:15 | 显示全部楼层 |阅读模式
16+256只售142999!

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-26 09:17 | 显示全部楼层
还真是16+256
回复

使用道具 举报

     
发表于 2026-8-26 09:18 | 显示全部楼层
后面16+512的皇帝版估计再加70000吧,219999这样
顺便苹果这个首发了消费级(?)pcie6.0固态的样子
回复

使用道具 举报

     
发表于 2026-8-26 09:22 | 显示全部楼层
这个16+256能跑ds v4f吗
回复

使用道具 举报

     
发表于 2026-8-26 09:35 | 显示全部楼层
本帖最后由 培根芝士蛋堡XD 于 2026-8-26 09:37 编辑
沙发沙发 发表于 2026-8-26 09:22
这个16+256能跑ds v4f吗

512g理论上可以跑满血的1M dpsk v4f,LLM时代内存和显存统一的优势出来了,现在对比N卡服务器价格,看M5 ultra甚至性价比爆表
回复

使用道具 举报

     
发表于 2026-8-26 09:56 | 显示全部楼层
现在内存已经不是金条,要称之为铑条了。
回复

使用道具 举报

     
发表于 2026-8-26 10:46 | 显示全部楼层
太贵了,m5ultra的带宽很惊人

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-26 11:34 | 显示全部楼层
本帖最后由 netplaying 于 2026-8-26 11:41 编辑

之前512g的m3 ultra就是性价比最高的本地部署超大模型的选择,671B参数量的DeepSeek V3/R1 Q4精度的MoE模型都能跑。部署成本只有nvidia方案的十分之一不到。当然输出速度也只有nvidia的十分之一,不过个人玩玩也足够了。
回复

使用道具 举报

     
发表于 2026-8-26 12:30 | 显示全部楼层
mini max h3抽卡能比pro6000快不
回复

使用道具 举报

     
发表于 2026-8-26 14:09 | 显示全部楼层
natt 发表于 2026-8-26 12:30
mini max h3抽卡能比pro6000快不

那真不能
Ultra主要还是给DSV4F和3.8 MAX的
回复

使用道具 举报

     
发表于 2026-8-26 14:11 | 显示全部楼层
本帖最后由 雪影 于 2026-8-26 14:22 编辑

512比较尴尬,跑DSV4F有点多,跑GLM5.3不够,要是有个768就完美了

256跑DSV4F又不够
128跑27B太多
回复

使用道具 举报

     
发表于 2026-8-26 15:21 | 显示全部楼层
雪影 发表于 2026-8-26 14:11
512比较尴尬,跑DSV4F有点多,跑GLM5.3不够,要是有个768就完美了

256跑DSV4F又不够

显存不会嫌多的,拉高并发之类的总是有用
回复

使用道具 举报

发表于 2026-8-26 17:10 | 显示全部楼层
雪影 发表于 2026-8-26 14:11
512比较尴尬,跑DSV4F有点多,跑GLM5.3不够,要是有个768就完美了

256跑DSV4F又不够

256够了吧,v4f是8bit/4bit混合,不到160G
回复

使用道具 举报

     
发表于 2026-8-26 18:18 | 显示全部楼层
noword 发表于 2026-8-26 17:10
256够了吧,v4f是8bit/4bit混合,不到160G

现在一般agent会启动多个subagent子代理,加上这个内存你还要和系统本身共用,部署1M dpsk v4f我觉得256g很难顶住
回复

使用道具 举报

     
发表于 2026-8-26 18:30 | 显示全部楼层
培根芝士蛋堡XD 发表于 2026-8-26 18:18
现在一般agent会启动多个subagent子代理,加上这个内存你还要和系统本身共用,部署1M dpsk v4f我觉得256g ...

Deepseek V4是CSA/HCA,1M上下文没量化就不到10G,量化就5G,还是够的
回复

使用道具 举报

发表于 2026-8-26 18:38 来自手机 | 显示全部楼层
m6换新架构了吗
回复

使用道具 举报

     
发表于 2026-8-26 19:40 | 显示全部楼层
startraveller 发表于 2026-8-26 18:30
Deepseek V4是CSA/HCA,1M上下文没量化就不到10G,量化就5G,还是够的

改大项目的时候,dpsk harness一口气开8个subagent都能看见,不量化还是比较难的
回复

使用道具 举报

     
发表于 2026-8-26 20:16 | 显示全部楼层
培根芝士蛋堡XD 发表于 2026-8-26 19:40
改大项目的时候,dpsk harness一口气开8个subagent都能看见,不量化还是比较难的 ...

8个都占满1M上下文的情况的话与其担心内存,更需要担心的是M5的prefill速度……
回复

使用道具 举报

     
发表于 2026-8-26 20:25 | 显示全部楼层
startraveller 发表于 2026-8-26 20:16
8个都占满1M上下文的情况的话与其担心内存,更需要担心的是M5的prefill速度…… ...

subagent也不是prefill,这主要是decode的问题,多并发容易打满算力bound导致单agent吞吐下降,这个也正常,但是总比oom要好
回复

使用道具 举报

     
发表于 2026-8-27 00:03 | 显示全部楼层
模型3~4个月就会过时,今天发布的Qwen3.8-Flash-Next就超越了DeepSeek V4 Flash 0731而且体积还只有一半,也可以通过扩展开到1M上下文,256G拿来跑这个刚好。至于512G内存版本可以拿来跑今天发布的GLM5.3 Flash。
内存不够用的话,把冷对话的KV Cache驱逐到别的机器上的内存就可以了,vllm/sglang结合LM Cache很简单。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-27 02:45 , Processed in 0.153218 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表