找回密码
 立即注册
搜索
查看: 1432|回复: 6

[科技] Meta开源30B AI 模型Muse Glimmer,4bit量化可在单卡24GB显存GPU运行

[复制链接]
发表于 2026-8-10 19:00 来自手机 | 显示全部楼层 |阅读模式
此帖将于2026-09-09 18:58自动关闭
IT之家 8 月 10 日消息,Meta 今日发布 AI 模型 Muse Glimmer,并在 Apache 2.0 许可协议下开源该模型权重。Muse Glimmer 是一款拥有 300 亿参数(30B)的模型,专为全天候常驻运行的本地智能体(Agent)工作流深度优化。
官方表示,Muse Glimmer 应用了 4bit 量化技术,使其可在 24GB/32GB 显存的 Mac 或 PC 上本地运行。实测验证这种压缩对智能体任务性能的影响微乎其微,几乎没有任何衰减。
Meta 在 MacBook M4 Max、M5 Max 以及 RTX 5090 平台上进行了测试。结果表明,该模型的运行速度可以胜任流畅的对话以及实时智能体交互,且所有计算均 100% 在本地设备上完成。

与 Gemma4-31B 和 Qwen3.6-27B 相比,Muse Glimmer 在多项主流大语言模型基准测试中,均展现出了同尺寸级别模型中的强劲性能。

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-11 08:33 来自手机 | 显示全部楼层






—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-11 08:38 来自手机 | 显示全部楼层
那不还是要起步9系显卡

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-8-11 08:45 来自手机 | 显示全部楼层
本地部署还有甲那还要你何用
回复

使用道具 举报

发表于 2026-8-11 08:50 来自手机 | 显示全部楼层
和qwen3.6比?
回复

使用道具 举报

     
发表于 2026-8-11 08:57 来自手机 | 显示全部楼层
我就觉得很奇怪 量化这活儿是社区负责的 干嘛他官方搞量化?

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-11 09:18 | 显示全部楼层
不是,用AI操作鼠标是什么路数
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-24 17:24 , Processed in 0.035832 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表