木谷高明 发表于 2026-8-26 20:01
看有不少团购dgx spark,两台可以跑v4f
除了老黄原版,华硕微星超聚变(从华为服务器业务拆出来的部门) ...
我用过了,其实moe可以,其他都太慢了,我还要ai视频电影
群友们别冲动啊,自己本地组服务器的价钱拿去买API,能蹬到你昏迷。
他这个毛利只有电费和折旧还有工资,又不用营销又没有售后等等
加上超强infra,一点都不奇怪
自由之紫roy 发表于 2026-8-26 20:04
我用过了,其实moe可以,其他都太慢了,我还要ai视频电影
对,主要是开源模型多了,单独买API乱七八糟还贵。
重度各种开源AI都玩的,自己搭也不贵。
来都来了 发表于 2026-8-26 20:04
群友们别冲动啊,自己本地组服务器的价钱拿去买API,能蹬到你昏迷。
qwen 3.8 27b FP8 去审核版了解一下
自由之紫roy 发表于 2026-8-26 19:55
不知道能不能算力自由,不过我还是决定把积蓄allin了。放纵一下。
找个便宜电卖算力给坛友吧
来都来了 发表于 2026-8-26 20:04
群友们别冲动啊,自己本地组服务器的价钱拿去买API,能蹬到你昏迷。
就是为了对付不能回答和被请喝茶的情况啊
lly778 发表于 2026-8-26 20:02
毛利和利润差好远的,ai企业大头在研发费用
没有讨论利润啊,这消息一开始就说了还在猛亏
毛利几乎就是衡量商业模式是否可行的最核心指标,你就是开个早餐店勇哥也要问你毛利多少,目前来看没有任何一家同行做到 DS 这个水平的,正如我之前提到的行业对比,82.9 已经是天花板级别
—— 来自 vivo V2309A, Android 16, 鹅球 v4.0
本帖最后由 舞以 于 2026-8-26 20:27 编辑
梁叔叔真是有钱买不到卡吧,要是把大厂们的卡都给梁叔叔,估计flash就能一直爽了
这话真有点孝子了,但是我觉得某几个厂真的是拿卡不办事。
话说记不住cli快捷键咋整,pi和反重力的cli感觉挺高效的但是上手记不住按键
本地QWEN3.8 27B的专武就是PI吗 DSH能适配不 懒得再折腾了
qwased 发表于 2026-8-26 20:31
话说记不住cli快捷键咋整,pi和反重力的cli感觉挺高效的但是上手记不住按键 ...
只是文本编辑快捷键的话其实大多数开源软件都有emacs/vim绑定,习惯之后拿到软件改改就行。
另外几乎所有terminal默认带最基础的emacs绑定,学一次到处用了属于,多用几年手就会变成emacs的形状了。
我这种非超能力者的普通人,还是喜欢webui或者桌面端。
squallx 发表于 2026-8-26 20:31
本地QWEN3.8 27B的专武就是PI吗 DSH能适配不 懒得再折腾了
可以,主要得弄个好使的上下文管理,pi vcc有现成的直接用,DSH版前面有楼友提到了,你往前翻翻看
感觉配上pi vcc之后64K上下文就真正可用了,实际用着和无限上下文也差不太多
squallx 发表于 2026-8-26 20:31
本地QWEN3.8 27B的专武就是PI吗 DSH能适配不 懒得再折腾了
可以用的 我一开始用的也是dsh,但pi的压缩上文和很轻便的开启的确更舒服就是了
https://mp.weixin.qq.com/s/16MOkzjvg6SLfozl1HjymA
Qwen3.8-Flash即将上线千问AI平台,对外提供API服务,每百万Tokens输入1元,输出3元。今晚,Qwen3.8-Flash还将首发上线“千问办公”。
—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99
来了,看着完全是v4f的水平呀Re:Source
难道说!黄金时代回来了!
还在信Qwen的分数吗?
等实测吧,qwen跑分不能太信,不然oa早就死了
N-gram Embedding好像之前deepseek提过的吧,但是没有放在v4上
我的DGX Spark已经摩拳擦掌了
德尔惠净水器 发表于 2026-8-26 20:58
N-gram Embedding好像之前deepseek提过的吧,但是没有放在v4上
ds专门发了篇论文,他们叫Engram,梁叔叔都署名了。
但是他们只是做了一些实验,还没有在主线模型引入。
如果可以特化办公技能那也相当不错了,办公模型这个生态位非常适合DGX这种小主机啊,小公司买一台直接省掉一个文员的工资了
https://huggingface.co/Qwen/Qwen3.8-Flash-Next
抢跑是吧
黄金时代!我先吃了
125B 6B的小模型,价格是否美丽!
好像输出 3 元输入 1 元,缓存内价格不知道
—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha
缓存只要和flash涨价前一样,就是黄金时代再来
缓存真的是大头
qwen干嘛要挑这么一个奇怪的大小
正好iq1 24g显卡也玩不起 但如果上api又有点太小的大小
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
牛来真是glm啊
实验性吧,n-gram embedding规模是51b,占总参数量的大约29%了,这个选择挺激进的,ds测试的结果一般是20%左右比较合适。
再大的规模可能测试代价和风险就太高了?
neptunehs 发表于 2026-8-26 21:20
qwen干嘛要挑这么一个奇怪的大小
正好iq1 24g显卡也玩不起 但如果上api又有点太小的大小
用那个啥freetoken好像能把ngram放ssd上,128g内存随便配个16g显卡就能跑的样子
我觉得0731-0816这段好时光回不来的
这段好时光本质是当时ds的价格太低了,甚至算是定价失误了
其他的大厂比ds严肃多了,会犯这种错误?
牛来好像说10点发 glm5.3flash
牛来我感觉会是glm订阅者的好消息
qwased 发表于 2026-8-26 21:32
牛来好像说10点发 glm5.3flash
免费期间结束了吗 哎
期待明天能有qwennextflash的免费接上
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
noneoneone 发表于 2026-8-26 15:17
啥?我昨天刚买了国算的plan,今天就没得玩了?
话说有没有用网页端讨论实施计划,然后抄下来给flash模型编 ...
可以用gpt它网页端免费的
https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
1比特量化版72.5GB
牛来好像也是122b大小,dgx这下真的要涨了
量化版这么大。看来只能围观了