自由之紫roy 发表于 2026-8-26 20:04

木谷高明 发表于 2026-8-26 20:01
看有不少团购dgx spark,两台可以跑v4f

除了老黄原版,华硕微星超聚变(从华为服务器业务拆出来的部门) ...

我用过了,其实moe可以,其他都太慢了,我还要ai视频电影

来都来了 发表于 2026-8-26 20:04

群友们别冲动啊,自己本地组服务器的价钱拿去买API,能蹬到你昏迷。

crow_wine 发表于 2026-8-26 20:04

他这个毛利只有电费和折旧还有工资,又不用营销又没有售后等等
加上超强infra,一点都不奇怪

木谷高明 发表于 2026-8-26 20:05

自由之紫roy 发表于 2026-8-26 20:04
我用过了,其实moe可以,其他都太慢了,我还要ai视频电影

对,主要是开源模型多了,单独买API乱七八糟还贵。

重度各种开源AI都玩的,自己搭也不贵。

自由之紫roy 发表于 2026-8-26 20:05

来都来了 发表于 2026-8-26 20:04
群友们别冲动啊,自己本地组服务器的价钱拿去买API,能蹬到你昏迷。

qwen 3.8 27b FP8 去审核版了解一下

qwased 发表于 2026-8-26 20:08

自由之紫roy 发表于 2026-8-26 19:55
不知道能不能算力自由,不过我还是决定把积蓄allin了。放纵一下。

找个便宜电卖算力给坛友吧

木谷高明 发表于 2026-8-26 20:12

来都来了 发表于 2026-8-26 20:04
群友们别冲动啊,自己本地组服务器的价钱拿去买API,能蹬到你昏迷。

就是为了对付不能回答和被请喝茶的情况啊

绕指流光 发表于 2026-8-26 20:18

lly778 发表于 2026-8-26 20:02
毛利和利润差好远的,ai企业大头在研发费用

没有讨论利润啊,这消息一开始就说了还在猛亏
毛利几乎就是衡量商业模式是否可行的最核心指标,你就是开个早餐店勇哥也要问你毛利多少,目前来看没有任何一家同行做到 DS 这个水平的,正如我之前提到的行业对比,82.9 已经是天花板级别

—— 来自 vivo V2309A, Android 16, 鹅球 v4.0

舞以 发表于 2026-8-26 20:26

本帖最后由 舞以 于 2026-8-26 20:27 编辑

梁叔叔真是有钱买不到卡吧,要是把大厂们的卡都给梁叔叔,估计flash就能一直爽了
这话真有点孝子了,但是我觉得某几个厂真的是拿卡不办事。

qwased 发表于 2026-8-26 20:31

话说记不住cli快捷键咋整,pi和反重力的cli感觉挺高效的但是上手记不住按键

squallx 发表于 2026-8-26 20:31

本地QWEN3.8 27B的专武就是PI吗 DSH能适配不 懒得再折腾了

LeoDT 发表于 2026-8-26 20:37

qwased 发表于 2026-8-26 20:31
话说记不住cli快捷键咋整,pi和反重力的cli感觉挺高效的但是上手记不住按键 ...

只是文本编辑快捷键的话其实大多数开源软件都有emacs/vim绑定,习惯之后拿到软件改改就行。

另外几乎所有terminal默认带最基础的emacs绑定,学一次到处用了属于,多用几年手就会变成emacs的形状了。

舞以 发表于 2026-8-26 20:38

我这种非超能力者的普通人,还是喜欢webui或者桌面端。

qwased 发表于 2026-8-26 20:38

squallx 发表于 2026-8-26 20:31
本地QWEN3.8 27B的专武就是PI吗 DSH能适配不 懒得再折腾了
可以,主要得弄个好使的上下文管理,pi vcc有现成的直接用,DSH版前面有楼友提到了,你往前翻翻看
感觉配上pi vcc之后64K上下文就真正可用了,实际用着和无限上下文也差不太多

kinfox 发表于 2026-8-26 20:38

squallx 发表于 2026-8-26 20:31
本地QWEN3.8 27B的专武就是PI吗 DSH能适配不 懒得再折腾了

可以用的 我一开始用的也是dsh,但pi的压缩上文和很轻便的开启的确更舒服就是了

tonyunreal 发表于 2026-8-26 20:51

https://mp.weixin.qq.com/s/16MOkzjvg6SLfozl1HjymA

Qwen3.8-Flash即将上线千问AI平台,对外提供API服务,每百万Tokens输入1元,输出3元。今晚,Qwen3.8-Flash还将首发上线“千问办公”。

—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99

王兰花秀丽 发表于 2026-8-26 20:52

来了,看着完全是v4f的水平呀Re:Source

qwased 发表于 2026-8-26 20:53

难道说!黄金时代回来了!

nxmonitor 发表于 2026-8-26 20:55

还在信Qwen的分数吗?

舞以 发表于 2026-8-26 20:56

等实测吧,qwen跑分不能太信,不然oa早就死了

德尔惠净水器 发表于 2026-8-26 20:58

N-gram Embedding好像之前deepseek提过的吧,但是没有放在v4上

startraveller 发表于 2026-8-26 21:00

我的DGX Spark已经摩拳擦掌了

舞以 发表于 2026-8-26 21:00

德尔惠净水器 发表于 2026-8-26 20:58
N-gram Embedding好像之前deepseek提过的吧,但是没有放在v4上

ds专门发了篇论文,他们叫Engram,梁叔叔都署名了。
但是他们只是做了一些实验,还没有在主线模型引入。

qwased 发表于 2026-8-26 21:03

如果可以特化办公技能那也相当不错了,办公模型这个生态位非常适合DGX这种小主机啊,小公司买一台直接省掉一个文员的工资了

tonyunreal 发表于 2026-8-26 21:04

https://huggingface.co/Qwen/Qwen3.8-Flash-Next

抢跑是吧

→熙← 发表于 2026-8-26 21:10

黄金时代!我先吃了
125B 6B的小模型,价格是否美丽!

misuzu0723 发表于 2026-8-26 21:15

好像输出 3 元输入 1 元,缓存内价格不知道

—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha

cscbzcbz 发表于 2026-8-26 21:19

缓存只要和flash涨价前一样,就是黄金时代再来
缓存真的是大头

neptunehs 发表于 2026-8-26 21:20

qwen干嘛要挑这么一个奇怪的大小
正好iq1 24g显卡也玩不起 但如果上api又有点太小的大小

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

城北无尘 发表于 2026-8-26 21:21

牛来真是glm啊

舞以 发表于 2026-8-26 21:22

实验性吧,n-gram embedding规模是51b,占总参数量的大约29%了,这个选择挺激进的,ds测试的结果一般是20%左右比较合适。
再大的规模可能测试代价和风险就太高了?

qwased 发表于 2026-8-26 21:24

neptunehs 发表于 2026-8-26 21:20
qwen干嘛要挑这么一个奇怪的大小
正好iq1 24g显卡也玩不起 但如果上api又有点太小的大小


用那个啥freetoken好像能把ngram放ssd上,128g内存随便配个16g显卡就能跑的样子

舞以 发表于 2026-8-26 21:25

我觉得0731-0816这段好时光回不来的
这段好时光本质是当时ds的价格太低了,甚至算是定价失误了
其他的大厂比ds严肃多了,会犯这种错误?

qwased 发表于 2026-8-26 21:32

牛来好像说10点发 glm5.3flash

舞以 发表于 2026-8-26 21:34

牛来我感觉会是glm订阅者的好消息

neptunehs 发表于 2026-8-26 21:35

qwased 发表于 2026-8-26 21:32
牛来好像说10点发 glm5.3flash

免费期间结束了吗 哎
期待明天能有qwennextflash的免费接上

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

zypyong 发表于 2026-8-26 21:38

noneoneone 发表于 2026-8-26 15:17
啥?我昨天刚买了国算的plan,今天就没得玩了?
话说有没有用网页端讨论实施计划,然后抄下来给flash模型编 ...

可以用gpt它网页端免费的

tonyunreal 发表于 2026-8-26 21:44

https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF

1比特量化版72.5GB

qwased 发表于 2026-8-26 21:44

牛来好像也是122b大小,dgx这下真的要涨了

kinfox 发表于 2026-8-26 21:45

量化版这么大。看来只能围观了
页: 275 276 277 278 279 280 281 282 283 284 [285] 286 287 288 289 290 291 292 293
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼