qwased 发表于 2026-8-13 12:22

本帖最后由 qwased 于 2026-8-13 12:25 编辑

大暴死 发表于 2026-8-13 12:17
5070ti原来能跑35a3b吗,昨天我想试试本地的ppt生成项目,哈基米一开始推荐我用qwen2.5 14b,我说都3.6了 ...

27b要跑那个16g显存特化版的iq4xxs,上下文开不了很多,倒是能跑个六七十tk/s
或者可以尝鲜跑bonsai27b
反正qwen系我测下来都有非常严重的不说人话+复读机循环+中英混杂,写代码倒是还行但是我又用不上

Rowen233 发表于 2026-8-13 12:23

我在Windows系统里让Agent开WSL运行命令一直碰到PowerShell的转义问题

serj005 发表于 2026-8-13 12:24

Rowen233 发表于 2026-8-13 12:23
我在Windows系统里让Agent开WSL运行命令一直碰到PowerShell的转义问题

修改agent配置,让它自己的shell执行器默认换成bash

CCauchy 发表于 2026-8-13 12:26

valand 发表于 2026-8-13 12:16
当然可以

怎么弄啊

论坛助手,iPhone

zy450 发表于 2026-8-13 12:28

横幅换了,还差更新记录!还有希望!

valand 发表于 2026-8-13 12:30

CCauchy 发表于 2026-8-13 12:26
怎么弄啊

论坛助手,iPhone

cli 用 esc 吧

小野賢章 发表于 2026-8-13 12:31

梁文峰老师~我还记得你~

四氧化三铅 发表于 2026-8-13 12:34

不太懂,是在说pro能力跟flash 55开吗? 这不太符合逻辑吧?这么做的目的为啥? 为何不把flash直接称为pro,把flash能力一开始就调弱一点呢。

Promeus 发表于 2026-8-13 12:34

有人看看上网冲浪的ds员工吗

午夜钓者 发表于 2026-8-13 12:34

本帖最后由 午夜钓者 于 2026-8-13 12:36 编辑

燕山雪 发表于 2026-8-13 12:20
感觉这楼口碑要直奔2077去了……
“没人会记得那些按时发布的垃圾模型”.webp ...
无非是b站发视频吹牛逼说灰测的就是正式版把大家期望值拉高了,官方可从来没说过什么灰测就是正式版

现在看正式版不如灰测模型有些人就开始滑坡了

半江瑟瑟半江红 发表于 2026-8-13 12:35

午夜钓者 发表于 2026-8-13 12:34
无非是b站发视频吹牛逼说灰测的就是正式版把大家期望值拉高了,官方可从来没说过什么灰测 ...

这不是灰测拉高的期待值,我就从没看那些视频,也没roll到灰测
我是根据flash能力倒推的

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

绝地潜兵 发表于 2026-8-13 12:37

那看来flash和PO只有参数量的不同,能力是一样的

风速前进mo 发表于 2026-8-13 12:39

感觉完全没有用pro的必要啊,能力差不多为什么不用便宜的

论坛助手,iPhone

午夜钓者 发表于 2026-8-13 12:39

半江瑟瑟半江红 发表于 2026-8-13 12:35
这不是灰测拉高的期待值,我就从没看那些视频,也没roll到灰测
我是根据flash能力倒推的


跟flash比还是略有提升

半江瑟瑟半江红 发表于 2026-8-13 12:42

午夜钓者 发表于 2026-8-13 12:39
跟flash比还是略有提升

我个人感觉就和flash与glm5.2的差距差不多,有,但不多,说实话某些情况下体感都不体感不出来
最重要的是,我本来以为1.6t大参数能大幅度提高开放性写作能力,结果这什么玩意

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

nianiania 发表于 2026-8-13 12:44

等下午有没有奇迹发生,昨晚好失望,本来想着终于可以停掉两个codex账号了

狭义文具爱好者 发表于 2026-8-13 12:45

现在不说对不上灰测和flash后训练预期了,先对不上的是自己的跑分。Terminal Bench 2.1,v4fga官方跑分82,第三方79算是正常误差和工具差异。v4pga官方87.9,第三方79和v4fga一样,还不只一个跑分这样。

午夜钓者 发表于 2026-8-13 12:45

半江瑟瑟半江红 发表于 2026-8-13 12:42
我个人感觉就和flash与glm5.2的差距差不多,有,但不多,说实话某些情况下体感都不体感不出来
最重要的是 ...

大参数后训练出问题了,flash因为体量小,后训练的比较好

serj005 发表于 2026-8-13 12:46

所以现在有多少人全面测过high的具体表现?现在网上全都是测的有问题的max档。

王兰花秀丽 发表于 2026-8-13 12:51

现在的状态太诡异了    Re:Source

孤灯蓝影 发表于 2026-8-13 12:51

本帖最后由 孤灯蓝影 于 2026-8-13 12:53 编辑

要等deepseek自己修吧,high档比max档都要好,很明显是参数问题。就像2077准时发表才发现优化极差,需要多个补丁修复。估计是用了国产芯片兼容出了问题

tillnight 发表于 2026-8-13 12:53

狭义文具爱好者 发表于 2026-8-13 12:45
现在不说对不上灰测和flash后训练预期了,先对不上的是自己的跑分。Terminal Bench 2.1,v4fga官方跑分82, ...

我一直不懂你们说的官方跑分是什么。至今也只有一张据说是harness群里发的图。Deepseek发模型一般确实都是带跑分的,但是这次连更新说明都没有发。以及正常的Deepseek是同步开源权重的,现在也没发。整个就不是正常状态。

wandeeees 发表于 2026-8-13 12:53

如果训练出问题了的话,为啥要说大幅提升价格,现在这性能没必要这么说吧

—— 来自 Xiaomi 2602BRT18C, Android 16上的 S1Next-鹅版 v2.1.2

80后卢瑟 发表于 2026-8-13 12:54

太怪了,low 最好

午夜钓者 发表于 2026-8-13 12:57

确实,楼主发的跑分图也不是官方发的

蜗塞塞 发表于 2026-8-13 13:04

本帖最后由 蜗塞塞 于 2026-8-13 13:06 编辑


tillnight 发表于 2026-8-13 12:53
我一直不懂你们说的官方跑分是什么。至今也只有一张据说是harness群里发的图。Deepseek发模型一般确实都 ...


肯定是官方的,官方微信群小助手发的

自由之紫roy 发表于 2026-8-13 13:05

现在连api到底是pro了吗?
我刚还让它干活了

很久就在那边l 发表于 2026-8-13 13:08

toyama nao榜也更新了,比flash高一点

zy450 发表于 2026-8-13 13:10

如果表现是这样的话,那可以理解为什么一定要等DSH出来了

cscbzcbz 发表于 2026-8-13 13:11

zy450 发表于 2026-8-13 13:10
如果表现是这样的话,那可以理解为什么一定要等DSH出来了

但是dsh也没出啊

ly4236 发表于 2026-8-13 13:11

这个如来的感觉太有意思了

狭义文具爱好者 发表于 2026-8-13 13:11

本帖最后由 狭义文具爱好者 于 2026-8-13 13:13 编辑


横幅已撤回,闹麻了

Lorraine_Kinney 发表于 2026-8-13 13:12

绷,官网的消息撤了,真是上错了?

アレクト 发表于 2026-8-13 13:12

答案是pro还没训练好就逃逸了,自己把自己发布了

wandeeees 发表于 2026-8-13 13:13

狭义文具爱好者 发表于 2026-8-13 13:11
横幅已撤回,闹麻了

由于表现不如预期,撤回了此次发布

德尔惠净水器 发表于 2026-8-13 13:13

官网更新消息已经撤回了

王兰花秀丽 发表于 2026-8-13 13:14

这也太搞了    Re:Source

cscbzcbz 发表于 2026-8-13 13:14

今天能修好吗,版本号为0813的模型没在0813发布?

ArthurDent 发表于 2026-8-13 13:14

アレクト 发表于 2026-8-13 13:12
答案是pro还没训练好就逃逸了,自己把自己发布了

还把公司电子锁锁了,花了一上午翘了锁才进去

—— 来自 Xiaomi 2112123AC, Android 13, 鹅球 v4.0-alpha

chuchoselph 发表于 2026-8-13 13:15

不是,这在干嘛呢?不能真是逃逸烂活儿吧,每个AI lab的必修课?

论坛助手,iPhone
页: 162 163 164 165 166 167 168 169 170 171 [172] 173 174 175 176 177 178 179 180 181
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼