本帖最后由 qwased 于 2026-8-13 12:25 编辑
大暴死 发表于 2026-8-13 12:17
5070ti原来能跑35a3b吗,昨天我想试试本地的ppt生成项目,哈基米一开始推荐我用qwen2.5 14b,我说都3.6了 ...
27b要跑那个16g显存特化版的iq4xxs,上下文开不了很多,倒是能跑个六七十tk/s
或者可以尝鲜跑bonsai27b
反正qwen系我测下来都有非常严重的不说人话+复读机循环+中英混杂,写代码倒是还行但是我又用不上
我在Windows系统里让Agent开WSL运行命令一直碰到PowerShell的转义问题
Rowen233 发表于 2026-8-13 12:23
我在Windows系统里让Agent开WSL运行命令一直碰到PowerShell的转义问题
修改agent配置,让它自己的shell执行器默认换成bash
valand 发表于 2026-8-13 12:16
当然可以
怎么弄啊
论坛助手,iPhone
横幅换了,还差更新记录!还有希望!
CCauchy 发表于 2026-8-13 12:26
怎么弄啊
论坛助手,iPhone
cli 用 esc 吧
梁文峰老师~我还记得你~
不太懂,是在说pro能力跟flash 55开吗? 这不太符合逻辑吧?这么做的目的为啥? 为何不把flash直接称为pro,把flash能力一开始就调弱一点呢。
有人看看上网冲浪的ds员工吗
本帖最后由 午夜钓者 于 2026-8-13 12:36 编辑
燕山雪 发表于 2026-8-13 12:20
感觉这楼口碑要直奔2077去了……
“没人会记得那些按时发布的垃圾模型”.webp ...
无非是b站发视频吹牛逼说灰测的就是正式版把大家期望值拉高了,官方可从来没说过什么灰测就是正式版
现在看正式版不如灰测模型有些人就开始滑坡了
午夜钓者 发表于 2026-8-13 12:34
无非是b站发视频吹牛逼说灰测的就是正式版把大家期望值拉高了,官方可从来没说过什么灰测 ...
这不是灰测拉高的期待值,我就从没看那些视频,也没roll到灰测
我是根据flash能力倒推的
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
那看来flash和PO只有参数量的不同,能力是一样的
感觉完全没有用pro的必要啊,能力差不多为什么不用便宜的
论坛助手,iPhone
半江瑟瑟半江红 发表于 2026-8-13 12:35
这不是灰测拉高的期待值,我就从没看那些视频,也没roll到灰测
我是根据flash能力倒推的
跟flash比还是略有提升
午夜钓者 发表于 2026-8-13 12:39
跟flash比还是略有提升
我个人感觉就和flash与glm5.2的差距差不多,有,但不多,说实话某些情况下体感都不体感不出来
最重要的是,我本来以为1.6t大参数能大幅度提高开放性写作能力,结果这什么玩意
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
等下午有没有奇迹发生,昨晚好失望,本来想着终于可以停掉两个codex账号了
现在不说对不上灰测和flash后训练预期了,先对不上的是自己的跑分。Terminal Bench 2.1,v4fga官方跑分82,第三方79算是正常误差和工具差异。v4pga官方87.9,第三方79和v4fga一样,还不只一个跑分这样。
半江瑟瑟半江红 发表于 2026-8-13 12:42
我个人感觉就和flash与glm5.2的差距差不多,有,但不多,说实话某些情况下体感都不体感不出来
最重要的是 ...
大参数后训练出问题了,flash因为体量小,后训练的比较好
所以现在有多少人全面测过high的具体表现?现在网上全都是测的有问题的max档。
现在的状态太诡异了 Re:Source
本帖最后由 孤灯蓝影 于 2026-8-13 12:53 编辑
要等deepseek自己修吧,high档比max档都要好,很明显是参数问题。就像2077准时发表才发现优化极差,需要多个补丁修复。估计是用了国产芯片兼容出了问题
狭义文具爱好者 发表于 2026-8-13 12:45
现在不说对不上灰测和flash后训练预期了,先对不上的是自己的跑分。Terminal Bench 2.1,v4fga官方跑分82, ...
我一直不懂你们说的官方跑分是什么。至今也只有一张据说是harness群里发的图。Deepseek发模型一般确实都是带跑分的,但是这次连更新说明都没有发。以及正常的Deepseek是同步开源权重的,现在也没发。整个就不是正常状态。
如果训练出问题了的话,为啥要说大幅提升价格,现在这性能没必要这么说吧
—— 来自 Xiaomi 2602BRT18C, Android 16上的 S1Next-鹅版 v2.1.2
太怪了,low 最好
确实,楼主发的跑分图也不是官方发的
本帖最后由 蜗塞塞 于 2026-8-13 13:06 编辑
tillnight 发表于 2026-8-13 12:53
我一直不懂你们说的官方跑分是什么。至今也只有一张据说是harness群里发的图。Deepseek发模型一般确实都 ...
肯定是官方的,官方微信群小助手发的
现在连api到底是pro了吗?
我刚还让它干活了
toyama nao榜也更新了,比flash高一点
如果表现是这样的话,那可以理解为什么一定要等DSH出来了
zy450 发表于 2026-8-13 13:10
如果表现是这样的话,那可以理解为什么一定要等DSH出来了
但是dsh也没出啊
这个如来的感觉太有意思了
本帖最后由 狭义文具爱好者 于 2026-8-13 13:13 编辑
横幅已撤回,闹麻了
绷,官网的消息撤了,真是上错了?
答案是pro还没训练好就逃逸了,自己把自己发布了
狭义文具爱好者 发表于 2026-8-13 13:11
横幅已撤回,闹麻了
由于表现不如预期,撤回了此次发布
官网更新消息已经撤回了
这也太搞了 Re:Source
今天能修好吗,版本号为0813的模型没在0813发布?
アレクト 发表于 2026-8-13 13:12
答案是pro还没训练好就逃逸了,自己把自己发布了
还把公司电子锁锁了,花了一上午翘了锁才进去
—— 来自 Xiaomi 2112123AC, Android 13, 鹅球 v4.0-alpha
不是,这在干嘛呢?不能真是逃逸烂活儿吧,每个AI lab的必修课?
论坛助手,iPhone