c12hero 发表于 2026-8-16 00:47
应该刚出的Qwen 3.8 -27B才是写文的最终答案
有测试吗,3.6完全不说人话还中英夹杂,写作完全不能用吧
风神出了pro的插件了
咋还有社区领袖道歉的环节
本帖最后由 bartholo4 于 2026-8-16 07:05 编辑
lly778 发表于 2026-8-16 03:16
风神出了pro的插件了
又回滚了...
但路由的 flash 真是又强又快
—— 来自 Xiaomi 2410DPN6CC, Android 16, 鹅球 v3.5.99-alpha
lly778 发表于 2026-8-16 03:16
风神出了pro的插件了
风神是谁?
—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0
zhongjie 发表于 2026-8-16 07:58
风神是谁?
—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0
https://github.com/yjh051108/dsh-routing-suite
这个插件的作者
ternayark 发表于 2026-8-15 16:22
如果是这样的话,是不是可以判定deepseek v4 flash+deepseek harness(唤起sub agent)已经可以胜任一些 ...
这就不知道了……
周末花了 20 块把自己的项目 Agent 内核从 pi 换成 dsh,感觉效果不是很契合,应该是我还没想清楚到底啥叫一切皆插件,过程还是蛮有趣的
—— 来自 鹅球 v3.3.96
本帖最后由 LeoDT 于 2026-8-16 09:33 编辑
仔细看了下xiaobright的报告,做了个Pi版的,大概试了试flash/pro都有效,有兴趣试用的可以试试。
pi-ds-anchor: https://gist.github.com/LeoDT/185bdd88cf4f65b49fd9caafaef5f0f9
思路就是新session发一条不带任何tool且只有魔法system prompt的消息"who are you",然后就可以正常用了,自己试了几次比单纯魔法稳定非常多。提供两个命令 `/new-ds-anchored-session` 新建锚定session,`/ds-anchor` 在新session中手动锚定。
因为是只给D老师用的,所以扩展里判断了provider,不是D老师的话不生效,具体逻辑看代码就好,没怎么详细测试过有问题的话自己修吧。
编辑:原理是直接拦截第一条消息在最后向模型发请求的时候改请求,所以跟其他扩展的兼容性应该还凑合,当然如果你有扩展注入custom message的话另说,我这里不处理。
pro 这不明显炼炸了吗,搞不懂有什么不能承认的。也不影响 flash 封神,鲸小子现在多少有点魔怔了。
—— 来自 S1Fun
本帖最后由 小野賢章 于 2026-8-16 09:42 编辑
nginx 本地3081端口代理3080,再用 cloudflared tunnel 连接到 nginx,可以手机访问了
这页面适配移动端,还挺好用的
worker_processes1;
events {
worker_connections1024;
}
http {
sendfile on;
keepalive_timeout65;
map $http_upgrade $connection_upgrade {
default upgrade;
'' close;
}
server {
listen 127.0.0.1:3081;
server_namelocalhost;
client_max_body_size 160m;
location / {
proxy_pass http://127.0.0.1:3080;
proxy_http_version 1.1;
proxy_set_header Host 127.0.0.1:3081;
proxy_set_header Origin http://127.0.0.1:3081;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection $connection_upgrade;
proxy_set_header X-Forwarded-For $proxy_add_x_forwarded_for;
proxy_set_header X-Forwarded-Proto $scheme;
proxy_read_timeout 3600s;
proxy_send_timeout 3600s;
}
}
}
只能说如果把折腾v4 pro的精力放到优化别的模型上,其实一样能得到震惊瘫坐的效果,v4 pro就是训炸了
—— 来自 S1Fun
ymm1030 发表于 2026-8-16 09:37
pro 这不明显炼炸了吗,搞不懂有什么不能承认的。也不影响 flash 封神,鲸小子现在多少有点魔怔了。
——...
pro这个状态确实验证我之前的担心,如果D老师坚持开源路线,就不应该像O/A两家针对harness训模型,希望他们这次只是草台。
但是flash是真的好用啊,涨价能不能不要涨那么多。
harukage 发表于 2026-8-16 09:47
这插件跟昨天那个dsh-anchored比哪个好?
这个好像还没有适配好pro,主要是对flash有效,dsh-anchored 反正pro效果是提升明显的。
我也发下自用的omp extension,烧了十几块做测试后初步定下的方案,不想继续折腾了
https://github.com/hugosol/my-omp-toolkit/tree/master/extensions/anchored-standard
可能有点心理作用,偶尔能看到let’s的思维链,但是根据不充分的测试结果其实模型能力可能和这个cot特征不一定有什么关系,都是玄学
最大的作用可能是把omp system prompt里自带那堆Roles和编码偏好给干掉了,现阶段的SOTA模型确实不太需要这类约束,让模型自由发挥更好,反正我确实不太喜欢omp这类太过臃肿的设计,所以干脆也不判断模型了,只有一个配置开关
我看b站有测试,v4pro的cot有俩甜点:一个是0工具环境,一个是严格的bash+str环境
估计后训练就可着这俩选择练的,练完发现过拟合了,不想继续拖了,dsh里面对齐出一个minimal mode拉倒!
本帖最后由 hugosol 于 2026-8-16 10:17 编辑
LeoDT 发表于 2026-8-16 09:48
pro这个状态确实验证我之前的担心,如果D老师坚持开源路线,就不应该像O/A两家针对harness训模型,希望他 ...
问题是O/A两家用自家harness有时候表现还没Pi好
我觉得可能不用太担心针对harness训练导致过拟合的问题,harness迭代速度比模型快多了,不可能以太过复杂的场景为基础去训练吧
反过来说真相更可能是训练出来这半吊子的水准所以梁子要等DeepSeek harness一起发,还强行加上个没什么卵用的极简模式给0813挽尊
感觉这一版可能还是有点问题。我在dsh里开V4 Pro Max搓个记忆系统,中间它问我:
开工前两个小决定
A. 插件放哪? 我建议先在新 clone 里以 packages/memoryforge/ 形式开发:source-launch 直接解析,迭代最快。等跑稳了,再按 dsh 的 dsh plugin --profile 链路抽成 out-of-tree 插件包(这才是最终形态,但没必要现在同时趟打包这条新河)。——没异议我就这么干。
B. 阶段 0 的补丁要不要先开分支提交? 建议在 new clone 里开个 memoryforge-patches 分支,把当前 7 个文件(6 改 + 1 新包)提交掉,作为干净基线。老 dsh 的旧 checkout 一个字都不动。你点头我就提交;不想提交就继续在脏树上开发,也行。
你回 A/B,我就开始写阶段 1 的代码。
我因为昨晚睡太晚导致今天早上神智不太清醒,差点回“A/B”……
后来我就在网页端当冷笑话讲给快捷模式和专家模式听,结果它们全都理解错误,把A和B当成了两个选项而不是两个问题。然后我又分别试了下网页版的grok和gpt,只有gpt正确理解了这个段子
野蛮人之夜 发表于 2026-8-16 10:24
感觉这一版可能还是有点问题。我在dsh里开V4 Pro Max搓个记忆系统,中间它问我:
这种不就是 走路洗车 和 你爸妈婚礼没请你 一类的脑筋急转弯嘛,以大模型的智商很难理解这类问题啦
野蛮人之夜 发表于 2026-8-16 10:24
感觉这一版可能还是有点问题。我在dsh里开V4 Pro Max搓个记忆系统,中间它问我:
正常应该会在UI分成两个问题再分别给3个选项吧,估计是抽风了
孩子挺聪明的,就是注意力不集中
LeoDT 发表于 2026-8-16 09:48
pro这个状态确实验证我之前的担心,如果D老师坚持开源路线,就不应该像O/A两家针对harness训模型,希望他 ...
Harness梁子不是说的很明白么,他认为是通向agi必经之路才专门去搞的,而且从这个状态来看,大概率还有为了未来的持续学习做准备的意思
发现一个问题,极简模式下没有压缩工具……对话满了无法压缩
有没有什么分销商的key可以购买,想买便宜点的
没有对话压缩有点要命了,但是这个和对话压缩也没关系呀
让 Pi 直接翻译了 anchored-standard 这个插件,现在看起来有效果,用得opencode go 的 v4pro
让它自己给极简模式增加一个compact了
lly778 发表于 2026-8-16 03:16
风神出了pro的插件了
感谢
请教佬,风神跟anchored-standard冲突不?
我意思是装了岂不是整两个了?重复了以后会不会有啥毛病
—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
请问这种情况该怎么办 第一轮不给工具 后面上了工具还是会断开
让DSH读了一遍本贴,他正在改进
Promeus 发表于 2026-8-16 10:47
Harness梁子不是说的很明白么,他认为是通向agi必经之路才专门去搞的,而且从这个状态来看,大概率还有为 ...
4天前你跟我谈AGI我觉得梁子的眼光应该不会有错
现在我只觉得DeepSeek的旗舰版模型和别家比还是有点差距
kylezy123 发表于 2026-8-16 11:19
请问这种情况该怎么办 第一轮不给工具 后面上了工具还是会断开
我也遇到过,不知道这是dsh的bug还是模型的bug,当时我换了好几个模型(k3/opus/glm),只要出现一次,后面就一直调用失败,我怀疑是dsh的bug,估计和字符串转义有关系,或者是不是导致前端注入了
用了anchored-standard是不是就不能读取项目记忆了?有办法解决吗?
本帖最后由 半江瑟瑟半江红 于 2026-8-16 11:53 编辑
笑死我了,昨天我把D指导PRO在创造模式下整的一个烂货的json文件发给GPT分析,它都发现这肥鱼有点ADHD
结论其实相当明确:
DeepSeek 不是没读上下文,而是“读了很多上下文,却没有形成正确的上下文层级”。
所以你的体感会和“它根本没读”几乎一模一样。
而且这份日志里,这个问题非常典型。
它很容易被“刚刚检索到的新东西”绑架。这是一种很典型的检索过拟合:搜到了什么,就想让刚搜到的东西成为答案。
不过我发现鱼它反而会随着对话上下文增加、调用工具增加,变得稍微聪明一些?
小野賢章 发表于 2026-8-16 11:21
我也遇到过,不知道这是dsh的bug还是模型的bug,当时我换了好几个模型(k3/opus/glm),只要出现一次,后 ...
我这个是pi web 用了那个魔法提示词注入
提示词:使用互联网检索一张蒙娜丽莎的原画,使用SVG绘制这张蒙娜丽莎,要求完全复刻并保留画笔笔触。不要复用已有的结果,确实要你自己画出来
用的anchored-standard,promax
为啥画成这样了
问一个基础问题,我在理解token向量的时候,能不能吧QKV理解成主谓宾
本帖最后由 半江瑟瑟半江红 于 2026-8-16 12:05 编辑
孤灯蓝影 发表于 2026-8-16 11:57
问一个基础问题,我在理解token向量的时候,能不能吧QKV理解成主谓宾
不能直接把 QKV = 主谓宾。这个类比会很快把你带偏。
更适合初学时的理解是:
Q = 我现在想找什么?
K = 我这里有什么特征,值不值得你来找我?
V = 如果你关注我,我实际把什么信息交给你?
而且最关键的一点是:每一个 token 都同时拥有 Q、K、V,不是某些 token 是 Q、某些是 K、某些是 V。
QKV不是主谓宾;QKV更像“查询—索引—内容”,主谓宾只是它能够通过这种机制学出来的一类关系。
Gpt说的
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
半江瑟瑟半江红 发表于 2026-8-16 11:28
笑死我了,昨天我把D指导PRO在创造模式下整的一个烂货的json文件发给GPT分析,它都发现这肥鱼有点ADHD
结论 ...
笑死,赛博懂王了
所以我们不需要很聪明的AI就能治理美国