cscbzcbz 发表于 2026-8-20 07:01

国算互联网这个429也太频繁了,而且为啥晚上凌晨也会429,昨天晚上睡前开了个任务,早上起来看中断了
我直接把重试次数改到100次了

厍无春 发表于 2026-8-20 07:15

本帖最后由 厍无春 于 2026-8-20 07:20 编辑

Fuuki 发表于 2026-8-20 02:13
灰测模型都有哪些公认的特点,其中哪些不支持路由说?

没有多模态,而且效果把fable,opus和gpt最顶级的模型都干爆了,够不够啊?

骨于野 发表于 2026-8-20 07:27

我服了,反驳我的要么是阴阳怪气,要么是人身攻击。就没有人拿出证据来反驳路由说吗?比如脏token,模型指纹什么的。我也很想是什么deepseek神秘内部模型,但目前没有证据指向它是啊。



—— 来自 鹅球 v3.5.99-alpha

未知伤亡 发表于 2026-8-20 07:33

有人信美国总统其实是乞丐,我只能说你高兴就好

x分裂者 发表于 2026-8-20 07:45

太tm唐了,以后看谁还敢嘲笑国宝帮,某些人实际上就是你先别管这微波炉专用,你看这釉。

来都来了 发表于 2026-8-20 07:49

到现在了,还有人念叨新模型是路由别家的模型,这种人可以说是既蠢且坏了。这种东西,你看它一眼你就输了。

cscbzcbz 发表于 2026-8-20 07:50

“地球就是平的,你有证据反驳我吗?”
好熟悉的味道啊

wandeeees 发表于 2026-8-20 07:54

到底吃了几碗粉?

nxmonitor 发表于 2026-8-20 07:55

实际上只要有眼睛就能看出来不一样,但是很明显有些人心黑所以眼瞎…

舞以 发表于 2026-8-20 07:56

我就想看看灰测模型有和Claude一样的脏token的实锤
其他方面打补丁的感觉已经是地平论者的模样了。

论坛助手,iPhone

qwased 发表于 2026-8-20 08:05

unsloth出新的qwen3.8 27b量化了,试了下iq3xxs,输出从50tps提升到55,显存占用少了一丢丢,上下文可以再开大点了
问一个问题能思考2~5万token,上下文短了还真扛不住。bonsai啥时候更新啊

xiaohanne 发表于 2026-8-20 08:06

厍无春 发表于 2026-8-20 07:15
没有多模态,而且效果把fable,opus和gpt最顶级的模型都干爆了,够不够啊?
...

话又说回来,这3个图,实在也看不出干爆了。

2017.05.04 发表于 2026-8-20 08:07

本帖最后由 2017.05.04 于 2026-8-20 08:09 编辑

骨于野 发表于 2026-8-20 07:27
我服了,反驳我的要么是阴阳怪气,要么是人身攻击。就没有人拿出证据来反驳路由说吗?比如脏token,模型指 ...

证据应该由你提出来,先把所谓脏token和模型指纹的证据链形成完整再做这种指责吧

关于模型性能和生物知识与网络安全方面的限制都不支持路由说

敏感问题的回复这个是要后训练控制的,这个异常也说明是新模型

关键是为什么DS要路由一个别的模型还接在自己的服务里,是做慈善吗

你有没有好好看过前面

—— 来自 HUAWEI SGT-AL00, Android 16, 鹅球 v4.0-alpha

xiaohanne 发表于 2026-8-20 08:09

骨于野 发表于 2026-8-20 07:27
我服了,反驳我的要么是阴阳怪气,要么是人身攻击。就没有人拿出证据来反驳路由说吗?比如脏token,模型指 ...

要不然呢,Deepseek白掏钱给用户用Fable,那我真的要叫梁子一声梁圣了,有这么做慈善的吗?

孤灯蓝影 发表于 2026-8-20 08:15

本帖最后由 孤灯蓝影 于 2026-8-20 08:20 编辑

骨于野 发表于 2026-8-20 07:27
我服了,反驳我的要么是阴阳怪气,要么是人身攻击。就没有人拿出证据来反驳路由说吗?比如脏token,模型指 ...

笑死,要是ds路由fabe5看来梁子还是股市赚太多发钱给大伙用,我猜路由的不是fabe5而是fable super max v100 plus utra,你问怎么路由的,我说梁子早就发明了时光机可以路由未来,怪不得炒股百战百胜。不闹了,你这套东西在哲学里面叫循环论证,你觉得你逻辑有道理,其实陷入了诡辩的漩涡,建议少看自媒体,多读点康德,起码能多增点思考也是好事。

frankCC 发表于 2026-8-20 08:16

lowezack 发表于 2026-8-20 06:28
dsh目前就是半成品,没啥好折腾的。核心契约还没稳定,以后还会大改的。

在我看来最起码的安全隔离是要 ...

现在插件我就是用win里的dsh给wsl里的dsh装插件,出了问题也会自动修,反而比直接自己把自己搞崩方便多了。

厍无春 发表于 2026-8-20 08:27

本帖最后由 厍无春 于 2026-8-20 08:33 编辑

xiaohanne 发表于 2026-8-20 08:06
话又说回来,这3个图,实在也看不出干爆了。

那这fable 和opus也没比这个强啊?
【各大群友 超级优秀的 DS灰测成果作品-哔哩哔哩】 https://www.bilibili.com/video/BV1qz8n6wEi6
官方员工还转发过这个视频,全是群里下午灰测出的

zjf 发表于 2026-8-20 08:31

scikirbypoke 发表于 2026-8-19 23:37
pi-antigravity拉完了,格式各种冲突,估计只装这个插件才能用
薅了便宜哈基米的乖乖用反重力 ...

我用cpa反代还可以,不过还没大量用,不知道会不会封号了

论坛助手,iPhone

蜇灵 发表于 2026-8-20 08:37

这什么路由论我还以为是带伙帆船着好玩的,没想到真有人信啊

厍无春 发表于 2026-8-20 08:48

我也觉得像是个和pro并行训练的一个模型,真可能是个新模型,但是新模型依旧没有多模态,就让人很困惑🤔

ZBY901026 发表于 2026-8-20 08:50

骨于野 发表于 2026-8-20 07:27
我服了,反驳我的要么是阴阳怪气,要么是人身攻击。就没有人拿出证据来反驳路由说吗?比如脏token,模型指 ...

ds的模型会把思维链展示出来
闭源模型是隐藏掉的
梁文锋已经能把别人加密的东西破译了展示出来是吧

信这个的我不好说是什么

Re:Source

2017.05.04 发表于 2026-8-20 08:54

与其说是地平论不如说是伪史论
哪怕同时没用过fable和ds,也应该知道现在开闭源ai服务都有哪些差别才对

—— 来自 HUAWEI SGT-AL00, Android 16, 鹅球 v4.0-alpha

当光停止 发表于 2026-8-20 08:55

你们要不去格斗区建个楼吧

tillnight 发表于 2026-8-20 09:01

厍无春 发表于 2026-8-20 08:48
我也觉得像是个和pro并行训练的一个模型,真可能是个新模型,但是新模型依旧没有多模态,就让人很困惑🤔 ...

现在是可以肯定他不是v4的,这点不用疑问。因为和之前不同,pro正式版现在已经出了,昨天又丢出这个明显sota级,按one-shot比至少领先fable5一代的东西,已经说明这东西和预备发布的v4pro不是一个模型,也否定了所谓又训了半个月训废了或者检查点直接删了这种搞笑情况。
最极端的情况是他是一个真正自学习的模型,因为灰测后期比初期有显著体感,而昨天比灰测后期又有明显提高。

至于多模态,这个其实不好说,他可以是按多模态训练但是限制了模型能力,所以模型实际是具有多模态但自认为没有,这种可能性是存在的。

tonyunreal 发表于 2026-8-20 09:03

dsh rc8不是在npm的next分支么,没上线吧

秦南心 发表于 2026-8-20 09:04

哪家多模态会用字符代替视觉的,还在路由

阿刚 发表于 2026-8-20 09:04

厍无春 发表于 2026-8-20 08:48
我也觉得像是个和pro并行训练的一个模型,真可能是个新模型,但是新模型依旧没有多模态,就让人很困惑🤔 ...

问题这鬼东西没有多模态才更吓人,盲人摸象摸出来和真的一样

脸宽 发表于 2026-8-20 09:06

好像都在说Qwen3.8-27B效果不错啊,本地部署。

厍无春 发表于 2026-8-20 09:07

本帖最后由 厍无春 于 2026-8-20 09:15 编辑

tillnight 发表于 2026-8-20 09:01
现在是可以肯定他不是v4的,这点不用疑问。因为和之前不同,pro正式版现在已经出了,昨天又丢出这个明显s ...

其实我觉得昨天下午放了灰测就是想让,v4pro后训练炼炸了的谣言不攻自破,变相回应一下。不过这也肯定了目前0813的pro能力提升不及预期确实有问题,不知道问题是出现在预训练还是后训练上,我个人倾向于出现在预训练上,不然也不会这么快就另起一炉了。

tillnight 发表于 2026-8-20 09:08

阿刚 发表于 2026-8-20 09:04
问题这鬼东西没有多模态才更吓人,盲人摸象摸出来和真的一样

这种级别的审美基本不可能没有多模态的。除非真的搞出什么玄学的涌现能力玩意。我不太信涌现说,虽然这个一直在llm理论里,但实际到目前为止,并没有观测到大模型真正出现这种能力跃升型的进化,前沿模型基本都靠scaling law牵动,排除内部模型什么的,一般人能看到的大模型里反正没观察到过能力突然跳级提高的模型。

ice菓 发表于 2026-8-20 09:09

都一个月了,某脑还没编明白为什么要路由呢,就这还有人信,一问为什么就开始打哈哈,什么lwf在A股挣钱了,什么实习生点错了,什么员工自己要用,属实幽默。为了靠上路由论一点逻辑都不要了

孟沁瑶 发表于 2026-8-20 09:14

所以现在什么情况,想问下遇到难一点的任务有必要切pro吗?日常一直用flash

星星海星 发表于 2026-8-20 09:14

新模型的话是否可以印证为什么0813问题不修就扔上来了?都去搞新模型了?

jinuzuktII 发表于 2026-8-20 09:16

资源有限吧,补旧的不如搞新的

当光停止 发表于 2026-8-20 09:18

孟沁瑶 发表于 08-20 09:14
所以现在什么情况,想问下遇到难一点的任务有必要切pro吗?日常一直用flash



性价比上没必要。

——来自 NX789J 上的 S1er 客户端

nxmonitor 发表于 2026-8-20 09:20

星星海星 发表于 2026-8-20 09:14
新模型的话是否可以印证为什么0813问题不修就扔上来了?都去搞新模型了?
显然是修不好了,有这么厉害的模型,肯定是真蒸馏啊,说明Pro基模就训得有问题,Flash没问题所以起飞

wesdrtfg 发表于 2026-8-20 09:21

难绷梁子17号涨价,然后灰度模型就又出现了,真就资源一空就开始干活了是吧

bn.ssgr 发表于 2026-8-20 09:22

本帖最后由 bn.ssgr 于 2026-8-20 09:26 编辑

当光停止 发表于 2026-8-20 08:55
你们要不去格斗区建个楼吧
有拉偏架的嫌疑

泰坦失足 发表于 2026-8-20 09:24

"几乎无限额度的前沿模型又来了!简直是V4 Flash再现
Muse Spark1.2已经在 OpenCode Go上提供,每 5 小时约 45,300 次请求
使用额度甚至超越DeepSeek V4 Flash(前) 和Mimo V2.5
只需注意:Muse Spark1.2 Contributor 默认会上传你的数据用于训练"
https://x.com/Fei2411/status/2090046812895973876

OpenCode最近真是抢了Openrouter不少风头, 啥时候会和Openrouter一样被高溢价收购呢

一骑当千 发表于 2026-8-20 09:28

不说技术方面,就利益角度,谁能告诉我ds官方路由第三方有啥好处,炒作意义是什么?他公司现在又不上市,无论老梁还是公司其它人都基本不在网上露面,你说a/做这事我还真信,至少对它上市有好处。
页: 238 239 240 241 242 243 244 245 246 247 [248] 249 250 251 252 253 254 255 256 257
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼