wjxforever 发表于 2026-8-13 00:20

正式更新肯定要等官方发消息之后

CCauchy 发表于 2026-8-13 00:20

感觉应该是了吧,之前写作都是10秒思考就开始瞎编,现在能注意到我文学材料里的逻辑陷阱

真田源次郎信繁 发表于 2026-8-13 00:22

趁还没涨价半夜多跑着
希望早上起来还没涨价

脸宽 发表于 2026-8-13 00:22

那就灯明天早上

论坛助手,iPhone

杀人鲸 发表于 2026-8-13 00:23

chronicle 发表于 2026-8-13 00:18
是多模态吗

不是,这个估计得等等。
虽然市面上很多说D老师不做这个,但不对,不是不做,而是认为多模态并不是通往AGI的必然之路,但也认可这个的必要性,所以以后有时间的时候会做,但不会作为必须做的任务。

—— 来自 S1Fun

CCauchy 发表于 2026-8-13 00:23

明天股市翻天吗

CCauchy 发表于 2026-8-13 00:24

羊寢 发表于 2026-8-13 00:24

试了一下nsfw文好像还不错

舞以 发表于 2026-8-13 00:25

能赢么,大鲸鱼

阿刚 发表于 2026-8-13 00:25

应该是布置了,试了下写文,他本来只会装个样子走的禁词审查这次认真的在每一条都过

冤枉呐 发表于 2026-8-13 00:26

阿刚 发表于 2026-8-13 00:25
应该是布置了,试了下写文,他本来只会装个样子走的禁词审查这次认真的在每一条都过 ...

这个禁词是你的设置还是甲……

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

蛋黄酱Release 发表于 2026-8-13 00:27

api的思维链变了,不会再代入角色思考了,让它写极端小h文也没有拒绝
但是它好像更不愿意直球写颜色内容了

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0

nxmonitor 发表于 2026-8-13 00:27

我觉得是你们幻觉了,要么正在分批上线……

阿刚 发表于 2026-8-13 00:27

冤枉呐 发表于 2026-8-13 00:26
这个禁词是你的设置还是甲……

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99 ...

就是针对各种尾椎骨肩胛骨还有各种不是a是b的句式的检查模式,之前他假装过一下但实际上不真的检查

CCauchy 发表于 2026-8-13 00:28

我怀疑它是不是从我之前的问题里学到了什么

tillnight 发表于 2026-8-13 00:28

本帖最后由 tillnight 于 2026-8-13 00:39 编辑

冤枉呐 发表于 2026-8-13 00:26
这个禁词是你的设置还是甲……

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99 ...
甲比flash0731还要厚一点。不过想破还是能破,只是和以前完全无甲不同了。

道德感明显变强,但文笔感觉也提升了。

novem 发表于 2026-8-13 00:29

感觉网页端没更新

冤枉呐 发表于 2026-8-13 00:33

阿刚 发表于 2026-8-13 00:27
就是针对各种尾椎骨肩胛骨还有各种不是a是b的句式的检查模式,之前他假装过一下但实际上不真的检查 ...

那相当可以啊!

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

杀人鲸 发表于 2026-8-13 00:33

novem 发表于 2026-8-13 00:29
感觉网页端没更新

看了应该是分批次的吧?事实上说到底也不清楚到底具体应该表现成为什么才算更新了。
只能说有一部分人的那种思考模式已经变了,变得和快速模式那样,很规整的逐步思考,而不是好的,现在我是叉叉,这种代入性的思考方式。

—— 来自 S1Fun

@weakb0y 发表于 2026-8-13 00:34

刚才在zcode里面试,不确定是不是上新了,但是kelivo实测同一个上下文的角色扮演,以前的破甲无效了。。

masakaha 发表于 2026-8-13 00:36

快点把harness端出来,最近看性能问题看的头痛,让我感受一下宇宙最强吧

城北无尘 发表于 2026-8-13 00:37

misuzu0723 发表于 2026-8-13 00:04
这么看来当初的灰度搞不好真的是

—— 来自 鹅球 v3.3.96-alpha

问题是doing的思维链不是说只有哈基米嘛?总不能是路由到gemini 4pro了嘛

qz66618 发表于 2026-8-13 00:37

光看官方跑分比fable没弱多少和k3互有胜负,这个图也不知道是不是在自己harness上跑出来的,还是等官方的harness发布了再看实际使用感受吧

—— 来自 鹅球 v3.5.99

舞以 发表于 2026-8-13 00:38

城北无尘 发表于 2026-8-13 00:37
问题是doing的思维链不是说只有哈基米嘛?总不能是路由到gemini 4pro了嘛

梁圣的因果律武器懂么
你楼都能刷出这种迫不及待开输的傻逼也是奇怪

→熙← 发表于 2026-8-13 00:40

所以真的上正式版了吗,当初的i'm doing呢

nxmonitor 发表于 2026-8-13 00:40

那个是典型的小模型转写了思维链,准确说是哈基米加了一个东西才是现在的思维链

tillnight 发表于 2026-8-13 00:40

最傻逼的是路由党们当年的“最大证据”是灰测没有nameeee的脏token。现在已经被反证了就是特意修了。

qz66618 发表于 2026-8-13 00:40

我之前就觉得加上harness能打平fable已经是奇迹了,参数量差距在这里摆着呢,说实话差这么多参数量如果真的还能打个有来有回已经是够厉害了我不敢想同等参数量下是个什么水平

—— 来自 鹅球 v3.5.99

L-JoeW 发表于 2026-8-13 00:40

阿刚 发表于 2026-8-13 00:27
就是针对各种尾椎骨肩胛骨还有各种不是a是b的句式的检查模式,之前他假装过一下但实际上不真的检查 ...

老哥,这个检查的提示词或者词库可以分享下吗,我让他写r18文也经常整出这些词太破坏气氛了

CCauchy 发表于 2026-8-13 00:45

出乎意料的结果,文学逻辑能力比sol最高好

来都来了 发表于 2026-8-13 00:48

那这个呢?这个意思就是正式版了吗?

nxmonitor 发表于 2026-8-13 00:50

我看见复合弓测试了,比之前灰测的差一些,但是至少是正常的结构

阿刚 发表于 2026-8-13 00:51

来都来了 发表于 2026-8-13 00:48
那这个呢?这个意思就是正式版了吗?

出来了,应该就是了

goranger 发表于 2026-8-13 00:52





论坛助手,iPhone

超极巨鲨鲨 发表于 2026-8-13 00:55

睡醒等评测了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99

阿刚 发表于 2026-8-13 00:56

L-JoeW 发表于 2026-8-13 00:40
老哥,这个检查的提示词或者词库可以分享下吗,我让他写r18文也经常整出这些词太破坏气氛了 ...

私信给你了

ダンボール戦車 发表于 2026-8-13 00:57


用的opencode的桌面版 是这么试的吗

酱油拌饭s 发表于 2026-8-13 00:59

看别的地方一片哀嚎说写过于黄的东西api带破甲词也不好使了啊,诸君有实验了的么

ycjiang1337 发表于 2026-8-13 00:59

酱油拌饭s 发表于 2026-8-13 00:59
看别的地方一片哀嚎说写过于黄的东西api带破甲词也不好使了啊,诸君有实验了的么 ...

一般向的SM之类的都能写,可能是涉及到非自愿会卡?

蛋黄酱Release 发表于 2026-8-13 01:00

酱油拌饭s 发表于 2026-8-13 00:59
看别的地方一片哀嚎说写过于黄的东西api带破甲词也不好使了啊,诸君有实验了的么 ...

试了,还行,一些比较超限的东西也能写,反复测了几次感觉文笔也好一些了

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0
页: 155 156 157 158 159 160 161 162 163 164 [165] 166 167 168 169 170 171 172 173 174
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼