cscbzcbz 发表于 2026-8-27 08:59

搞得我有点心动
非刚需,纯当作理财,DXG有必要现在买一套吗?有没有大手帮忙分析
我觉得关键是预期未来这些小体量模型能力会不会越来越强

斯卡文分则能成 发表于 2026-8-27 08:59

原来ox是zai的模型啊
昨天红脖子论坛还有人说是google的

乌桃内设格温 发表于 2026-8-27 09:01

现在v4是不是特别难穿甲,以前做自己公司内部开发环境的网安测试有几个提示词现在直接拦截了

zfy1989 发表于 2026-8-27 09:03

qqq2142 发表于 2026-8-27 08:43
还是不行,看来只能老老实实用grok了

可以的,https://github.com/yexi-by/dsh-unrestricted#readme,这个

沙发沙发 发表于 2026-8-27 09:07

牛来不是在第一天大伙就知道是glm了,google纯在蹭好吧

王兰花秀丽 发表于 2026-8-27 09:09

倒不用那么急着买吧,说不定明年雷军把价格打下来了呢    Re:Source

阿刚 发表于 2026-8-27 09:09

好力竭啊,这个逼ai他有时候会张嘴就来,让他确认记忆模式他说了一大堆结果根本不对。。。有时候他很多基本错误是特么藏在真话里的。。。我好几次是獭马靠直觉发现的。。。

冤枉呐 发表于 2026-8-27 09:10

goranger 发表于 2026-8-27 00:14
为了让更多新朋友能 0 成本上手体验 GLM-5.3-Flash,我们准备了一批 GLM Coding Plan 7 天体验卡(从未订阅 ...

我自己的分享链接不知道在哪生成,就用你这个给别人转发了哈哈哈

scikirbypoke 发表于 2026-8-27 09:16

猜谷歌主要是前几天有好几个开发者说大的要来了,当然谷歌根本不可能找opencode搞……

f77887 发表于 2026-8-27 09:33

startraveller 发表于 2026-8-27 01:07
上下文实际占多了就暴跌到10tps出头了

【16G显卡畅跑Qwen3.8 27B!80K+上下文不降智:Qwen3.8 27B社区魔改版榜单来袭!-哔哩哔哩】 https://b23.tv/bFdHxj6
实在不行就用这个专门为16g显卡优化过的

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0

龙骑士尹志平 发表于 2026-8-27 09:33

goranger 发表于 2026-8-27 00:14
为了让更多新朋友能 0 成本上手体验 GLM-5.3-Flash,我们准备了一批 GLM Coding Plan 7 天体验卡(从未订阅 ...

加个小功能再测试下,20%的用量就过去了,是不是要选择5.3flash才用得没那么快啊

LeoDT 发表于 2026-8-27 09:34

squallx 发表于 2026-8-27 07:35
DSH本地干活选哪种长期记忆?OpenViking树状还是dsh-memory简洁平铺? 我看GPT说现在的CODEX也改用多层复 ...

写代码的话,现在有一波“什么记忆系统都不靠谱,代码才是唯一事实”的小趋势。

我实际体验下来也是,优先需要考虑的是让模型能读到他需要读到的所有东西,这个不管是记忆还是代码库我觉得都挺难做到的。代码结构化索引/检索工具体验下来还算不错,至少比rg/find之类提供的信息更准确,但是这类工具的问题是文档他不索引的,还是需要使用者适时提醒模型阅读需求/技术决策文档(尤其是主动性比较强的模型,如果没有文档约束会很容易出问题)。

goranger 发表于 2026-8-27 09:36

冤枉呐 发表于 2026-8-27 09:10
我自己的分享链接不知道在哪生成,就用你这个给别人转发了哈哈哈

我这个是在他公众号的官方发的

论坛助手,iPhone

goranger 发表于 2026-8-27 09:36

龙骑士尹志平 发表于 2026-8-27 09:33
加个小功能再测试下,20%的用量就过去了,是不是要选择5.3flash才用得没那么快啊 ...

那估计是

论坛助手,iPhone

半江瑟瑟半江红 发表于 2026-8-27 09:42

斯卡文分则能成 发表于 2026-8-27 08:59
原来ox是zai的模型啊
昨天红脖子论坛还有人说是google的

谷歌的人自己在推特上暗示的,招笑死了。

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

neptunehs 发表于 2026-8-27 09:54

虽然我也不知道有没有用 但我也传个火吧 https://agentrouter.org/register?aff=S4UP

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

misuzu0723 发表于 2026-8-27 09:55

本来想着要不买个最低档的套餐作为 GPTplus 的补充,结果 lite 套餐都要 100 出头?

—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha

Rowen233 发表于 2026-8-27 10:01

斯卡文分则能成 发表于 2026-8-27 08:59
原来ox是zai的模型啊
昨天红脖子论坛还有人说是google的
Gemini一堆人在那边各种暗示是Ox是Gemini太搞笑了
感觉谷歌现在内部乱的要死 他们自己都不知道自己有哪些模型

ycjiang1337 发表于 2026-8-27 10:04

cscbzcbz 发表于 2026-8-26 23:25
分点给梁叔叔吧

看到W8A8就知道智谱用的是910系列,梁叔叔用不了

—— 来自 HUAWEI SGT-AL50, Android 16, 鹅球 v3.4.97-alpha

yikka 发表于 2026-8-27 10:06

gemini 这波蹭热度是真的小丑

来都来了 发表于 2026-8-27 10:27

哈基米的人在想什么?这又不是恐怖袭击,死无对证,各个组织跳出来认领。这种匿名模型,只要正主一出来,自己蹭热度不是纯小丑吗?

jojog 发表于 2026-8-27 10:32

总不能什么都不干吧

BarricadeMKXX 发表于 2026-8-27 10:33

所以现在爽蹬ds还是10刀的command code吗?

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99-alpha

wandeeees 发表于 2026-8-27 10:35

没人讨论QWEN3.8 FLASH吗,有新架构,加上了engram,不知道性能咋样

厍无春 发表于 2026-8-27 10:41

wandeeees 发表于 2026-8-27 10:35
没人讨论QWEN3.8 FLASH吗,有新架构,加上了engram,不知道性能咋样

这个新架构相当不错啊,50b的ngram加上,效果显著

tillnight 发表于 2026-8-27 10:45

scikirbypoke 发表于 2026-8-27 09:16
猜谷歌主要是前几天有好几个开发者说大的要来了,当然谷歌根本不可能找opencode搞…… ...

别洗了,谷歌研究员直接引用猜牛来的推,然后说如果说这是咕咕嘎嘎会怎么样?然后多名谷歌研究员用各种暧昧的语气反复暗示。您说的好像都是第三方在猜一样。没人猜谷歌,直到谷歌研究员自己来蹭,然后被自媒体放大为“谷歌认领”,由于稍微懂一点的都能看出牛来和glm关系,所以社区很快又开始猜谷歌为智谱提供算力底座,解决美国本土数据安全问题,推上谷歌研究员们仍然是你们猜,说不定对了呢的态度。
纯纯小丑,特别是最后揭晓牛来的一大卖点还是纯国产算力,属于从头小丑到最后。

nxmonitor 发表于 2026-8-27 10:49

本帖最后由 nxmonitor 于 2026-8-27 10:52 编辑

wandeeees 发表于 2026-8-27 10:35
没人讨论QWEN3.8 FLASH吗,有新架构,加上了engram,不知道性能咋样
雷霆大思考问题比较严重,engram好像会让这个模型的规划能力提升,会学着大参数模型的做法去做,问题是智力还不够高,会出现走歪的问题……

唠叨 发表于 2026-8-27 10:49

我想知道Qwen 3.8 Flash跟GLM-5.3 Flash哪个干日常工作更合适看价格都能替代梁文峰

nxmonitor 发表于 2026-8-27 10:53

还有GLM吐字慢是正常的,谁叫他们用910C这个卡的,怎么都是慢的……

Azcarlo 发表于 2026-8-27 10:53

等一个glm 5.3 flash 用量实测,有人说折价的api 比套餐便宜,我感觉不大可能。

— from Xiaomi 23127PN0CC, Android 16, S1 Next Goose v3.5.99

很久就在那边l 发表于 2026-8-27 10:55

还真是比套餐便宜
https://p.sda1.dev/34/998d4b0610c96901a7d7a355aec0ed3d/image.jpg

tonyunreal 发表于 2026-8-27 10:57

Azcarlo 发表于 2026-8-27 10:53
等一个glm 5.3 flash 用量实测,有人说折价的api 比套餐便宜,我感觉不大可能。

— from Xiaomi 23127PN0C ...

用量 看看11471楼
按量计费比套餐便宜是因为定价的问题,套餐里定的很贵

—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99

Azcarlo 发表于 2026-8-27 10:59

本帖最后由 Azcarlo 于 2026-8-27 11:04 编辑

很久就在那边l 发表于 2026-8-27 10:55
还真是比套餐便宜

这图里的不是比套餐贵吗
这图有问题吧,智谱的套餐还有峰谷价
woc还真有,api比高峰的套餐便宜
— from Xiaomi 23127PN0CC, Android 16, S1 Next Goose v3.5.99

neptunehs 发表于 2026-8-27 11:01

nvidia nim的手机收不到验证码的 有人有办法解决吗

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

dark_saber 发表于 2026-8-27 11:02

我也传个火吧 https://agentrouter.org/register?aff=ZFGm

kinfox 发表于 2026-8-27 11:04

我早上让glm5.3flash给我蹬了一个html游戏,模拟经营的。。。我给了它参考游戏,我以前用dsf和hy3做的。
结果glm它做了2小时了,第一波花费了我1500积分。。。因为它觉得花的太多了自动给我停了,还问我要不要继续。
第二波还在蹬。。。还有3步。。不知道还要多久和多少积分
感觉比dsf慢很多,。感觉它一直在改各种bug
还在继续等结果

nxmonitor 发表于 2026-8-27 11:06

还有不知道是不是错觉,5.3Flash比牛来时的智力水平降低了……

wandeeees 发表于 2026-8-27 11:06

nxmonitor 发表于 2026-8-27 10:49
雷霆大思考问题比较严重,engram好像会让这个模型的规划能力提升,会学着大参数模型的做法去做,问题是智 ...

感觉deepseek的神秘灰测模型应该就是加上了这个engram,看他思考的时候非常自信,能很好的规划任务

eno_emos 发表于 2026-8-27 11:07

commandcode的v4f难道是他们自己部署的?怎么感觉有点降智

tonyunreal 发表于 2026-8-27 11:07

据多家外媒报道,知名开源模型网站Hugging Face被英伟达129亿美元收购
页: 279 280 281 282 283 284 285 286 287 288 [289] 290 291 292 293
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼