唠叨 发表于 2026-8-20 10:22

xiaohanne 发表于 2026-8-20 10:19
minimax的智力相对低一点,比mimo强,略逊glm5.2。
另外以前订阅的时候,高峰期限流很烦人,不适合需要即 ...

我现在的工作要求模型有图片理解能力,用哪个合适,主要是还得便宜

xiaohanne 发表于 2026-8-20 10:23

舞以 发表于 2026-8-20 10:16
估计是啥bug或者过渡态吧,昨晚还查不到,我的网页和客户端也看不到

bug吧,vibe coding流行,我都快习惯牢美那几家大模型厂商隔三岔五出个闹麻了的bug了

舞以 发表于 2026-8-20 10:24

唠叨 发表于 2026-8-20 10:22
我现在的工作要求模型有图片理解能力,用哪个合适,主要是还得便宜

mimo吧,2.5(非pro)有多模态,还廉价,速度不错,如果能力你觉得够用

Promeus 发表于 2026-8-20 10:24

小野賢章 发表于 2026-8-20 10:11
说路由的忘记之前A/说检测到国内的AI实验室使用他们的模型,会给主动降智+投毒了吗,这么看不起A/的风控?
...

我之前说的就是这个ds之前用了15万次就出来狗叫,现在这个路由说是直接把达里奥脸扯下来打,是说达里奥后端让梁子深度求索了吗

xiaohanne 发表于 2026-8-20 10:25

本帖最后由 xiaohanne 于 2026-8-20 10:27 编辑

唠叨 发表于 2026-8-20 10:22
我现在的工作要求模型有图片理解能力,用哪个合适,主要是还得便宜
还是得自己试,智力够用的边界真的因人而异。
mimo,hy3,minimax m3,感觉大概是这么个智力排序,价格排序也差不多,你可以看看哪里有免费token薅一点来试试。

舞以 发表于 2026-8-20 10:27

廉价多模态现在我印象里就是mimov2.5和gpt-luna?luna开个plu订阅基本就能爽用了。
mimo的话虽然能力一般,但是价格还是对标v4f涨价之前的。

龙骑士尹志平 发表于 2026-8-20 10:28

muermaru 发表于 2026-8-20 10:07
直接用antigravity cli,走终端代理就不会有恶心的地区限制问题了

不行啊,佬, curl ipinfo.io看已经是国外了,cli Oauth已经走完能看到账号信息了,进去一样有地区限制

蛋黄酱Release 发表于 2026-8-20 10:28

glm5.3怎么雷达站上的分这么低实际用起来有什么不爽的地方吗

inpachi 发表于 2026-8-20 10:31

其实我工作也用不了多少token,毕竟我主业只是测试,大部分时候只需要排障和定位,剩下的开单就行了,让程序去烧token,就算是梁文峰也蹬得动。
主要是下班回家玩酒馆,这东西缓存命中率低、经常因为不够满意需要抽卡重roll,再加上ds似乎总是不填表,梁文谷都有点蹬不动。
最近找了个还算可以的mimo预设,写起来还算听话,填表也经常填,猛猛蹬opencodego也不太花钱,姑且算是找到了平衡点。

villsian 发表于 2026-8-20 10:32

龙骑士尹志平 发表于 2026-8-20 10:28
不行啊,佬, curl ipinfo.io看已经是国外了,cli Oauth已经走完能看到账号信息了,进去一样有地区限制 ...

可以看谷歌的文档,有地区限制列表。

我记得香港肯定是不能用。美国节点开了tun模式是可以用的。

tillnight 发表于 2026-8-20 10:32

蛋黄酱Release 发表于 2026-8-20 10:28
glm5.3怎么雷达站上的分这么低实际用起来有什么不爽的地方吗

人很醒目的提示了目前样本数不够,新加的三兄弟都不作为正式分数推荐。
不过倒是能看的出kimi是真的贵,蹬的人是真的少,起码舍得拿出来公益蹬的很少。

qwased 发表于 2026-8-20 10:39

脸宽 发表于 2026-8-20 09:06
好像都在说Qwen3.8-27B效果不错啊,本地部署。

第一个让我非常悔恨为什么我只有16G显存的本地模型量化可以凑合但是上下文不开到160K以上真的很难用,思考两下就没了

卡普空 发表于 2026-8-20 10:40

qwased 发表于 2026-8-20 10:39
第一个让我非常悔恨为什么我只有16G显存的本地模型量化可以凑合但是上下文不开到160K以上真的很难用,思 ...

20g显存会好用一点吗?

qwased 发表于 2026-8-20 10:42

卡普空 发表于 2026-8-20 10:40
20g显存会好用一点吗?
1G显存能多20K上下文吧,KV Q8量化
Q4量化视觉就基本变成瞎子了

neptunehs 发表于 2026-8-20 10:43

本帖最后由 neptunehs 于 2026-8-20 10:45 编辑

qwased 发表于 2026-8-20 10:39
第一个让我非常悔恨为什么我只有16G显存的本地模型量化可以凑合但是上下文不开到160K以上真的很难用,思 ...

我24g也没感觉到可用的地步就是了 上下文是跑满了 但高上下文下速度极慢。。。甚至还会断。还忽略了一次agents的约束造成了大量工作重来。感觉还是128k+不要让opencodecompact才算能用(多开subagent就行 但更慢了 而且断了更惨)
这时候就能感觉到infra的重要性了

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

唠叨 发表于 2026-8-20 10:45

https://platform.xiaomimimo.com/console/balance
求个小米官方的邀请码我搞10赠金试试mimo

muermaru 发表于 2026-8-20 10:47

龙骑士尹志平 发表于 2026-8-20 10:28
不行啊,佬, curl ipinfo.io看已经是国外了,cli Oauth已经走完能看到账号信息了,进去一样有地区限制 ...

一个是看下终端的环境变量有没有配好;一个是代理的流量日志,有没有确实走代理的节点;然后就是和楼下说的检查代理节点的地区是不是支持的地区。
我这边日本节点,都配好之后,反重力cli已经用了很久的,应该是没问题的

qwased 发表于 2026-8-20 10:47

龙骑士尹志平 发表于 2026-8-20 10:03
谢谢大佬,开了提示地区限制,不开就是网络连接不上

我去小红书学的,桌面快捷方式的目标改成下面这串就可以全部走代理了
端口改成你自己代理的

C:\Windows\System32\cmd.exe /c "set HTTP_PROXY=http://127.0.0.1:7897&& set HTTPS_PROXY=http://127.0.0.1:7897&& set NO_PROXY=127.0.0.1,localhost&& start "" "Antigravity.exe""

overflowal 发表于 2026-8-20 10:48

这些小工作站的算力不行的。你别看都嗷嗷地说自己一秒出多少token。你让它prefill一下个几百k的上下文试试。    Re:Source

qwased 发表于 2026-8-20 10:49

本帖最后由 qwased 于 2026-8-20 10:51 编辑

muermaru 发表于 2026-8-20 10:47
一个是看下终端的环境变量有没有配好;一个是代理的流量日志,有没有确实走代理的节点;然后就是和楼下说 ...
https://policies.google.com/country-association-form
其实是要在这里改归属地提交申请修改失败=账号报废,去买个老号吧

qwased 发表于 2026-8-20 10:51

neptunehs 发表于 2026-8-20 10:43
我24g也没感觉到可用的地步就是了 上下文是跑满了 但高上下文下速度极慢。。。甚至还会断。还忽略了一次a ...

思考换能力就这样了,上下文长度不够的话啥都干不了

nxmonitor 发表于 2026-8-20 10:56

GLM5.3也是雷霆大思考,不知道这个问题什么时候能到改进

xiaohanne 发表于 2026-8-20 10:57

nxmonitor 发表于 2026-8-20 10:56
GLM5.3也是雷霆大思考,不知道这个问题什么时候能到改进

后训练提升能力的代价就是雷霆大思考,暂时来看无解。

nxmonitor 发表于 2026-8-20 11:01

xiaohanne 发表于 2026-8-20 10:57
后训练提升能力的代价就是雷霆大思考,暂时来看无解。

不过我看灰测的就很好,token效率和总时间控制得都不错,只是不出等于没有…

UncleDracula 发表于 2026-8-20 11:03

厍无春 发表于 2026-8-20 09:07
其实我觉得昨天下午放了灰测就是想让,v4pro后训练炼炸了的谣言不攻自破,变相回应一下。不过这也肯定了 ...

想多了,梁子从来就不在乎外面说什么,只会闷头做DS,还有嘎韭菜

misuzu0723 发表于 2026-8-20 11:08

opencode go的4F彻底拉完了,吐字慢,首字出的慢,思考半天结果自行截断,完全没法用

cscbzcbz 发表于 2026-8-20 11:11

misuzu0723 发表于 2026-8-20 11:08
opencode go的4F彻底拉完了,吐字慢,首字出的慢,思考半天结果自行截断,完全没法用 ...

今天特别慢,昨天还行
我已经用回梁叔叔官方API了,简直不要太丝滑

Promeus 发表于 2026-8-20 11:12

nxmonitor 发表于 2026-8-20 11:01
不过我看灰测的就很好,token效率和总时间控制得都不错,只是不出等于没有… ...

灰测那个是全新模型就一切说得通了

空き地卯木 发表于 2026-8-20 11:13

misuzu0723 发表于 2026-8-20 11:08
opencode go的4F彻底拉完了,吐字慢,首字出的慢,思考半天结果自行截断,完全没法用 ...

scnet的也是,晚上回去蹬还好,白天上班时间一切过去就报输出超额
感觉得开始把一些活排到夜间去干了

tillnight 发表于 2026-8-20 11:13

nxmonitor 发表于 2026-8-20 11:01
不过我看灰测的就很好,token效率和总时间控制得都不错,只是不出等于没有… ...

这明显是一个规模更大的新模型,连安全对齐都没做显然不可能已经做好了后训练,能力大概率是模型自己泛化出来的,本来就是“后训练的代价是雷霆思考”的反例,而不是“后训练做的好也可以不雷霆思考”的证明。

舞以 发表于 2026-8-20 11:18


这个条款结合国内的数据管理法律法规,要真有Claude同款脏token,我都信是梁叔叔派三个俄国特工从a\那里把权重偷出来了。

xiaohanne 发表于 2026-8-20 11:18

tillnight 发表于 2026-8-20 11:13
这明显是一个规模更大的新模型,连安全对齐都没做显然不可能已经做好了后训练,能力大概率是模型自己泛化 ...

我觉得是这样的,大模的智力提升本质还是要靠参数,尤其大参数带来的泛化能力是无可取代的。
但是实践中真把超大参数模型拿出来,厂商没那么多算力用户也没那么多钱,后训练是一种追求经济性的选择。
考虑到梁子对agi还没放弃希望,我感觉他们可能确实没给后训练投入太多精力,更多是给投资人一个交代,这也可以解释pro为什么不如预期。

王兰花秀丽 发表于 2026-8-20 11:20

没人聊聊这次rc8更新吗,数据结构变了怎么迁移呀    Re:Source

舞以 发表于 2026-8-20 11:21

王兰花秀丽 发表于 2026-8-20 11:20
没人聊聊这次rc8更新吗,数据结构变了怎么迁移呀    Re:Source

找agent帮忙写个脚本?

xiaohanne 发表于 2026-8-20 11:24

王兰花秀丽 发表于 2026-8-20 11:20
没人聊聊这次rc8更新吗,数据结构变了怎么迁移呀    Re:Source

遇事不决问ai()

龙骑士尹志平 发表于 2026-8-20 11:26

qwased 发表于 2026-8-20 10:49
https://policies.google.com/country-association-form
其实是要在这里改归属地提交申请修改失败=账号报 ...

完蛋,果然我是在中国。

qwased 发表于 2026-8-20 11:26

感觉DSH还是非必要不使用吧,也太不成熟了,换个别的harness先用着

舞以 发表于 2026-8-20 11:26

dsh现在是个自己造轮子的玩具,官方都不承诺不进行破坏兼容性的更新

论坛助手,iPhone

serj005 发表于 2026-8-20 11:30

发现dsh的会话记录都是zstd压缩的,难得看到zstd在合适的地方应用起来,会话体积比其他agent能少一半以上。

qwased 发表于 2026-8-20 11:32

龙骑士尹志平 发表于 2026-8-20 11:26
完蛋,果然我是在中国。
全程代理开一个新号然后老号拉进家庭组吧,勉强也能用
就是现在新号非常容易风控
页: 240 241 242 243 244 245 246 247 248 249 [250] 251 252 253 254 255 256 257 258 259
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼