强烈怀疑梁文峰时间就是ds上班时间,不包括午休
haiuhfuwah 发表于 2026-8-20 15:24
强烈怀疑梁文峰时间就是ds上班时间,不包括午休
肯定的,梁文峰时间是北京时间,全球都是按照北京时间来定谷峰,而不是各时区按照各时区作息来定谷峰,很明显就是为了给ds的员工上班时间腾资源玩agi,下班了就把全量资源放出来给你球穷屌抢来玩。
serj005 发表于 2026-8-20 11:54
现在的网页专家模式好像稳定we need了
不稳定,我前两天试验是we need今天试是let me
qwased 发表于 2026-8-20 10:42
1G显存能多20K上下文吧,KV Q8量化
Q4量化视觉就基本变成瞎子了
并没有变成瞎子,你有没有测过能得出这结论
已经把一套业务流程重建了一遍,有点被榨干了。
pf67 发表于 2026-8-20 15:56
并没有变成瞎子,你有没有测过能得出这结论
我试过KV从Q8降到Q4,图片细节全都说不对了,还会瞎编
codex发神经了吗,公司网管突然来问我为什么这么多海外流量,结果排查一圈发现codex开着会话就会常驻1Mbps左右的网络连接,最近24小时跑了20G
qwased 发表于 2026-8-20 16:06
我试过KV从Q8降到Q4,图片细节全都说不对了,还会瞎编
不要量化kv cache,这个东西非常敏感的 Re:Source
inpachi 发表于 2026-8-20 16:10
codex发神经了吗,公司网管突然来问我为什么这么多海外流量,结果排查一圈发现codex开着会话就会常驻1Mbps ...
好几个版本之前就这样了啊 你们的网安现在才来
— from motorola XT2603-1, Android 16, S1 Next Goose v4.0
IIIIIlllllIIIII 发表于 2026-8-20 16:29
好几个版本之前就这样了啊 你们的网安现在才来
— from motorola XT2603-1, Android 16, S1 Next Goose...
我这边看了下Windows的数据使用量记录,过去30天里跑了大概50G,过去7天里跑了大概40G,过去24小时里跑了大概20G,所以今天才突然找上我的
inpachi 发表于 2026-8-20 16:36
我这边看了下Windows的数据使用量记录,过去30天里跑了大概50G,过去7天里跑了大概40G,过去24小时里跑了 ...
所以到底是传输了什么
IIIIIlllllIIIII 发表于 2026-8-20 16:29
好几个版本之前就这样了啊 你们的网安现在才来
— from motorola XT2603-1, Android 16, S1 Next Goose...
那么它到底在跑什么数据?
codex需要怎么多流量干嘛,搜集数据?
来都来了 发表于 2026-8-20 16:43
那么它到底在跑什么数据?
我们的网安说是会传你的会话历史包含tool call的结果 也就是假如你用codex读了代码那么scam altman也就拿到了你的代码
— from motorola XT2603-1, Android 16, S1 Next Goose v4.0
IIIIIlllllIIIII 发表于 2026-8-20 16:46
我们的网安说是会传你的会话历史包含tool call的结果 也就是假如你用codex读了代码那么scam altman也就拿 ...
谁家代码一秒一个M连着传几十个G啊?代码不都是几KB的东西吗?而且我听你说后,还专门开了codex,根本就没有你说的每秒一M的网络传输。
本帖最后由 木谷高明 于 2026-8-20 17:01 编辑
来都来了 发表于 2026-8-20 13:14
你们到处薅羊毛时所有API都是自己重新填的吗?我的电脑+手机上有七八个地方需要填API,让我三天换一个供应 ...
github上有开源的自建中转,需要docker,如果你自己有地方部署的话可以搞一个。自动判断API是否可用,每次新薅的加进去就行,最后通过一个API访问。
来都来了 发表于 2026-8-20 16:53
谁家代码一秒一个M连着传几十个G啊?代码不都是几KB的东西吗?而且我听你说后,还专门开了codex,根本就 ...
你上下文漂移的厉害
幻觉也很厉害
鉴定为doubao
— from motorola XT2603-1, Android 16, S1 Next Goose v4.0
事实上就是这样啊,貌似是开着客户端就是客户端跑,只用cli就是有会话的那个cli跑。
这也能解释为什么我这边codex.exe在24小时和7天内跑的流量很少,但30天内跑的流量也有大约10个G。因为我之前有段时间没开客户端只开了cli
国算平台这……他的token plan转发阿里云?二道贩子?……只有千问 3.8 max 可以用了
公司内网上新glm5.3了,输入$1.40输出$4.40,每天25$额度,让我来测试一下
国算这个,计算消费会延迟特别久,而且经常429,确实像二道贩子
白日依山尽 发表于 2026-8-20 17:10
国算这个,计算消费会延迟特别久,而且经常429,确实像二道贩子
国算平台你看他主页也知道,他就是菜市场啊,每个后端商户都是不一样的
qwased 发表于 2026-8-20 15:12
浏览器默认设置不修改的话是可以直接读到真实ip的
研究了一下,可能号废了
codex 有服务端压缩上下文好像
在用dsh跑sol,发现dsh默认的压缩策略好像是压到100k上下?挺适合ds的1m上下文,codex默认的272k看起来不太合适了
没有快得拉稀的 flash 好难受啊
crow_wine 发表于 2026-8-20 17:56
没有快得拉稀的 flash 好难受啊
梁叔叔的贼快
crow_wine 发表于 2026-8-20 17:56
没有快得拉稀的 flash 好难受啊
六点了可以蹬官方了
梁文谷,变身!
装了这个插件真的好玩
2017.05.04 发表于 2026-8-20 18:08
装了这个插件真的好玩
这是哪个插件?
小野賢章 发表于 2026-8-20 17:24
codex 有服务端压缩上下文好像
有的,云端压缩
跑其他反代模型还得把这个关了不然会卡住
最新版的DSH上有人发现了疑似flash视觉模型的相关代码
misuzu0723 发表于 2026-8-20 18:50
最新版的DSH上有人发现了疑似flash视觉模型的相关代码
我觉得最抽象的就是这个消息……
编程工具支持图像本来应该是基本功能……
—— 来自 Xiaomi 25042PN24C, Android 16, 鹅球 v3.5.99
白日依山尽 发表于 2026-8-20 17:10
国算这个,计算消费会延迟特别久,而且经常429,确实像二道贩子
就是部署,优化能力不行,二道贩子不至于,卡还是有的,之前有个活动算力机器免费用一周,ssh一打开吓到我了,1TB内存,128GB显存,就是部署模型体验拉,我到活动结束都没搞成功过。
misuzu0723 发表于 2026-8-20 18:50
最新版的DSH上有人发现了疑似flash视觉模型的相关代码
rc8提交记录明文写了增加多模态输入支持
白日依山尽 发表于 2026-8-20 17:10
国算这个,计算消费会延迟特别久,而且经常429,确实像二道贩子
我还巴不得它是二道贩子,ocg也是二道贩子虽然有时候慢但至少能用,超算这个一直429我都快疯了
—— 来自 HONOR MAA-AN10, Android 16, 鹅球 v3.5.99-debug
我说的不是支持图片输入那个,是出现了新的模型id
可以直接去 github 源码搜索deepseek-v4-flash-vision-exp
—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha
c月光咖啡 发表于 2026-8-20 19:08
我还巴不得它是二道贩子,ocg也是二道贩子虽然有时候慢但至少能用,超算这个一直429我都快疯了
—— 来 ...
别用了,根本没法用