看坛友说的我心痒难耐,我怎么就没roll到过神秘劲霸D指导,梁子,我这半年可在你的网站花了300多了啊
暴论一波,论技术的话
DeepSeek>>月之暗面>OpenAI>a\
可能是我对llm作为一个技术产品的审美被梁圣雷普了吧
半江瑟瑟半江红 发表于 2026-7-19 10:35
看坛友说的我心痒难耐,我怎么就没roll到过神秘劲霸D指导,梁子,我这半年可在你的网站花了300多了啊 ...
用oepncode接DeepSeek的API,我用PI也没roll出来过
学生模型的上限永远低于教师模型在游戏里表现好,证明它的后训练(尤其是RL对齐)做得比B好,这恰是“非蒸馏”的后训练技术(强化学习)在起作用
只能说洋大人的伟大是某些人的思想钢印…
这几个画工程模型,还有对GODOT的应用,更像是理想中的哈基米…
我记得 V4 preview 发布时好像说过,正式版的参数量会乘以2?
现在roll新模型的几率应该还挺大的,昨晚新建的apikey,新对话10次以内就能roll到
今天我彻底roll不到了没有v4正式版我可怎么活呀
zy450 发表于 2026-7-19 10:39
用oepncode接DeepSeek的API,我用PI也没roll出来过
救世啊!
ayanamilin 发表于 2026-7-19 10:40
我记得 V4 preview 发布时好像说过,正式版的参数量会乘以2?
从来没说过啊 Re:Source
本帖最后由 舞以 于 2026-7-19 11:18 编辑
我感觉漏很多漏油为ds展示了“1.6t不该有的能力”感到奇怪,本质还是被oa两家骗了
我感觉至少在叙事上,这两家是不能说自己的模型(特别是旗舰)多有性价比,成本有多低,怎么依靠训练达成了小容量高能力。
哪怕搞限额重置和实质降价,也要有一种施舍的姿态,“哎,为了你们这群贱民能稍微多感受到神的恩泽,我们这群大祭司又加了两天班来优化!”
总而言之,一定要说我们的模型多大多稠密多昂贵,来塑造一种“神性”,典型就是fable。不直接说也要纵容和诱导社区在这方面的讨论。
glm已经证明,在此前炒作最狠,被视为claude“独特智慧”的coding,其实完全就是个训练和工程问题。
just know how,然后去做,就能有结果。
论坛助手,iPhone
本帖最后由 tonberry 于 2026-7-19 11:03 编辑
秦南心 发表于 2026-7-19 10:39
学生模型的上限永远低于教师模型在游戏里表现好,证明它的后训练(尤其是RL对齐)做得比B好,这恰是“非蒸 ...
又给人扣帽子,我只是在给某些敏感问题出现了国模不应该有的回答(什么叫存在争议啊)一个合理化的解释。
我认为国模尤其ds比oa有着更强的技术能力。
我认为所谓蒸馏是国内还是海外互相都在干的,就a÷这货不要脸拿来说事。
不要老是先入为主去猜想别人屁股好吧。
有没有可能我能roll到正式版恰恰是因为我对ds从过去到现在都在大量使用。
即使这个灰度模型不是正式版而是v4.1乃至v5,它的进化能力也是不可思议的
我一直不觉得OA两家在技术上有什么领先,无非是更大的参数量+高质量语料的训练造就了他们的领先地位,说白了大模型搞到现在都是在一个transformer架构上来回倒腾,哪有那么多可以实现跨越式进步的技术革新
—— 来自 鹅球 v3.5.99
就算是克又怎么样,用ds的价格给你玩肥波还有啥不满的,甲都给你预先破了
tonberry 发表于 2026-7-19 10:55
又给人扣帽子,我只是在给某些敏感问题出现了国模不应该有的回答(什么叫存在争议啊)一个合理化的解释。 ...
你今天的人格是客观壬
zy450 发表于 2026-7-19 10:39
用oepncode接DeepSeek的API,我用PI也没roll出来过
同用pi链接DS的api未roll出来过
明天总不能不来吧
jyj256 发表于 2026-7-19 11:07
接上以后怎么测试是不是
试试一句话许愿让它做个东西,看它的思维链主要是let me做啥还是I'm doing啥
前者就是preview,后者大概率是正式版
论坛助手,iPhone
秦南心 发表于 2026-7-19 11:00
你今天的人格是客观壬
莫名其妙看不懂的网络用语,大脑年龄多大了
明天不来也得发个延期邮件吧,他那个调价通知还在官网挂着呢
—— 来自 鹅球 v3.5.99
tonberry 发表于 2026-7-19 11:10
莫名其妙看不懂的网络用语,大脑年龄多大了
你这样挺好,继续选择忽略,继续保持不懂,继续做个巨童
秦南心 发表于 2026-7-19 11:18
你这样挺好,继续选择忽略,继续保持不懂,继续做个巨童
你很懂的话,你倒是帮我解答疑问啊,
你想对我表达啥观点啥态度认为我立场是什么样直说啊,我又不是不正面回答,又没人不让你说,装神弄鬼的
Sza 发表于 2026-7-19 10:04
我看了好几个这几天的v4正式版视频。我想知道这个模型的知识量为什么那么大?各种类型的游戏都能做出大致模 ...
1.6t 是什么很小的模型吗?🤔
lobsteru 发表于 2026-7-19 10:15
我看说k3这个2.8T参数部署起来限制挺多,现在可能只有gb300能发挥好,大模型后面可能参数量越来越大,梁圣 ...
K3应该也是为950超节点准备的
—— 来自 HUAWEI SGT-AL50, Android 12, 鹅球 v3.4.97-alpha
tillnight 发表于 2026-7-19 10:34
Qwen的新旗舰看起来也是5.6 Sol这级的,唐杰年初的发言快要成著名战忽案例了,关键这反击第一枪还是他自己 ...
2023年上半年华为新闻发布会,当时徐值军说华为必须有美国政府批准才能生产5G手机,旁边孟晚舟一脸绷不住的表情
—— 来自 HUAWEI SGT-AL50, Android 12, 鹅球 v3.4.97-alpha
tonberry 发表于 2026-7-19 08:05
我是跑过去围观的好吧,正常表述我测到的和我看到的,你哪里看到我观点是认同他们? ...
......你没有意识到你是在搬shi么
没有意识到搬shi是污染环境的行为么...
jyj256 发表于 2026-7-19 11:07
接上以后怎么测试是不是
思考里面出现let me就是旧版
出现大量的i'm就是正式版
Sza 发表于 2026-7-19 10:04
我看了好几个这几天的v4正式版视频。我想知道这个模型的知识量为什么那么大?各种类型的游戏都能做出大致模 ...
在K3之前,V4就是参数量最大的开源模型
—— 来自 HUAWEI SGT-AL50, Android 12, 鹅球 v3.4.97-alpha
我在rikkahub上roll出来一次,手贱重置了
tonberry 发表于 2026-7-19 12:17
你很懂的话,你倒是帮我解答疑问啊,
你想对我表达啥观点啥态度认为我立场是什么样直说啊,我又不是不正 ...
意思就是别再搬屎了,谭友对于品鉴精神病人的脑回路没有任何兴趣
—— 来自 HUAWEI SGT-AL50, Android 12, 鹅球 v3.4.97-alpha
phorcys02 发表于 2026-7-19 12:27
......你没有意识到你是在搬shi么
没有意识到搬shi是污染环境的行为么...
因为我想的是看到的论据经过实践后确实有可以讨论的地方,而且我前面反复强调我不认可ln的观点。
当然你说把这事拉进来讨论是搬shi,那我明白我做错的点在哪了。
舞以 发表于 2026-7-19 10:35
暴论一波,论技术的话
DeepSeek>>月之暗面>OpenAI>a\
可能是我对llm作为一个技术产品的审美被梁圣雷普 ...
别人都是弱智,放着技术最高最便宜的不用,赶着给A畜送钱是吧?
机械的已经有了,家人们,我需要他自动画 PCB 。我需要他帮我画天线,帮我画传输线。帮我设计地线。
开源大模型们的大砍刀要开始砍这些闭源的AI了
jyj256 发表于 2026-7-19 11:07
接上以后怎么测试是不是
除了看有没有let me,思维链里有没有列项也是一个特征。
昨天玩了一天,灰度版思维链里从来不会1 2 3 4的列项。
spaceblue 发表于 2026-7-19 12:32
别人都是弱智,放着技术最高最便宜的不用,赶着给A畜送钱是吧?
那毕竟不乳不用的人多了去了,有些人就是吃乳滑营销
试了几天了,全是let me我已急哭😭,梁子明天不出就是牢梁了
—— 来自 Xiaomi 2602BRT18C, Android 16上的 S1Next-鹅版 v2.1.2