haiuhfuwah 发表于 2026-7-9 10:36

ds要发了吗?

Promeus 发表于 2026-7-9 10:43

【疑似ds正式版-哔哩哔哩】 https://b23.tv/oBybgIJ

马里奥,感觉下限glm5.2,上限和gpt5.5/opus4.8掰手腕

酱狐狸 发表于 2026-7-9 10:48

不会要等到7.17世界人工智能大会再发吧

nxmonitor 发表于 2026-7-9 10:51

有可能7.13,顺便挂上智普和Minimax的空单……

Promeus 发表于 2026-7-9 10:56

有个据说是ds员工的微信里说是713吧,另外那人好像还说梁圣在搞超巨型模型

drodchang 发表于 2026-7-9 10:58

Promeus 发表于 2026-7-9 10:56
有个据说是ds员工的微信里说是713吧,另外那人好像还说梁圣在搞超巨型模型 ...

国内不搞超大模型说不过去了,国外御三家个个都要10T了

neptunehs 发表于 2026-7-9 10:58

Promeus 发表于 2026-7-9 10:56
有个据说是ds员工的微信里说是713吧,另外那人好像还说梁圣在搞超巨型模型 ...

超巨型模型搞了也用不起啊 还是觉得v4f这种大小是甜点区

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

nxmonitor 发表于 2026-7-9 11:08

drodchang 发表于 2026-7-9 10:58
国内不搞超大模型说不过去了,国外御三家个个都要10T了

我觉得真没这么大,如果真这么大而且这个V4正式版是真的,只能说明他们的模型架构有点落后了……

很久就在那边l 发表于 2026-7-9 11:10

又不开源怎么知道是多大的模型,马斯克说5t,另一边Cursor的CEO说他们即将发布1.5t的模型和gpt、opus一样大

pwzzy 发表于 2026-7-9 11:13

nxmonitor 发表于 2026-7-9 11:08
我觉得真没这么大,如果真这么大而且这个V4正式版是真的,只能说明他们的模型架构有点落后了…… ...

a畜的架构就是落后,10t的稠密模型是他们现在焦头烂额的主要原因。国内上到这个量级是必然的趋势,但是是稀疏的,现在还在追赶是训练卡(b系列)真不够

drodchang 发表于 2026-7-9 11:14

nxmonitor 发表于 2026-7-9 11:08
我觉得真没这么大,如果真这么大而且这个V4正式版是真的,只能说明他们的模型架构有点落后了…… ...

闭源模型没有透露过参数,但普遍认为越来越大,超过10T是迟早的事,大模型还是有优势,当然也越来越贵。

nxmonitor 发表于 2026-7-9 11:18

pwzzy 发表于 2026-7-9 11:13
a畜的架构就是落后,10t的稠密模型是他们现在焦头烂额的主要原因。国内上到这个量级是必然的趋势,但是是 ...

真稠密现在的HBM的带宽都不够吧,但是他们确实只会堆规模是真的

nxmonitor 发表于 2026-7-9 11:32

反正A÷的路子快被自己走死了,API价格这么高导致toB的逻辑都说不下去了,openAI还在尝试降价拉人,不知道他们成本到底怎模样,但是真拉用户数又可能会变成gemini的样子

Promeus 发表于 2026-7-9 11:34

nxmonitor 发表于 2026-7-9 11:08
我觉得真没这么大,如果真这么大而且这个V4正式版是真的,只能说明他们的模型架构有点落后了…… ...

v4还是1.6t啊那截图说是搞21T的新模

tillnight 发表于 2026-7-9 11:56

现在主流观点是gpt5.5和opus4.8目前来看大概率都远没达到早前猜测的5t。理论上10t就要把互联网数据吃光了,里面有多少辣鸡数据,边际效益有多糟糕,想想也知道。

chenyedgg 发表于 2026-7-9 12:05

opus 5t、mythos 10t是老马说的,这参数目前就不可能真danse

Azcarlo 发表于 2026-7-9 12:05

A畜10T的模型是dense那必不可能,只可能是moe。坊间传闻说一个非常不稀疏激活参数很高的moe。

— from Xiaomi 23127PN0CC, Android 16, S1 Next Goose v3.5.99

overflowal 发表于 2026-7-9 12:14

10T稠密模型也说的出来,你知道10T的dense是什么计算量吗?

bixinhaner 发表于 2026-7-9 12:15

grok4.5在哪能白嫖?瑟瑟能力还是第一吗?

qwased 发表于 2026-7-9 12:15

tillnight 发表于 2026-7-9 11:56
现在主流观点是gpt5.5和opus4.8目前来看大概率都远没达到早前猜测的5t。理论上10t就要把互联网数据吃光了, ...

把写码用户产生的数据灌回去呗,反正出bug了用户自己会盯着让修,天然RL

半江瑟瑟半江红 发表于 2026-7-9 12:32

bixinhaner 发表于 2026-7-9 12:15
grok4.5在哪能白嫖?瑟瑟能力还是第一吗?

早完蛋了,创意写作能力一坨屎还不如minimax m3

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

半江瑟瑟半江红 发表于 2026-7-9 12:33

很久就在那边l 发表于 2026-7-9 11:10
又不开源怎么知道是多大的模型,马斯克说5t,另一边Cursor的CEO说他们即将发布1.5t的模型和gpt、opus一样大 ...

gpt5.5肯定没多大

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

Promeus 发表于 2026-7-9 13:03

【疑似ds正式版-哔哩哔哩】 https://b23.tv/zTO9xtZ
马里奥赛车

【灰度测试dsv4正式版?泰拉瑞亚-以撒结合-RTS-浏览器操作系统-割绳子-星露谷全测试-哔哩哔哩】 https://b23.tv/3QORysb

其他一些疑似v4正式版的成果

Evspeed 发表于 2026-7-9 13:29

半江瑟瑟半江红 发表于 2026-7-9 12:33
gpt5.5肯定没多大

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

5.6差不多2T

阿刚 发表于 2026-7-9 13:46

我现在的api应该没灰到,让他编了个洛克人结果非常弱智

Promeus 发表于 2026-7-9 14:00

阿刚 发表于 2026-7-9 13:46
我现在的api应该没灰到,让他编了个洛克人结果非常弱智

其实怀疑这位是草台填错手机号把内测发他了

chenyedgg 发表于 2026-7-9 14:13

https://www.lesswrong.com/posts/veFMEzDDyWaer2Sms/sanity-checking-incompressible-knowledge-probes
gpt5.5只有1.5T是这个方法推出来的吗?

这的话最多只能推算世界知识参数量,gpt和claude很明显不会像gemini一样塞很多的世界知识

JRPG 发表于 2026-7-9 14:14

绝地潜兵 发表于 2026-7-6 00:15
按照酒馆的多agent方向,AI文案可能要两三个agent+skill才能有活人感
一个风格大纲
一个草稿


但这么搞费用也成倍上升

酱油拌饭s 发表于 2026-7-9 15:24

本帖最后由 酱油拌饭s 于 2026-7-9 15:25 编辑

新换了cherrystudio,做了知识库,接D老师写同人,发现仿写文笔之后虽然没ai味儿,但人味儿也特别淡啊,求教诸位有什么好的提示词或者解决方法么

舞以 发表于 2026-7-9 15:40

本帖最后由 舞以 于 2026-7-9 15:42 编辑

“超大稠密模型”更像是一个赢学概念:ds为代表的moe稀疏模型是下等模型,而claude这种(他们想象中的)dense模型才是真的智能。
类似的还有每次claude更新版本小红书和小蓝书上都有人高呼能力又又又又飞跃啦!
gpt都没有类似级别的炒作待遇

论坛助手,iPhone

半江瑟瑟半江红 发表于 2026-7-9 16:10

酱油拌饭s 发表于 2026-7-9 15:24
新换了cherrystudio,做了知识库,接D老师写同人,发现仿写文笔之后虽然没ai味儿,但人味儿也特别淡啊,求 ...

给llm约束太多它就是会往最不会出错的方向生成,也就是人味儿淡了,反正cherrystudio自带claw,上文风skill板正它吧

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

半江瑟瑟半江红 发表于 2026-7-9 16:12

舞以 发表于 2026-7-9 15:40
“超大稠密模型”更像是一个赢学概念:ds为代表的moe稀疏模型是下等模型,而claude这种(他们想象中的)den ...

放任A畜跟个脑瘫一样炒作本身就是closeai的炒作吧,以前我觉得closeai跟个畜生一样,这辈子都不想给它掏钱,现在有a畜衬托我都订阅plus了

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

奶香花卷 发表于 2026-7-9 16:18

半江瑟瑟半江红 发表于 2026-7-9 16:12
放任A畜跟个脑瘫一样炒作本身就是closeai的炒作吧,以前我觉得closeai跟个畜生一样,这辈子都不想给它掏 ...

我也是……

燕山雪 发表于 2026-7-9 17:16

半江瑟瑟半江红 发表于 2026-7-9 16:10
给llm约束太多它就是会往最不会出错的方向生成,也就是人味儿淡了,反正cherrystudio自带claw,上文风ski ...

能推荐几个文风skill么?原生ai文确实太呆了看不下去

半江瑟瑟半江红 发表于 2026-7-9 17:17

燕山雪 发表于 2026-7-9 17:16
能推荐几个文风skill么?原生ai文确实太呆了看不下去

直接塞想要的文风的范文让llm自己总结

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

zhongjie 发表于 2026-7-9 17:25

燕山雪 发表于 2026-7-9 17:16
能推荐几个文风skill么?原生ai文确实太呆了看不下去

我都是找自己喜欢的文章,直接让LLM总结它的文风

半江瑟瑟半江红 发表于 2026-7-9 18:51

燕山雪 发表于 2026-7-9 17:16
能推荐几个文风skill么?原生ai文确实太呆了看不下去

对了,总结文风skill的LLM和写作的LLM不要用同一个,免得过拟合

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

阿刚 发表于 2026-7-9 18:56

燕山雪 发表于 2026-7-9 17:16
能推荐几个文风skill么?原生ai文确实太呆了看不下去

总结加切几段样本进去效果最好,让他按照不同写作场景切几段原文要求他写之前读原文。而且得强制要求,他有时候会假装读一下糊弄你

不见不散 发表于 2026-7-9 19:08

nxmonitor 发表于 2026-7-9 19:57

https://www.bilibili.com/video/BV1GyMj6dE4Q
新例子,群星文明六和魔兽世界
页: 44 45 46 47 48 49 50 51 52 53 [54] 55 56 57 58 59 60 61 62 63
查看完整版本: DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼