chaoliu 发表于 2026-7-15 23:02
问下现在用ai搓软件,ui这方面有什么好用的工具?我现在只会让ai自己噼里啪啦打代码,但与之匹配的ui我用的 ...
pencil可以试试
tillnight 发表于 2026-7-16 09:40
如果豆包在训的10t级的今年也搬上来的话,ai叙事爆不爆不好说,御三家叙事是真要爆了。这a/上市不好估价了 ...
https://p.sda1.dev/33/f54f54e3fa1adda5ab7d8983b717b5d9/image.jpg
无内鬼,来点哈基米笑话
zy450 发表于 2026-7-16 08:56
看了你回复,刷了几次也刷到I’m……确实感觉不一样,感觉思考长了很多
正式版果然很聪明,我让他做了个二次元的昆特牌,让他自己调用我之前本地部署好的文生图模型,一次出结果,逻辑都对。之前绝对做不到这个效果
v4不是原生多模态吧,最后肯定还是要走原生多模态这条路
Promeus 发表于 2026-7-16 10:05
无内鬼,来点哈基米笑话
不知为什么我觉得哪怕前面都是假的,3.5pro这个性能预测真实度也很高
—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99
说来他们内部有在研究世界模型吗,感觉啥时候世界模型能和LLM结合起来才能达到AGI,纯LLM应该很难或者不可能吧
cscbzcbz 发表于 2026-7-16 10:10
正式版果然很聪明,我让他做了个二次元的昆特牌,让他自己调用我之前本地部署好的文生图模型,一次出结果 ...
是的,强非常多。。。。我让正式版做个增量游戏,预览版经常连数字都不动,正式版可以直接玩起来
wandeeees 发表于 2026-7-16 10:21
说来他们内部有在研究世界模型吗,感觉啥时候世界模型能和LLM结合起来才能达到AGI,纯LLM应该很难或者不可 ...
LLM肯定不行,本质就是猜词,只要还在猜就不可能是AGI
wandeeees 发表于 2026-7-16 10:21
说来他们内部有在研究世界模型吗,感觉啥时候世界模型能和LLM结合起来才能达到AGI,纯LLM应该很难或者不可 ...
世界模型这东西,都不知道具体是个啥。 Re:Source
哈基米怎么就成了这个样子
—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha
本帖最后由 泰坦失足 于 2026-7-16 11:02 编辑
Gemini现在还能换着花样几乎零成本薅羊毛. 但就是没人用
本帖最后由 cscbzcbz 于 2026-7-16 11:22 编辑
截图图展示一下效果
https://postimg.cc/xXHhcz1Nhttps://postimg.cc/21vMVZS3https://static.stage1st.com/image/filetype/image.gif
tk553521 发表于 2026-7-16 10:44
哈基米怎么就成了这个样子
—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha
我怀疑是让牢伊把中东的算力中心炸了影响了gemini的算力
这玩意现在唯一可以吹牛逼的世界知识都倒退到24年以前了
Promeus 发表于 2026-7-16 10:05
无内鬼,来点哈基米笑话
拿A÷对比,就是比代码能力吧
本帖最后由 nxmonitor 于 2026-7-16 11:47 编辑
K3没有后端测试的结果啊,看到的全都是前端,那这个结论怎么得出的呢?
sellboy 发表于 2026-7-16 11:28
拿A÷对比,就是比代码能力吧
gemini现在全方面拉胯
—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99
nxmonitor 发表于 2026-7-16 11:46
K3没有后端测试的结果啊,看到的全都是前端,那这个结论怎么得出的呢?
根据2.6推测的呗
nxmonitor 发表于 2026-7-16 11:46
K3没有后端测试的结果啊,看到的全都是前端,那这个结论怎么得出的呢?
K3 现在比较容易测前端能力,后端能力现在没 API 测试起来比较麻烦
Promeus 发表于 2026-7-16 10:05
无内鬼,来点哈基米笑话
看到minimax绷不住了
如果不把minimax放进去,我估计就信了
ds大规模推送了吧,我今天已经各种I'm了
刷了十多次,都是let me
按耐不住了
GLM5.5好像还不是多模态?
此誓的守望 发表于 2026-7-16 15:38
把自己也超了 何意味
半江瑟瑟半江红 发表于 2026-7-16 15:43
把自己也超了 何意味
因为某脑鲸小子就是一视同仁的烂炒啊鲸鱼从来没豁免过
要下班了,难道真要明天?! Re:Source
从一开始就说了明天发。就是邮件的问题而已,梁子肯定觉得之前决定太草率了,还没想好怎么涨价,搞不好几天后就没涨价这回事了。
明天还不发在我这里评价真要变成小梁了,D指导pro现在流口水成啥样了
—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99
也不知道是不是错觉 我觉得今天的v4f(opencode go)好神勇 opencode go也好v4f也罢都不会加入灰度的吧?
—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
neptunehs 发表于 2026-7-16 18:24
也不知道是不是错觉 我觉得今天的v4f(opencode go)好神勇 opencode go也好v4f也罢都不会加入灰度的吧?
...
看看提示词let me是不是消失了
正式版速度慢不少,不过准确度很高
—— 来自 Xiaomi 24031PN0DC, Android 16, 鹅球 v3.5.99
本帖最后由 绝地潜兵 于 2026-7-16 18:45 编辑
冤枉呐 发表于 2026-7-16 08:56
给我个邮箱,我们发一发提示词和结果讨论一下?
看了看我的预设,不涉及角色和对话示例
英文占比78%,中文占比22%,英文高效毋庸置疑
中文主要是写作风格
英文主要是破甲、视角、动作和约束指令
上下文最后的Post-History Instructions自检流程,中英占比1比1。
上个回复说的是这部分全部用英文,结果就成了英文机翻
nxmonitor 发表于 2026-7-16 18:29
看看提示词let me是不是消失了
还在 那就是没灰度
—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
kimi 不会也要等吧
好想评测
K3王朝了?
看到某脑社区一句话生成个galgame
绝地潜兵 发表于 2026-7-16 18:56
K3王朝了?
看到某脑社区一句话生成个galgame
kimi做前端一直很好。但是能力如何这个要具体测试 Re:Source
k3真的有那么神吗?要不要提前开个会员怕到时候跟glm一样抢不到
—— 来自 vivo V2405A, Android 16, 鹅球 v4.0-alpha