本帖最后由 czhhws 于 2026-7-31 18:03 编辑
蜇灵 发表于 2026-7-31 17:59
你们一般是直接用codex 桌面版还是vsc插件?
Codex 是 OpenAI 推出的 AI 编程助手,通过 Responses API 与模型交互,DeepSeek API 原生支持该格式。
Codex 的各个客户端形态——Codex CLI、ChatGPT 桌面端、VS Code 的 Codex 插件(Codex IDE extension)——共用同一份配置文件,按本文配置一次,即可在所有形态使用 DeepSeek 模型。
https://api-docs.deepseek.com/zh ... _integrations/codex
不过我没用过vsc的插件,毕竟我只算轻量用户。
现在flash正式版和pro预览版 哪个强
化物语 发表于 2026-7-31 18:05
现在flash正式版和pro预览版 哪个强
flash正式版
不过目前Luna有多模态这点还是稍微强点 看V4P正式版吧
czhhws 发表于 2026-7-31 16:59
私了
syl,上面都私信了。
同求破甲
化物语 发表于 2026-7-31 18:05
现在flash正式版和pro预览版 哪个强
正式版完爆
现在感觉和grok有点像,即使破甲后年龄红线也不能碰。
站立风景 发表于 2026-7-31 18:11
现在感觉和grok有点像,即使破甲后年龄红线也不能碰。
没,反正我用起来没限制。反而grok死活不可能,用了各种突破后一直会被限,用一些比较巧妙的可能会输出但在下次马上就又没用了。
—— 来自 realme RMX3700, Android 16, 鹅球 v3.5.99-alpha
nxmonitor 发表于 2026-7-31 15:58
模型基本已经是好了,除非灰测停的这几天继续后训练
现在应该石锤是等Harness了
终于把flash的正式版憋出来了吗,首先200多B的小模型肯定不要幻想过高的能力,不过这种后训练的提升确实让人期待pro的正式版的高度。最后我感觉以后要换到codex和ds自己的harness来使用ds了。
站立风景 发表于 2026-7-31 18:11
现在感觉和grok有点像,即使破甲后年龄红线也不能碰。
DS这个是幻觉甲,不是专门搞的甲
半江瑟瑟半江红 发表于 2026-7-31 17:15
不容易出现上下文幻觉,节约上下文记忆,节约词元
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0 ...
本质上一样的,所谓知识库也是相关软件帮你拼到提示词里
以前模型还讲究注意力三明治之类的,现在各类模型提供长上下文,这种技巧也过时了,最后的效果都差不多
识图用量特别少,用啥多模态合适
——来自 2410DPN6CC 上的 S1er 客户端
之前的预览版是直接下架了吗?
我用workbuddy接的pro,是不是切成flash就是今天的正式版了?
不让用大写 发表于 2026-7-31 18:30
之前的预览版是直接下架了吗?
我用workbuddy接的pro,是不是切成flash就是今天的正式版了? ...
API的接口方面应该是被覆盖了,但是网页和APP上面还是原版的。
—— 来自 S1Fun
我看各处只有API的消息
想问问网页版、APP端的Flash是正式版了吗?
pure_liquid 发表于 2026-7-31 18:43
我看各处只有API的消息
想问问网页版、APP端的Flash是正式版了吗?
没有
pure_liquid 发表于 2026-7-31 18:43
我看各处只有API的消息
想问问网页版、APP端的Flash是正式版了吗?
不是,请充钱 Re:Source
这v4flash 正式版的agent能力比预览版pro强4倍不止。按我之前干活的经验,派发了一个通过设计文档审核项目代码的工作。
(审核出来十来个问题)
没有任何提示的情况下,自动不同分支子agent分别设计编译过测试。然后审核合并。然后继续下一轮流水线。
最关键是之前的预览版马马虎虎干完一轮工作就会向你汇报完成完成进度了。而且这种情况下如果继续,下一轮质量就会下降。
现在从4点过开始跑这个任务,现在以及跑了俩轮半了(每轮并行解决三个问题),还在井井有条的继续干,没有违背。
梁圣要赶跑c端用户了?
论坛助手,iPhone
这个openfic非常好用,比酒馆好用十倍,这才是现代小黄文的打开方式Re:Source
舞以 发表于 2026-7-31 18:47
梁圣要赶跑c端用户了?
论坛助手,iPhone
https://p.sda1.dev/34/9574aacb0445c13f0f7a6a75d82d4717/image.jpg
难说c端更新会不会排在很后面的位置
—— 来自 Xiaomi 22127RK46C, Android 15, 鹅球 v3.5.99-alpha
deepseek要有官方agent了?终于可以和我的opencode说拜拜了
—— 来自 Xiaomi 24129PN74C, Android 15, 鹅球 v3.5.99
一堆中转站转发他c端卖钱白嫖他当然想赶走
论坛助手,iPhone
本帖最后由 Rowen233 于 2026-7-31 19:11 编辑
Luna这波最急的好像是谷顺歌啊
太猛了,又强又快又便宜此前舍不得用的ocg额度以后全用来蹬v4f了
—— 来自 vivo V2405A, Android 16, 鹅球 v4.0
蜇灵 发表于 2026-7-31 17:59
你们一般是直接用codex 桌面版还是vsc插件?
我一直都是cli
—— 来自 鹅球 v3.5.99
测试了一下,用/goal做一个步步为营,中间不设任何人工引导
整体开发思路还算有点道理 可惜在游戏理解上面完全不对 连开发带测试总共执行了50分钟
回头试一试别的场景和方法论
—— 来自 鹅球 v3.5.99
库德里尔 发表于 2026-7-31 19:13
测试了一下,用/goal做一个步步为营,中间不设任何人工引导
整体开发思路还算有点道理 可惜在游戏理解上面 ...
毕竟小模型,glm 也是稍微偏离主流一点的项目就会很明显的体现出来 taste 的缺点
ocg现在是
正式版了吗,那我得入一个了 Re:Source
v4f感觉又拉高了我对v4p正式版的期待
论坛助手,iPhone
flash好评,打glm5.2毫无问题
很难说梁圣这一手是不是故意整gpt luna的
唐圣得搞个风味v4的底模了啊,5.2被小这么多的v4f打真的顶不住了吧
论坛助手,iPhone
库德里尔 发表于 2026-7-31 19:13
测试了一下,用/goal做一个步步为营,中间不设任何人工引导
整体开发思路还算有点道理 可惜在游戏理解上面 ...
这个需求要等V4P正式版出来了,灰测的性能可以满足要求
舞以 发表于 2026-7-31 19:19
唐圣得搞个风味v4的底模了啊,5.2被小这么多的v4f打真的顶不住了吧
论坛助手,iPhone ...
还有个V4P呢,GLM5.5刚出来都不一定赶得上…
在 Hermes 开了个新会话问老会话是不是会自动使用正式版,它就开始反复思考,没管它过了一会儿还在思考,手动停了,然后发现花了 0.6
然后在一个老会话里吐槽这事,它讽刺了两次同一句话
emmm...
本帖最后由 库德里尔 于 2026-7-31 19:24 编辑
nxmonitor 发表于 2026-7-31 19:21
这个需求要等V4P正式版出来了,灰测的性能可以满足要求
主要是“两个墙不能重叠”的部分都没有满足 非常遗憾 感觉好像只在交叉点做了唯一性判断
ai算法方面都不管了
我是觉得如果显式提示它先过一遍websearch,至少游戏规则应该能正确的
—— 来自 鹅球 v3.5.99
别管什么小赢鲸了,MiniMax H3好像要成为涩涩界的核弹了