nxmonitor 发表于 2026-8-8 00:57

本帖最后由 nxmonitor 于 2026-8-8 01:05 编辑

怎么还吹上了,还敢国外代工不就是擦边吗还怎么样?你看同样造芯片的平头哥还去不去代工了?前几页漏油分析是没问题啊,就这风格……

绝地潜兵 发表于 2026-8-8 01:01

唉,我草,我从字节的TRAE迁移到了OpenCode,配合V4F正式版好用得很呐,原本用的是啥玩意哦

脸宽 发表于 2026-8-8 01:04

羊寢 发表于 2026-8-7 18:44
还是夏瑾啊,前几天有更新的

不知道是不是用的open code,还是什么原因感觉有点不如之前好用

论坛助手,iPhone

nxmonitor 发表于 2026-8-8 01:05

绝地潜兵 发表于 2026-8-8 01:01
唉,我草,我从字节的TRAE迁移到了OpenCode,配合V4F正式版好用得很呐,原本用的是啥玩意哦 ...
这东西比qoder还拉,根本没法用的程度,也不知道前几个月强制员工用后面怎么了……

Evspeed 发表于 2026-8-8 01:10

当年中美都批准了老黄收购Mellanox现在想想也是神奇,没这个的话老黄NVL72/144那些大节点内部的通信能力完全比不了华为,现在老黄优势会少一些。

蛋黄酱Release 发表于 2026-8-8 01:10

绝地潜兵 发表于 2026-8-8 01:01
唉,我草,我从字节的TRAE迁移到了OpenCode,配合V4F正式版好用得很呐,原本用的是啥玩意哦 ...

不如再试试zcode

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0

舞以 发表于 2026-8-8 01:11

字节之前都吹是未来的中国谷歌,这下llm领域真是卧龙凤雏了。
张一鸣说的批话和谷歌人员流失不好说哪个更让人难绷。

绝地潜兵 发表于 2026-8-8 01:16

还有更垃圾的cherry agent,联网搜索都要你消费它家的API才肯干活,绝绝子

舞以 发表于 2026-8-8 01:18

codex让我觉得好用的还是那个桌面端,但是桌面端有严重的长时间运行之后卡爆整个电脑,必须重启的问题
希望dsh出来之后有好用的第三方桌面端

蜇灵 发表于 2026-8-8 01:42

goranger 发表于 2026-8-7 23:42
我那个回复应该有误,应该是主要是通过go套餐调用就行后边我发了图

论坛助手,iPhone ...

哦,那就好,我在用reasonix,差点想换opencode了

80后卢瑟 发表于 2026-8-8 06:21

本帖最后由 80后卢瑟 于 2026-8-8 06:27 编辑

13号 发表于 2026-8-8 00:21
没有恶意。 但是我都用pi了, 啥我不会自己搞定啊, 搞不定我直接打开pi让他自己给我推荐工具自己装上了 ...
单纯图省事的东西,会比较方便。就像你自己有一个配置列表,你也可以一键 apply 你自己的插件列表和 skills 一样。

想省事就用默认推荐,想高度定制就自己设置列表一键安装

sellboy 发表于 2026-8-8 08:11

因为多卡互联的进步,现在训超大模型在硬件上应该是没问题的。
但现在模型尺寸应该不是唯一重要维度了,去年的思考模式、今年的Agent能力
而且思考模式今年也在发展,思考长度换智商需要长的上下文长度,现在普遍1M的情况下各家不同的注意力机制也带来了不同的效果和实现成本。
可以说如果没有先进的技术底座,模型就算很大也只是很贵罢了。

eno_emos 发表于 2026-8-8 08:34

脸宽 发表于 2026-8-8 01:04
不知道是不是用的open code,还是什么原因感觉有点不如之前好用

论坛助手,iPhone ...

flash正式版确实甲变厚了不少
可能是这个原因导致的

焚尘 发表于 2026-8-8 10:48

现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?
或者单纯使用体验上,想要比较好的生态以及扩展能力,然后又要保证至少比肩Claude Code的工作能力的agent?

半江瑟瑟半江红 发表于 2026-8-8 10:50

焚尘 发表于 2026-8-8 10:48
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?或者单纯使用体验上,想要 ...

那你一句比肩claudecode就杀死比赛了
本来我还想推荐一下zcode的,但这玩意其实还不如opencode

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

小野賢章 发表于 2026-8-8 10:50

codex 之前我用得少的时候天天重置,这周我把月额度蹬完了,然后一直没有重置

tk553521 发表于 2026-8-8 11:38

焚尘 发表于 2026-8-8 10:48
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?
或者单纯使用体验上,想要 ...

如果用的v4f可以用reasonix先过渡一下等专武,其它模型其实codex也可以,不是非得用cc的

CCauchy 发表于 2026-8-8 12:07

持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存?

论坛助手,iPhone

来都来了 发表于 2026-8-8 12:12

本帖最后由 来都来了 于 2026-8-8 12:55 编辑

想多了,持续学习八成就是类似Claude,给你本地整一个MD文档,平时的错题本都记到里面。

错题本这个东西,刚开始的效果都挺好。但是随着你用的时间越来越久,错题本里的内容越来越多,AI的注意力也会下降。在长对话中,无视错题本的情况是非常多见的。

我的设想是,云端大模型加本地小模型,也许是一个可行的方案。本地小模型就相当于绘画时用的Lora一样,其内容会覆盖在大模型之上。本地小模型自动进行训练,实现长期存储的效果,在运行时要求本地有一定的算力,不要求太高,但是集显或亮机卡肯定不行,如果能实现3060级别的显卡流畅运行的话,应该是个很有竞争力的方案。

overflowal 发表于 2026-8-8 12:13

CCauchy 发表于 2026-8-8 12:07
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存 ...

不知道怎么搞,都说是探索中了    Re:Source

sellboy 发表于 2026-8-8 12:19

CCauchy 发表于 2026-8-8 12:07
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存 ...

这是明年的核心技术,现在有人能拿出来话堪比V4f正式版去年年中问世。

無始無終 发表于 2026-8-8 12:21

焚尘 发表于 2026-8-8 10:48
现在还在用Claude Code,想试试新的agent,什么比较靠谱的agent能力比较排行吗?
或者单纯使用体验上,想要 ...

那只有Pi了,但很多东西要自己配

—— 来自 HUAWEI NOH-AN00, Android 12, 鹅球 v4.0

spaceblue 发表于 2026-8-8 12:26

张一鸣不纯种汉奸吗?蒸馏本来就是正常行为到他嘴里变成啥十恶不赦的事情了。
就像老美抵制新疆棉,这时候一个中国服装企业跳出来说本公司任何产品绝不使用新疆棉,别人怎么看?

neptunehs 发表于 2026-8-8 12:44

CCauchy 发表于 2026-8-8 12:07
持续学习/自我改进怎么搞啊?每个用户一个差分模型吗,以后没有缓存的事了?还是说某种新型压缩上下文缓存 ...

我是觉得只要一天还要缓存上下文 而不是自由高速存储 那就一天没有agi
可能是我啥都不懂的错觉就是了

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

CCauchy 发表于 2026-8-8 12:59

neptunehs 发表于 2026-8-8 12:44
我是觉得只要一天还要缓存上下文 而不是自由高速存储 那就一天没有agi
可能是我啥都不懂的错觉就是了


呃,前者是一种功能,后者是一种实现方式,看不懂

论坛助手,iPhone

CCauchy 发表于 2026-8-8 13:03

也许应该有一种印象层/模糊记忆层,用来指导模型何时去精读之前的上下文,这样就没有上下文窗口的概念了,才能真正解决上下文腐败,大概几mb大小,可以跨会话继承,也没有微调的概念了(可以先破甲再共享了,塞点重口的东西

论坛助手,iPhone

Luminous脑壳痛 发表于 2026-8-8 13:57

为什么现在才说张一鸣是汉奸,前两年抖音收购第一时间给美国跪下不就已经定性了吗

很久就在那边l 发表于 2026-8-8 14:02

英伟达免费API更新flash0731了,现在没多少人发现速度还挺快

jasoncoop 发表于 2026-8-8 14:13

Luminous脑壳痛 发表于 2026-8-8 13:57
为什么现在才说张一鸣是汉奸,前两年抖音收购第一时间给美国跪下不就已经定性了吗 ...

火星公民张一鸣,没错,这次是双重验证

akirt 发表于 2026-8-8 14:24

张一鸣自家的seed没少拿他家coding plan付费用户的数据炼
还好意思提不让蒸馏的事
是怕被别人看穿就算蒸也是一坨翔吧

巨魔已被忠诚 发表于 2026-8-8 14:43

来都来了 发表于 2026-8-8 12:12
想多了,持续学习八成就是类似Claude,给你本地整一个MD文档,平时的错题本都记到里面。

错题本这个东西, ...

为什么要用md啊。
推理路由的相关路径会在概率分布上呈现出来,也就是向量梯度。那么把用户特征记下来就好了。没必要整全部上下文,前AI时代都能处理用户画像然后用算法推送。只是用户画像精准,本质是需求分析,不代表模型可以持续学习。

hugosol 发表于 2026-8-8 14:44

持续学习和记忆系统什么的其实已经有点过时了,因为大家发现这玩意做得太傻瓜式反而不好用,塞进来的大部分不是你想要的东西
我个人更想要的是可以主动控制agent加载哪方面的记忆,简单地说就是上下文管理,然后更进一步就是怎么构造更高质量的上下文

noword 发表于 2026-8-8 14:48

梁鸽说的“持续学习”应该是类似训练阶段吧,模型自主训练

模型自己在学习.jpg

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha

舞以 发表于 2026-8-8 14:54

现在的新模型就能摆脱之前的各种skill,因为真正有价值的工作轨迹都被后训练塞进去了,梁鸽的意思是这一步,乃至涉及到知识本身的变化都能持续自主完成?
感觉挺难的,和llm架构本身都有冲突,能搞出来说明ds牛逼呗

蛋黄酱Release 发表于 2026-8-8 15:11

现在deepseek的网页端和app基本没法用了现在搜索资料和简单对话用哪个app好一点,千问?

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0

neptunehs 发表于 2026-8-8 15:14

很久就在那边l 发表于 2026-8-8 14:02
英伟达免费API更新flash0731了,现在没多少人发现速度还挺快

顺便据说amd也有了 也是一天多少免费额度来着

不过我不知道怎么搞

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

Promeus 发表于 2026-8-8 15:45

Flash被蹬智障了吧让他写个冒险加人的故事坚持要把人直接加进来

此誓的守望 发表于 2026-8-8 15:54

你还说别,你要说Zcode是DS的伪专武还真没问题,毕竟5.2的底模是ds3.2,你就说是不是ds系列的吧

半江瑟瑟半江红 发表于 2026-8-8 15:55

蛋黄酱Release 发表于 2026-8-8 15:11
现在deepseek的网页端和app基本没法用了现在搜索资料和简单对话用哪个app好一点,千问?

—— 来自 vivo V ...

Rikkahub或者chatbox接个tavily的api

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

舞以 发表于 2026-8-8 16:07

gpt也能试试?现在说是开放对面用户的额度了?
但是如果只是低级模型加上限制推理预算的话效果不知道满不满意。
页: 140 141 142 143 144 145 146 147 148 149 [150] 151 152 153 154 155 156 157 158 159
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼