wonderful259 发表于 2026-8-9 22:56

现在越发期待 pro 的性能了,不知道 harness 发布的时候,ds 会不会上 plan 计划。

lactone 发表于 2026-8-9 23:31

如果真要和harness一起发,搞不好梁子也会搞tokenplan了

控制流量,搞分级定价,甚至搞价格歧视,都比现在纯卖api靠调价容易

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha

hugosol 发表于 2026-8-9 23:40

当光停止 发表于 2026-8-9 21:38
Pathfounders 从行业消息人士处获悉,Hassabis 原本希望与 Dean 同时离职,但谷歌管理层认为这一消息将导致 ...

我就说Hassabis居然没有跟着一起跑路,明明他看上去应该是最受不了大公司文化那种人

我被骗了五块钱 发表于 2026-8-10 00:02

当光停止 发表于 2026-8-9 21:38
Pathfounders 从行业消息人士处获悉,Hassabis 原本希望与 Dean 同时离职,但谷歌管理层认为这一消息将导致 ...

gemini至今是我用的最多的模型,不管是CLI搞AIRP还是网页日常对话···感觉gemini不知道什么时候就完全掉队了,这么大的公司,真的莫名其妙

半江瑟瑟半江红 发表于 2026-8-10 00:05

我被骗了五块钱 发表于 2026-8-10 00:02
gemini至今是我用的最多的模型,不管是CLI搞AIRP还是网页日常对话···感觉gemini不知道什么时候就完全 ...

从4月底上下文退化到64k都没有开始就完了

lubo 发表于 2026-8-10 00:06

发现一个移动端的Agent,OpenMinis,有Linux沙盒、终端,感觉不错啊
https://github.com/OpenMinis/OpenMinis

scikirbypoke 发表于 2026-8-10 00:15

我发现flash思考链还是用英语好,复杂问题、大量工具调用、长上下文的情况下中文思考的标点符号很容易充斥整个思考链,出现无限感叹号、无限右括号、无限破折号等等

nxmonitor 发表于 2026-8-10 07:28

台风大概率出不了…

cscbzcbz 发表于 2026-8-10 07:42

不出就不出吧,flash能不能不降智了,周末是感觉笨了一些

当光停止 发表于 2026-8-10 08:33

本帖最后由 当光停止 于 2026-8-10 08:36 编辑

剑指今天下午1点半!

deepseek不可能翻车的!我就是要吹爆梁文峰!

diohanmilton 发表于 2026-8-10 08:35

这两天用kimi k3做决策,ds v4f做实施,把一个别人的Python代码迁移到c#/avalonia,基本没有问题,除了细节要打磨。

但是v4f没有多模态,导致gui还是不太行。然后改gui用的kimi 2.7 code,k3消耗的分太多了。

—— 来自 HONOR PGT-AN10, Android 16, 鹅球 v4.0-alpha

david5515 发表于 2026-8-10 09:00

新的一周新的等待

卡普空 发表于 2026-8-10 09:16

lactone 发表于 2026-8-9 23:31
如果真要和harness一起发,搞不好梁子也会搞tokenplan了

控制流量,搞分级定价,甚至搞价格歧视,都比现在 ...

搞code plan那不是更便宜了,支持

来都来了 发表于 2026-8-10 09:17



群友就像是没有游戏可玩整天眼巴巴等官方发消息的■■■玩家

买码!注册! 发表于 2026-8-10 09:18

八月初最后一天,再不发可就不礼貌了对吧,梁宫春日

蜇灵 发表于 2026-8-10 09:21

goranger 发表于 2026-8-9 21:06
现在好像已经有了

论坛助手,iPhone

opencode go 的 v4f 已经支持 reponse API了?我试试看

蜇灵 发表于 2026-8-10 09:24

scikirbypoke 发表于 2026-8-10 00:15
我发现flash思考链还是用英语好,复杂问题、大量工具调用、长上下文的情况下中文思考的标点符号很容易充斥 ...

这种感觉就是上下文坏了,我昨天就是,有个对话,每次开始思考超过一定字数就变成复读感叹号和破折号,而且动不动触发上下文压缩,明明我UI界面显示上下文才一百k不到,最后没办法让他写了个交接文档开新对话去了

specialized01 发表于 2026-8-10 09:33

lactone 发表于 2026-8-9 21:14
批评ds的其实不少,正常批评也合理

有的明显是带情绪的,经典话术是哪个benchmark把0731排前十,就会拉 ...

v4f0731已经变成检验成色的试金石了

c月光咖啡 发表于 2026-8-10 10:10

问个问题,本地小参数模型(显存<16GB)做一些开发部署调试的工作,哪个好用?有没有好用agent?

我试过opencode+ Qwen2.7-coder 7B/3.5 8B/3.6-35b-a3b,蠢我都还能接受,MYSQL客户端都装好了还不懂怎么怎么连数据库,90%概率死循环

来都来了 发表于 2026-8-10 10:14

数据库不是硬连的啊,你让他写个程序去连。就像你自己力气再大,喝咖啡也不能手锤啊,好歹要买个工具去磨。

c月光咖啡 发表于 2026-8-10 10:21

python写个脚本连不就行了,用全参数的模型分分钟自己能够搞定。再说了蠢就算了,我都还能教它怎么做,就是经常死循环,一个问题反复同样办法无限试探

valand 发表于 2026-8-10 10:22

c月光咖啡 发表于 2026-8-10 10:21
python写个脚本连不就行了,用全参数的模型分分钟自己能够搞定。再说了蠢就算了,我都还能教它怎么做,就是 ...

本地模型就是这样的

燕山雪 发表于 2026-8-10 10:24

之前ds4f干完活自己写了个填字游戏玩的事,苦主把原始记录发到GitHub和知乎了:https://github.com/Guanyu-AI-prog/deepseek-v4-flash-wordle-incident。

https://www.zhihu.com/question/2068108635620774765/answer/2069542921674692433

燕山雪 发表于 2026-8-10 10:25

c月光咖啡 发表于 2026-8-10 10:10
问个问题,本地小参数模型(显存<16GB)做一些开发部署调试的工作,哪个好用?有没有好用agent?

我试过o ...

35b用来干活比27b差非常多

startraveller 发表于 2026-8-10 10:26

c月光咖啡 发表于 2026-8-10 10:21
python写个脚本连不就行了,用全参数的模型分分钟自己能够搞定。再说了蠢就算了,我都还能教它怎么做,就是 ...

本地小尺寸模型现在也就3.6 27B勉强能做点小活,但是16G显存还是没戏了。 别折腾自己了,花1块钱给dsv4f就能搞定的事情。

noneoneone 发表于 2026-8-10 10:28

c月光咖啡 发表于 08-10 10:10
问个问题,本地小参数模型(显存<16GB)做一些开发部署调试的工作,哪个好用?有没有好用agent?


我试过opencode+ Qwen2.7-coder 7B/3.5 8B/3.6-35b-a3b,蠢我都还能接受,MYSQL客户端都装好了还不懂怎么怎么连数据库,90%概率死循环



我的意见见6093楼,就是没必要自己部署。用的少就直接DeepSeek api,用的多就opencodego。
如果一定要本地部署,那我觉得27b相对好一些。

——来自 2410DPN6CC 上的 S1er 客户端

qz66618 发表于 2026-8-10 10:29

昨天还有人被邀请内测harness感觉剑指这周五了

—— 来自 鹅球 v3.5.99

cscbzcbz 发表于 2026-8-10 10:33

直觉告诉我今天应该没有,快进到周五

龙骑士尹志平 发表于 2026-8-10 10:33

翻车是不可能翻车的,我永远相信文峰giegie

c月光咖啡 发表于 2026-8-10 10:34

我主要是要在内网机部署一个方便调试内网系统,没办法用cloud api的,看来还是自己攒点钱自费补贴工作吧

→熙← 发表于 2026-8-10 10:39

重新定义8月初

小野賢章 发表于 2026-8-10 10:40

感觉现在已经不需要IDE了,把jetbrains全家桶取消了,现在就用vscode review一下修改

阿刚 发表于 2026-8-10 10:43

又到周一啦,来看坛友发癫!

c月光咖啡 发表于 2026-8-10 10:45

小野賢章 发表于 2026-8-10 10:40
感觉现在已经不需要IDE了,把jetbrains全家桶取消了,现在就用vscode review一下修改 ...

不用感觉,我已经完全脱离IDE做了几个项目了,这个图太符合我的感受了
https://p.sda1.dev/34/6a506f5d7133156badcdad7951f1f581/image.jpg

—— 来自 HONOR MAA-AN10, Android 16, 鹅球 v3.5.99-debug

tk553521 发表于 2026-8-10 10:47

我已经彻底放弃不看代码了,让大模型查大模型,多查几轮拉倒

—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha

neptunehs 发表于 2026-8-10 10:49

燕山雪 发表于 2026-8-10 10:24
之前ds4f干完活自己写了个填字游戏玩的事,苦主把原始记录发到GitHub和知乎了:https://github.com/Guanyu- ...

点进去就发现模型是mimo
问题出在hermes

躺枪的吃白饭蓝色大肥鱼

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

med 发表于 2026-8-10 10:50

感觉读长文本、长代码能力下降了

大喵喵 发表于 2026-8-10 10:54

我周末在一个512G内存加RTX 5880 的服务器上成功部署了unlosh的deepseek v4 flash 8bit 满血版本。就是太慢了点,生成只有6token/s

crow_wine 发表于 2026-8-10 11:13

我感觉还好,就是方法论感觉更重要了。调一些算法,你不给ai设计一套好的debug流程,它能给你手算算到它自己崩溃。还有就是ai用gdb打断点单步调试的能力很弱,其他所有的动态工具的调用的能力都很弱

crow_wine 发表于 2026-8-10 11:15

只有git这种明显训练资料很多的场景才表现得好一点
页: 144 145 146 147 148 149 150 151 152 153 [154] 155 156 157 158 159 160 161 162 163
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼