现在越发期待 pro 的性能了,不知道 harness 发布的时候,ds 会不会上 plan 计划。
如果真要和harness一起发,搞不好梁子也会搞tokenplan了
控制流量,搞分级定价,甚至搞价格歧视,都比现在纯卖api靠调价容易
—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
当光停止 发表于 2026-8-9 21:38
Pathfounders 从行业消息人士处获悉,Hassabis 原本希望与 Dean 同时离职,但谷歌管理层认为这一消息将导致 ...
我就说Hassabis居然没有跟着一起跑路,明明他看上去应该是最受不了大公司文化那种人
当光停止 发表于 2026-8-9 21:38
Pathfounders 从行业消息人士处获悉,Hassabis 原本希望与 Dean 同时离职,但谷歌管理层认为这一消息将导致 ...
gemini至今是我用的最多的模型,不管是CLI搞AIRP还是网页日常对话···感觉gemini不知道什么时候就完全掉队了,这么大的公司,真的莫名其妙
我被骗了五块钱 发表于 2026-8-10 00:02
gemini至今是我用的最多的模型,不管是CLI搞AIRP还是网页日常对话···感觉gemini不知道什么时候就完全 ...
从4月底上下文退化到64k都没有开始就完了
发现一个移动端的Agent,OpenMinis,有Linux沙盒、终端,感觉不错啊
https://github.com/OpenMinis/OpenMinis
我发现flash思考链还是用英语好,复杂问题、大量工具调用、长上下文的情况下中文思考的标点符号很容易充斥整个思考链,出现无限感叹号、无限右括号、无限破折号等等
台风大概率出不了…
不出就不出吧,flash能不能不降智了,周末是感觉笨了一些
本帖最后由 当光停止 于 2026-8-10 08:36 编辑
剑指今天下午1点半!
deepseek不可能翻车的!我就是要吹爆梁文峰!
这两天用kimi k3做决策,ds v4f做实施,把一个别人的Python代码迁移到c#/avalonia,基本没有问题,除了细节要打磨。
但是v4f没有多模态,导致gui还是不太行。然后改gui用的kimi 2.7 code,k3消耗的分太多了。
—— 来自 HONOR PGT-AN10, Android 16, 鹅球 v4.0-alpha
新的一周新的等待
lactone 发表于 2026-8-9 23:31
如果真要和harness一起发,搞不好梁子也会搞tokenplan了
控制流量,搞分级定价,甚至搞价格歧视,都比现在 ...
搞code plan那不是更便宜了,支持
群友就像是没有游戏可玩整天眼巴巴等官方发消息的■■■玩家
八月初最后一天,再不发可就不礼貌了对吧,梁宫春日
goranger 发表于 2026-8-9 21:06
现在好像已经有了
论坛助手,iPhone
opencode go 的 v4f 已经支持 reponse API了?我试试看
scikirbypoke 发表于 2026-8-10 00:15
我发现flash思考链还是用英语好,复杂问题、大量工具调用、长上下文的情况下中文思考的标点符号很容易充斥 ...
这种感觉就是上下文坏了,我昨天就是,有个对话,每次开始思考超过一定字数就变成复读感叹号和破折号,而且动不动触发上下文压缩,明明我UI界面显示上下文才一百k不到,最后没办法让他写了个交接文档开新对话去了
lactone 发表于 2026-8-9 21:14
批评ds的其实不少,正常批评也合理
有的明显是带情绪的,经典话术是哪个benchmark把0731排前十,就会拉 ...
v4f0731已经变成检验成色的试金石了
问个问题,本地小参数模型(显存<16GB)做一些开发部署调试的工作,哪个好用?有没有好用agent?
我试过opencode+ Qwen2.7-coder 7B/3.5 8B/3.6-35b-a3b,蠢我都还能接受,MYSQL客户端都装好了还不懂怎么怎么连数据库,90%概率死循环
数据库不是硬连的啊,你让他写个程序去连。就像你自己力气再大,喝咖啡也不能手锤啊,好歹要买个工具去磨。
python写个脚本连不就行了,用全参数的模型分分钟自己能够搞定。再说了蠢就算了,我都还能教它怎么做,就是经常死循环,一个问题反复同样办法无限试探
c月光咖啡 发表于 2026-8-10 10:21
python写个脚本连不就行了,用全参数的模型分分钟自己能够搞定。再说了蠢就算了,我都还能教它怎么做,就是 ...
本地模型就是这样的
之前ds4f干完活自己写了个填字游戏玩的事,苦主把原始记录发到GitHub和知乎了:https://github.com/Guanyu-AI-prog/deepseek-v4-flash-wordle-incident。
https://www.zhihu.com/question/2068108635620774765/answer/2069542921674692433
c月光咖啡 发表于 2026-8-10 10:10
问个问题,本地小参数模型(显存<16GB)做一些开发部署调试的工作,哪个好用?有没有好用agent?
我试过o ...
35b用来干活比27b差非常多
c月光咖啡 发表于 2026-8-10 10:21
python写个脚本连不就行了,用全参数的模型分分钟自己能够搞定。再说了蠢就算了,我都还能教它怎么做,就是 ...
本地小尺寸模型现在也就3.6 27B勉强能做点小活,但是16G显存还是没戏了。 别折腾自己了,花1块钱给dsv4f就能搞定的事情。
c月光咖啡 发表于 08-10 10:10
问个问题,本地小参数模型(显存<16GB)做一些开发部署调试的工作,哪个好用?有没有好用agent?
我试过opencode+ Qwen2.7-coder 7B/3.5 8B/3.6-35b-a3b,蠢我都还能接受,MYSQL客户端都装好了还不懂怎么怎么连数据库,90%概率死循环
我的意见见6093楼,就是没必要自己部署。用的少就直接DeepSeek api,用的多就opencodego。
如果一定要本地部署,那我觉得27b相对好一些。
——来自 2410DPN6CC 上的 S1er 客户端
昨天还有人被邀请内测harness感觉剑指这周五了
—— 来自 鹅球 v3.5.99
直觉告诉我今天应该没有,快进到周五
翻车是不可能翻车的,我永远相信文峰giegie
我主要是要在内网机部署一个方便调试内网系统,没办法用cloud api的,看来还是自己攒点钱自费补贴工作吧
重新定义8月初
感觉现在已经不需要IDE了,把jetbrains全家桶取消了,现在就用vscode review一下修改
又到周一啦,来看坛友发癫!
小野賢章 发表于 2026-8-10 10:40
感觉现在已经不需要IDE了,把jetbrains全家桶取消了,现在就用vscode review一下修改 ...
不用感觉,我已经完全脱离IDE做了几个项目了,这个图太符合我的感受了
https://p.sda1.dev/34/6a506f5d7133156badcdad7951f1f581/image.jpg
—— 来自 HONOR MAA-AN10, Android 16, 鹅球 v3.5.99-debug
我已经彻底放弃不看代码了,让大模型查大模型,多查几轮拉倒
—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha
燕山雪 发表于 2026-8-10 10:24
之前ds4f干完活自己写了个填字游戏玩的事,苦主把原始记录发到GitHub和知乎了:https://github.com/Guanyu- ...
点进去就发现模型是mimo
问题出在hermes
躺枪的吃白饭蓝色大肥鱼
—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
感觉读长文本、长代码能力下降了
我周末在一个512G内存加RTX 5880 的服务器上成功部署了unlosh的deepseek v4 flash 8bit 满血版本。就是太慢了点,生成只有6token/s
我感觉还好,就是方法论感觉更重要了。调一些算法,你不给ai设计一套好的debug流程,它能给你手算算到它自己崩溃。还有就是ai用gdb打断点单步调试的能力很弱,其他所有的动态工具的调用的能力都很弱
只有git这种明显训练资料很多的场景才表现得好一点