justwul 发表于 2026-8-13 22:30

LieZ 发表于 2026-8-13 22:23
dsh自带的搜索是不是抓不到正文?

可以啊,我测试了没问题

逐日依然 发表于 2026-8-13 22:32

zy450 发表于 2026-8-13 22:26
看之前视频是说官方公布的成绩是在专武跑的

官方公告说的就是“使用 DeepSeek Harness 极简模式作为框架进行测试(使用 max 档位,topp=0.95,temperature=1.0),其他框架下结果可能略有不同”,倒也不用看视频才能知道。

chronicle 发表于 2026-8-13 22:33

→熙← 发表于 2026-8-13 21:40
怀念灰度的第一天

opencode 灰度


我猜啊,灰度的是带多模态的版本。

上面那个明显和原版很像,是不是类似k3那种按照原版画出来的。

实现估计和mimo差不多,分开训练再整合。

cscbzcbz 发表于 2026-8-13 22:39

这个传说中的极简模式是不是还不支持windows,因为这个模式要调用工具bash,但是dsh设置禁止在windos上使用bash,安装了GIT也不行。

舞以 发表于 2026-8-13 22:40

极简模式感觉纯benchmark用的吧,实际上 code mode比较合适一点

论坛助手,iPhone

秦南心 发表于 2026-8-13 22:44

一切皆为插件,那以后酒馆就在dsh上开了啊维持一个稳定dsh版本做无限拓展

孤灯蓝影 发表于 2026-8-13 22:45

本帖最后由 孤灯蓝影 于 2026-8-13 22:47 编辑

为什么deepseek配合它的harness可以极大提速
这个问题问到点子上了!你提到的“DeepSeek + Harness”组合,其实触及了大模型落地和自动化工程结合的核心。

要理解为什么提速,得先厘清概念:这里的 Harness 大概率不是指那个测试框架,而是指DeepSeek自研的模型训练/推理加速引擎(类似英伟达的TensorRT-LLM或微软的DeepSpeed)。

这套组合之所以“极快”,核心在于软硬件协同的“暴力美学”,主要体现在这三点:

· 计算与通信的重叠(让GPU永不空闲):大模型推理最怕“显存搬运”耽误时间。Harness引擎能把计算(矩阵乘法)和通信(多卡传数据)完全流水线化。就像快递员在送这一单时,系统已经把下一单的包裹塞到他车上了,GPU利用率可以拉到90%以上,远超传统框架。
· 动态批处理的“聚划算”策略:传统框架是等凑满一车人(固定批次)才发车,导致用户干等。Harness支持连续动态批处理,它不等,而是把几毫秒内来的请求“塞”进同一个计算图里一起跑,既保证低延迟,又把算力压榨到极限。
· FP8量化与内核融合(极致瘦身):DeepSeek深度适配了英伟达H系列显卡的FP8精度,数据传输量直接减半。同时把多个细碎操作(比如“加偏置+归一化+激活”)合并成一个“超级内核”,减少了显存读写次数,让计算速度质变。

最直白的对比:
不用这套组合,就像手动挡赛车(技术好也能跑,但换挡总得顿一下)。用了DeepSeek+Harness,好比换成了双离合自动变速箱——换挡(计算切换)在一瞬间完成,动力(算力)几乎零中断。

所以这不是简单的软件优化,而是“数学算法(FP8)+ 系统调度(流水线)+ 硬件指令(CUDA)”三层深度绑定的结果。这也是为什么DeepSeek能把推理成本做到极低的核心原因之一。

如果还想了解FP8量化和普通精度到底差在哪,或者流水线并行的具体实现,我可以接着细聊,想听哪个?😊

怎么感觉一股鲸鱼娘傲娇样

→熙← 发表于 2026-8-13 22:46

cscbzcbz 发表于 2026-8-13 22:39
这个传说中的极简模式是不是还不支持windows,因为这个模式要调用工具bash,但是dsh设置禁止在windos上使用 ...

装一个pwsh 7看看,我这里他是用pwsh的

半江瑟瑟半江红 发表于 2026-8-13 22:47

Dsh有桌面版吗?我让flash接zcode里给我下一个怎么只有浏览器插件的tui版

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

小野賢章 发表于 2026-8-13 22:48

知乎上一个内侧dsh的开发者说他们开发插件的时候用的是v4flash,也是今天才用上pro的

孤灯蓝影 发表于 2026-8-13 22:49

半江瑟瑟半江红 发表于 2026-8-13 22:47
Dsh有桌面版吗?我让flash接zcode里给我下一个怎么只有浏览器插件的tui版

—— 来自 HUAWEI SGU-AL10, And ...

没有,问过harness了,只能浏览器内安装页面

舞以 发表于 2026-8-13 22:49

半江瑟瑟半江红 发表于 2026-8-13 22:47
Dsh有桌面版吗?我让flash接zcode里给我下一个怎么只有浏览器插件的tui版

—— 来自 HUAWEI SGU-AL10, And ...

只有webui和headless,tui和gui等插件实现吧

论坛助手,iPhone

vincevincetang 发表于 2026-8-13 22:49

蹬了一会,这harness的缓存命中是有点说法

半江瑟瑟半江红 发表于 2026-8-13 22:51

舞以 发表于 2026-8-13 22:49
只有webui和headless,tui和gui等插件实现吧

论坛助手,iPhone

我问gpt,它誓言旦旦跟我说它可以写一个桌面版
先让它在codex跑着了,写不好明天pua它

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

gooyoy 发表于 2026-8-13 22:51

所以还有没有反转?https://p.sda1.dev/34/e2a555a607c5c5a258e6d678423729a0/image.jpg

—— 来自 HUAWEI PLA-AL10, Android 16, 鹅球 v3.5.99

城北无尘 发表于 2026-8-13 22:54

很奇怪,dsh中自带的opencode go配置不能GPT 5.6 Luna选,去yaml里面自己输入luna模型后,不兼容,直接所有opencode go的模型都不让用了。是不是luna用专门的单独的兼容站点啊

小野賢章 发表于 2026-8-13 22:54

是不是可以用cloudflared把网页暴露到公网啊,但是没有鉴权挺危险的

spaceblue 发表于 2026-8-13 22:54



和Pi太像了啥都能自己装

cscbzcbz 发表于 2026-8-13 22:55

感觉用DSH驾驭deepseek pro确实比用其他agent厉害一些 是错觉吗

王兰花秀丽 发表于 2026-8-13 22:57

本帖最后由 王兰花秀丽 于 2026-8-13 23:00 编辑

上下文到30%以上,命中率基本上都有99%,确实有点夸张...   

UI细节上bug不少,但是功能比我想象的完整,甚至支持后台任务 Re:Source

LeoDT 发表于 2026-8-13 22:59

spaceblue 发表于 2026-8-13 22:54
和Pi太像了啥都能自己装

感觉理解成插件热插拔的Pi就好了,用来写代码写文章大材小用了,这个设计应该是为了长期运行并且过程中会不断自己扩展自己的场景准备的。

wuliang 发表于 2026-8-13 23:02

harness怎么破甲,他拒绝了我的破甲提示词

孤灯蓝影 发表于 2026-8-13 23:03

本帖最后由 孤灯蓝影 于 2026-8-13 23:07 编辑

LeoDT 发表于 2026-8-13 22:59
感觉理解成插件热插拔的Pi就好了,用来写代码写文章大材小用了,这个设计应该是为了长期运行并且过程中会 ...

长任务agent,这个意义真是重大,之前就有这个概念说是要有那种能跑几个小时的agent。没想到deepseek搞定了。这个意义可以类比OpenAI那帮人搞出transforms之于NLP。说实话很多楼友没有意识到这个agent有多么划时代的意义,可以说是震撼。

真田源次郎信繁 发表于 2026-8-13 23:05

这harness虽然简单,但不用说性能,用户体验还真挺好的,比别的都舒服

小野賢章 发表于 2026-8-13 23:06

城北无尘 发表于 2026-8-13 22:54
很奇怪,dsh中自带的opencode go配置不能GPT 5.6 Luna选,去yaml里面自己输入luna模型后,不兼容,直接所有 ...

opencode go上luna是response的api,估计dsh没有区分,可以单独创建一个openai的供应商配置luna,另外minimax和qwen是anthropic的api

Nanachi 发表于 2026-8-13 23:07

不支持多模态的话,是不是就没办法和GUI软件交互了?在Windows上直接跑还是弄到Linux服务器上好点呢

crow_wine 发表于 2026-8-13 23:08

也就是说这个agent可以动态的更新自己的能力,那确实可以作为长任务框架

LeoDT 发表于 2026-8-13 23:09

孤灯蓝影 发表于 2026-8-13 23:03
长任务agent,这个意义真是重大,之前就有这个概念说是要有那种能跑几个小时的agent。没想到deepseek搞定 ...

主要还是短期内看不到收益,想象力限制根本想不出什么需要长期运行并且目的不是写代码的使用场景,全自动量化分析之类的么。

而且要长期运行的话,怎么能涨价呢???

crow_wine 发表于 2026-8-13 23:09

我用了下,公式渲染差点,但是比想象中要完整。公式就等别人做插件了,我懒得动手了

crow_wine 发表于 2026-8-13 23:11

不过我挺喜欢这个web端的,在wsl里面用很方便。
说明架构是分离的,可以很轻松支持虚拟机

bartholo4 发表于 2026-8-13 23:12

还真是要长期运行的 Agent 才能够真的有用。一个随时能够接受你所有信息的 Agent,它就能够在沉默的情况下,先帮你把很多东西想好,适时的给出建议

—— 来自 Xiaomi 2410DPN6CC, Android 16, 鹅球 v3.5.99-alpha

孤灯蓝影 发表于 2026-8-13 23:12

本帖最后由 孤灯蓝影 于 2026-8-13 23:15 编辑

LeoDT 发表于 2026-8-13 23:09
主要还是短期内看不到收益,想象力限制根本想不出什么需要长期运行并且目的不是写代码的使用场景,全自动 ...

我猜首先是梁子用来长时间实现量化交易的。然后其他的场景可能有监控天气,水文现象之类的,需要长时间监听的项目。所以很多楼友还是没意识到这个agent的伟大,还沉浸在什么一句话搞游戏的情景中。对于我来说这个agent真是震撼,真正意义上AI领域的巨大进步

绕指流光 发表于 2026-8-13 23:14

LeoDT 发表于 2026-8-13 23:09
主要还是短期内看不到收益,想象力限制根本想不出什么需要长期运行并且目的不是写代码的使用场景,全自动 ...

有什么想不出来的,运维啊。能力真的够强实时监控报告并带第一时间分析,个人项目流量不大的话交给他管理都行    Re:Source

绕指流光 发表于 2026-8-13 23:15

孤灯蓝影 发表于 2026-8-13 23:12
我猜首先是梁子用来长时间实现量化交易的。然后其他的场景可能有监控天气,水文现象之类的,需要长时间监 ...

所有需要运维的项目理论上都能尝试搞一下,这块想象空间还是挺大的    Re:Source

→熙← 发表于 2026-8-13 23:15

子代理异步的,不堵主线程, 派子代理后, 可以继续让主线程做别的事情,子代理完成自己注入上下文, 子代理里面也可以自己发消息
主线程也能继续注入完成工作的子代理让他继续干

真田源次郎信繁 发表于 2026-8-13 23:15

长任务agent各方面都有用啊
甚至可以做数学证明的

来都来了 发表于 2026-8-13 23:16

所以这个也是毛坯房吗?我刚把pi装的称心如意,不想再装一次毛坯房了

库德里尔 发表于 2026-8-13 23:18

来都来了 发表于 2026-8-13 23:16
所以这个也是毛坯房吗?我刚把pi装的称心如意,不想再装一次毛坯房了

从pi里面吸取了很多营养 有一部分和pi是一脉相承的 包括万物插件化的设计
但我觉得目前按裸npx启动来说 可以开箱即用了

我感觉甚至可以试着把pi做好的套组迁过去 就是dsh的插件还没研究过

LANGWANG 发表于 2026-8-13 23:18

这个缓存命中率好舒服啊

HazukiShion 发表于 2026-8-13 23:19

页: 178 179 180 181 182 183 184 185 186 187 [188] 189 190 191 192 193 194 195 196 197
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼