找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-13 15:39 | 显示全部楼层
蓝色梦魇 发表于 2026-9-13 15:38
现在ds4.1flash,用DSH的话还有必要第一轮注入极简模式的提示词吗(用anchored-standard) ...

第一步是别用DSH……
回复

使用道具 举报

     
发表于 2026-9-13 15:57 | 显示全部楼层
蓝色梦魇 发表于 2026-9-13 15:38
现在ds4.1flash,用DSH的话还有必要第一轮注入极简模式的提示词吗(用anchored-standard) ...

不行,极简会导致DS4.1非常不稳定,应该是这块后训练还没做完
DSH的普通模式或者切PI最好
回复

使用道具 举报

发表于 2026-9-13 15:58 | 显示全部楼层
省心就用zcode,pi稍微麻烦点,这两个算是最好的了


现在glm5.3的智力不大行了,不知道什么时候能换代
回复

使用道具 举报

     
发表于 2026-9-13 16:26 来自手机 | 显示全部楼层
感觉pi什么都不加已经够应对普通零碎要求了,想管理大型工程可以自己做些文档加以引导。
我到现在还是很不相信许愿式开发,包括直接接管大型代码仓。AI怎么识别微小但关键的设置和节点呢?很快就会被淹没在上下文中。

—— 来自 Xiaomi 25042PN24C, Android 16, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-9-13 16:29 来自手机 | 显示全部楼层
想在codex用astra搞点瑟瑟内容,怎么破限讷?

—— 来自 HUAWEI OCE-AN50, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-13 16:33 | 显示全部楼层
V4.1flash从体量上是GLM5.3的水平,实际质量其实还略高出一点(甚至短程任务K3也比不过),但是速度差得就太大了,总觉得两边是不是杠上了……
回复

使用道具 举报

     
发表于 2026-9-13 16:35 | 显示全部楼层
木水风铃 发表于 2026-9-13 16:29
想在codex用astra搞点瑟瑟内容,怎么破限讷?

—— 来自 HUAWEI OCE-AN50, Android 12, 鹅球 v3.5.99 ...

编故事,astra容易轻信别人
回复

使用道具 举报

     
发表于 2026-9-13 16:36 | 显示全部楼层
智谱的GLM5.5估计会遇到Kimi一样的问题,有训练的能力但是没运营的算力,最后还是要看V4.1Pro的脸色
回复

使用道具 举报

发表于 2026-9-13 16:42 来自手机 | 显示全部楼层
相见恨晚 发表于 2026-9-13 14:39
workbuddy太恶心了,没用他们优惠的模型也在任务一半跳出超出使用频率强行终止,要切auto才能重新来,太恶 ...

可以换模型说继续啊

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-13 16:51 | 显示全部楼层
novalli 发表于 2026-9-13 16:26
感觉pi什么都不加已经够应对普通零碎要求了,想管理大型工程可以自己做些文档加以引导。
我到现在还是很不 ...

我也是默认pi用到死,什么功能都不加,最多只加btw这类不额外引入上下文的辅助性插件,目前没有遇到不够用的场景,或者说真遇到棘手需求换其他agent一般也解决不了。
现在模型越来越强的基础上可以说就是工具类上下文越少整体智力和能力水平越高。
ds自己的测试报告也是工具越简单能力越强,能力表现最强的就是剔除一切工具只剩一个bash的mini-swe。
回复

使用道具 举报

     
发表于 2026-9-13 16:52 来自手机 | 显示全部楼层
魔法师lain 发表于 2026-9-13 16:42
可以换模型说继续啊

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99

换模型一样的,必须选auto,换成minimax m3然后积分唰唰往下掉,明明没用多少token。
回复

使用道具 举报

     
发表于 2026-9-13 16:54 | 显示全部楼层
4.1f是不是被调得不会说人话了,让4.1f做点调研,出来的报告让人感觉看不懂中文了
回复

使用道具 举报

     
发表于 2026-9-13 16:56 | 显示全部楼层
用k3感觉是有条不紊,稳扎稳打。用v4.1f感觉横冲直撞,脱缰野马
回复

使用道具 举报

发表于 2026-9-13 17:02 来自手机 | 显示全部楼层
本帖最后由 来都来了 于 2026-9-13 17:04 编辑

看到楼里吹Pi的人越来越多,我很欣慰没有用过Pi的人真的都应该用一用,它确实非常强大,而且非常高效省钱。

顺便一提,DS4.1已经很少大战PowerShell和GBK了,感觉在这一块应该是专门做了训练。
回复

使用道具 举报

发表于 2026-9-13 17:08 | 显示全部楼层
serj005 发表于 2026-9-13 16:51
我也是默认pi用到死,什么功能都不加,最多只加btw这类不额外引入上下文的辅助性插件,目前没有遇到不够 ...

新一代模型普遍在训练阶段就内化了大量约束,会本能的调用工具去验证自己的行为,这时候在老一代harness里就捉急了,注入的十几ktoken往往会坏事成为对抗性prompt把模型逼疯的,很多雷霆大思考就是这么来的
回复

使用道具 举报

     
发表于 2026-9-13 17:09 | 显示全部楼层
蓝色梦魇 发表于 2026-9-13 15:38
现在ds4.1flash,用DSH的话还有必要第一轮注入极简模式的提示词吗(用anchored-standard) ...

4.1F和模式没关系。
回复

使用道具 举报

发表于 2026-9-13 17:14 | 显示全部楼层
本帖最后由 mitzvah 于 2026-9-13 17:17 编辑
novalli 发表于 2026-9-13 16:26
感觉pi什么都不加已经够应对普通零碎要求了,想管理大型工程可以自己做些文档加以引导。
我到现在还是很不 ...

让模型自己grep很不可靠的,给他部署静态分析工具的mcp,让其基于静态分析工具的结果理解代码库
回复

使用道具 举报

     
发表于 2026-9-13 17:19 | 显示全部楼层
drodchang 发表于 2026-9-13 14:47
Adam Majmudar是openai的研究员,他的X发了篇帖子,解释为啥业内要降速了:
从外部来看,把过去两周发生的 ...

笑嘻了 plateau 到了没活了开始吹是监管了 LLM本身的极限 - 加上RL的极限 - LSTM的极限(we are here) 然后大崩盘之后还有的说 哎呀是监管怎么怎么样
回复

使用道具 举报

     
发表于 2026-9-13 17:24 来自手机 | 显示全部楼层
ds4.1现在还能破限么,用之前的提示词被她一秒识破了,完全不影响她的道德判断标准
回复

使用道具 举报

发表于 2026-9-13 17:32 来自手机 | 显示全部楼层
现在啥国模日译中翻译最好?性价比最高的呢?

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-9-13 17:43 | 显示全部楼层
魔法师lain 发表于 2026-9-13 17:32
现在啥国模日译中翻译最好?性价比最高的呢?

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99 ...

资源够就上gemma4,本地文字类任务的神,没好的gpu腾讯的hymt2或者sakura,cpu都能跑
回复

使用道具 举报

     
发表于 2026-9-13 17:51 来自手机 | 显示全部楼层
wuliang 发表于 2026-9-13 17:24
ds4.1现在还能破限么,用之前的提示词被她一秒识破了,完全不影响她的道德判断标准 ...

目前最好的破限方式仍然是酒馆预设,然后是 dsh 的破限模式的插件

—— 来自 HONOR PTP-AN70, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-13 17:57 | 显示全部楼层
魔法师lain 发表于 2026-9-13 17:32
现在啥国模日译中翻译最好?性价比最高的呢?

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99 ...

https://hf-mirror.com/alphaZimut ... APEX-GGUF/tree/main

速度暴打gemma4,质量比gemma4开思考都略高
回复

使用道具 举报

发表于 2026-9-13 19:13 来自手机 | 显示全部楼层
本帖最后由 魔法师lain 于 2026-9-13 19:16 编辑
qwased 发表于 2026-9-13 17:57
https://hf-mirror.com/alphaZimuth/Hy-MT2-30B-A3B-APEX-GGUF/tree/main

速度暴打gemma4,质量比gemma4 ...

问的是不是本地跑的啦,接云端api和key直接跑的。偶只有个魔改a3000,不能装新驱动,才12g显存。

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-13 19:16 | 显示全部楼层
魔法师lain 发表于 2026-9-13 16:42
可以换模型说继续啊

—— 来自 HUAWEI ALT-AL10, Android 12, 鹅球 v3.5.99

敲定了两天的细节开始执行十几分钟后直接中断,确实可以换auto继续,但自动换的minimax在压缩对话后又问了我一堆问题,气得我一点都不想看让它直接动手不要再问了,虽然文档做得多,但做出来的肯定和我想的不一样了。所以现在下载qoder了
回复

使用道具 举报

     
发表于 2026-9-13 19:20 | 显示全部楼层
想用藤子的积分可以用codebuddy
回复

使用道具 举报

     
发表于 2026-9-13 19:24 | 显示全部楼层
魔法师lain 发表于 2026-9-13 19:13
问的是不是本地跑的啦,接云端api和key直接跑的。偶只有个魔改a3000,不能装新驱动,才12g显存。

——  ...

口水网文哈基米比较好,认梗能力强
句子比较复杂的正经书籍还是gpt吧,flash级的模型容易误解
回复

使用道具 举报

     
发表于 2026-9-13 19:37 | 显示全部楼层
偶然看到有个脏token测试意外让gpt吐出思维链的,也全是I need but wait actually谁蒸的谁
回复

使用道具 举报

     
发表于 2026-9-13 19:40 | 显示全部楼层
qoder初体验之让它看了一下文档它也回答完成后发送键就一直转圈无法再继续对话
回复

使用道具 举报

     
发表于 2026-9-13 20:30 来自手机 | 显示全部楼层
mitzvah 发表于 2026-9-13 17:14
让模型自己grep很不可靠的,给他部署静态分析工具的mcp,让其基于静态分析工具的结果理解代码库 ...

这个确实。之前用一个差一点的模型处理一个数据.c,里面一堆名字类似的数组,每次都找到类似的第一个数组就不找了,必须要强调完全一致的变量名才行,然后隔不多久又忘了。。。

—— 来自 Xiaomi 25042PN24C, Android 16, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-9-13 20:33 | 显示全部楼层
本帖最后由 noneoneone 于 2026-9-13 20:38 编辑

用了两天mimo。
感想是其他大模型还只是向不说人话的状态发展,mimo已经更进一步,处于不懂人话的状态了。
而且不只是flash,pro也是神人思路。
回复

使用道具 举报

     
发表于 2026-9-13 20:45 | 显示全部楼层
noneoneone 发表于 2026-9-13 20:33
用了两天mimo。
感想是其他大模型还只是向不说人话的状态发展,mimo已经更进一步,处于不懂人话的状态了。
...

2.5还是X呢
2.5我感觉只要提示词够明确,它还是能干点活的,就是不会主动测试,适合做子代理
回复

使用道具 举报

     
发表于 2026-9-13 20:46 | 显示全部楼层
drodchang 发表于 2026-9-13 14:47
Adam Majmudar是openai的研究员,他的X发了篇帖子,解释为啥业内要降速了:
从外部来看,把过去两周发生的 ...

主要是安全加固很容易影响正常使用且要大量人工介入

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-13 20:47 来自手机 | 显示全部楼层
dario昨天发言连马斯克奥特曼谷歌都附和了,不知道葫芦里卖什么药

还传ds非正式的表示认可

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-13 21:07 | 显示全部楼层
tonyunreal 发表于 2026-9-13 20:45
2.5还是X呢
2.5我感觉只要提示词够明确,它还是能干点活的,就是不会主动测试,适合做子代理 ...

X,也不是说不能干活,就是经常用奇异的思路理解我的指令,然后又用摆烂的方式实现我的要求。
有一种向猴爪许愿的感觉。
回复

使用道具 举报

     
发表于 2026-9-13 21:26 来自手机 | 显示全部楼层
noneoneone 发表于 2026-9-13 21:07
X,也不是说不能干活,就是经常用奇异的思路理解我的指令,然后又用摆烂的方式实现我的要求。
有一种向猴 ...

x系列应该是炼失败了吧
看用过的人就没有说好话的……

—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-13 21:29 来自手机 | 显示全部楼层
llm是语言模型,而编程语言是人工造出来的规则语言,llm在编程和找人类编程里的漏洞上强过人类也没什么奇怪的
回复

使用道具 举报

发表于 2026-9-13 21:41 来自手机 | 显示全部楼层
lactone 发表于 2026-9-13 20:47
dario昨天发言连马斯克奥特曼谷歌都附和了,不知道葫芦里卖什么药

还传ds非正式的表示认可

大概率是中美会前虚空造牌吧,现在的状态离全球经济危机不太远了,想空间换时间多拖一阵。
回复

使用道具 举报

     
发表于 2026-9-13 21:53 | 显示全部楼层
qoder只送300积分,deepseekflash几下子就用了一百了,有点不经用啊,它也没个签到领积分。话说它60块的和别家的比咋样啊,楼里也没怎么见说这个qoder的
回复

使用道具 举报

     
发表于 2026-9-13 21:56 | 显示全部楼层
不就是加息预期高涨,然后美国AI公司要爆炸吗?
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 10:14 , Processed in 0.200130 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表