找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-17 10:36 | 显示全部楼层
沙发沙发 发表于 2026-9-17 09:41
不是,小米这模型现在才后训练,那之前测的那一坨又是啥

挽尊的说法,所有模型都必须有后训练才能用,只不过质量差异而已
回复

使用道具 举报

     
发表于 2026-9-17 11:11 | 显示全部楼层
感谢罗圣开源

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×

评分

参与人数 1战斗力 -2 收起 理由
空き地卯木 -2 higo滚

查看全部评分

回复

使用道具 举报

发表于 2026-9-17 11:16 | 显示全部楼层
永远要跟在别人身后去踩两脚最新最热的国产货, 是我熟悉的猴山作风
回复

使用道具 举报

     
发表于 2026-9-17 11:17 | 显示全部楼层
andychen 发表于 2026-9-17 02:08
codex工具的自带的上下文压缩有问题,压缩完以后要让会话手动重载一次记忆 ...

我遇到的问题应该和压缩无关(由于速度问题,宣称的百万上下文填满要很久),有些会话从初始状态就表现得很“懒惰”而且按照待办事项自动化实验汇报进度时表述异常简陋模糊;
根据你的提示搜issue和OAI论坛的时候,意外发现我这情况好像还不是孤例,不清楚到底啥毛病,还是Astra确实不适合我需求的这类工作
回复

使用道具 举报

     
发表于 2026-9-17 11:21 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-17 11:29 编辑
飛霞精灵 发表于 2026-9-17 11:16
永远要跟在别人身后去踩两脚最新最热的国产货, 是我熟悉的猴山作风

mimo2.5就这样,结果拉得一比,新模型前几天又不是没试过,还是拉
回复

使用道具 举报

     
发表于 2026-9-17 11:24 | 显示全部楼层
agentrouter一直报错是我的问题吗
回复

使用道具 举报

     
发表于 2026-9-17 11:30 | 显示全部楼层
4.1F不知道什么时候发新的checkpoint,现在有一种感觉这个模型也是很匆忙端上来的,有些问题是V4预览版就有的
回复

使用道具 举报

     
发表于 2026-9-17 11:31 来自手机 | 显示全部楼层

纯属放屁,群里测试mimo x一坨
回复

使用道具 举报

     
发表于 2026-9-17 11:35 | 显示全部楼层

不敢说超越,只敢说平替。那大概率是不如的
回复

使用道具 举报

     
发表于 2026-9-17 11:44 来自手机 | 显示全部楼层
mimo又不是第一次了,多数模型都走过送鸡蛋,没鸡蛋,克扣鸡蛋的路。mimo迭了几代目前还在第一步
回复

使用道具 举报

     
发表于 2026-9-17 11:49 | 显示全部楼层
mino连731都打不过把
回复

使用道具 举报

     
发表于 2026-9-17 11:50 | 显示全部楼层
那 jev 重构了我自己的 pi tool 审查 插件
用起来非常不错 速度快 也拦住不安全的 bash 命令
再也不怕被删库了

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-17 11:51 | 显示全部楼层
Union Alpha你们都是哪个平台的
我用的opencode
上下文太小了导致简单的review都没法做
使用体验极差

Re:Source
回复

使用道具 举报

     
发表于 2026-9-17 11:54 来自手机 | 显示全部楼层
华子官宣960系列提前原定时间半年发布,就是不知道产能问题能解决多少,不知道国产duv对算力卡产能有多少贡献

——来自  HUAWEI Pura X View OpenHarmony-7.0.0.105(26) 上的 S1 Orange 1.4.4
回复

使用道具 举报

     
发表于 2026-9-17 11:54 | 显示全部楼层
gpt是不是只给中文区降智啊
回复

使用道具 举报

     
发表于 2026-9-17 12:51 | 显示全部楼层


- 昇腾960DT 提前至2027Q1上市
- 昇腾960PR 提前至2027Q3上市
- Atlas 960 风冷超节点 2027Q2上市
- Atlas 960 液冷超节点 2027Q3上市


梁子:ntmd...

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-17 13:07 | 显示全部楼层
平贺才人 发表于 2026-9-17 12:51
- 昇腾960DT 提前至2027Q1上市
- 昇腾960PR 提前至2027Q3上市
- Atlas 960 风冷超节点 2027Q2上市

AI芯片真赚钱,难怪华子车都不想造
回复

使用道具 举报

     
发表于 2026-9-17 13:27 | 显示全部楼层
saintsimpler 发表于 2026-9-17 11:54
华子官宣960系列提前原定时间半年发布,就是不知道产能问题能解决多少,不知道国产duv对算力卡产能有多少贡 ...

我的看法是真实时间表没有提前,只是本来计划的纯内部试用阶段就开放外部企业使用。
回复

使用道具 举报

     
发表于 2026-9-17 13:37 | 显示全部楼层
现在4.1f的破甲难度是不是高了很多啊
回复

使用道具 举报

     
发表于 2026-9-17 14:01 | 显示全部楼层
干苦力活只要返回结果和说明的场合都能明显看出来41f越来越不说人话(越来越像gpt),写文的不要用了
回复

使用道具 举报

     
发表于 2026-9-17 14:17 | 显示全部楼层
4.1flash无论是token消耗还是不说人话方面都在向SOTA模型靠拢,唯一的优势就是成本了
回复

使用道具 举报

     
发表于 2026-9-17 14:25 来自手机 | 显示全部楼层
英文输出其实还行(或者是我看不出来),中文输出全是黑话,看得脑壳痛

—— 来自 Google Pixel 7 Pro, Android 15, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-17 14:29 来自手机 | 显示全部楼层
41f拿来改文其实还行
回复

使用道具 举报

     
发表于 2026-9-17 14:30 | 显示全部楼层
Cloude_L 发表于 2026-9-17 14:01
干苦力活只要返回结果和说明的场合都能明显看出来41f越来越不说人话(越来越像gpt),写文的不要用了 ...

gpt那套特色文法是越看越恶心现在一堆洗稿ai号也是这个恶心的不讲人话味了,github上的国产vibe软件更新日志全都没眼看,又费眼又费脑

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-17 14:36 | 显示全部楼层
Pi v2现在能看到代码了,有兴趣的可以去github上pico分支看看,变化非常大,可以问问Copilot有什么变化。

新的插件架构看上去有受一点Cordis启发,但是比Cordis约束更强,结构也更清晰。现在还不清楚是和extension并存还是直接替换,因为写起来更麻烦了,还是希望有些小功能可以像extension那样简单做。

另外还引入了SQLite做session存储,但也没有替换现在JSONL的迹象,整体看来是往长时间稳定运行的方向去的。
回复

使用道具 举报

     
发表于 2026-9-17 15:21 来自手机 | 显示全部楼层
astra实在太不经用了,一周用完了这个月60%的credit恐怖如斯

—— 来自 OPPO PKU110, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-17 15:32 | 显示全部楼层
试了下dsh的computer use,模型4.1f,准确率还是低了    Re:Source
回复

使用道具 举报

发表于 2026-9-17 15:41 | 显示全部楼层
serj005 发表于 2026-9-17 14:30
gpt那套特色文法是越看越恶心现在一堆洗稿ai号也是这个恶心的不讲人话味了,github上的国产vibe软件更新 ...

上下文太长了吧,模型注意力被分散了以后就容易说这种词不达意的话
回复

使用道具 举报

     
发表于 2026-9-17 15:42 | 显示全部楼层
love4aids 发表于 2026-9-17 13:37
现在4.1f的破甲难度是不是高了很多啊

除了铜矿和强迫,其他的尺度再大都没问题.问题是写出来的文根本没眼看
回复

使用道具 举报

     
发表于 2026-9-17 15:51 来自手机 | 显示全部楼层
未知伤亡 发表于 2026-9-17 15:41
上下文太长了吧,模型注意力被分散了以后就容易说这种词不达意的话

不完全是词不达意,gpt现在的中文就是经常用一些莫名其妙的单字动词还有乱打比喻来描述它做的工作还要记录日志,然后逻辑又很跳跃,不用塞多少上下文,单纯直出一个日志很大概率就已经是这种文本风格了。
现在最大的问题是这种风格开始扩散,越来越多的模型都开始这样不讲人话。
回复

使用道具 举报

     
发表于 2026-9-17 16:04 | 显示全部楼层
说明万亿参数量也只能编程特化,AGI的路还长的很呢
回复

使用道具 举报

     
发表于 2026-9-17 16:06 来自手机 | 显示全部楼层
Mirathel 发表于 2026-9-17 11:17
我遇到的问题应该和压缩无关(由于速度问题,宣称的百万上下文填满要很久),有些会话从初始状态就表现得 ...

试试在提示词上进行更详细的目标描述

这半年新训练的模型都优化了指令遵守,所以模糊提示词下的性能不好。但上下文窗口和思维链特性又导致过多的规则要求同样会导致性能下降,也就是说现在对提示词质量的要求比以前更高,要在相对有限的空间内给出明确的指令

现在各家模型厂开始卷harness就是这个原因
回复

使用道具 举报

     
发表于 2026-9-17 16:20 来自手机 | 显示全部楼层
处男鉴黄师 发表于 2026-9-17 08:52
试过了,大概两年前suno水平

那minimax music3作为DiT模型连两年前的suno都不如吗,有点拉了...反正YuE2我随便玩了玩感觉效果能接受了

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-17 16:22 | 显示全部楼层
hugosol 发表于 2026-9-17 14:17
4.1flash无论是token消耗还是不说人话方面都在向SOTA模型靠拢,唯一的优势就是成本了 ...

上下文长度的问题,上下文长度超过50%,输出的中文就开始有点问题了
大于70%就开始说胡话, 如果保持在 10-40%基本还是很正常的。
回复

使用道具 举报

     
发表于 2026-9-17 16:22 | 显示全部楼层
4.1f写文完全没法用,大概也是pro回归的重要原因,等下版本吧
回复

使用道具 举报

     
发表于 2026-9-17 16:32 | 显示全部楼层
这个不回人话(包括代码也不写人能看的代码)的趋势非常明显,因为训练中有对 token 效率的追求,所以最终的结果是,只要 agent 能懂这个代码就行,同时为了 token 效率,代码需要越短越好。GPT 系列这点非常非常明显
回复

使用道具 举报

     
发表于 2026-9-17 16:32 | 显示全部楼层
有什么免费的英语配音可以用么?有个视频需要配英语旁白,现在用edge-tts,勉强能用。gemini 3.1 flash tts效果很好,不过有每日限额。
回复

使用道具 举报

发表于 2026-9-17 16:38 | 显示全部楼层
lilod 发表于 2026-9-17 16:32
这个不回人话(包括代码也不写人能看的代码)的趋势非常明显,因为训练中有对 token 效率的追求,所以最终 ...

有一个很有名的skill叫caveman,就是让模型用原始人一样的最简单词汇思考和输出,可以非常有效的压缩token使用量。对于写代码这是好事,对写作就是灾难了
回复

使用道具 举报

     
发表于 2026-9-17 16:38 | 显示全部楼层
之前不是还有个omen alpha吗?感觉一点波澜都没有,牛来真是天时地利,而且5.3f本身也有实力。

顺带一下,忘记miboy4月份疯狂碰瓷ds v4的事情了吗
回复

使用道具 举报

     
发表于 2026-9-17 17:12 | 显示全部楼层
提示词很重要,某脑有个测试预设4.1f写出来的文和哈基米差不多惊艳

论坛助手,iPhone
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 08:46 , Processed in 0.218412 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表