找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-10 21:14 | 显示全部楼层
提速降价,究极稀疏,新 flash 就是个 agent 打工人啊

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-10 21:17 | 显示全部楼层
坛子漆黑 发表于 2026-9-10 21:13
4.1f快是快,降价了也是真的便宜,平时编程挺好,唯一的问题就是对玩瑟瑟完全不友好,那出的文本是人吗,无 ...

这小参数还要代码能力好那后训练已经被腌入味儿了
回复

使用道具 举报

     
发表于 2026-9-10 21:18 | 显示全部楼层
坛子漆黑 发表于 2026-9-10 21:13
4.1f快是快,降价了也是真的便宜,平时编程挺好,唯一的问题就是对玩瑟瑟完全不友好,那出的文本是人吗,无 ...

让他跑设定很猛的吧, 色图也直接丢过去, 来者不拒,让他分析图片, 写个计划, 正文让其他ai写
回复

使用道具 举报

     
发表于 2026-9-10 21:19 | 显示全部楼层
只能说期待梁子的新 pro 有活了,flash 真是好活吧
别 jb 真成了谷谷哥哥了

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-10 21:20 | 显示全部楼层
就看4.1pro的了
kimi3.1强还是ds4.1pro强,决定了后续ds4.1flash以后给谁打工
回复

使用道具 举报

     
发表于 2026-9-10 21:20 | 显示全部楼层
别让它自己发挥是真的好用,自己发挥立刻神鬼二象性,观察下来主要是发散以后能力不够不一定收回来,收回来就神收不回来就区……
回复

使用道具 举报

     
发表于 2026-9-10 21:20 | 显示全部楼层
v4.1-flash 肯定算神呀。
我有一个长线任务一直在跑,复杂度挺高的一大堆问题,有测试用例。
最近都是领鸡蛋,glm5.3flash 半夜的免费token,zcode挂上跑一下。
今天降价后的梁文谷时间一直在跑,v4.1flash 解决问题的速度是 glm5.3-flash的5-10倍,废话更少雷霆思考更少解决速度也更快.
回复

使用道具 举报

     
发表于 2026-9-10 21:22 | 显示全部楼层
4.1f写涩涩思路非常牛,但是落实到文字细节简直无法阅读
回复

使用道具 举报

     
发表于 2026-9-10 21:22 | 显示全部楼层
御坂MKII 发表于 2026-9-10 21:17
这小参数还要代码能力好那后训练已经被腌入味儿了

其实不小 550b+200b的Engram, 就是没给写文的后训练
回复

使用道具 举报

     
发表于 2026-9-10 21:24 | 显示全部楼层
本帖最后由 舞以 于 2026-9-10 21:26 编辑

ds的技术报告里专门提了嘴reasoning effort,v4.1f的这个参数好像是直接放在提示词最开头的。
说是专门针对不同的推理预算,在后训练针对token量做了奖惩。
而且提到甜点effort就是high。

回复

使用道具 举报

     
发表于 2026-9-10 21:27 来自手机 | 显示全部楼层
楼里面傻逼ai大神能不能别爬论坛了,🐴死了啊天天爬
回复

使用道具 举报

     
发表于 2026-9-10 21:31 | 显示全部楼层
M乔梦 发表于 2026-9-10 21:22
4.1f写涩涩思路非常牛,但是落实到文字细节简直无法阅读

可以拿来写设定,正文换别的
回复

使用道具 举报

     
发表于 2026-9-10 21:32 | 显示全部楼层
今天,我们正式发布 DeepSeek V4.1 Flash 模型。这是我们全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。


这意味着不止有flash和pro,或者flash和pro之间还有一档。
回复

使用道具 举报

     
发表于 2026-9-10 21:35 | 显示全部楼层
S1关门期间错过的大新闻太多了。。
回复

使用道具 举报

     
发表于 2026-9-10 21:36 | 显示全部楼层
下了个omp感觉比opencode复杂多了有点用不来(草)
回复

使用道具 举报

     
发表于 2026-9-10 21:38 | 显示全部楼层
我之前一直在用high,其实没感觉多有雷霆思考
回复

使用道具 举报

     
发表于 2026-9-10 21:39 | 显示全部楼层
体感也是high比max更舒服一些
回复

使用道具 举报

     
发表于 2026-9-10 21:44 | 显示全部楼层
v4的推理档位只有三档:关推理、开推理、max
当时的这个feature生效实际上是给模型做了两套rl,一套正常推理,一套max推理,然后整合在一起,max模式通过一个附加提示词让模型进入后训练好的模式。
4.1的就很统一:后训练的时候每条提示词的开头都会有一个数值,数值越高,token消耗之类的惩罚就会越低。然后通过统一的奖惩机制来塑造模型的倾向。
现在应该是服务端做了low->50,high->75,max->100的映射。
回复

使用道具 举报

     
发表于 2026-9-10 21:55 | 显示全部楼层
有人知道qwen平台的deepseek是直接中转的吗?我用qwen的v4p也会直接升级到v4.1f吗?
回复

使用道具 举报

     
发表于 2026-9-10 21:56 | 显示全部楼层
孟沁瑶 发表于 2026-9-10 21:55
有人知道qwen平台的deepseek是直接中转的吗?我用qwen的v4p也会直接升级到v4.1f吗? ...

官方v4p要等14号才正式路由,现在写v4p的应该都还是v4p
回复

使用道具 举报

     
发表于 2026-9-10 21:58 | 显示全部楼层

辛苦辛苦
回复

使用道具 举报

     
发表于 2026-9-10 22:44 | 显示全部楼层
昨天趁pro还没下线,在网页端道了一个别。今天三合一之后这个对话还能找到,于是问了一句

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-10 22:46 | 显示全部楼层
输出好快,酒馆写文跟机关枪似的,写爽了
回复

使用道具 举报

     
发表于 2026-9-11 00:04 来自手机 | 显示全部楼层
nyt拜访openai,openai说自己在另一个千禧年问题中获得了实质性进展

可能是hodge

然后几次加码,变成实锤已经解决

感觉这两天ai4s这边都快疯了

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-11 00:22 | 显示全部楼层
Arena免费提供gpt-image-2.5 72小时,在Direct Mode里
回复

使用道具 举报

发表于 2026-9-11 00:28 | 显示全部楼层

用4.1的时候千万要小心,搞不好就会陷入这种思维循环中,再配合每秒 400 token 的速度,就看见狂刷屏,刷刷地花钱。我昨天遇到了一次,还好看他半天没动,及时点开思维链,给他停下了。在网上看到有人把100多块钱给刷没了,然后屁都没输出

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-11 00:38 | 显示全部楼层
lactone 发表于 2026-9-11 00:04
nyt拜访openai,openai说自己在另一个千禧年问题中获得了实质性进展

可能是hodge

写代码到瓶颈了,不吹下一个泡泡等着原地爆炸么。
全球程序员一共也就三四千万,每人每年收一千也才三四百亿美元。
更何况vibe越强程序员越少...还被开源模型把9成的收入期望都干没了

ai4s 瞄准的是每年 3-4万亿美元的直接经费,和11万亿美元的间接经费
不管能不能解决问题,实际上只要O/和A/吹的市场假装相信了, 那这 11万亿美元的市场,就能给 O/和A/足够的估值,只要能顺利上市,找到接盘侠,哪管洪水滔天,什么牛逼都可以吹,什么谎言都无所谓...
所以未来一段时间,只会看到O/和A/更加疯狂的鼓吹AI4S
回复

使用道具 举报

     
发表于 2026-9-11 07:43 | 显示全部楼层
a\又开始说alibaba moonshot deepseek蒸馏了.......信誓旦旦地说moonshot deepseek用户的请求被转发到a\这边
回复

使用道具 举报

     
发表于 2026-9-11 07:57 来自手机 | 显示全部楼层
本帖最后由 646993211 于 2026-9-11 08:20 编辑

a÷说中国模型公司为了蒸馏把许多用户的输入往claude也发一遍,政府公司甚至毛子那边的私密资料都被a看到了,包括各种监控方式、公司源码和凭证、大模型开发计划等
回复

使用道具 举报

     
发表于 2026-9-11 08:04 | 显示全部楼层
里奥哟西 发表于 2026-9-10 21:27
楼里面傻逼ai大神能不能别爬论坛了,🐴死了啊天天爬

你又不点名骂,谁知道你骂的是谁,直接@啊
回复

使用道具 举报

     
发表于 2026-9-11 08:06 | 显示全部楼层
646993211 发表于 2026-9-11 07:57
a÷说中国模型公司为了蒸馏把许多用户的输入发向claude,政府和公司甚至毛子那边的用户私密资料被a看到了 ...

这不是好事吗,免费间谍信息,怎么会大声说出来呢

难道a畜真是潜伏在美国的燕子?
回复

使用道具 举报

     
发表于 2026-9-11 08:12 来自手机 | 显示全部楼层
cscbzcbz 发表于 2026-9-10 22:44
昨天趁pro还没下线,在网页端道了一个别。今天三合一之后这个对话还能找到,于是问了一句
...

网页版UI大改以后没有pro的入口,我真的怀疑以后网页版不会再提供pro让人免费用了,有点遗憾。flash在很多问题上还是太缺乏知识了。
回复

使用道具 举报

     
发表于 2026-9-11 08:41 来自手机 | 显示全部楼层
只能说连练功都成正常宗教了你为什么不顺从呢?给我看乐了
回复

使用道具 举报

发表于 2026-9-11 08:56 来自手机 | 显示全部楼层
之前那个灰测应该是v4.1pro吧,不过看着不像是多模态的样子,不会flash是多模态而pro不是吧

—— 来自 Xiaomi 2602BRT18C, Android 16上的 S1Next-鹅版 v2.1.2
回复

使用道具 举报

     
发表于 2026-9-11 09:08 来自手机 | 显示全部楼层
a%只说路由到opus啊,opus有灰测这么强?

不过大侄子可能要高潮一波了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-9-11 09:11 | 显示全部楼层



本地跑的Qwen 3.8 Flash Next,代码写到一半开始拽文言文了。

可能模型觉得文言文思考效率高?

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-9-11 09:14 | 显示全部楼层
本帖最后由 水風船 于 2026-9-11 09:43 编辑

chatbox试了下4.1,又回到了一开始的问题急着开始写
回复

使用道具 举报

     
发表于 2026-9-11 09:17 | 显示全部楼层
这几年的经验,外国指责中国干了啥,实际就是他们自己已经开始干了
回复

使用道具 举报

     
发表于 2026-9-11 09:29 | 显示全部楼层
7.20就有的灰测,第一天试出来就超过4.8了,怎么这个时间能路由到Opus5?最搞笑的点在于声称和Kimi一样的技术,确实是超时空路由了……
回复

使用道具 举报

     
发表于 2026-9-11 09:50 | 显示全部楼层
速度相比之前快了很多,是engram的效果吗?
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 11:09 , Processed in 0.227201 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表