找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-22 13:09 来自手机 | 显示全部楼层
目前这俩参数应该都是没挂engram的,所以可能4.1p是2+1t,巨模8+2t还有就是疑似有型的大手发力给梁子刷新华子的卡了
回复

使用道具 举报

     
发表于 2026-9-22 13:10 来自手机 | 显示全部楼层
提示,信源是今年以来对ds消息没对过的Information。原文中有非常明显的常识性错误,把v4pro写成1.4t。但是总体上我倒觉得不管是不是真消息,看起来都挺像回事的。今天千问实际上证实了华为发布昇腾新路线图时吹的国模明年都将迈入10t时代的饼。Deepseek肯定是也在准备10t级的,但是我觉得实际上这一次肯定还是英伟达卡练,外媒原文是在说ds准备用昇腾训练卡,可信度不高。
回复

使用道具 举报

     
发表于 2026-9-22 13:13 来自手机 | 显示全部楼层
还是那句话,目前的架构里10T模型只有DS能稳定运营还用得起…
回复

使用道具 举报

发表于 2026-9-22 13:13 | 显示全部楼层
我灰测模型呢,从7月中旬首次灰测到现在俩月了,最近也没再次灰测,是在最后调整吗能不能在中秋前放出来啊
回复

使用道具 举报

     
发表于 2026-9-22 13:14 来自手机 | 显示全部楼层
4.1感觉很啰嗦,不适合归纳总结

据说step 5是国模里最省token的

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-22 13:15 | 显示全部楼层
发现openrouter好像有个300秒的硬限制,现在国模都喜欢长考,非Flash的很容易思考阶段就给断了……
回复

使用道具 举报

     
发表于 2026-9-22 13:17 来自手机 | 显示全部楼层
lactone 发表于 2026-9-22 13:14
4.1感觉很啰嗦,不适合归纳总结

据说step 5是国模里最省token的

这个是纯大份模型,完全不可用
回复

使用道具 举报

     
发表于 2026-9-22 13:33 来自手机 | 显示全部楼层
qwased 发表于 2026-9-22 13:17
这个是纯大份模型,完全不可用

作为免费一个月的鸡蛋没那么差,而且今天真加算力了,能跑100多tps,跑起来至少是有v4f0731水平的。
回复

使用道具 举报

     
发表于 2026-9-22 14:03 来自手机 | 显示全部楼层
这周luna要发,不知道能到什么水平

如果能到k3水平,那压力会挺大

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-22 14:05 来自手机 | 显示全部楼层
大野蛮时代,什么水平都是自己说了算,毕竟所有跑分都已经是野榜。
回复

使用道具 举报

发表于 2026-9-22 14:18 来自手机 | 显示全部楼层
profr 发表于 2026-9-22 08:27
【Grok 4.7:看完前端表现,只能寄希望于后端能力了......AI 前端能力全面测试】https://www.bilibili.com/ ...

grok本身的优势区间就是后端。在屎山论剑里,grok的成绩一直不错。
回复

使用道具 举报

     
发表于 2026-9-22 14:22 来自手机 | 显示全部楼层
🐒模不是我嘲讽哦,每次都是拉踩吹嘘怎么样,实际上每次都是一坨

评分

参与人数 2战斗力 +3 收起 理由
空き地卯木 + 1 华子没大搞llm算是行业幸事
darktide + 2 同意

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-22 14:25 | 显示全部楼层
居于月上伊莫库 发表于 2026-9-22 09:55
已领感谢。
接龙:
快来助我领鸡蛋 TierFlow 全新系统上线,新用户注册就送30元额度,好友通过您的链接完 ...

一直显示这个 已达到该类型验证码的每日发送上限 这是怎么回事?
回复

使用道具 举报

     
发表于 2026-9-22 14:29 | 显示全部楼层
这个AA榜原来就有点不行了,为了Astra改了一下彻底爆炸,这些模型比V4.1F好用的不超过五个,但是跑分个个都高。
回复

使用道具 举报

     
发表于 2026-9-22 14:30 来自手机 | 显示全部楼层
智谱股价在昨日下午和今早疯狂拉升后终于开始大跌
在弱智整改和假开源后
未来不可能有任何公司敢用zcode
一个上市公司把危机公关当幼儿园作业在做
B2B之路走不通,恐怕靠个人使用者不可能撑得起这几千亿市值
回复

使用道具 举报

     
发表于 2026-9-22 14:35 | 显示全部楼层
gpt是不是要发重置券了
回复

使用道具 举报

     
发表于 2026-9-22 14:37 来自手机 | 显示全部楼层
梁叔叔会去做空智谱吗
回复

使用道具 举报

     
发表于 2026-9-22 14:39 来自手机 | 显示全部楼层
本帖最后由 neptunehs 于 2026-9-22 14:41 编辑

榜目前我只认屎山论剑
但就米家对各种手机评测者的对待方式
我甚至怀疑屎山有没必要去测他家

当然如果能测的话赶紧测 我想看结果
能跟glm跟qwen两flash一样能解决白银bug 我就当主力用了

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-22 14:43 | 显示全部楼层
看了下公司的统计,截止目前我在工作中用了8亿的4.1f,截图在内网就不贴出来了。
绝大部分都是日常工作,写自动化脚本,运维linux,在我指挥下的中等难度的编程。
感觉第一快是真的爽,很多任务几分钟就搞完完爆别的的要十几二十分钟的。第二能力不错,工具调用,识图都还可以。智力体感确实比之前的flash高一点,但是上限还是没有pro高。
不过也有不少问题,最主要就是上下文超过400k之后,会唱歌,工具调用的格式会乱总之有很严重的问题。第二个就是有点想gpt那样不说人话,头疼的很,文本的语法质量直线下降
回复

使用道具 举报

     
发表于 2026-9-22 14:45 | 显示全部楼层
4.1flash还有一个问题是写脚本时的超时喜欢给到300秒,遇到错误时就会效率很低,要告诉他超时设置低一点
回复

使用道具 举报

     
发表于 2026-9-22 14:48 来自手机 | 显示全部楼层
还是需要4.1p的规划快端上来吧
回复

使用道具 举报

     
发表于 2026-9-22 14:52 | 显示全部楼层
本帖最后由 Hattle 于 2026-9-22 14:53 编辑

DSH 发了 v0.1.7-alpha.1 了
又修复了一堆的东西,
重磅更新:支持语音输入了!
回复

使用道具 举报

     
发表于 2026-9-22 14:53 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-22 14:56 编辑

V4.1F用一个体量更大模型指挥是最好的方式,单独用就体现出后训练还不够的问题了
回复

使用道具 举报

     
发表于 2026-9-22 14:59 | 显示全部楼层
我在codex里开mcp用astra6指挥deepseek,又快又便宜
回复

使用道具 举报

     
发表于 2026-9-22 15:09 来自手机 | 显示全部楼层
Hattle 发表于 2026-9-22 14:52
DSH 发了 v0.1.7-alpha.1 了
又修复了一堆的东西,
重磅更新:支持语音输入了!

现在dsh算是半边迈入成熟产品的状态了,这版本之后会话管理更完善了
回复

使用道具 举报

     
发表于 2026-9-22 15:21 来自手机 | 显示全部楼层
之前他的回复看着像重置卡,现在不好说。
回复

使用道具 举报

发表于 2026-9-22 15:22 来自手机 | 显示全部楼层
crow_wine 发表于 2026-9-22 14:43
看了下公司的统计,截止目前我在工作中用了8亿的4.1f,截图在内网就不贴出来了。
绝大部分都是日常工作,写 ...

为啥不限制下上下文,模型支持1M又不是一定必须用1M,把上下文改成256k或300k

编程里1m上下文毛用没有,后期模型一回合调用一次工具,token用量直接起飞。

回复

使用道具 举报

     
发表于 2026-9-22 15:27 | 显示全部楼层
我现在有点担心pro 4.1也是这种不说人话的风格……
回复

使用道具 举报

     
发表于 2026-9-22 15:37 | 显示全部楼层

nao 榜:Mimo V2.6 pro和flash,最大支持128k输出,但目前推理测试会有59%超过最大长度,无法计分,最终分数也不可靠,所以不会开分。coding正常测。
回复

使用道具 举报

     
发表于 2026-9-22 15:40 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-22 15:41 编辑
小野賢章 发表于 2026-9-22 15:37
nao 榜:Mimo V2.6 pro和flash,最大支持128k输出,但目前推理测试会有59%超过最大长度,无法计分,最终分 ...

这个上下文,配合MUFC测试里只有32K能保持注意力,只能说不好说……
回复

使用道具 举报

发表于 2026-9-22 15:44 | 显示全部楼层
Hattle 发表于 2026-9-22 14:52
DSH 发了 v0.1.7-alpha.1 了
又修复了一堆的东西,
重磅更新:支持语音输入了!

最新版dsh0.17 用dsv4.1还是默认自己不是识图模型啊,怎么搞 ??model "deepseek-flash" does not declare image input; switch to an image-capable model to read images
回复

使用道具 举报

     
发表于 2026-9-22 15:46 来自手机 | 显示全部楼层
本来luna或者sol说的是上周发,然后推到这个周,那么怎么说周二发也不奇怪

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-22 15:48 | 显示全部楼层
本帖最后由 80后卢瑟 于 2026-9-22 15:49 编辑
小野賢章 发表于 2026-9-22 15:37
nao 榜:Mimo V2.6 pro和flash,最大支持128k输出,但目前推理测试会有59%超过最大长度,无法计分,最终分 ...

不说别的,就这个雷霆大思考...

思考了十几分钟连个屁都没,可以评价为练歪了

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-22 15:48 来自手机 | 显示全部楼层
zack1999 发表于 2026-9-22 15:44
最新版dsh0.17 用dsv4.1还是默认自己不是识图模型啊,怎么搞 ??model "deepseek-flash" does not decla ...

这个配置是在YAML里面的吧,可以让她自己修
当然也可以直接获取一下最新模型试试,获取完也有可能本地的YAML自己修好了
回复

使用道具 举报

     
发表于 2026-9-22 15:49 来自手机 | 显示全部楼层
阿里巴巴说下一步准备训练10t模型,ds也据传下一步准备训练10t。算力问题看来得到了某种程度的解决
回复

使用道具 举报

     
发表于 2026-9-22 15:50 | 显示全部楼层
zack1999 发表于 2026-9-22 15:44
最新版dsh0.17 用dsv4.1还是默认自己不是识图模型啊,怎么搞 ??model "deepseek-flash" does not decla ...

模型配置里,把输入类型勾选一下图片

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-9-22 15:52 | 显示全部楼层
Hattle 发表于 2026-9-22 15:50
模型配置里,把输入类型勾选一下图片

可以了!谢谢!不知道这里还能编辑
回复

使用道具 举报

     
发表于 2026-9-22 15:53 | 显示全部楼层
spaceblue 发表于 2026-9-22 14:59
我在codex里开mcp用astra6指挥deepseek,又快又便宜

都塞进codex还是和DSH互联?
回复

使用道具 举报

     
发表于 2026-9-22 15:57 | 显示全部楼层
让dsh看了一下最近几个版本的更新,看到这两个
DeepSeek 账号登录 + Platform 页面(desktop/credentials/client),独立显示赠送额度、显示 profile 头像;credentials 可配置 inference origin 并丢弃不匹配的授权。
Computer use(Cua Driver 两种 provider)、Browser use(Stagehand / Playwright MCP / Chrome DevTools MCP 等后端)、本地 SenseVoice 语音输入、Auto review(风险分级审查、逐次调用授权,作为可选 bundle 发布)。
回复

使用道具 举报

     
发表于 2026-9-22 15:59 | 显示全部楼层
本帖最后由 小野賢章 于 2026-9-22 16:01 编辑

登陆账号是不是意味着要出coding plan了,或者是为了桌面端的易用性考虑。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 08:19 , Processed in 0.198613 second(s), 5 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表