找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
发表于 2026-9-22 22:02 | 显示全部楼层
挺好奇qwen4 27b能比3.8 27b强多少
回复

使用道具 举报

     
发表于 2026-9-22 22:05 | 显示全部楼层
话说回来ocg和ccgoat这两家转发官方ds也没开放fim补全,可能是现在大家真的一点代码都不自己敲了罢
回复

使用道具 举报

     
发表于 2026-9-22 22:20 | 显示全部楼层
AIHubMix和ZenMux都被DNS污染了吗?
回复

使用道具 举报

     
发表于 2026-9-22 22:28 来自手机 | 显示全部楼层
mimo2.6好的时候看起来不错
但确实是容易因为各种bug死循环啊。。。感觉不处于能用的阶段

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-22 23:04 来自手机 | 显示全部楼层
问下有没有什么让大肥鱼回答说人话的方法推荐,最近不说人话的大肥鱼用多了搞的我写出的文字都有种ai味了。作为对比刚才用哈基米3.8f简直回到了天堂。
回复

使用道具 举报

     
发表于 2026-9-22 23:16 | 显示全部楼层
4.1flash完全没法用来讨论需求,反复几轮询问才知道它在说啥,效率太低了
但是拿别的模型讨论好把文档丢给它执行很不错,最适合那种自动化流程了
回复

使用道具 举报

发表于 2026-9-22 23:42 | 显示全部楼层
大家每天几个亿的用不心疼钱么。。。我每天大概下班梁文谷蹬一两个亿的ds4.1,感觉好贵啊。让大肥鱼给我找个便宜的,结果他说我现在就是最便宜的了
回复

使用道具 举报

     
发表于 2026-9-22 23:52 来自手机 | 显示全部楼层
苇原雪道 发表于 2026-9-22 23:42
大家每天几个亿的用不心疼钱么。。。我每天大概下班梁文谷蹬一两个亿的ds4.1,感觉好贵啊。让大肥鱼给我找 ...

workbuddy签到然后去codebuddy code用,模仿claude code的,还有webui
回复

使用道具 举报

     
发表于 2026-9-22 23:57 | 显示全部楼层
为什么几家/公司都乐于扫库上传,是因为开源仓库吃完了,优质 coding 训练资源只剩下私有库了吗    Re:Source
回复

使用道具 举报

     
发表于 2026-9-23 00:02 | 显示全部楼层
雨昼斯基 发表于 2026-9-22 23:57
为什么几家/公司都乐于扫库上传,是因为开源仓库吃完了,优质 coding 训练资源只剩下私有库了吗    Re:Sour ...

所以还是不要小看用户数量带来的优势啊
deepseek还是不够重视市场方面
回复

使用道具 举报

     
发表于 2026-9-23 00:04 | 显示全部楼层
nxmonitor 发表于 2026-9-22 20:37
910C连推理都不行,这机器整个方向都错了,说实话不如对着DS的需求造卡呢,DS之前说要自己造,不如华为拉着 ...

910C本质上就是910B两个拼一块,底子还是910B,方向肯定是老的
回复

使用道具 举报

     
发表于 2026-9-23 00:29 | 显示全部楼层
发现了个项目 https://github.com/miuuyy/Astra-Ares

根据任务 调整思考强度. 对我来说太实用了. gpt-6-Astra 好是好. 就是太费额度了. 😂
回复

使用道具 举报

     
发表于 2026-9-23 00:32 | 显示全部楼层
jev 这模型来识别广告太好用了. 最近搓了拓展把X下面那种福黑不黑全被block了
回复

使用道具 举报

     
发表于 2026-9-23 00:34 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-23 00:35 编辑
novem 发表于 2026-9-23 00:02
所以还是不要小看用户数量带来的优势啊
deepseek还是不够重视市场方面

其实用户这个是不怎么担心的,调用量太高了都把服务器蹬爆了,只担心他们洗数据洗不过来……
回复

使用道具 举报

     
发表于 2026-9-23 00:36 | 显示全部楼层
还有Jev这种东西到底有什么新花样?当初NLP做本文情感分类的时候也没这么多人吹吧?然后这种东西后面就成功被LLM干掉了……
回复

使用道具 举报

     
发表于 2026-9-23 00:37 | 显示全部楼层
opus5.5发布了 最近因为灰度到新的opus5.5,一大特征就是速度非常快,tps最低都在150+,观测到过300+

token效率太高了.

希望国模在token效率加强一下吧.
回复

使用道具 举报

     
发表于 2026-9-23 00:42 | 显示全部楼层
nxmonitor 发表于 2026-9-23 00:36
还有Jev这种东西到底有什么新花样?当初NLP做本文情感分类的时候也没这么多人吹吧?然后这种东西后面就成功 ...

jev比较通用吧. NLP不通用啊.  LLM现在的问题是太慢了. jev 我算上延迟都能400ms
回复

使用道具 举报

     
发表于 2026-9-23 00:43 来自手机 | 显示全部楼层
反正华为的卡,除了前几天电信那个模型,确实再没听说过用来宣传的训练案例。DS的950DT应该都拿去推理了,至少这一代没听说用来训练
回复

使用道具 举报

     
发表于 2026-9-23 00:44 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-23 00:47 编辑
RookieTnT 发表于 2026-9-23 00:42
jev比较通用吧. NLP不通用啊.  LLM现在的问题是太慢了. jev 我算上延迟都能400ms ...

换个名字叫“基于LLM的分类算法”怎么样?你用个几B的小模型也能实现需求,智力也确实是几B的小模型……
回复

使用道具 举报

     
发表于 2026-9-23 00:49 | 显示全部楼层
nxmonitor 发表于 2026-9-23 00:44
换个名字叫“基于LLM的分类算法”怎么样?你用个几B的小模型也能实现,智力也确实是几B的小模型…… ...

你用几B的小模型去试下就知道了.
性能完被爆,上下文1k左右,用本地的和jev做了本地的一个任务,jev准确率更高点,不过后面肯定会有其它家推出来参数量更高点的模型。
回复

使用道具 举报

     
发表于 2026-9-23 00:53 | 显示全部楼层
Jev的优势是输出确定,还有可以一个请求批量跑一批结果出来,还有响应速度够快也是质变
我看到推荐的用法是用来做“门禁”,用来辅助其他大模型一起使用应该才是正确的用法,要是生态能搞起来也能作为agent基建的一部分
回复

使用道具 举报

     
发表于 2026-9-23 01:11 来自手机 | 显示全部楼层
本帖最后由 qz66618 于 2026-9-23 01:12 编辑

opus5.5震撼发布,看跑分是比gpt6强的,最近OA两家更新的频率和幅度都变大了啊,感觉DS的v4.1pro能比肩gpt6都比较难了

—— 来自 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-23 02:16 来自手机 | 显示全部楼层
hugosol 发表于 2026-9-22 23:16
4.1flash完全没法用来讨论需求,反复几轮询问才知道它在说啥,效率太低了
但是拿别的模型讨论好把文档丢给 ...

今年下半年开始对agentic coding优化的低参数量模型都是这样。说白了就是过拟合了

使用大参数量的模型会好一点
回复

使用道具 举报

发表于 2026-9-23 03:12 来自手机 | 显示全部楼层
zack1999 发表于 2026-9-22 15:44
最新版dsh0.17 用dsv4.1还是默认自己不是识图模型啊,怎么搞 ??model "deepseek-flash" does not decla ...

可能是因为你以前自定义过模型列表 你在设置里面把模型列表还原为默认试试

—— 来自 鹅球 v4.0
回复

使用道具 举报

发表于 2026-9-23 03:16 来自手机 | 显示全部楼层
求问一下 有没有什么现成方案是能让Agent 软件的工作区和会话库同步到两台电脑上用的,我现在用的是 OneDrive 结果前两天炸锅了现在还在修

—— 来自 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-23 03:45 | 显示全部楼层
看来A/确实急了 OPUS基本没有甲,重口能随便写

gpt反而感觉拉了,性能没啥提升单纯是降价?
回复

使用道具 举报

     
发表于 2026-9-23 03:59 | 显示全部楼层
a÷确实有点东西啊,昨天一个前端任务用astra max调了大半天,pro5x用了周额度的20%还有些小bug,结果刚刚用opus5.5extra档位半小时搞定,没有bug不说还只用了plus周额度的5%不到    Re:Source
回复

使用道具 举报

     
发表于 2026-9-23 04:05 | 显示全部楼层
jojog 发表于 2026-9-23 03:45
看来A/确实急了 OPUS基本没有甲,重口能随便写

gpt反而感觉拉了,性能没啥提升单纯是降价? ...

真的吗 要是文笔好的话就不得不支持了
回复

使用道具 举报

发表于 2026-9-23 04:09 | 显示全部楼层
AO两家pace the frontier原来是这种pace法

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-23 04:13 | 显示全部楼层
本帖最后由 andychen 于 2026-9-23 04:25 编辑
jojog 发表于 2026-9-23 03:45
看来A/确实急了 OPUS基本没有甲,重口能随便写

gpt反而感觉拉了,性能没啥提升单纯是降价? ...

我使用了一下Luna,发现在Codex内会暴露出自然语言思维链。我怀疑Sol和Luna都是Astra蒸馏的GPT 5,不然应该是隐式思维链才对

不过降价是实实在在的,现在Luna性价比已经超过DS4.1f了
回复

使用道具 举报

     
发表于 2026-9-23 04:15 | 显示全部楼层
qz66618 发表于 2026-9-23 01:11
opus5.5震撼发布,看跑分是比gpt6强的,最近OA两家更新的频率和幅度都变大了啊,感觉DS的v4.1pro能比肩gpt6 ...

参数量的限制还是很明显,国内目前综合能力最强的还是参数量最大的Kimi K3。据说Moonshot这周也有新发布,看是不是K3的更新吧
回复

使用道具 举报

     
发表于 2026-9-23 04:47 | 显示全部楼层
squallx 发表于 2026-9-23 04:05
真的吗 要是文笔好的话就不得不支持了

手头没有skill 感觉比grok好但是肯定比不上国模
回复

使用道具 举报

     
发表于 2026-9-23 04:49 | 显示全部楼层
andychen 发表于 2026-9-23 04:13
我使用了一下Luna,发现在Codex内会暴露出自然语言思维链。我怀疑Sol和Luna都是Astra蒸馏的GPT 5,不然应 ...

蒸馏应该是肯定的

之前5.6能用的skill给6用了秒变成一坨,明显是astra的特征

日常用可能没感觉,要是个降智的astra的话说实话不如用opus……
回复

使用道具 举报

     
发表于 2026-9-23 05:03 | 显示全部楼层
jojog 发表于 2026-9-23 04:49
蒸馏应该是肯定的

之前5.6能用的skill给6用了秒变成一坨,明显是astra的特征

我本以为Sol和Luna使用了Astra的结构设计,目前看来并没有

至于Opus,5把我对这系列模型的信任彻底干崩了,我会等更多实际使用分享。尤其是这次跟着OpenAI降价,Anthropic的算力瓶颈挺严重的,让我很怀疑是不是又有什么雷
回复

使用道具 举报

     
发表于 2026-9-23 05:43 来自手机 | 显示全部楼层
本帖最后由 lactone 于 2026-9-23 05:44 编辑

这段时间就是国模最难受的时间,数据和算力压力都挺大

opus5.5这个看样子依然是后训练主导的

看k3.1吧,感觉也应该快发了

—— 来自 vivo V2505A, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-23 05:56 | 显示全部楼层
本帖最后由 andychen 于 2026-9-23 05:58 编辑
lactone 发表于 2026-9-23 05:43
这段时间就是国模最难受的时间,数据和算力压力都挺大

opus5.5这个看样子依然是后训练主导的

从Opus和Sonnet两个系列模型的发展轨迹看,我觉得Anthropic的后训练和蒸馏技术恐怕在所有前沿实验室里排名倒数前三
回复

使用道具 举报

     
发表于 2026-9-23 06:04 | 显示全部楼层
马老板4.7拉了吗 额度还烧的飞快 这下就算30刀3个月也没啥性价比了
回复

使用道具 举报

     
发表于 2026-9-23 06:09 | 显示全部楼层
hugosol 发表于 2026-9-22 23:16
4.1flash完全没法用来讨论需求,反复几轮询问才知道它在说啥,效率太低了
但是拿别的模型讨论好把文档丢给 ...

用网页版astra省额度进行指挥 当了中间传话筒  几轮之后这两的用词都快跟人类语言无法对齐了
回复

使用道具 举报

     
发表于 2026-9-23 06:45 来自手机 | 显示全部楼层
目前看来 6sol luna 主要是性价比的提升,5.5opus 看起来是爆了?

—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-9-23 07:38 来自手机 | 显示全部楼层
希望k3.1能至少打掉fable吧

—— 来自 vivo V2505A, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 07:45 , Processed in 0.201285 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表