找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-15 22:20 | 显示全部楼层
绝地潜兵 发表于 2026-9-15 21:56
一根筋两头堵了,某社区把这群人赶走过,至于为什么赶走

也不知道旅程现在发展得怎么样了,祝她们安好吧。

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-9-15 22:31 | 显示全部楼层
使用dsh第四天,开始玩花的,多加skill中。
然后发现有人做了个客户端,还能联动steam的壁纸引擎本地文件作为聊天背景。
回复

使用道具 举报

     
发表于 2026-9-15 23:02 | 显示全部楼层
杀人鲸 发表于 2026-9-15 20:31
是啊,API 那边虽然现在也有点儿严,想办法破了以后还是可以写很多东西的,但就想赖在免费的这边。

对了 ...

我就搞不懂了,api几乎跟裸奔一样又是白菜价,怎么就跟个炫压抑智障一样在这说这种屁话都不肯稍微学一下……这种c端用户赶走都是仁慈的了,得用枪打了
回复

使用道具 举报

     
发表于 2026-9-15 23:03 | 显示全部楼层
只用deepseek网页版问一些简单问题的我竟然被封号4天
太迷了吧
pro永久下架就算了,flash也开始赶人
回复

使用道具 举报

     
发表于 2026-9-15 23:07 来自手机 | 显示全部楼层
不要刚在聊弱智集美后就突然像反串一样发一个赶不走的c端用户发言啊
回复

使用道具 举报

     
发表于 2026-9-15 23:14 | 显示全部楼层
你别说贝壳姐能唱的歌还挺多,就是调子不太准
回复

使用道具 举报

     
发表于 2026-9-15 23:25 | 显示全部楼层
tillnight 发表于 2026-9-15 22:11
V4.1F的论文里明确提到训练中有几十个教师模型参与。除非你觉得DS故意在论文里误导。 ...

那这种教师模型是“更大更重更稠密运行成本更高”的吗,我就是很怀疑这点
回复

使用道具 举报

     
发表于 2026-9-15 23:30 | 显示全部楼层
贝壳姐唱歌居然每次点都不一样,说明是实时生成的
梁子你这么好玩的多媒体模型藏着掖着干嘛阿,开源出来给大家耍耍阿
回复

使用道具 举报

头像被屏蔽
     
发表于 2026-9-15 23:32 | 显示全部楼层
提示: 该帖被管理员或版主屏蔽
回复

使用道具 举报

发表于 2026-9-15 23:46 | 显示全部楼层
这可是擅长仅退款和拒绝吊牌羞耻的新时代女性,用你一个破APP咋啦?
回复

使用道具 举报

     
发表于 2026-9-16 00:28 来自手机 | 显示全部楼层
哈基米好像完全没有训练过怎么调llamacpp,给了他模型和说明,他跑了20分钟还在调查llamacpp有什么参数,跑都没跑起来
换回大肥鱼填参数都不带想的,感觉有针对性训练过
回复

使用道具 举报

     
发表于 2026-9-16 00:36 | 显示全部楼层
为啥雷达站上的high会比max分数高这么多?
回复

使用道具 举报

     
发表于 2026-9-16 01:15 | 显示全部楼层
devin 搞了免费SWE-2(基于K3微调) 活动.  爽蹬了
回复

使用道具 举报

     
发表于 2026-9-16 01:17 | 显示全部楼层
nxmonitor 发表于 2026-9-16 00:36
为啥雷达站上的high会比max分数高这么多?

max有问题有时候会卡住然后不停地嗯嗯嗯嗯嗯跟闪灵男主发疯写出来的东西一样
回复

使用道具 举报

     
发表于 2026-9-16 01:21 | 显示全部楼层
RookieTnT 发表于 2026-9-16 01:15
devin 搞了免费SWE-2(基于K3微调) 活动.  爽蹬了

没忍住 开了一个月的 pro (20$) 能用fable5.1 感觉还可以 缓解一下 gpt-6-sol没出来前的空窗期
回复

使用道具 举报

     
发表于 2026-9-16 01:21 | 显示全部楼层
max现在有bug,会路由到摘要思维链
回复

使用道具 举报

     
发表于 2026-9-16 07:04 | 显示全部楼层
阿刚 发表于 2026-9-15 23:02
我就搞不懂了,api几乎跟裸奔一样又是白菜价,怎么就跟个炫压抑智障一样在这说这种屁话都不肯稍微学一下 ...

嗯,去小红书搜,一眼就知道这帮人就是想白嫖的
回复

使用道具 举报

     
发表于 2026-9-16 07:57 来自手机 | 显示全部楼层
所以把V4P的API保留但是APP停掉是个好措施…
回复

使用道具 举报

     
发表于 2026-9-16 09:24 | 显示全部楼层
阿刚 发表于 2026-9-15 23:02
我就搞不懂了,api几乎跟裸奔一样又是白菜价,怎么就跟个炫压抑智障一样在这说这种屁话都不肯稍微学一下 ...

就我在小红书经常能刷到的帖子来看,这些人最统一的说法是“API不好聊冷冰冰的”我怀疑是这帮集美温度没调试或者其他原因,反正是一群只会抠欢乐豆的蠢货
回复

使用道具 举报

     
发表于 2026-9-16 09:30 来自手机 | 显示全部楼层
刘胜与的文章转到外网了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-16 09:34 来自手机 | 显示全部楼层
lactone 发表于 2026-9-16 09:30
刘胜与的文章转到外网了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99

就是外网火了才被国内注意的
回复

使用道具 举报

     
发表于 2026-9-16 09:38 | 显示全部楼层
jev 发布了. 好像是 Diffusion 模型. 100亿 token /42美元 输出免费. 智力比luna相对高一点.

不过不能聊天 只能输出代码.

感觉还可以啊. 量大管饱 速度还快.

预约地址:https://typesafe.ai/
回复

使用道具 举报

     
发表于 2026-9-16 10:03 来自手机 | 显示全部楼层
RookieTnT 发表于 2026-9-16 09:38
jev 发布了. 好像是 Diffusion 模型. 100亿 token /42美元 输出免费. 智力比luna相对高一点.

不过不能聊天 ...

这个不能生成代码,应该是只能生成决策结果,输入问题和结果选项,输出各个结果的概率值
回复

使用道具 举报

     
发表于 2026-9-16 10:57 | 显示全部楼层
nxmonitor 发表于 2026-9-16 00:36
为啥雷达站上的high会比max分数高这么多?

前面几页有人提到了,他的训练甜点区就是high,max反而会陷入雷霆大思考
回复

使用道具 举报

     
发表于 2026-9-16 10:59 来自手机 | 显示全部楼层
现在搞嵌入和重排的模型有推荐吗
还是这个概念本身已经开始过时了

—— 来自 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-9-16 11:07 | 显示全部楼层
4.1F能在单a3上部署吗,两台搞不起啊
回复

使用道具 举报

     
发表于 2026-9-16 11:09 来自手机 | 显示全部楼层
jev这个模型我看了一下,感觉这玩意儿能够用的地方有限啊

这个得你自己问问题,然后自己给选项,他还只能打分,没法告诉你为啥选这个

—— 来自 HONOR AAK-AN00, Android 17, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-9-16 11:22 | 显示全部楼层
库德里尔 发表于 2026-9-16 10:59
现在搞嵌入和重排的模型有推荐吗
还是这个概念本身已经开始过时了

向量模型远不如文本匹配,说真的意义不大
回复

使用道具 举报

发表于 2026-9-16 11:25 | 显示全部楼层
本帖最后由 Baccano 于 2026-9-16 11:29 编辑

我才知道原来A\的盈利是靠着剔除掉训练新模型的成本才盈利的,不然还是年亏几百亿。
难怪达里奥三番五次说要减速。

顺便,《Anthropic 预计 8 月净增收入锐减,其将营收困境归咎于中国大模型厂商》
祝好死。
回复

使用道具 举报

     
发表于 2026-9-16 11:27 | 显示全部楼层
无人在意的角落,谷谷歌歌给了一次额度重置
回复

使用道具 举报

     
发表于 2026-9-16 11:27 | 显示全部楼层
怎么可能盈利,ARR这个指标也是很搞笑,理发店年底集中充一波卡,就能说自己的ARR按照这波算了?
回复

使用道具 举报

     
发表于 2026-9-16 11:28 | 显示全部楼层
UmarIbnLaAhad 发表于 2026-9-16 11:27
无人在意的角落,谷谷歌歌给了一次额度重置

而tibo已经四天没有按reset按钮了
回复

使用道具 举报

发表于 2026-9-16 11:39 | 显示全部楼层
等待qwen4发布,不知道能不能比27B和flashnext强多少
回复

使用道具 举报

     
发表于 2026-9-16 11:51 来自手机 | 显示全部楼层
kyonmoe 发表于 2026-9-16 11:07
4.1F能在单a3上部署吗,两台搞不起啊

https://www.modelscope.cn/models/pfeifferj/Qwen3.8-Flash-Next-GSQ-RCO-GGUF/files

来试试这个
回复

使用道具 举报

     
发表于 2026-9-16 11:56 | 显示全部楼层
nxmonitor 发表于 2026-9-16 11:27
怎么可能盈利,ARR这个指标也是很搞笑,理发店年底集中充一波卡,就能说自己的ARR按照这波算了? ...

比ARR更离谱的还有SPV呢...
只要不是我直接买的卡就不算我的成本,至于具体成本谁付,那你别管...

反正全世界程序员每人都给O/和A/每年各缴纳1000美元,都不够他们填现在的ARR的

这也是O/狂吹AI4S的原因, 全世界程序员都当韭菜理论上都不够一家割了,
必须瞄准更大更离谱经费更多的目标...


回复

使用道具 举报

     
发表于 2026-9-16 12:02 来自手机 | 显示全部楼层
想买苹果M5U 512g部署4.1F玩,不过看到现在苹果都没有fp4加速?那岂不是部署了那速度也没有可玩性

—— 来自 vivo V2547A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-16 12:05 来自手机 | 显示全部楼层
retp 发表于 2026-9-16 12:02
想买苹果M5U 512g部署4.1F玩,不过看到现在苹果都没有fp4加速?那岂不是部署了那速度也没有可玩性

—— 来 ...

算力决定prefill,带宽决定decode
agent环境其实mac的算力是够用的,基本全程都在缓存里面
回复

使用道具 举报

发表于 2026-9-16 12:05 | 显示全部楼层
retp 发表于 2026-9-16 12:02
想买苹果M5U 512g部署4.1F玩,不过看到现在苹果都没有fp4加速?那岂不是部署了那速度也没有可玩性

—— 来 ...

我看loclllam老哥跑出了40 tps tg ,800prefill的速度,配合提示缓存秒出还是能用的
回复

使用道具 举报

发表于 2026-9-16 12:09 | 显示全部楼层
qwased 发表于 2026-9-16 12:05
算力决定prefill,带宽决定decode
agent环境其实mac的算力是够用的,基本全程都在缓存里面 ...

ds4模型大多数情况下就是个无情的带宽机器,因为提示缓存命中率被优化得太好了,动不动99% 每一轮的新增对话都只要prefill几十个token,其它全部复用,mac算力低也不怕
回复

使用道具 举报

     
发表于 2026-9-16 12:17 来自手机 | 显示全部楼层
mitzvah 发表于 2026-9-16 12:09
ds4模型大多数情况下就是个无情的带宽机器,因为提示缓存命中率被优化得太好了,动不动99% 每一轮的新增 ...

x上说openai和a/各自抢了几十万台mac来给内部做推理算力
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 09:21 , Processed in 0.209610 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表