找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] 正式版到底什么时候来?|DeepSeek v4讨论专楼

 火.. [复制链接]
发表于 2026-7-19 16:12 | 显示全部楼层
Promeus 发表于 2026-7-19 16:09
2.4T的千问3.8,怎么上下文才200k

肯定是1m的,但是省钱就限制200k    Re:Source
回复

使用道具 举报

     
发表于 2026-7-19 16:14 来自手机 | 显示全部楼层
我想问一下,客户端思考链以“我们要”而不是“用户想”开头
是否就是大家讨论的正式版模型呢?
回复

使用道具 举报

     
发表于 2026-7-19 16:16 | 显示全部楼层
又一个仅次肥波的来了

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-7-19 16:17 | 显示全部楼层
阿里的宣传真的要等着看看,他们还有个严重问题就是产品思路很不清晰
回复

使用道具 举报

发表于 2026-7-19 16:22 | 显示全部楼层
qz66618 发表于 2026-7-19 16:16
又一个仅次肥波的来了

阿里还是想开了,它那max不开源也没人用    Re:Source
回复

使用道具 举报

     
发表于 2026-7-19 16:24 来自手机 | 显示全部楼层
试了下k3 一天就把我半个月的opencode go额度用完了(
梁圣快来吧(

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-7-19 16:24 | 显示全部楼层
max多半不会开源的,能开源个122ba10b就谢天谢地了

不过fable级别模型蒸馏出来的122b a10b  多半也足够强,灭了opus4.6问题不大

回复

使用道具 举报

     
发表于 2026-7-19 16:24 | 显示全部楼层
阿里再不开没有窗口期了,鲸鱼和kimi给的压力大
回复

使用道具 举报

发表于 2026-7-19 16:26 | 显示全部楼层
本帖最后由 mitzvah 于 2026-7-19 16:30 编辑

其实阿里要是能把他那个wan2.6   wan2.7开出来反而更好,它的那个破视频模型才是真的没人用只有开源价值
回复

使用道具 举报

     
发表于 2026-7-19 16:27 来自手机 | 显示全部楼层
3.8的小模型可以本地部署的什么时候出
回复

使用道具 举报

     
发表于 2026-7-19 16:29 | 显示全部楼层
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户
回复

使用道具 举报

发表于 2026-7-19 16:33 | 显示全部楼层
mitzvah 发表于 2026-7-19 16:24
max多半不会开源的,能开源个122ba10b就谢天谢地了

不过fable级别模型蒸馏出来的122b a10b  多半也足够强 ...

已经说要开了。毕竟不开实际也没啥意义了。    Re:Source
回复

使用道具 举报

     
发表于 2026-7-19 16:33 来自手机 | 显示全部楼层
仅次于fable就是踩头5.6sol了
回复

使用道具 举报

     
发表于 2026-7-19 16:34 来自手机 | 显示全部楼层
overflowal 发表于 2026-7-19 16:33
已经说要开了。毕竟不开实际也没啥意义了。    Re:Source

那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势
回复

使用道具 举报

     
发表于 2026-7-19 16:35 来自手机 | 显示全部楼层
【Qwen3.8一句话生成我的世界-哔哩哔哩】 https://b23.tv/qUREN0f

反正oneshot mc纯区
回复

使用道具 举报

发表于 2026-7-19 16:38 | 显示全部楼层
nxmonitor 发表于 2026-7-19 16:29
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户 ...

小模型恰恰是阿里最有价值的东西,一大票自动驾驶机器人端侧模型都等着这玩意的更新下锅呢
回复

使用道具 举报

     
发表于 2026-7-19 16:42 | 显示全部楼层
overflowal 发表于 2026-7-19 16:33
已经说要开了。毕竟不开实际也没啥意义了。    Re:Source

官号也可以是话术,毕竟和以前一样开MAX的量化版也叫开。虽然看口气好像这次好像是真要开源旗舰。
回复

使用道具 举报

     
发表于 2026-7-19 16:43 | 显示全部楼层
lordquest 发表于 2026-7-19 15:03
12b的模型还是太小了,26b a4b应该会好一些。我自己测试的笔记本的5070ti 12g显存,35b a3b,开mtp大于能 ...

发现混元7b q6量化跑某本小说翻译会稳定死循环,换成q8量化就好了
量化真的有这么大的影响吗
回复

使用道具 举报

     
发表于 2026-7-19 16:43 | 显示全部楼层
Promeus 发表于 2026-7-19 16:34
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势 ...

刷分把语料污染了就是这个结果
回复

使用道具 举报

     
发表于 2026-7-19 16:44 | 显示全部楼层
mitzvah 发表于 2026-7-19 16:38
小模型恰恰是阿里最有价值的东西,一大票自动驾驶机器人端侧模型都等着这玩意的更新下锅呢 ...

如果真的有价值原先的负责人也不会被开掉了,他们就是为了收回投入搞的
回复

使用道具 举报

     
发表于 2026-7-19 16:48 | 显示全部楼层
这个2.4t估计是非常缺后训练的,直接说每天都在进化。。大概是准备走豆包现在的模式了,每周都更新检查点。
回复

使用道具 举报

     
发表于 2026-7-19 16:49 | 显示全部楼层
我现在本地部署了FunASR作为语音识别的,现在这段字就是ASR出品。
豆包的那些会议摘要语音识别,还有搜狗的那个实在是太唐,没法用。Deepseek 的网页端也没有那录音的,搞的那些插件版本的,效果也是完全联网。经常就遇到中断或者失败,网络波动,识别质量不高。
下午花了2小时,找DS一步一步挑选前后端和模型,现在把CapsWriter-Offline部署到本地,晚上给转移到docker上面。就是NAS的内存有点吃紧,据说没GPU快,现在大概一分钟的语音转录的话,加上联网修正的话,会延迟大概0.5秒才会出现。PC 的情况下,我显卡显存16G,占用2G。
不过现在实现语音识别自由了。还可以通过开头关键词联网修正过于口语化的助词。搞提示词质量输入的话更快了。
回复

使用道具 举报

发表于 2026-7-19 16:52 | 显示全部楼层
不太行,跟V4 PRO预览版差不多,也是一堆let me,然后B站的那些V4 PRO正式版的案例都不能生成出来。

只能说未来可期把,能达到GLM后训练的水平应该还是可以很强的
回复

使用道具 举报

     
发表于 2026-7-19 16:56 | 显示全部楼层
Qwen和Llama状态差不多,不过阿里好歹是比美国百度强多了
开源或者不开源,放小模型和不放小模型这都是细枝末节的事,关键是能力行不行
如果能力不行那就靠开源画饼,如果能力不行也不开源那就路边一套
回复

使用道具 举报

     
发表于 2026-7-19 16:57 | 显示全部楼层
let me这个东西是不是V3的思维链祖传的东西?包括很长的思维链和左右互搏
回复

使用道具 举报

     
发表于 2026-7-19 17:00 | 显示全部楼层
所以今天还是没消息吗
回复

使用道具 举报

     
发表于 2026-7-19 17:01 | 显示全部楼层
nxmonitor 发表于 2026-7-19 16:29
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户 ...

小模型是卖卡的
回复

使用道具 举报

     
发表于 2026-7-19 17:02 来自手机 | 显示全部楼层
Alunamin 发表于 2026-7-19 17:00
所以今天还是没消息吗

今天出现大规模坠机和客户端灰度,怎么看都是快来了
回复

使用道具 举报

     
发表于 2026-7-19 17:02 | 显示全部楼层
Promeus 发表于 2026-7-19 16:34
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势 ...

3.8就是Max,2.4T大小,不然Qwen怎么可能还有更大的模型
回复

使用道具 举报

     
发表于 2026-7-19 17:03 | 显示全部楼层
nxmonitor 发表于 2026-7-19 16:44
如果真的有价值原先的负责人也不会被开掉了,他们就是为了收回投入搞的 ...

小模型可以赚GPU的钱,大模型做不到第一梯队就是路边一条
回复

使用道具 举报

     
发表于 2026-7-19 17:06 | 显示全部楼层
ycjiang1337 发表于 2026-7-19 17:03
小模型可以赚GPU的钱,大模型做不到第一梯队就是路边一条

所以说思路混乱啊,这三个都想一起卖怎么成功呢,平头哥这东西报价相对而言还很贵
回复

使用道具 举报

     
发表于 2026-7-19 17:18 | 显示全部楼层
nxmonitor 发表于 2026-7-19 17:06
所以说思路混乱啊,这三个都想一起卖怎么成功呢,平头哥这东西报价相对而言还很贵 ...

阿里云又不是没有普通N卡。如果是卖MaaS的话Qwen闭源模型连豆包都打不过,但如果是卖GPU的话火山才是路边一条
回复

使用道具 举报

     
发表于 2026-7-19 17:19 | 显示全部楼层
今天我去看了华为的超节点,确实很夸张看着就很有气势……
回复

使用道具 举报

发表于 2026-7-19 17:23 | 显示全部楼层
真田源次郎信繁 发表于 2026-7-19 16:56
Qwen和Llama状态差不多,不过阿里好歹是比美国百度强多了
开源或者不开源,放小模型和不放小模型这都是细枝 ...

wan2.5开始闭源,你要说能力不行吗,新版的wan进步其实不小,但是就是没人用 哪怕作广告也没人用,人家字节视频生成的蛋糕吃得太爽了,你阿里的wan模型怎么办?


回复

使用道具 举报

发表于 2026-7-19 17:27 | 显示全部楼层
qwased 发表于 2026-7-19 16:43
发现混元7b q6量化跑某本小说翻译会稳定死循环,换成q8量化就好了
量化真的有这么大的影响吗 ...

小模型量化影响很大
回复

使用道具 举报

     
发表于 2026-7-19 17:37 来自手机 | 显示全部楼层
杀人鲸 发表于 2026-7-19 15:39
在贴吧看到的,有人出现的客户端界面,客户端这边也要跟上了吗?但是我倒没有遇到,有相同界面的朋友出来说 ...

4.0更新之后就有了啊
回复

使用道具 举报

     
发表于 2026-7-19 17:47 | 显示全部楼层
羊寢 发表于 2026-7-19 17:37
4.0更新之后就有了啊

诶,亲爱的朋友,看来你运气还是挺不错的,因为这不是每个人都有,就比如说上面都有人提过了。
我就是没有被灰度测试到的倒霉蛋,所以看到贴吧有人贴出来了这个东西以后才转发过来的。
回复

使用道具 举报

     
发表于 2026-7-19 17:51 | 显示全部楼层
好像不是文字游戏,千问明确说这次要开源2.4t权重的旗舰了。但是另一方面新基座的3.8又没带max的后缀,也许是量化的小模型直接没了。文档里写到最大支持上下文100万,原生多模态。新时代标配了。智谱确实是该换底模了,感觉V4也不够当他们的新底模。
回复

使用道具 举报

     
发表于 2026-7-19 18:05 来自手机 | 显示全部楼层
邮件呢,难道随明天发模型一起发吗

—— 来自 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-7-19 18:09 | 显示全部楼层
感觉这一个楼层属于是S1近期来说最火的一个帖子 只能说也真的是挺有趣的,虽然我也是每天疯狂刷这个帖子的内容就是了。

顺便3000楼就归我了吧!

—— 来自 S1Fun
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-7-28 04:23 , Processed in 0.341788 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表