overflowal 发表于 2026-7-19 16:12

Promeus 发表于 2026-7-19 16:09
2.4T的千问3.8,怎么上下文才200k

肯定是1m的,但是省钱就限制200k    Re:Source

pure_liquid 发表于 2026-7-19 16:14

我想问一下,客户端思考链以“我们要”而不是“用户想”开头
是否就是大家讨论的正式版模型呢?

qz66618 发表于 2026-7-19 16:16

又一个仅次肥波的来了

nxmonitor 发表于 2026-7-19 16:17

阿里的宣传真的要等着看看,他们还有个严重问题就是产品思路很不清晰

overflowal 发表于 2026-7-19 16:22

qz66618 发表于 2026-7-19 16:16
又一个仅次肥波的来了

阿里还是想开了,它那max不开源也没人用    Re:Source

neptunehs 发表于 2026-7-19 16:24

试了下k3 一天就把我半个月的opencode go额度用完了(
梁圣快来吧(

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

mitzvah 发表于 2026-7-19 16:24

max多半不会开源的,能开源个122ba10b就谢天谢地了

不过fable级别模型蒸馏出来的122b a10b多半也足够强,灭了opus4.6问题不大

秦南心 发表于 2026-7-19 16:24

阿里再不开没有窗口期了,鲸鱼和kimi给的压力大

mitzvah 发表于 2026-7-19 16:26

本帖最后由 mitzvah 于 2026-7-19 16:30 编辑

其实阿里要是能把他那个wan2.6   wan2.7开出来反而更好,它的那个破视频模型才是真的没人用只有开源价值

龙骑士尹志平 发表于 2026-7-19 16:27

3.8的小模型可以本地部署的什么时候出

nxmonitor 发表于 2026-7-19 16:29

小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户

overflowal 发表于 2026-7-19 16:33

mitzvah 发表于 2026-7-19 16:24
max多半不会开源的,能开源个122ba10b就谢天谢地了

不过fable级别模型蒸馏出来的122b a10b多半也足够强 ...

已经说要开了。毕竟不开实际也没啥意义了。    Re:Source

Promeus 发表于 2026-7-19 16:33

仅次于fable就是踩头5.6sol了

Promeus 发表于 2026-7-19 16:34

overflowal 发表于 2026-7-19 16:33
已经说要开了。毕竟不开实际也没啥意义了。    Re:Source

那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势

Promeus 发表于 2026-7-19 16:35

【Qwen3.8一句话生成我的世界-哔哩哔哩】 https://b23.tv/qUREN0f

反正oneshot mc纯区

mitzvah 发表于 2026-7-19 16:38

nxmonitor 发表于 2026-7-19 16:29
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户 ...

小模型恰恰是阿里最有价值的东西,一大票自动驾驶机器人端侧模型都等着这玩意的更新下锅呢

tillnight 发表于 2026-7-19 16:42

overflowal 发表于 2026-7-19 16:33
已经说要开了。毕竟不开实际也没啥意义了。    Re:Source

官号也可以是话术,毕竟和以前一样开MAX的量化版也叫开。虽然看口气好像这次好像是真要开源旗舰。

qwased 发表于 2026-7-19 16:43

lordquest 发表于 2026-7-19 15:03
12b的模型还是太小了,26b a4b应该会好一些。我自己测试的笔记本的5070ti 12g显存,35b a3b,开mtp大于能 ...

发现混元7b q6量化跑某本小说翻译会稳定死循环,换成q8量化就好了
量化真的有这么大的影响吗

nxmonitor 发表于 2026-7-19 16:43

Promeus 发表于 2026-7-19 16:34
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势 ...

刷分把语料污染了就是这个结果

nxmonitor 发表于 2026-7-19 16:44

mitzvah 发表于 2026-7-19 16:38
小模型恰恰是阿里最有价值的东西,一大票自动驾驶机器人端侧模型都等着这玩意的更新下锅呢 ...

如果真的有价值原先的负责人也不会被开掉了,他们就是为了收回投入搞的

tillnight 发表于 2026-7-19 16:48

这个2.4t估计是非常缺后训练的,直接说每天都在进化。。大概是准备走豆包现在的模式了,每周都更新检查点。

巨魔已被忠诚 发表于 2026-7-19 16:49

我现在本地部署了FunASR作为语音识别的,现在这段字就是ASR出品。
豆包的那些会议摘要语音识别,还有搜狗的那个实在是太唐,没法用。Deepseek 的网页端也没有那录音的,搞的那些插件版本的,效果也是完全联网。经常就遇到中断或者失败,网络波动,识别质量不高。
下午花了2小时,找DS一步一步挑选前后端和模型,现在把CapsWriter-Offline部署到本地,晚上给转移到docker上面。就是NAS的内存有点吃紧,据说没GPU快,现在大概一分钟的语音转录的话,加上联网修正的话,会延迟大概0.5秒才会出现。PC 的情况下,我显卡显存16G,占用2G。
不过现在实现语音识别自由了。还可以通过开头关键词联网修正过于口语化的助词。搞提示词质量输入的话更快了。

wandeeees 发表于 2026-7-19 16:52

不太行,跟V4 PRO预览版差不多,也是一堆let me,然后B站的那些V4 PRO正式版的案例都不能生成出来。

只能说未来可期把,能达到GLM后训练的水平应该还是可以很强的

真田源次郎信繁 发表于 2026-7-19 16:56

Qwen和Llama状态差不多,不过阿里好歹是比美国百度强多了
开源或者不开源,放小模型和不放小模型这都是细枝末节的事,关键是能力行不行
如果能力不行那就靠开源画饼,如果能力不行也不开源那就路边一套

nxmonitor 发表于 2026-7-19 16:57

let me这个东西是不是V3的思维链祖传的东西?包括很长的思维链和左右互搏

Alunamin 发表于 2026-7-19 17:00

所以今天还是没消息吗

ycjiang1337 发表于 2026-7-19 17:01

nxmonitor 发表于 2026-7-19 16:29
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户 ...

小模型是卖卡的

Promeus 发表于 2026-7-19 17:02

Alunamin 发表于 2026-7-19 17:00
所以今天还是没消息吗

今天出现大规模坠机和客户端灰度,怎么看都是快来了

ycjiang1337 发表于 2026-7-19 17:02

Promeus 发表于 2026-7-19 16:34
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势 ...

3.8就是Max,2.4T大小,不然Qwen怎么可能还有更大的模型

ycjiang1337 发表于 2026-7-19 17:03

nxmonitor 发表于 2026-7-19 16:44
如果真的有价值原先的负责人也不会被开掉了,他们就是为了收回投入搞的 ...

小模型可以赚GPU的钱,大模型做不到第一梯队就是路边一条

nxmonitor 发表于 2026-7-19 17:06

ycjiang1337 发表于 2026-7-19 17:03
小模型可以赚GPU的钱,大模型做不到第一梯队就是路边一条

所以说思路混乱啊,这三个都想一起卖怎么成功呢,平头哥这东西报价相对而言还很贵

ycjiang1337 发表于 2026-7-19 17:18

nxmonitor 发表于 2026-7-19 17:06
所以说思路混乱啊,这三个都想一起卖怎么成功呢,平头哥这东西报价相对而言还很贵 ...

阿里云又不是没有普通N卡。如果是卖MaaS的话Qwen闭源模型连豆包都打不过,但如果是卖GPU的话火山才是路边一条

nxmonitor 发表于 2026-7-19 17:19

今天我去看了华为的超节点,确实很夸张看着就很有气势……

mitzvah 发表于 2026-7-19 17:23

真田源次郎信繁 发表于 2026-7-19 16:56
Qwen和Llama状态差不多,不过阿里好歹是比美国百度强多了
开源或者不开源,放小模型和不放小模型这都是细枝 ...

wan2.5开始闭源,你要说能力不行吗,新版的wan进步其实不小,但是就是没人用 哪怕作广告也没人用,人家字节视频生成的蛋糕吃得太爽了,你阿里的wan模型怎么办?


chenyedgg 发表于 2026-7-19 17:27

qwased 发表于 2026-7-19 16:43
发现混元7b q6量化跑某本小说翻译会稳定死循环,换成q8量化就好了
量化真的有这么大的影响吗 ...

小模型量化影响很大

羊寢 发表于 2026-7-19 17:37

杀人鲸 发表于 2026-7-19 15:39
在贴吧看到的,有人出现的客户端界面,客户端这边也要跟上了吗?但是我倒没有遇到,有相同界面的朋友出来说 ...

4.0更新之后就有了啊

杀人鲸 发表于 2026-7-19 17:47

羊寢 发表于 2026-7-19 17:37
4.0更新之后就有了啊

诶,亲爱的朋友,看来你运气还是挺不错的,因为这不是每个人都有,就比如说上面都有人提过了。
我就是没有被灰度测试到的倒霉蛋,所以看到贴吧有人贴出来了这个东西以后才转发过来的。

tillnight 发表于 2026-7-19 17:51

好像不是文字游戏,千问明确说这次要开源2.4t权重的旗舰了。但是另一方面新基座的3.8又没带max的后缀,也许是量化的小模型直接没了。文档里写到最大支持上下文100万,原生多模态。新时代标配了。智谱确实是该换底模了,感觉V4也不够当他们的新底模。

qz66618 发表于 2026-7-19 18:05

邮件呢,难道随明天发模型一起发吗

—— 来自 鹅球 v3.5.99

杀人鲸 发表于 2026-7-19 18:09

感觉这一个楼层属于是S1近期来说最火的一个帖子 只能说也真的是挺有趣的,虽然我也是每天疯狂刷这个帖子的内容就是了。

顺便3000楼就归我了吧!

—— 来自 S1Fun
页: 65 66 67 68 69 70 71 72 73 74 [75] 76 77 78 79 80 81 82 83 84
查看完整版本: DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼