Promeus 发表于 2026-7-19 16:09
2.4T的千问3.8,怎么上下文才200k
肯定是1m的,但是省钱就限制200k Re:Source
我想问一下,客户端思考链以“我们要”而不是“用户想”开头
是否就是大家讨论的正式版模型呢?
又一个仅次肥波的来了
阿里的宣传真的要等着看看,他们还有个严重问题就是产品思路很不清晰
qz66618 发表于 2026-7-19 16:16
又一个仅次肥波的来了
阿里还是想开了,它那max不开源也没人用 Re:Source
试了下k3 一天就把我半个月的opencode go额度用完了(
梁圣快来吧(
—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99
max多半不会开源的,能开源个122ba10b就谢天谢地了
不过fable级别模型蒸馏出来的122b a10b多半也足够强,灭了opus4.6问题不大
阿里再不开没有窗口期了,鲸鱼和kimi给的压力大
本帖最后由 mitzvah 于 2026-7-19 16:30 编辑
其实阿里要是能把他那个wan2.6 wan2.7开出来反而更好,它的那个破视频模型才是真的没人用只有开源价值
3.8的小模型可以本地部署的什么时候出
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户
mitzvah 发表于 2026-7-19 16:24
max多半不会开源的,能开源个122ba10b就谢天谢地了
不过fable级别模型蒸馏出来的122b a10b多半也足够强 ...
已经说要开了。毕竟不开实际也没啥意义了。 Re:Source
仅次于fable就是踩头5.6sol了
overflowal 发表于 2026-7-19 16:33
已经说要开了。毕竟不开实际也没啥意义了。 Re:Source
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势
【Qwen3.8一句话生成我的世界-哔哩哔哩】 https://b23.tv/qUREN0f
反正oneshot mc纯区
nxmonitor 发表于 2026-7-19 16:29
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户 ...
小模型恰恰是阿里最有价值的东西,一大票自动驾驶机器人端侧模型都等着这玩意的更新下锅呢
overflowal 发表于 2026-7-19 16:33
已经说要开了。毕竟不开实际也没啥意义了。 Re:Source
官号也可以是话术,毕竟和以前一样开MAX的量化版也叫开。虽然看口气好像这次好像是真要开源旗舰。
lordquest 发表于 2026-7-19 15:03
12b的模型还是太小了,26b a4b应该会好一些。我自己测试的笔记本的5070ti 12g显存,35b a3b,开mtp大于能 ...
发现混元7b q6量化跑某本小说翻译会稳定死循环,换成q8量化就好了
量化真的有这么大的影响吗
Promeus 发表于 2026-7-19 16:34
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势 ...
刷分把语料污染了就是这个结果
mitzvah 发表于 2026-7-19 16:38
小模型恰恰是阿里最有价值的东西,一大票自动驾驶机器人端侧模型都等着这玩意的更新下锅呢 ...
如果真的有价值原先的负责人也不会被开掉了,他们就是为了收回投入搞的
这个2.4t估计是非常缺后训练的,直接说每天都在进化。。大概是准备走豆包现在的模式了,每周都更新检查点。
我现在本地部署了FunASR作为语音识别的,现在这段字就是ASR出品。
豆包的那些会议摘要语音识别,还有搜狗的那个实在是太唐,没法用。Deepseek 的网页端也没有那录音的,搞的那些插件版本的,效果也是完全联网。经常就遇到中断或者失败,网络波动,识别质量不高。
下午花了2小时,找DS一步一步挑选前后端和模型,现在把CapsWriter-Offline部署到本地,晚上给转移到docker上面。就是NAS的内存有点吃紧,据说没GPU快,现在大概一分钟的语音转录的话,加上联网修正的话,会延迟大概0.5秒才会出现。PC 的情况下,我显卡显存16G,占用2G。
不过现在实现语音识别自由了。还可以通过开头关键词联网修正过于口语化的助词。搞提示词质量输入的话更快了。
不太行,跟V4 PRO预览版差不多,也是一堆let me,然后B站的那些V4 PRO正式版的案例都不能生成出来。
只能说未来可期把,能达到GLM后训练的水平应该还是可以很强的
Qwen和Llama状态差不多,不过阿里好歹是比美国百度强多了
开源或者不开源,放小模型和不放小模型这都是细枝末节的事,关键是能力行不行
如果能力不行那就靠开源画饼,如果能力不行也不开源那就路边一套
let me这个东西是不是V3的思维链祖传的东西?包括很长的思维链和左右互搏
所以今天还是没消息吗
nxmonitor 发表于 2026-7-19 16:29
小模型不赚钱基本要完蛋,他们现在恨不得从平头哥到Qorder到Qwen Max一条龙卖给用户 ...
小模型是卖卡的
Alunamin 发表于 2026-7-19 17:00
所以今天还是没消息吗
今天出现大规模坠机和客户端灰度,怎么看都是快来了
Promeus 发表于 2026-7-19 16:34
那说的是3.8啦,max不一定开源。千问有个问题就是分挺高使用效果很一般,不知道3.8能不能扭转局势 ...
3.8就是Max,2.4T大小,不然Qwen怎么可能还有更大的模型
nxmonitor 发表于 2026-7-19 16:44
如果真的有价值原先的负责人也不会被开掉了,他们就是为了收回投入搞的 ...
小模型可以赚GPU的钱,大模型做不到第一梯队就是路边一条
ycjiang1337 发表于 2026-7-19 17:03
小模型可以赚GPU的钱,大模型做不到第一梯队就是路边一条
所以说思路混乱啊,这三个都想一起卖怎么成功呢,平头哥这东西报价相对而言还很贵
nxmonitor 发表于 2026-7-19 17:06
所以说思路混乱啊,这三个都想一起卖怎么成功呢,平头哥这东西报价相对而言还很贵 ...
阿里云又不是没有普通N卡。如果是卖MaaS的话Qwen闭源模型连豆包都打不过,但如果是卖GPU的话火山才是路边一条
今天我去看了华为的超节点,确实很夸张看着就很有气势……
真田源次郎信繁 发表于 2026-7-19 16:56
Qwen和Llama状态差不多,不过阿里好歹是比美国百度强多了
开源或者不开源,放小模型和不放小模型这都是细枝 ...
wan2.5开始闭源,你要说能力不行吗,新版的wan进步其实不小,但是就是没人用 哪怕作广告也没人用,人家字节视频生成的蛋糕吃得太爽了,你阿里的wan模型怎么办?
qwased 发表于 2026-7-19 16:43
发现混元7b q6量化跑某本小说翻译会稳定死循环,换成q8量化就好了
量化真的有这么大的影响吗 ...
小模型量化影响很大
杀人鲸 发表于 2026-7-19 15:39
在贴吧看到的,有人出现的客户端界面,客户端这边也要跟上了吗?但是我倒没有遇到,有相同界面的朋友出来说 ...
4.0更新之后就有了啊
羊寢 发表于 2026-7-19 17:37
4.0更新之后就有了啊
诶,亲爱的朋友,看来你运气还是挺不错的,因为这不是每个人都有,就比如说上面都有人提过了。
我就是没有被灰度测试到的倒霉蛋,所以看到贴吧有人贴出来了这个东西以后才转发过来的。
好像不是文字游戏,千问明确说这次要开源2.4t权重的旗舰了。但是另一方面新基座的3.8又没带max的后缀,也许是量化的小模型直接没了。文档里写到最大支持上下文100万,原生多模态。新时代标配了。智谱确实是该换底模了,感觉V4也不够当他们的新底模。
邮件呢,难道随明天发模型一起发吗
—— 来自 鹅球 v3.5.99
感觉这一个楼层属于是S1近期来说最火的一个帖子 只能说也真的是挺有趣的,虽然我也是每天疯狂刷这个帖子的内容就是了。
顺便3000楼就归我了吧!
—— 来自 S1Fun