找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-1 11:33 来自手机 | 显示全部楼层
本帖最后由 neptunehs 于 2026-9-1 11:36 编辑
自由之紫roy 发表于 2026-9-1 11:30
我看评测27b不比3.8flash分数低啊
27b到底可以平替v4f0731吗

就算qwen那个分数信得过且不讨论ds系分数对不上实操的实力吧 那也是满血版的分数
能跑满血版qwen3.8 27b的设备 应该可以跑v4f的iq2甚至iq3了吧?

27b的iq3或q4什么的肯定不能平替 昨晚才把我东西搞砸的人路过

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-1 12:10 来自手机 | 显示全部楼层
自由之紫roy 发表于 2026-9-1 11:30
我看评测27b不比3.8flash分数低啊
27b到底可以平替v4f0731吗

不知道 没用过27B 不好评价
回复

使用道具 举报

发表于 2026-9-1 12:31 | 显示全部楼层
求问一下千问3.8flash实际使用体验好吗?轻度使用(像原来的opencodego那种程度)买什么比较划算?阿里云百炼的lite套餐行吗?
回复

使用道具 举报

     
发表于 2026-9-1 13:40 来自手机 | 显示全部楼层
Glm6规划rsi了
回复

使用道具 举报

     
发表于 2026-9-1 14:05 来自手机 | 显示全部楼层
jonarryn 发表于 2026-9-1 12:31
求问一下千问3.8flash实际使用体验好吗?轻度使用(像原来的opencodego那种程度)买什么比较划算?阿里云百 ...

看12142楼 lite套餐7天大概1.5E  看你用量了  我不到24小时蹬了80%了  后天command才重置 明天只能蹬api了

评分

参与人数 1战斗力 +1 收起 理由
jonarryn + 1 好评加鹅

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-1 14:13 来自手机 | 显示全部楼层

RSI容易炼翻车啊

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-1 14:26 | 显示全部楼层

minimax m3是不是就是硬练rsi的例子?
回复

使用道具 举报

     
发表于 2026-9-1 14:32 来自手机 | 显示全部楼层
sellboy 发表于 2026-9-1 14:26
minimax m3是不是就是硬练rsi的例子?

记得刚出来的时候吹什么自主进化,比肩 opus

—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-9-1 14:42 | 显示全部楼层
唠叨 发表于 2026-9-1 11:24
我在蹬千问的plan   个人感觉qwen3.8flash比v4f好用   v4f可以考虑command     你可以点只看该作者看我楼 ...

开了千问的lite试了一下,确实qwen3.8flash代码智力上没问题,我自己一个月估计应该蹬不出10个亿,这个plan的量也刚好。不够的再用dsv4f补充。感谢大佬~~
回复

使用道具 举报

     
发表于 2026-9-1 14:47 | 显示全部楼层
blackdragon765 发表于 2026-9-1 11:18
所以老板们,现在还有什么便宜一点的dsv4f api么,plan也可以,预算50到100一个月,主要用来维护单位内网的 ...

minimax m3用来当视觉识别, 文生图和图生图拐杖还是可以的, 别指望这货能干活
回复

使用道具 举报

发表于 2026-9-1 14:47 | 显示全部楼层
CCauchy 发表于 2026-9-1 11:31
话说agentrouter还能坚持多久啊,怎么都不开放充值

好像已经这样纯公益一年了,只有每天签到和邀请方式能获得余额。
而且它扣余额比例在中转站里算最贵的,肯定不会打算收费,收费了没有任何竞争力

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-1 15:11 | 显示全部楼层
qwased 发表于 2026-9-1 03:48
你是不是交给他超出能力范围的任务了

破案了,hermes昨晚上出问题,上下文断了一段,我和他的信息对不上他就疯了……
回复

使用道具 举报

     
发表于 2026-9-1 15:22 来自手机 | 显示全部楼层
试了一下qwen3.8f,感觉速度和智力都还不错。最近发布的这几个flash模型好像都不错,感觉也是好起来了
反倒是大模型没一个真正比得上k3的
回复

使用道具 举报

     
发表于 2026-9-1 15:28 来自手机 | 显示全部楼层
blackdragon765 发表于 2026-9-1 11:18
所以老板们,现在还有什么便宜一点的dsv4f api么,plan也可以,预算50到100一个月,主要用来维护单位内网的 ...

我搞了commandcode,你可以考虑试试水,算手续费75r左右一个月吧,dsv4f给60刀额度,不过要用v4fv就只有20刀额度了

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-1 15:28 来自手机 | 显示全部楼层
我目前在用cherry studio写小说,蛮好奇其他楼友都是用啥软件,有推荐的吗?
话说,不同软件对AI的能力和开销,有影响吗?

—— 来自 Xiaomi 22081212C, Android 15, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-1 15:44 来自手机 | 显示全部楼层
1707k 发表于 2026-9-1 15:28
我目前在用cherry studio写小说,蛮好奇其他楼友都是用啥软件,有推荐的吗?
话说,不同软件对AI的能力和开 ...

Codex,拆成工作结构

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

评分

参与人数 1战斗力 +1 收起 理由
1707k + 1 感谢回复

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-1 15:50 | 显示全部楼层
蛋黄酱Release 发表于 2026-9-1 15:22
试了一下qwen3.8f,感觉速度和智力都还不错。最近发布的这几个flash模型好像都不错,感觉也是好起来了
反倒 ...

对的,K3的中文也最好。赶快出K3.1吧!
回复

使用道具 举报

发表于 2026-9-1 16:00 来自手机 | 显示全部楼层
买了gpt pro 20x,这下舒服了。也不知道glm拿来的勇气卖这么贵。

这一个月高强度用国模写代码,感觉综合效率跟gpt比差距还是很大的。
回复

使用道具 举报

     
发表于 2026-9-1 16:03 | 显示全部楼层
BarricadeMKXX 发表于 2026-9-1 15:28
我搞了commandcode,你可以考虑试试水,算手续费75r左右一个月吧,dsv4f给60刀额度,不过要用v4fv就只有2 ...

好!谢谢老板,我去看一下~~
回复

使用道具 举报

     
发表于 2026-9-1 16:07 | 显示全部楼层
之前一直是用 pi + ds4f,最近一些 side project 尝试了一下 dsh,感觉 dsh(标准模式)+ ds4f 就已经挺好了
回复

使用道具 举报

     
发表于 2026-9-1 16:35 来自手机 | 显示全部楼层
有人知道千问的token plan套餐大概相当于多少折扣吗
回复

使用道具 举报

     
发表于 2026-9-1 16:40 | 显示全部楼层
想问下我想用ai自己写个mud游戏,我能看得懂少量代码,应该用哪个ai比较合适?如果后续我做了图像资产要加入mud用啥ai合适?
回复

使用道具 举报

发表于 2026-9-1 16:42 | 显示全部楼层
K3要怎么用最划算呢?直接走官方订阅吗

(非码农
回复

使用道具 举报

     
发表于 2026-9-1 16:43 来自手机 | 显示全部楼层
神手之兔 发表于 2026-9-1 16:40
想问下我想用ai自己写个mud游戏,我能看得懂少量代码,应该用哪个ai比较合适?如果后续我做了图像资产要加 ...

GPT吧,GPT便宜

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-1 16:55 | 显示全部楼层
jinuzuktII 发表于 2026-9-1 16:42
K3要怎么用最划算呢?直接走官方订阅吗

(非码农

官方199的应该是性价比最高的
回复

使用道具 举报

     
发表于 2026-9-1 16:56 | 显示全部楼层
我把 Claude、OpenAI 全退了,改用豆包,享受没被 agentic 训练破坏的语言能力

暴论:AI 的未来在字节。

回复

使用道具 举报

     
发表于 2026-9-1 16:59 | 显示全部楼层
K3让我失望的是非coding领域的讨论完全没有更强一档的感觉
甚至不如v4pro,可能是问题场景的原因。
coding领域都拄上拐了,又贵又慢的模型直接pass。

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-1 17:04 | 显示全部楼层
本帖最后由 唠叨 于 2026-9-1 17:05 编辑
蛋黄酱Release 发表于 2026-9-1 16:35
有人知道千问的token plan套餐大概相当于多少折扣吗

1. 先算两天实际消耗总 Token
08-31:434,859 + 16,871,296 + 247,325 = 17,553,480

09-01:7,467,888 + 80,033,152 + 1,007,677 = 88,508,717

已用合计:17,553,480 + 88,508,717 = 106,062,197(约 1.0606 亿)

2. 反推 7 天总可用 Token 量
剩余 14.2% → 已用 85.8%

7 天总可用 Token = 106,062,197 ÷ 85.8% ≈ 123,615,614

即约 1.2362 亿 Tokens。

3. 按这两天(08-31 + 09-01)比例不变,分配这 1.2362 亿 Tokens
先算样本比例(总量 106,062,197):

类型        Token 数        占比
未缓存输入        7,902,747        7.451%
缓存命中输入        96,904,448        91.366%
输出        1,255,002        1.183%
应用到 123,615,614 Tokens:

类型        分配 Token 数(约)        单价(/Mtokens)        费用
未缓存输入        ≈ 9,210,000(9.21 M)        ¥0.8        ¥7.37
缓存命中输入        ≈ 112,960,000(112.96 M)        ¥0.1        ¥11.30
输出        ≈ 1,462,000(1.46 M)        ¥2.7        ¥3.95
4. 最终结果
7 天总可用 Token ≈ 1.2362 亿
按现有结构,全部用完总费用 ≈ ¥22.62 元
按四周计算,39元买90元用量


我得提醒一下 今天派子代理出现多次429 触发了TPM限流

顺便有没有路过的大佬指个路 哪里有蹬3.8flash更便宜的订阅啊

评分

参与人数 2战斗力 +2 收起 理由
jonarryn + 1 好评加鹅
蛋黄酱Release + 1 好评加鹅

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-1 17:10 | 显示全部楼层
神手之兔 发表于 2026-9-1 16:40
想问下我想用ai自己写个mud游戏,我能看得懂少量代码,应该用哪个ai比较合适?如果后续我做了图像资产要加 ...

我自己用的GPT Pro 20x,不过用下来感觉5x可能更合适一些。
我并不熟悉代码,每次AI写完之后,都要自己梳理一下AI都写了什么,实际并不能非常有效率的指挥调整代码和文档。好在学习了怎么和AI约定注释和文档说明后缓解了不少困难。

就是每周重置额度的时候,觉得自己都用不了多少,5x档位间隔使用可能更适合我。
开到20x应该是老练程序员才能用好吧。
回复

使用道具 举报

发表于 2026-9-1 17:11 | 显示全部楼层
奥柏伦亲王 发表于 2026-9-1 16:55
官方199的应该是性价比最高的

刚发现 199 的百万上下文还是分环境的,真坏呀
回复

使用道具 举报

     
发表于 2026-9-1 17:11 来自手机 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-1 17:29 编辑

等灰测的神秘模型吧,哪怕不是六边形战士也不怎么瘸腿(写文除外),但是总觉得参数又大了,价格不一定能下来…
回复

使用道具 举报

     
发表于 2026-9-1 17:14 来自手机 | 显示全部楼层
ayanamilin 发表于 2026-9-1 16:56
我把 Claude、OpenAI 全退了,改用豆包,享受没被 agentic 训练破坏的语言能力

暴论:AI 的未来在字节。

那美国大豆包显然更强点…
回复

使用道具 举报

     
发表于 2026-9-1 17:26 | 显示全部楼层
舞以 发表于 2026-9-1 16:59
K3让我失望的是非coding领域的讨论完全没有更强一档的感觉
甚至不如v4pro,可能是问题场景的原因。
coding ...

其他领域我不了解,但根据我用下来的体验,以及一些讨论的情况,K3在法律领域是通用模型SOTA
回复

使用道具 举报

     
发表于 2026-9-1 17:36 | 显示全部楼层
奥柏伦亲王 发表于 2026-9-1 17:26
其他领域我不了解,但根据我用下来的体验,以及一些讨论的情况,K3在法律领域是通用模型SOTA ...

Harvey基于K3后训练的法律专用模型吗
回复

使用道具 举报

     
发表于 2026-9-1 17:43 | 显示全部楼层
舞以 发表于 2026-9-1 16:59
K3让我失望的是非coding领域的讨论完全没有更强一档的感觉
甚至不如v4pro,可能是问题场景的原因。
coding ...

也不是,我用下来觉得K3的设计讨论方面还是很有意思的
回复

使用道具 举报

     
发表于 2026-9-1 17:45 | 显示全部楼层
奥柏伦亲王 发表于 2026-9-1 17:26
其他领域我不了解,但根据我用下来的体验,以及一些讨论的情况,K3在法律领域是通用模型SOTA ...

我是讨论的文史政治类的问题(没到甲的程度),感觉k3,v4pro,sol(同一个壳,不是官方app)的讨论深度差不多,遣词用句v4pro更好。

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-1 17:47 | 显示全部楼层
论讨论深度,gpt网页/app的pro模式有明显提升,但是剥掉这层官方壳之后sol感觉就一般了。

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-1 17:49 | 显示全部楼层
舞以 发表于 2026-9-1 17:45
我是讨论的文史政治类的问题(没到甲的程度),感觉k3,v4pro,sol(同一个壳,不是官方app)的讨论深度 ...

和现在的AI讨论最大的问题是如果我不知道我想要什么样的结果那AI也答不出来,人的上限决定模型的上限了
回复

使用道具 举报

     
发表于 2026-9-1 17:49 来自手机 | 显示全部楼层
舞以 发表于 2026-9-1 16:59
K3让我失望的是非coding领域的讨论完全没有更强一档的感觉
甚至不如v4pro,可能是问题场景的原因。
coding ...


K3在语文能力领域比如酒馆比ds v4pro强的多,如果你没感觉到差别,那就是你用的太少,用社区的话来说就是活人感
回复

使用道具 举报

     
发表于 2026-9-1 17:50 | 显示全部楼层
qwased 发表于 2026-9-1 17:36
Harvey基于K3后训练的法律专用模型吗

harvey对K3的认可度确实很高,认为它不仅是开源sota,在美国法上也比那几个闭源的表现更好,当然我觉得这事也有可能是双方在搞营销,KIMI要上市,harvey要后训练K3做自己的垂直模型。

但是从国内法领域来说,kimi在法律问题上确实显得很聪明,而且专武kimi-code、网页端、桌面端的kimi work都能直接接入华宇元典和天眼查的数据库,不需要单独配置mcp也不需要再交一份数据库的钱,也是非常用心了。如果是在workbuddy里用k3,可能会感觉差异没那么大。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 13:18 , Processed in 0.124953 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表