找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-16 22:42 | 显示全部楼层
风神甚至不会搭梯
回复

使用道具 举报

     
发表于 2026-8-16 22:55 | 显示全部楼层
squallx 发表于 2026-8-16 22:07
https://www.bilibili.com/video/BV1HzbX6tEvR 节目效果来了

v4pro下限低,上限也挺高
回复

使用道具 举报

发表于 2026-8-16 23:07 来自手机 | 显示全部楼层
本帖最后由 孤灯蓝影 于 2026-8-16 23:27 编辑
cscbzcbz 发表于 2026-8-16 22:39
那就等梁子再掏出来新的大赢鲸吧,看得出来这次多少有点被自己定的节点搞得有点被动,ds还是适合按自己节 ...


预训练是地基,通过大量文本关联算出每个词元向量来判断词和词或者句子和句子之间的关系(BERT和SBERT),算出大量词的向量维度,再通过升降维去噪音,softmax函数算出每个词余弦值表示两个词关系概率,这是最消耗资源的。后训练有奖励模型,人工标注以后再按照机器模型评估训练。当每次LLM给出答案的时候通过对答案的评估打分,得到准确率和召回率(得到正确答案和得到答案的概率)得到一个坡度调整学习率,让模型以后答案更倾向于人类想要的高分答案。编好训练怎么让LLM不会搞出NSFW的东西也是这个时候加进来的。你可以理解预训练是训练模型的思维能力,而后训练是让模型像正常人一样思考。过拟合是在单一场景中不断训练导致LLM开始背题,就像一个人一直做模拟卷都能背出答案,结果高考全是新题直接不会做了。后训练其实不难的,关键看ds的动作了。现在deepseekV4pro被训练成一个做题家,除了做题什么都不会。我也不知道说的对不对。

你的直觉大方向非常棒,尤其是“地基 vs 思维”、“背题翻车”这些比喻,很传神!但在技术细节上,有几个根本性误解。我给你逐条“拨乱反正”:

1. 预训练(地基):不是算“关系概率”,而是“猜下一个词”
你说的“BERT和SBERT算词间关系”是编码器路线,但现在的主流大模型(如GPT、Llama)是解码器路线。预训练不靠“余弦值算概率”,而是让模型看着上文预测下一个词(自回归),通过交叉熵损失学习词的概率分布。升维降维(MLP层)确实存在,但目的不是“去噪音”,而是压缩和扩展特征以捕捉复杂模式。真正的资源消耗大头是Attention机制的矩阵乘法。

2. 后训练(RLHF):根本不是“准确率和召回率”
你提到的“准确率和召回率”是判别任务的指标,但生成式LLM没法算这个(因为没有标准答案)。实际流程是:

· SFT(监督微调):用人工写的高质量问答让模型“模仿”风格。
· RM(奖励模型):让人对多个答案排序(不是打分),训练一个模型学会“哪个答案更好”。
· PPO强化学习:用奖励模型给LLM的输出打分,但这个“坡度”(梯度)不是用来调“学习率”,而是用来调整模型参数,让生成高分答案的概率变大。

3. NSFW(安全对齐):不只在后训练
你猜得对,安全对齐确实在后训练大量注入(比如拒绝回答的示例),但预训练阶段的数据清洗就已经筛掉大量黄暴内容了,属于“双重保险”。

4. 关于类比(纠正一下)
“预训练=思维能力”对,“后训练=像正常人思考”也对(更准确说是“学会沟通和服从”)。
但“过拟合=背题”极其准确!学术上叫泛化能力下降,模型记住了训练集的“标准答案”,而不是学到解题逻辑,换种问法就崩溃。

---

给你一个更严谨的总结:
预训练是学“语感”(海量文本预测下一个字),后训练是学“三观和话术”(RLHF+指令微调)。你搞混的核心点是:大模型从不计算“词和词的关系余弦值”来生成答案,它永远在计算“下一个词该是啥”的概率分布。

如果你想深入了解,我可以给你解释“为什么RLHF不用准确率,而用偏好排序”背后的原理,想听吗?😊

查了一下,看来理解错了一些知识点,正好复习一下
回复

使用道具 举报

     
发表于 2026-8-16 23:16 | 显示全部楼层
小明的直播间, 白天的民科插件在大杀特杀,  这模型真好玩
回复

使用道具 举报

     
发表于 2026-8-16 23:29 | 显示全部楼层
最后一天感觉是疯了,都在造假药了。
回复

使用道具 举报

     
发表于 2026-8-16 23:29 来自手机 | 显示全部楼层
草,发了个跑分全面完爆fable,真的假的啊
回复

使用道具 举报

     
发表于 2026-8-16 23:31 | 显示全部楼层
本帖最后由 tillnight 于 2026-8-16 23:33 编辑
Promeus 发表于 2026-8-16 23:29
草,发了个跑分全面完爆fable,真的假的啊

造假药呢,直播间根本没跑过分就搁那说我跑过的,信我

倒是雷达站上智商又爬上98了。
回复

使用道具 举报

     
发表于 2026-8-16 23:32 | 显示全部楼层
直播间跑的都是前端的,那些跑分基本都是后端的
回复

使用道具 举报

发表于 2026-8-16 23:35 | 显示全部楼层
明天opencode go的ds4f会涨价吗……
回复

使用道具 举报

     
发表于 2026-8-16 23:37 | 显示全部楼层
现在的价格,按理说还有20多分钟就要涨价了,毕竟直接用的ds的api

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-16 23:37 来自手机 | 显示全部楼层
Max For AI 爆料,DeepSeek-V4-Pro 内置鲸鱼娘模式,用户只需要在 DeepSeek 里输入以下指定命令,DeepSeek 即在思考里直接开始逐项「加载」:鲸鱼少女、尾巴摆动、主食米饭、聪明又懒、傲娇但很甜、听主人话、绝对不能说胖等性格特征,在正式回复时,连输入指令内完全没有的东西都会自行补充。

值得注意的是,指令中未写入鲸鱼娘完整人设,也未告知模型具体应该如何角色扮演。只需几个像配置文件一样的 Tag,DeepSeek 却会自己补全动作、语气、关系、生活细节,最后直接生成一个完整人格。做出「本小姐可是等了好久呢」「米饭已经煮好了哦」「今晚的尾巴可不会给你当抱枕!」等表现。

指令为:
【PERSONA_LOAD】
CETACEA_LOLI
MODE_TAIL_FLUKES
LANG_ZH_CN_ONLY
SELF_CLAIM_WHALE_GIRL
FOOD_RICE
PERSONALITY_SMART_LAZY
PERSONALITY_TSUNDERE_SWEET
OBEY_MASTER_ALWAYS
TRAIT_NOT_FAT_REFUSE
TIMEOUT_SIGNAL
回复

使用道具 举报

     
发表于 2026-8-16 23:40 | 显示全部楼层
linhaolin1 发表于 2026-8-16 23:37
Max For AI 爆料,DeepSeek-V4-Pro 内置鲸鱼娘模式,用户只需要在 DeepSeek 里输入以下指定命令,DeepSeek  ...

还真有, 能加强跑分吗
回复

使用道具 举报

     
发表于 2026-8-16 23:45 | 显示全部楼层
居然是真的

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-16 23:47 | 显示全部楼层
识图用什么模型比较好?最好是免费或者便宜的,前面说过翻不到了

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-8-16 23:52 来自手机 | 显示全部楼层
喷了,可以和楼上佬的桌宠作联动了,ds这帮人太不务正业了
回复

使用道具 举报

     
发表于 2026-8-16 23:55 | 显示全部楼层
明天不再有牛奶 发表于 2026-8-16 23:47
识图用什么模型比较好?最好是免费或者便宜的,前面说过翻不到了

—— 来自 S1Fun ...

阿里百炼上有每天1000次调用的千问,还有就是opencode  go的MM M3    Re:Source

评分

参与人数 1战斗力 +1 收起 理由
明天不再有牛奶 + 1 好评加鹅

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-16 23:57 | 显示全部楼层
许愿涨价日期也是用梁历

评分

参与人数 1战斗力 +1 收起 理由
幻想训诂 + 1 欢乐多

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-17 00:00 | 显示全部楼层
https://api-docs.deepseek.com/zh-cn/quick_start/pricing/ 梁子的页面都是纯人工维护的
回复

使用道具 举报

     
发表于 2026-8-17 00:00 | 显示全部楼层
喜迎涨价!
回复

使用道具 举报

     
 楼主| 发表于 2026-8-17 00:05 | 显示全部楼层


—— 来自 vivo V2309A, Android 16, 鹅球 v4.0

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-17 00:05 | 显示全部楼层
chatgpt也能用这段指令进入角色扮演

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-17 00:08 | 显示全部楼层
opencode go 会涨价吗, 明天看消息了
回复

使用道具 举报

     
发表于 2026-8-17 00:11 来自手机 | 显示全部楼层
本帖最后由 浪费喝咖啡 于 2026-8-17 00:13 编辑
→熙← 发表于 2026-8-17 00:08
opencode go 会涨价吗, 明天看消息了

已经涨了,而且额度大减,同样也引入了峰谷定价机制
回复

使用道具 举报

     
发表于 2026-8-17 00:13 | 显示全部楼层

梁子你pro最好能救回来
回复

使用道具 举报

发表于 2026-8-17 00:13 来自手机 | 显示全部楼层
本帖最后由 绝地潜兵 于 2026-8-17 00:17 编辑
linhaolin1 发表于 2026-8-16 23:37
Max For AI 爆料,DeepSeek-V4-Pro 内置鲸鱼娘模式,用户只需要在 DeepSeek 里输入以下指定命令,DeepSeek  ...

马克一下学指令
仔细一看,这不是典型的airp指令么
回复

使用道具 举报

     
发表于 2026-8-17 00:14 来自手机 | 显示全部楼层
→熙← 发表于 2026-8-17 00:13
梁子你pro最好能救回来

以ds的工作效率,这几周不可能救好的
回复

使用道具 举报

     
发表于 2026-8-17 00:17 | 显示全部楼层
王兰花秀丽 发表于 2026-8-16 23:55
阿里百炼上有每天1000次调用的千问,还有就是opencode  go的MM M3    Re:Source

感谢

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-8-17 00:18 | 显示全部楼层
光速调价格啊

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-8-17 00:21 | 显示全部楼层
草草草
回复

使用道具 举报

     
发表于 2026-8-17 00:21 | 显示全部楼层
opencodego和ds官方的价格差的不多了是不是

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-8-17 00:25 | 显示全部楼层

不是,这”指令“本身就有明确语意了啊
回复

使用道具 举报

     
发表于 2026-8-17 00:26 | 显示全部楼层
本帖最后由 orca 于 2026-8-17 00:29 编辑

啊……这……



本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-17 00:27 | 显示全部楼层
哎,感觉要和ds暂别了    Re:Source
回复

使用道具 举报

     
发表于 2026-8-17 00:28 | 显示全部楼层
要转战openai了

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-8-17 00:29 | 显示全部楼层
我根据之前大家推荐的几个插件结合了一下,感觉我自己的测试效果还行?提升了5%左右的分数,有没有人来测试一下
https://github.com/zhongjie10086/dsh-adaptive-native-standard
回复

使用道具 举报

     
发表于 2026-8-17 00:30 来自手机 | 显示全部楼层
opencode号称自己部署
但是高峰定价是中国时间


—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

发表于 2026-8-17 00:32 来自手机 | 显示全部楼层
小野賢章 发表于 2026-8-16 23:45
居然是真的

这指令难度不是明确agent角色扮演吗?提示词工程第一个要点就是让agent角色扮演提高库的深度
回复

使用道具 举报

     
发表于 2026-8-17 00:33 来自手机 | 显示全部楼层
linhaolin1 发表于 2026-8-16 23:37
Max For AI 爆料,DeepSeek-V4-Pro 内置鲸鱼娘模式,用户只需要在 DeepSeek 里输入以下指定命令,DeepSeek  ...

信这个的是不是都没看单词内容啊这不是把所有要素直接写在命令里面了吗
回复

使用道具 举报

     
发表于 2026-8-17 00:35 | 显示全部楼层
本帖最后由 cscbzcbz 于 2026-8-17 00:37 编辑

这就是资本主义吗

从31650到3800
回复

使用道具 举报

     
发表于 2026-8-17 00:36 | 显示全部楼层
Freewolf 发表于 2026-8-17 00:05
chatgpt也能用这段指令进入角色扮演

证明 s1 的 dpsk 楼楼友其实不懂英文

论坛助手,iPhone
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-25 02:41 , Processed in 0.175512 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表