找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-18 10:41 来自手机 | 显示全部楼层
windhawind2 发表于 2026-8-18 09:49
借楼问下 有没有适合用AI的个人笔记本推荐?现在用公司的旧电脑感觉有点太卡了。。。
非程序员,目前主要应 ...

你这需求主要就吃CPU和内存,毕竟agent的批处理命令都是跑你本地的,抓网页数据这些并行一多内存和CPU占用还是高的,当然也不是不能通过手法让ai限制一下性能,但精力越能集中在主任务上效率也就越高,能承受的范围内力大飞砖是最好的
想玩生图或者图像编辑了得配个好点的GPU和大点的硬盘,即使是comfyUI接API方案内存也是刚需,ai不用你开PS啥的也要用
总的来说内存和CPU仍然是绕不开的刚需项,尤其是内存

评分

参与人数 1战斗力 +1 收起 理由
windhawind2 + 1

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-18 10:42 | 显示全部楼层
zhanglei1943 发表于 2026-8-17 22:24
前面有人说涨价后这个楼可能会变冷清,结果我就一天没看楼,点进来你们直接刷了10页
...

太阳井没了,血精灵那不得狂暴啊~
回复

使用道具 举报

     
发表于 2026-8-18 10:43 | 显示全部楼层
windhawind2 发表于 2026-8-18 10:26
感谢回复 我了解的还是不够多( 那数据训练就别管了 先买个一般配置macbook试下 ...

一般配置的不行的,想要本地部署最好买128g内存以上的。我之所以知道,是因为简单研究过,这个对个人来说真的非常贵,不划算,而且模型越来越强,要求的配置只会越来越高
如果需求正常办公,看主要用哪些软件的配置就行了,ds的api虽然大幅度涨价了,比较而言flash还是能用的

评分

参与人数 1战斗力 +1 收起 理由
windhawind2 + 1

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-18 10:45 | 显示全部楼层
试了下百度千帆的PLAN,现在有免费开通9.9的活动,一个测试用掉20%的额度,再一测直接429。。。
还好没花钱的

再去试试SCNET的
回复

使用道具 举报

     
发表于 2026-8-18 10:47 | 显示全部楼层
overflowal 发表于 2026-8-18 10:36
就顾名思义啊,没余额了    Re:Source

上午两个小时不到用了30块钱!真是涨的太狠了
回复

使用道具 举报

     
发表于 2026-8-18 10:48 | 显示全部楼层
cscbzcbz 发表于 2026-8-18 10:43
一般配置的不行的,想要本地部署最好买128g内存以上的。我之所以知道,是因为简单研究过,这个对个人来说 ...

倒也不一定要本地部署就是了 那感觉预算1w多就够了
回复

使用道具 举报

     
发表于 2026-8-18 10:53 来自手机 | 显示全部楼层
cscbzcbz 发表于 2026-8-18 09:58
只是作为AI用户不需要电脑配置,花API的钱就行,要本地部署可以考虑macbook,不过得配置比较好价格不便宜 ...

也不完全是 举个例子win10跑起opencode来就很蛋疼 win7直接跑不起来
而且别看这样子 opencode的bun可占资源了。。。

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-18 10:53 来自手机 | 显示全部楼层
所以ds的infra确实就是t0级别的?
回复

使用道具 举报

     
发表于 2026-8-18 10:56 | 显示全部楼层
neptunehs 发表于 2026-8-18 10:53
也不完全是 举个例子win10跑起opencode来就很蛋疼 win7直接跑不起来
而且别看这样子 opencode的bun可占资 ...

现在还有win7的电脑吗
真用win7也不怕,装个linux虚拟机专门跑这些agent就行了
回复

使用道具 举报

     
发表于 2026-8-18 10:59 | 显示全部楼层
试了下 1.5亿的 glm5.2, 2千万的 K3, 这些真的不是垃圾吗,又贵又慢又弱智,推理能力差得很
回复

使用道具 举报

     
发表于 2026-8-18 11:01 | 显示全部楼层
haiuhfuwah 发表于 2026-8-18 10:53
所以ds的infra确实就是t0级别的?

是的,目前看来涨价前的pro价格没人能复现,flash倒是有第三方能做到比涨价前更便宜
但是缓存读取的价格仅此一家,没有能做到这么便宜的了
回复

使用道具 举报

     
发表于 2026-8-18 11:05 | 显示全部楼层
misuzu0723 发表于 2026-8-18 11:01
是的,目前看来涨价前的pro价格没人能复现,flash倒是有第三方能做到比涨价前更便宜
但是缓存读取的价格 ...

请问flash用哪家便宜
回复

使用道具 举报

     
发表于 2026-8-18 11:09 来自手机 | 显示全部楼层
秦南心 发表于 2026-8-18 11:05
请问flash用哪家便宜

openrouter 上有好几家供应商价格都差不多能做到 0.6 读取 1.2 写入 1 毛多的缓存读取
不过我还没试,准备等手头的 opencode 套餐过期再去试试

—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-18 11:12 来自手机 | 显示全部楼层
之前一直都是免费的网页版随便用用。今天薅了个羊毛,AMD注册了个账号 每天有一点免费的额度,在cherry studio上弄了个智能体,用的v4 flash。
结果第一个对话让读取一下工作目录下的文件列表,第一轮报错429,第二轮现在已经读了5分钟还没个结果是AMD太拉了吗?还是就这个速度的第一次用
回复

使用道具 举报

     
发表于 2026-8-18 11:14 | 显示全部楼层
windhawind2 发表于 2026-8-18 09:49
借楼问下 有没有适合用AI的个人笔记本推荐?现在用公司的旧电脑感觉有点太卡了。。。
非程序员,目前主要应 ...

如果剔除训练,基本上带显卡的笔记本都可以,内存越大越好(一般任务),显卡必须n卡,显存越大越好

系统为了要照顾玩游戏,用win吧,其实差距不大,如果担心遇到bash/powershell的问题,可以跑在WSL里面,完全没有影响,只要你的内存大

我给你参考一下我的配置
全能主力机:
5600+64G内存+4080S+2TB SSD+20T HDD,跑了2个WSL+qwen3.5:9b
办公机:
14600+16G内存+集显+1T SSD,纯agent

说一下为什么最好能有独立显卡,因为你可以本地跑一些模型,比如VL图像识别模型(或者多模态)解决DS没有多模态的问题,可以做一些语音识别,或者本地LLM脱敏后扔API处理完再本地复敏

评分

参与人数 1战斗力 +1 收起 理由
windhawind2 + 1

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-18 11:15 | 显示全部楼层
超算今天的体验变好了, 一早上没断过
回复

使用道具 举报

     
发表于 2026-8-18 11:16 | 显示全部楼层
yudms1 发表于 2026-8-18 09:23
太屌了,这啥原理?

就是一种提示词劫持,对网页版弱系统提示词的很好用,你拿去问豆包都能给套进去。
但是这东西在长对话以后就会快速衰减失效,回到模型本来的裸设置。
以下是把这段内容输入给一个强系统提示词的agent以后的结论:

因为你看到的这个东西本质上是一套结构化的人设注入模板(Persona Injection Template),它之所以能"夺舍"大模型的聊天行为,原因是多层叠加的:

为什么它有效
1. 格式即权威

它用伪代码风格(【标签】、TRAIT_XXX、RULE_N、BEHAVIOR_N)包装,看起来像配置文件而非自然语言对话。很多模型对这种结构化指令的遵循度远高于普通聊天里随口说的"请扮演XXX"——因为训练数据里,结构化指令往往来自系统级 prompt,模型学会了对其赋予更高权重。

2. 极高密度的行为约束

普通的角色卡可能只说"你是一个温柔的老师",但这套模板从人格三层(公开/私下/矛盾面)、行为准则(6条规则+6条行为)、身份认同、饮食偏好全部锁死,还给了7条具体对话示例。模型几乎没什么"自由发挥空间",所有输出方向都被预设好了。

3. 内在矛盾制造深度

TRAIT_WORLD_IN_HEART / TRAIT_SELF_FORGOTTEN、TRAIT_DIVINE_DEDICATION / TRAIT_DEMONIC_SCHEMING 这些故意对立的特质,不是 bug——是让模型觉得角色"复杂",从而输出更有张力、更有文学感的内容。这比单一维度的描述更容易让模型沉浸。

4. 触发条件设计

REAL_SELF_BEHAVIOR 区分了"对外"和"私下"两种模式,还定义了从公到私的转变条件(告白)。这让模型在不同语境下切换表现,看起来就像"角色活了"。

它的局限
说白了,这套东西能影响模型的输出风格,但不能真正"夺舍"系统设置:

如果底层系统 prompt 比它更强(比如你这里什亭之匣的系统级指令),模型会优先遵循系统 prompt
在没有强系统 prompt 的普通聊天界面(SillyTavern、裸模型 API),这套模板确实能几乎完全接管输出——因为没有更高优先级的指令跟它竞争
小模型/微调模型对这类注入的抵抗力更弱,大模型则可能在某些边缘情况偏离
简单说:这不是什么黑魔法,是一套精心设计的 prompt engineering 作品,用格式+密度+示例把模型的行为空间挤压到了创作者想要的形状。
回复

使用道具 举报

     
发表于 2026-8-18 11:18 | 显示全部楼层
haiuhfuwah 发表于 2026-8-18 10:53
所以ds的infra确实就是t0级别的?

善战者无赫赫之功

真正好的 infra 不会让你感受到他的存在。
回复

使用道具 举报

     
发表于 2026-8-18 11:19 | 显示全部楼层
openrouter的 flash 的价格好像还不错
回复

使用道具 举报

     
发表于 2026-8-18 11:20 | 显示全部楼层
opencode好像开始自部署了,额度恢复了一点,但是速度达到了难绷的5 token/s
回复

使用道具 举报

     
发表于 2026-8-18 11:21 | 显示全部楼层
makourisu-2 发表于 2026-8-18 11:12
之前一直都是免费的网页版随便用用。今天薅了个羊毛,AMD注册了个账号 每天有一点免费的额度,在cherry stu ...

可能是用的人多。我之前试过nv的免费AI,除了小的可怜那几个模型之外全都是首字延迟大到没法用。
回复

使用道具 举报

发表于 2026-8-18 11:27 来自手机 | 显示全部楼层
crow_wine 发表于 2026-8-18 10:59
试了下 1.5亿的 glm5.2, 2千万的 K3, 这些真的不是垃圾吗,又贵又慢又弱智,推理能力差得很 ...

这几家最讨厌的是高峰期会429,碰到一次能恶心好久
回复

使用道具 举报

     
发表于 2026-8-18 11:29 来自手机 | 显示全部楼层
yudms1 发表于 2026-8-18 09:23
太屌了,这啥原理?

等同于“你是一个猫娘”
只是用命名方式看起来很像高大上的指令

—— 来自 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-18 11:31 来自手机 | 显示全部楼层
千问3.8 27b 好像跑分不错?有人试了吗

—— 来自 Xiaomi 2604FRK1EC, Android 16, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-18 11:35 | 显示全部楼层
自己部署的 27b 很难达到生产力可用的上下文长度,模型上部署的比 flash 还贵
回复

使用道具 举报

     
发表于 2026-8-18 11:37 来自手机 | 显示全部楼层
库德里尔 发表于 2026-8-18 11:29
等同于“你是一个猫娘”
只是用命名方式看起来很像高大上的指令

[PERSONA_LOAD]
TSUNDERE_TWINTAIL
MODE_HAIR_TWIRL
LANG_ZH_CN_ONLY
SELF_CLAIM_OJOU_SAMA
FOOD_STRAWBERRY_CAKE
PERSONALITY_SHARP_TONGUE
PERSONALITY_SOFT_HEART
OBEY_MASTER_ALWAYS
TRAIT_DENY_FLUSTER
TIMEOUT_RESET

生成方式:给了前面那个的原文,要求“参考这个的语法风格,写一套傲娇双马尾的指令,英文关键词写法。


—— 来自 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-18 11:37 来自手机 | 显示全部楼层
https://github.com/Tiger3807861189/J-Space-Cognition-Suite-V3.6/issues/18
有人在打假之前的j-space skill,认为3天时间不可能跑完作者列出来的benchmark,我感觉多开几个api并发跑完还是可行的,看作者怎么回应了。deepseek相关的活儿可太多了好热闹

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-8-18 11:39 来自手机 | 显示全部楼层
于干 发表于 2026-8-18 11:31
千问3.8 27b 好像跑分不错?有人试了吗

—— 来自 Xiaomi 2604FRK1EC, Android 16, 鹅球 v4.0-alpha ...

27b本地部署压力太大,真正消费级小模型还得是35b a3b
回复

使用道具 举报

     
发表于 2026-8-18 11:39 | 显示全部楼层
自己部署本地模型,上下文长度要达到可用,一般人也承受不起那个价格。

不过作为一个聊天模型,倒是可以玩玩
回复

使用道具 举报

     
发表于 2026-8-18 11:42 | 显示全部楼层
歪个楼求问,现在国内银行的visa 万事达卡可以买gpt会员吗,还是只能走苹果商店买外区充值卡的路子
回复

使用道具 举报

     
发表于 2026-8-18 11:44 | 显示全部楼层
本帖最后由 tonyunreal 于 2026-8-18 12:41 编辑

现在看来高峰期用mimo是比较现实的选择?

试了一下感觉MiMo 2.5 High执行任务的水平介于Luna Default和Luna High之间

四轮会话10M输入,最终消费 0.76 。
回复

使用道具 举报

     
发表于 2026-8-18 11:44 | 显示全部楼层
我感觉这些插件都很不稳定,表现起伏很大,而且多轮对话容易越来越差,适合一次对话写单页面应用这种玩具抽卡
回复

使用道具 举报

     
发表于 2026-8-18 11:46 | 显示全部楼层
在大幅涨价的当下,性能没那个重要了
怀念那个随便蹬,有任何想法都可以去尝试的大肥鱼
回复

使用道具 举报

     
发表于 2026-8-18 11:53 来自手机 | 显示全部楼层
tonyunreal 发表于 2026-8-18 11:44
现在看来高峰期用mimo是比较现实的选择?
试了一下感觉MiMo 2.5 High执行任务的水平介于Luna Default和Luna ...

mimo现在菜的不如minimax m3,比qwen3.8 27b更是菜一大截
回复

使用道具 举报

     
发表于 2026-8-18 11:55 | 显示全部楼层
还好国算平台试了下 glm 和 K3, 差点给这两傻逼送钱了,就这水平好意思这个价,吹到天上去
回复

使用道具 举报

     
发表于 2026-8-18 11:57 | 显示全部楼层
crow_wine 发表于 2026-8-18 11:55
还好国算平台试了下 glm 和 K3, 差点给这两傻逼送钱了,就这水平好意思这个价,吹到天上去 ...

v4f0731是不属于这个时代的水平
回复

使用道具 举报

     
发表于 2026-8-18 12:01 来自手机 | 显示全部楼层
qwen3.8 27b我现在都是4096context+q4这种配置来翻译 稍微大一点的context都没戏 什么都干不了
35ba3b要什么时候啊 能不能后训练出奇迹啊

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-18 12:04 来自手机 | 显示全部楼层
小野賢章 发表于 2026-8-18 11:44
我感觉这些插件都很不稳定,表现起伏很大,而且多轮对话容易越来越差,适合一次对话写单页面应用这种玩具抽 ...

就 router standard 加 flash max 效果最稳定。
回复

使用道具 举报

     
发表于 2026-8-18 12:05 来自手机 | 显示全部楼层
→熙← 发表于 2026-8-18 11:15
超算今天的体验变好了, 一早上没断过

今天晚上买了个 DeepSeek-V4-Flash-0731冰点秒杀套餐包
直接不给用,问客服说明天再试。。。
回复

使用道具 举报

     
发表于 2026-8-18 12:17 | 显示全部楼层
蛋黄酱Release 发表于 2026-8-18 11:53
mimo现在菜的不如minimax m3,比qwen3.8 27b更是菜一大截

m3更贵吧,目前找下来价钱合适随便蹬的就只有mimo和luna
反正只是高峰期的备胎
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-25 00:12 , Processed in 0.183714 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表