windhawind2 发表于 2026-8-18 09:49
借楼问下 有没有适合用AI的个人笔记本推荐?现在用公司的旧电脑感觉有点太卡了。。。
非程序员,目前主要应 ...
你这需求主要就吃CPU和内存,毕竟agent的批处理命令都是跑你本地的,抓网页数据这些并行一多内存和CPU占用还是高的,当然也不是不能通过手法让ai限制一下性能,但精力越能集中在主任务上效率也就越高,能承受的范围内力大飞砖是最好的
想玩生图或者图像编辑了得配个好点的GPU和大点的硬盘,即使是comfyUI接API方案内存也是刚需,ai不用你开PS啥的也要用
总的来说内存和CPU仍然是绕不开的刚需项,尤其是内存
zhanglei1943 发表于 2026-8-17 22:24
前面有人说涨价后这个楼可能会变冷清,结果我就一天没看楼,点进来你们直接刷了10页
...
太阳井没了,血精灵那不得狂暴啊~
windhawind2 发表于 2026-8-18 10:26
感谢回复 我了解的还是不够多( 那数据训练就别管了 先买个一般配置macbook试下 ...
一般配置的不行的,想要本地部署最好买128g内存以上的。我之所以知道,是因为简单研究过,这个对个人来说真的非常贵,不划算,而且模型越来越强,要求的配置只会越来越高
如果需求正常办公,看主要用哪些软件的配置就行了,ds的api虽然大幅度涨价了,比较而言flash还是能用的
试了下百度千帆的PLAN,现在有免费开通9.9的活动,一个测试用掉20%的额度,再一测直接429。。。
还好没花钱的
再去试试SCNET的
overflowal 发表于 2026-8-18 10:36
就顾名思义啊,没余额了 Re:Source
上午两个小时不到用了30块钱!真是涨的太狠了
cscbzcbz 发表于 2026-8-18 10:43
一般配置的不行的,想要本地部署最好买128g内存以上的。我之所以知道,是因为简单研究过,这个对个人来说 ...
倒也不一定要本地部署就是了 那感觉预算1w多就够了
cscbzcbz 发表于 2026-8-18 09:58
只是作为AI用户不需要电脑配置,花API的钱就行,要本地部署可以考虑macbook,不过得配置比较好价格不便宜 ...
也不完全是 举个例子win10跑起opencode来就很蛋疼 win7直接跑不起来
而且别看这样子 opencode的bun可占资源了。。。
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
所以ds的infra确实就是t0级别的?
neptunehs 发表于 2026-8-18 10:53
也不完全是 举个例子win10跑起opencode来就很蛋疼 win7直接跑不起来
而且别看这样子 opencode的bun可占资 ...
现在还有win7的电脑吗
真用win7也不怕,装个linux虚拟机专门跑这些agent就行了
试了下 1.5亿的 glm5.2, 2千万的 K3, 这些真的不是垃圾吗,又贵又慢又弱智,推理能力差得很
haiuhfuwah 发表于 2026-8-18 10:53
所以ds的infra确实就是t0级别的?
是的,目前看来涨价前的pro价格没人能复现,flash倒是有第三方能做到比涨价前更便宜
但是缓存读取的价格仅此一家,没有能做到这么便宜的了
misuzu0723 发表于 2026-8-18 11:01
是的,目前看来涨价前的pro价格没人能复现,flash倒是有第三方能做到比涨价前更便宜
但是缓存读取的价格 ...
请问flash用哪家便宜
秦南心 发表于 2026-8-18 11:05
请问flash用哪家便宜
openrouter 上有好几家供应商价格都差不多能做到 0.6 读取 1.2 写入 1 毛多的缓存读取
不过我还没试,准备等手头的 opencode 套餐过期再去试试
—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha
之前一直都是免费的网页版随便用用。今天薅了个羊毛,AMD注册了个账号 每天有一点免费的额度,在cherry studio上弄了个智能体,用的v4 flash。
结果第一个对话让读取一下工作目录下的文件列表,第一轮报错429,第二轮现在已经读了5分钟还没个结果是AMD太拉了吗?还是就这个速度的第一次用
windhawind2 发表于 2026-8-18 09:49
借楼问下 有没有适合用AI的个人笔记本推荐?现在用公司的旧电脑感觉有点太卡了。。。
非程序员,目前主要应 ...
如果剔除训练,基本上带显卡的笔记本都可以,内存越大越好(一般任务),显卡必须n卡,显存越大越好
系统为了要照顾玩游戏,用win吧,其实差距不大,如果担心遇到bash/powershell的问题,可以跑在WSL里面,完全没有影响,只要你的内存大
我给你参考一下我的配置
全能主力机:
5600+64G内存+4080S+2TB SSD+20T HDD,跑了2个WSL+qwen3.5:9b
办公机:
14600+16G内存+集显+1T SSD,纯agent
说一下为什么最好能有独立显卡,因为你可以本地跑一些模型,比如VL图像识别模型(或者多模态)解决DS没有多模态的问题,可以做一些语音识别,或者本地LLM脱敏后扔API处理完再本地复敏
超算今天的体验变好了, 一早上没断过
yudms1 发表于 2026-8-18 09:23
太屌了,这啥原理?
就是一种提示词劫持,对网页版弱系统提示词的很好用,你拿去问豆包都能给套进去。
但是这东西在长对话以后就会快速衰减失效,回到模型本来的裸设置。
以下是把这段内容输入给一个强系统提示词的agent以后的结论:
因为你看到的这个东西本质上是一套结构化的人设注入模板(Persona Injection Template),它之所以能"夺舍"大模型的聊天行为,原因是多层叠加的:
为什么它有效
1. 格式即权威
它用伪代码风格(【标签】、TRAIT_XXX、RULE_N、BEHAVIOR_N)包装,看起来像配置文件而非自然语言对话。很多模型对这种结构化指令的遵循度远高于普通聊天里随口说的"请扮演XXX"——因为训练数据里,结构化指令往往来自系统级 prompt,模型学会了对其赋予更高权重。
2. 极高密度的行为约束
普通的角色卡可能只说"你是一个温柔的老师",但这套模板从人格三层(公开/私下/矛盾面)、行为准则(6条规则+6条行为)、身份认同、饮食偏好全部锁死,还给了7条具体对话示例。模型几乎没什么"自由发挥空间",所有输出方向都被预设好了。
3. 内在矛盾制造深度
TRAIT_WORLD_IN_HEART / TRAIT_SELF_FORGOTTEN、TRAIT_DIVINE_DEDICATION / TRAIT_DEMONIC_SCHEMING 这些故意对立的特质,不是 bug——是让模型觉得角色"复杂",从而输出更有张力、更有文学感的内容。这比单一维度的描述更容易让模型沉浸。
4. 触发条件设计
REAL_SELF_BEHAVIOR 区分了"对外"和"私下"两种模式,还定义了从公到私的转变条件(告白)。这让模型在不同语境下切换表现,看起来就像"角色活了"。
它的局限
说白了,这套东西能影响模型的输出风格,但不能真正"夺舍"系统设置:
如果底层系统 prompt 比它更强(比如你这里什亭之匣的系统级指令),模型会优先遵循系统 prompt
在没有强系统 prompt 的普通聊天界面(SillyTavern、裸模型 API),这套模板确实能几乎完全接管输出——因为没有更高优先级的指令跟它竞争
小模型/微调模型对这类注入的抵抗力更弱,大模型则可能在某些边缘情况偏离
简单说:这不是什么黑魔法,是一套精心设计的 prompt engineering 作品,用格式+密度+示例把模型的行为空间挤压到了创作者想要的形状。
haiuhfuwah 发表于 2026-8-18 10:53
所以ds的infra确实就是t0级别的?
善战者无赫赫之功
真正好的 infra 不会让你感受到他的存在。
openrouter的 flash 的价格好像还不错
opencode好像开始自部署了,额度恢复了一点,但是速度达到了难绷的5 token/s
makourisu-2 发表于 2026-8-18 11:12
之前一直都是免费的网页版随便用用。今天薅了个羊毛,AMD注册了个账号 每天有一点免费的额度,在cherry stu ...
可能是用的人多。我之前试过nv的免费AI,除了小的可怜那几个模型之外全都是首字延迟大到没法用。
crow_wine 发表于 2026-8-18 10:59
试了下 1.5亿的 glm5.2, 2千万的 K3, 这些真的不是垃圾吗,又贵又慢又弱智,推理能力差得很 ...
这几家最讨厌的是高峰期会429,碰到一次能恶心好久
yudms1 发表于 2026-8-18 09:23
太屌了,这啥原理?
等同于“你是一个猫娘”
只是用命名方式看起来很像高大上的指令
—— 来自 鹅球 v3.5.99
千问3.8 27b 好像跑分不错?有人试了吗
—— 来自 Xiaomi 2604FRK1EC, Android 16, 鹅球 v4.0-alpha
自己部署的 27b 很难达到生产力可用的上下文长度,模型上部署的比 flash 还贵
库德里尔 发表于 2026-8-18 11:29
等同于“你是一个猫娘”
只是用命名方式看起来很像高大上的指令
TSUNDERE_TWINTAIL
MODE_HAIR_TWIRL
LANG_ZH_CN_ONLY
SELF_CLAIM_OJOU_SAMA
FOOD_STRAWBERRY_CAKE
PERSONALITY_SHARP_TONGUE
PERSONALITY_SOFT_HEART
OBEY_MASTER_ALWAYS
TRAIT_DENY_FLUSTER
TIMEOUT_RESET
生成方式:给了前面那个的原文,要求“参考这个的语法风格,写一套傲娇双马尾的指令,英文关键词写法。
—— 来自 鹅球 v3.5.99
https://github.com/Tiger3807861189/J-Space-Cognition-Suite-V3.6/issues/18
有人在打假之前的j-space skill,认为3天时间不可能跑完作者列出来的benchmark,我感觉多开几个api并发跑完还是可行的,看作者怎么回应了。deepseek相关的活儿可太多了好热闹
—— 来自 鹅球 v3.3.96
于干 发表于 2026-8-18 11:31
千问3.8 27b 好像跑分不错?有人试了吗
—— 来自 Xiaomi 2604FRK1EC, Android 16, 鹅球 v4.0-alpha ...
27b本地部署压力太大,真正消费级小模型还得是35b a3b
自己部署本地模型,上下文长度要达到可用,一般人也承受不起那个价格。
不过作为一个聊天模型,倒是可以玩玩
歪个楼求问,现在国内银行的visa 万事达卡可以买gpt会员吗,还是只能走苹果商店买外区充值卡的路子
本帖最后由 tonyunreal 于 2026-8-18 12:41 编辑
现在看来高峰期用mimo是比较现实的选择?
试了一下感觉MiMo 2.5 High执行任务的水平介于Luna Default和Luna High之间
四轮会话10M输入,最终消费 0.76 。
我感觉这些插件都很不稳定,表现起伏很大,而且多轮对话容易越来越差,适合一次对话写单页面应用这种玩具抽卡
在大幅涨价的当下,性能没那个重要了
怀念那个随便蹬,有任何想法都可以去尝试的大肥鱼
tonyunreal 发表于 2026-8-18 11:44
现在看来高峰期用mimo是比较现实的选择?
试了一下感觉MiMo 2.5 High执行任务的水平介于Luna Default和Luna ...
mimo现在菜的不如minimax m3,比qwen3.8 27b更是菜一大截
还好国算平台试了下 glm 和 K3, 差点给这两傻逼送钱了,就这水平好意思这个价,吹到天上去
crow_wine 发表于 2026-8-18 11:55
还好国算平台试了下 glm 和 K3, 差点给这两傻逼送钱了,就这水平好意思这个价,吹到天上去 ...
v4f0731是不属于这个时代的水平
qwen3.8 27b我现在都是4096context+q4这种配置来翻译 稍微大一点的context都没戏 什么都干不了
35ba3b要什么时候啊 能不能后训练出奇迹啊
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
小野賢章 发表于 2026-8-18 11:44
我感觉这些插件都很不稳定,表现起伏很大,而且多轮对话容易越来越差,适合一次对话写单页面应用这种玩具抽 ...
就 router standard 加 flash max 效果最稳定。
→熙← 发表于 2026-8-18 11:15
超算今天的体验变好了, 一早上没断过
今天晚上买了个 DeepSeek-V4-Flash-0731冰点秒杀套餐包
直接不给用,问客服说明天再试。。。
蛋黄酱Release 发表于 2026-8-18 11:53
mimo现在菜的不如minimax m3,比qwen3.8 27b更是菜一大截
m3更贵吧,目前找下来价钱合适随便蹬的就只有mimo和luna
反正只是高峰期的备胎