cscbzcbz 发表于 2026-8-22 20:37

酱狐狸 发表于 2026-8-22 20:33
尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规 ...

靠,我都顶着峰值蹬了一天了主要想用新的V模型
辛苦梁子周末加班来发通知和改价格逻辑

jinuzuktII 发表于 2026-8-22 20:38

noneoneone 发表于 2026-8-22 19:09
如果llm的成本进一步降低,好像可以考虑在用户打字的时候就让大模型开始猜用户意图,提前准备答案。
harnes ...

以后游戏画面是AI算的,会话是AI猜的,卧槽

2017.05.04 发表于 2026-8-22 20:40

酱狐狸 发表于 2026-8-22 20:33
尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规 ...

笑出声了周六才想起这茬

—— 来自 HUAWEI SGT-AL00, Android 16, 鹅球 v4.0-alpha

阿刚 发表于 2026-8-22 20:42

舞以 发表于 2026-8-22 19:14
我觉得文学写作也许得反过来:
大规模模型写具体的文本,大纲之类的反而和flash讨论就行


虽然但是,我觉的flash的正文写作比pro要好不知道为啥,pro总是会把ai臭带出来

来都来了 发表于 2026-8-22 20:43

这deepseek也太草台了吧,为什么这种事情现在才想起来?我看等到公休日时,他们这个公告还要再改一次。

阿刚 发表于 2026-8-22 20:44

cscbzcbz 发表于 2026-8-22 20:37
靠,我都顶着峰值蹬了一天了主要想用新的V模型
辛苦梁子周末加班来发通知和改价格逻辑 ...

你们都不看官网价格公告是吧,一开始就没提周末全是营销号传来传去

奈姆乐斯美都莎 发表于 2026-8-22 20:46

自由之紫roy 发表于 2026-8-22 19:11
预判你的预判的预判
猜你喜欢/猜你想问/您寻找的是不是 x
猜你想猜我猜你 √

舞以 发表于 2026-8-22 20:47

没绷住,草台班子真神了

论坛助手,iPhone

tonyunreal 发表于 2026-8-22 20:52

酱狐狸 发表于 2026-8-22 20:33
尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规 ...

果然是二游
太糙了

UncleDracula 发表于 2026-8-22 20:52

这什么神区二象性公司,能做出人类顶级AI,却犯着实习生错误

飛霞精灵 发表于 2026-8-22 20:53

我还以为他们的工作日是按美国时间计算的.....

ycjiang1337 发表于 2026-8-22 20:56

难道不是从一开始就故意没分工作日吗?负载没那么大才降价

—— 来自 HUAWEI SGT-AL50, Android 16, 鹅球 v3.4.97-alpha

龙骑士尹志平 发表于 2026-8-22 20:57

可能官网和api都是v4f管理,真人也就审核下,等投诉反馈多了才想起来这个时间没把周末和节假日放进去。

王兰花秀丽 发表于 2026-8-22 21:01

喷了,最近活真的多,感觉和鲸鱼娘的联系都更紧密了    Re:Source

妄想中毒 发表于 2026-8-22 21:01

Cherry Studio为啥用了V4FV还是识别不了图片

neptunehs 发表于 2026-8-22 21:02

ox根本用不了 今晚准备充钱重回梁文谷
有没有那个鲸鱼娘亲自帮计费的那个dsh插件的地址?(

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

SmterC 发表于 2026-8-22 21:07

飛霞精灵 发表于 2026-8-22 19:44
问问一个工作上的问题,是否需要DSH帮忙搞定。
我手头有现成的教材电子版,章节和教材本身就可以。
但新学 ...

模型能力肯定是够的,不过还要看配套工具对office类文件的支持
我之前测试的时候,codex桌面版自带一个对office操作的skill还是什么工具,相比起其他的agent类工具,就更擅长处理好文字排版这一块
可以试试

舞以 发表于 2026-8-22 21:12

neptunehs 发表于 2026-8-22 21:02
ox根本用不了 今晚准备充钱重回梁文谷
有没有那个鲸鱼娘亲自帮计费的那个dsh插件的地址?(


https://github.com/MeteorNOX/DeepSeek-Balance-Whale-Widget

kinfox 发表于 2026-8-22 21:16

终于折腾了两天,让本地部署的qwen3.8 27b能够无限上下文,不会断联了。还接进去WorkBuddy,给它武装了skill来优化,
平均速度60也算能接受,
疯狂让它干活了大半天,效果意外的好。
能够覆盖大部分dsf的活了,拯救了我被梁谷痛创的钱包😂

neptunehs 发表于 2026-8-22 21:18

kinfox 发表于 2026-8-22 21:16
终于折腾了两天,让本地部署的qwen3.8 27b能够无限上下文,不会断联了。还接进去WorkBuddy,给它武装了skil ...

为什么我搞的时候就给我埋了一堆雷呢。。。

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

qwased 发表于 2026-8-22 21:20

kinfox 发表于 2026-8-22 21:16
终于折腾了两天,让本地部署的qwen3.8 27b能够无限上下文,不会断联了。还接进去WorkBuddy,给它武装了skil ...

咋整的,是那种上下文窗口到一半就写入外置记忆文件的做法吗

qwased 发表于 2026-8-22 21:21

SmterC 发表于 2026-8-22 21:07
模型能力肯定是够的,不过还要看配套工具对office类文件的支持
我之前测试的时候,codex桌面版自带一个对 ...

https://github.com/iOfficeAI/OfficeCli 这个吗

城北无尘 发表于 2026-8-22 21:22

SmterC 发表于 2026-8-22 21:07
模型能力肯定是够的,不过还要看配套工具对office类文件的支持
我之前测试的时候,codex桌面版自带一个对 ...

https://github.com/wssfk12138/dsh-damage-pulse

小黑盒上这个比较火,有小肥鱼动画

kinfox 发表于 2026-8-22 21:26

qwased 发表于 2026-8-22 21:20
咋整的,是那种上下文窗口到一半就写入外置记忆文件的做法吗

我让另外一个ai给我出的方案,搞了个监听的双窗口,从8080转到8090,它会侦测当前的token消耗,自动压缩上下文,来保持我显卡内存不崩《脆弱的4090》,然后skill做任务拆分步骤,保证每一步都有记录,
就靠这方式,把昨天一做长任务就因为思考过多然后gg掉的qwen,变成了现在做什么都可以直出,还不会断,显存也控制的很好的强者,
我把模型打印数据给ds分析,它甚至赞叹模型状态保持的太完美了😂

ds说:从你发来的最新日志来看,整个系统已经进入了一个 “高命中率、高速度、零错误” 的完美状态。

UncleDracula 发表于 2026-8-22 21:28

目前做UI设计的哪家强?哈基米?KIMIK3?

奈落的孤火花 发表于 2026-8-22 21:39

kinfox 发表于 2026-8-22 21:26
我让另外一个ai给我出的方案,搞了个监听的双窗口,从8080转到8090,它会侦测当前的token消耗,自动压缩 ...

是4090 48g吗?求分享我也需要

kinfox 发表于 2026-8-22 21:40

奈落的孤火花 发表于 2026-8-22 21:39
是4090 48g吗?求分享我也需要

24g。。。。我只能用q4量化模型😭

奈落的孤火花 发表于 2026-8-22 21:43

kinfox 发表于 2026-8-22 21:40
24g。。。。我只能用q4量化模型😭
我是5090 32g,求方案总结md,我也想照着给配好

lzchen 发表于 2026-8-22 21:45

kinfox 发表于 2026-8-22 21:26
我让另外一个ai给我出的方案,搞了个监听的双窗口,从8080转到8090,它会侦测当前的token消耗,自动压缩 ...

求方案,我的2080ti也想试试。

半江瑟瑟半江红 发表于 2026-8-22 21:47

UncleDracula 发表于 2026-8-22 21:28
目前做UI设计的哪家强?哈基米?KIMIK3?

K3,gemini就当它死了就行,从来都不用放在考虑范围内

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

kinfox 发表于 2026-8-22 21:49

如果大家想试试。我明天让ai帮我搞个总结md发上来吧

goranger 发表于 2026-8-22 21:50

《科创板日报》获悉,DeepSeek API开放平台将于2026年8月23日(周日)00:00起,优化峰谷计费规则。调整后,周末(周六及周日)全天将不再区分峰谷时段,统一按低谷时段价格计费。新规则生效前产生的费用,仍按原计费标准结算。   他们周末果然不上班

dazzle 发表于 2026-8-22 21:56

阿刚 发表于 2026-8-22 20:42
虽然但是,我觉的flash的正文写作比pro要好不知道为啥,pro总是会把ai臭带出来 ...

因为pro经常用力过猛,三句话一个比喻,我都是用skill让它不写比喻,关键段落才写景物描写

ds4文笔其实已经非常好了,flash比较平实的写法反而比较像人类。不过pro也有好处,就是思考更丰富一点,偶尔抽卡能抽到非常牛逼的句子

蜇灵 发表于 2026-8-22 21:59

goranger 发表于 2026-8-22 19:20
我觉得楼友被外国人骗了,他们为了准牺牲了快,然后说所谓loop啥的,但实际上其实他们也知道,你随便讲几句 ...

本质上是资本家对于自己发动人类主观能动性的能力不乐观,于是寄希望于AGI毕其功于一役吧

zhongjie 发表于 2026-8-22 22:00

这个改价是从今晚开始,还是明晚开始?

蜇灵 发表于 2026-8-22 22:00

酱狐狸 发表于 2026-8-22 20:33
尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规 ...

草,原来是之前搞忘了吗

蜇灵 发表于 2026-8-22 22:02

zhongjie 发表于 2026-8-22 22:00
这个改价是从今晚开始,还是明晚开始?

23日0时,就是两个小时后开始吧

BarricadeMKXX 发表于 2026-8-22 22:05

来都来了 发表于 2026-8-22 20:43
这deepseek也太草台了吧,为什么这种事情现在才想起来?我看等到公休日时,他们这个公告还要再改一次。 ...

公休日好办,直接发个限时折扣

goranger 发表于 2026-8-22 22:06

本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。

论坛助手,iPhone

goranger 发表于 2026-8-22 22:07

蜇灵 发表于 2026-8-22 22:02
23日0时,就是两个小时后开始吧

现在本来就是梁文谷,当成现在开始也没差啊

论坛助手,iPhone
页: 260 261 262 263 264 265 266 267 268 269 [270] 271 272 273 274 275 276 277 278 279
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼