icewind_yx 发表于 2026-8-22 18:16

买二台dgx 成本多少

半江瑟瑟半江红 发表于 2026-8-22 18:19

秦南心 发表于 2026-8-22 18:10
写文能力太主观,鹿客更是纯靠下半身思考的就没必要参考,

就现在AI的能力来说,写文对于看的下去番茄的受 ...

做资料收集不如网页免费谷歌ai模式,现在gemini不会联网搜索

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

城北无尘 发表于 2026-8-22 18:21

硅基流动说是上了0731还保持着原价,但是貌似只把名字改成了0731,无论是网站上模型简介描写还是repeat Nameeee的表现,依然是预览版

论坛助手,iPhone

lubo 发表于 2026-8-22 18:23


朴实无华的商战

qwased 发表于 2026-8-22 18:28

半江瑟瑟半江红 发表于 2026-8-22 18:19
做资料收集不如网页免费谷歌ai模式,现在gemini不会联网搜索

—— 来自 HUAWEI SGU-AL10, Android 16,...

反重力里面可以啊,就是不会主动搜,一定要强调去网上搜索对应内容他才会开始搜

tonyunreal 发表于 2026-8-22 18:32

城北无尘 发表于 2026-8-22 18:21
硅基流动说是上了0731还保持着原价,但是貌似只把名字改成了0731,无论是网站上模型简介描写还是repeat Nam ...

看主播测试硅基的flash max只有30多tok/s,笑死

ななひら 发表于 2026-8-22 18:34

neptunehs 发表于 2026-8-22 16:35
现在也有很多人推测glm根本没钱搞测试 所以应该是以glm为基底的composer3
但composer不是kimi基底吗
说到 ...

glm根本不测试的,之前那个5.0就有bug,官方API复读和乱码的频率都很高,到最后都没修好,用turbo撑了一个多月后赶紧发布5.1了。那个bug好像是多并发的时候kv缓存时序会错位,甚至能读到其他用户的上下文。

冤枉呐 发表于 2026-8-22 18:46

NONORIRI 发表于 2026-8-22 17:08
比起机械飞升,更像是跟他们信仰的宗教差不多,期待弥赛亚或者耶稣再临,之后就演绎圣经剧本由带着大能力 ...

因信称义嘛
预设:他们是上帝选民
结论:他们一定会赢。
结果被非教徒逼在身后,万一被超了就完犊子了,要么上帝抛弃他们,要么这届上帝不行。

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

tk553521 发表于 2026-8-22 18:48

3.7试完回来,一坨,还是得v4f

—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha

lactone 发表于 2026-8-22 18:50

3.7flash muse spark1.2和grok4.6属实三大高分低能
有一种老qwen的美

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha

冤枉呐 发表于 2026-8-22 18:51

qwased 发表于 2026-8-22 18:12
文字粗看还可以,内容一坨,可能适合写无脑黄文

那可以拿rag和指令来控制啊
找一个聪明的写大纲,他来写文字

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

唠叨 发表于 2026-8-22 18:56

我蹬了两天 感觉minimax m3有点好用啊 是错觉吗?

舞以 发表于 2026-8-22 18:56

v4fv要是恢复到涨价前就好了,,,

舞以 发表于 2026-8-22 18:58

唠叨 发表于 2026-8-22 18:56
我蹬了两天 感觉minimax m3有点好用啊 是错觉吗?

小马过河,好用就用

tonyunreal 发表于 2026-8-22 18:59

舞以 发表于 2026-8-22 18:56
v4fv要是恢复到涨价前就好了,,,
v模型我顶着高峰价格蹬的
图片秒看不转换省了好多token

蛋黄酱Release 发表于 2026-8-22 19:01

大胆点,v4fv恢复到以前的价格同时ocg恢复60刀额度

qwased 发表于 2026-8-22 19:05

冤枉呐 发表于 2026-8-22 18:51
那可以拿rag和指令来控制啊
找一个聪明的写大纲,他来写文字


很难,我感觉他好像不跟我在一个频道上,不太理解我的意图,改点什么东西也是顾头不顾尾的

noneoneone 发表于 2026-8-22 19:09

如果llm的成本进一步降低,好像可以考虑在用户打字的时候就让大模型开始猜用户意图,提前准备答案。
harness本身自带的提示词、记忆、项目内的指导文件怎么也会用到,就算问题猜错了,缓存也能命中一部分。
猜对的话,可能用户这边字还没打完,那边就已经思考完毕,等着动手了。

自由之紫roy 发表于 2026-8-22 19:11

noneoneone 发表于 2026-8-22 19:09
如果llm的成本进一步降低,好像可以考虑在用户打字的时候就让大模型开始猜用户意图,提前准备答案。
harnes ...

预判你的预判的预判

舞以 发表于 2026-8-22 19:14

我觉得文学写作也许得反过来:
大规模模型写具体的文本,大纲之类的反而和flash讨论就行

论坛助手,iPhone

goranger 发表于 2026-8-22 19:20

我觉得楼友被外国人骗了,他们为了准牺牲了快,然后说所谓loop啥的,但实际上其实他们也知道,你随便讲几句出来的东西那是许愿和算命,那为何不追求又准又快快速人为验收迭代?就像flash那样,包括luna自己也有2.5倍小号的fast模式。

论坛助手,iPhone

noneoneone 发表于 2026-8-22 19:21

进一步,是不是可以让大模型辅助训练出一个小模型,专门判断用户输入信息的完整性,一旦这个小模型认为很可能已经能猜到用户意图(或者多个任务中的一部分任务)了,就提前把现有信息推送给大模型。

goranger 发表于 2026-8-22 19:21

另外今天三开openrouter和open code,使劲蹬ox模型,除了偶尔会长考十几分钟把自己搞崩以外有上个月flash无限蹬不怕用完的感觉了,好怀念

论坛助手,iPhone

qwased 发表于 2026-8-22 19:22

舞以 发表于 2026-8-22 19:14
我觉得文学写作也许得反过来:
大规模模型写具体的文本,大纲之类的反而和flash讨论就行


不行的,你用一下grill me和他讨论剧情,参数量越小的模型能给出的建议越不知所谓,要么土到地心要么完全没逻辑

goranger 发表于 2026-8-22 19:23

noneoneone 发表于 2026-8-22 19:09
如果llm的成本进一步降低,好像可以考虑在用户打字的时候就让大模型开始猜用户意图,提前准备答案。
harnes ...

你试试语音输入法会不会偶尔让你着急拍桌子就知道这样行不行了。实际上微信语音输入法现在就这么干的

论坛助手,iPhone

一般市民 发表于 2026-8-22 19:33

noneoneone 发表于 2026-8-22 19:09
如果llm的成本进一步降低,好像可以考虑在用户打字的时候就让大模型开始猜用户意图,提前准备答案。
harnes ...

Gork的Web端就是这样的,有些极简问题比如"1+1"直接在输入框下面显示答案。

小野賢章 发表于 2026-8-22 19:43

现在最好的沉浸式翻译模型是什么opencode go里面的mimo吗

飛霞精灵 发表于 2026-8-22 19:44

问问一个工作上的问题,是否需要DSH帮忙搞定。
我手头有现成的教材电子版,章节和教材本身就可以。
但新学期领导要求我们写教案。(我早就作出来PPT用作随堂教学了,但领导不认)。
领导要求的非常细腻,教学目的/课堂目的/教学方法/课堂步骤(精确到分钟)/学生作业/课后反馈之类都要写。
而且是每堂课都有。
尤其要严格按word的格式和字体来(这点非常恶心)。
这玩意儿前几年我做过类似的。最近两三年一度不用了。
结果现在又要捡起来。

拿AI跑最后输出原样符合字体和格式的教案,能不能行?

cscbzcbz 发表于 2026-8-22 19:50

飛霞精灵 发表于 2026-8-22 19:44
问问一个工作上的问题,是否需要DSH帮忙搞定。
我手头有现成的教材电子版,章节和教材本身就可以。
但新学 ...

我觉得问题不大,应该说是非常easy了

frankCC 发表于 2026-8-22 19:58

本帖最后由 frankCC 于 2026-8-22 20:02 编辑

智谱这拉新连点诚意都没有,说是新用户赠1亿token,结果就两天有效期,还不如用牛来呢

Eina 发表于 2026-8-22 20:03

飛霞精灵 发表于 2026-8-22 19:44
问问一个工作上的问题,是否需要DSH帮忙搞定。
我手头有现成的教材电子版,章节和教材本身就可以。
但新学 ...

下个腾子的workbuddy白嫖,这个属于最简单的需求

squallx 发表于 2026-8-22 20:11

飞天荷兰人 发表于 2026-8-22 10:21
我去,官方他这缓存保存超过12个小时!牛哇!

4点刷新 这是二游

厍无春 发表于 2026-8-22 20:16

goranger 发表于 2026-8-22 19:23
你试试语音输入法会不会偶尔让你着急拍桌子就知道这样行不行了。实际上微信语音输入法现在就这么干的

论 ...

微信输入法的语音和豆包输入法的有半档的差距,微信能用,豆包好用

半江瑟瑟半江红 发表于 2026-8-22 20:19

冤枉呐 发表于 2026-8-22 18:51
那可以拿rag和指令来控制啊
找一个聪明的写大纲,他来写文字


它指令遵循不行

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

半江瑟瑟半江红 发表于 2026-8-22 20:21

舞以 发表于 2026-8-22 19:14
我觉得文学写作也许得反过来:
大规模模型写具体的文本,大纲之类的反而和flash讨论就行


肯定不行,参数小的模型思路很狭窄,用grilling 讨论提纲就能明显感觉出来,5.6sol>d指导pro>d指导flash

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

来都来了 发表于 2026-8-22 20:24

搓了一个pi的傻屌扩展

→熙← 发表于 2026-8-22 20:27

tonyunreal 发表于 2026-8-22 18:32
看主播测试硅基的flash max只有30多tok/s,笑死

如果稳定其实还好, 其他的第3方各种400,429, 体验更差

酱狐狸 发表于 2026-8-22 20:33

尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规则做如下调整:
工作日(周一至周五):继续执行原有峰谷分段计费。
周末(周六、周日):全天不再区分峰谷时段,统一按照低谷时段价格收取调用费用。
此调整旨在让您在周末更灵活地安排业务,无需担心高峰时段成本,同时也有助于我们平衡全网算力负载,持续为您提供更优质稳定的服务。
特别说明:
新规则自北京时间 2026 年 8 月 23 日凌晨(周日 00:00)起生效,届时系统将自动按新标准计费。新规则生效前的费用,仍按原计费规则结算,敬请理解。
如您在计费调整后继续选择使用我们的服务,则代表您已同意调整后的计费方式;如不同意接受则可选择退出使用并申请退费。如有任何疑问或需进一步了解相关信息,请随时联系我们。
感谢您对我们的支持与理解!
DeepSeek 团队


终于想起周末的事了

wandeeees 发表于 2026-8-22 20:36

酱狐狸 发表于 2026-8-22 20:33
尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规 ...

哈哈哈哈哈,加班发个公告吗,太草台了

龙骑士尹志平 发表于 2026-8-22 20:36

酱狐狸 发表于 2026-8-22 20:33
尊敬的 DeepSeek API 用户:
您好!
我们将于北京时间 2026 年 8 月 23 日(周日)00:00 起,对峰谷计费规 ...

过于草台
页: 259 260 261 262 263 264 265 266 267 268 [269] 270 271 272 273 274 275 276 277 278
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼