passgan 发表于 2026-8-22 09:50

qwased 发表于 2026-8-22 09:47
自有硬件了不能保持24小时占用60%以上感觉都是爆亏也不知道硬件涨价还能涨多久,不涨了的话折旧一点吓人 ...

极客湾的云飞在直播里说手机涨价可能要持续到29年,虽然不知道真的假的,不过硬件应该也有参考价值吧

tillnight 发表于 2026-8-22 09:52

last_regret 发表于 2026-8-22 09:49
网页版没有flash-vision-exp吧。开联网搜索后网页版能识别卡迪公,不能识别野兽;chatbox的flash-vision- ...

网页版当然更新了,识图模式就是。昨天api更新4v的时候识图模式一起挂了一会,然后联网搜索就上线了,怎么可能没更新模型。

tillnight 发表于 2026-8-22 09:54

本帖最后由 tillnight 于 2026-8-22 09:57 编辑

last_regret 发表于 2026-8-22 09:49
网页版没有flash-vision-exp吧。开联网搜索后网页版能识别卡迪公,不能识别野兽;chatbox的flash-vision- ...

另外chatbox是没有适配ds的api的联网搜索功能的,只能用chat接口,所以无法调用自带的搜索。在agent时代chatbox已经不太能用了。你现在测的识别人物功能谁家都得靠搜索功能来做的,本身的世界知识够也很容易幻觉。这本身是个工程实现问题,比如识图好用的豆包,他的基座模型肯定是一个比v4 flash小的量化模型,不然豆包不会舍得给c端免费用,但是他识图是sota的,显然依赖的是搜索的联网数据库数据。

last_regret 发表于 2026-8-22 09:58

tillnight 发表于 2026-8-22 09:54
另外chatbox是没有适配ds的api的联网搜索功能的,只能用chat接口。在agent时代chatbox已经不太能用了。你 ...

那我回去试试,手机上只有chatbox

jinuzuktII 发表于 2026-8-22 10:02

怎么说,周六日是梁谷还是梁峰还是和周1-5一样划分

王兰花秀丽 发表于 2026-8-22 10:03

搜索对于认人这种场景基本没用吧,本来就认不出来难道还能用关键词搜几十张男的一一比对吗    Re:Source

LeoDT 发表于 2026-8-22 10:10

jinuzuktII 发表于 2026-8-22 10:02
怎么说,周六日是梁谷还是梁峰还是和周1-5一样划分

试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。

nxmonitor 发表于 2026-8-22 10:10

认人这个根本不是识图能力而是世界知识…

eno_emos 发表于 2026-8-22 10:12

这个匿名的glm模型很有意思,思考强度开到max就是雷霆巨大思考,输出2wtoken思考半小时
开到high就是很dsv4flash的风格
开到low并不是不思考,而是把思考内容通过文件读写注释写到文件里面,然后再读文件强行思考

你这low何意味啊

jinuzuktII 发表于 2026-8-22 10:13

LeoDT 发表于 2026-8-22 10:10
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。 ...

啊,梁叔叔太狠了

龙骑士尹志平 发表于 2026-8-22 10:18

LeoDT 发表于 2026-8-22 10:10
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。 ...

啊 被ds骗了

飞天荷兰人 发表于 2026-8-22 10:21

我去,官方他这缓存保存超过12个小时!牛哇!

c月光咖啡 发表于 2026-8-22 10:29

问个问题,4080s 16G 本地部署小的视觉模型,是Qwen2.5-VL:14b,Qwen3-VL:8b,还是Qwen3.5:9b,主要是识别画面里的内容,描述越清楚越好

来都来了 发表于 2026-8-22 10:32

周末也搞峰谷吗?梁子这么搞你就没意思了。

cyberalogo 发表于 2026-8-22 10:46

笑死,给大肥鱼识图塞了三张港产片利智和吴家丽穿和服的电影截图,无一例外被鉴定为艺妓回忆录的章子怡。

大肥鱼究竟有多喜欢章子怡。

自由之紫roy 发表于 2026-8-22 10:48

本帖最后由 自由之紫roy 于 2026-8-22 10:57 编辑

我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说又涨了2000。换了cpu,换了gpu,换了ssd,换了电源,相当于都换掉了。
-----------------------------------------------------------------

目前设备是
万兆交换机和路由器,2000M电信宽带有公网ip
1、绿联4800p 4*14T 512G*2 ssd缓存 ups 备份数据,docker下载,照片服务器 万兆网卡

2、8840HX 64G 5600ddr5 5070ti 12G 笔记本玩玩2k路径光追3a也足够了,日常就是远程操作端
3、macmini m4pro 24G 2Tssd,万兆网卡,主要放hermes,openclaw,codex等agent harness,远程用笔记本调用
4、新pc也是万兆网卡,做量化因子训练,挖掘,回测等,需要高精度的权重模型,附带圆一个电影梦想
目前的配置应该是足够折腾好久了,如果后续觉得要升级,还能加一块pro5000 72g 原生pcie 8x,可以跑更大模型

wandeeees 发表于 2026-8-22 11:00

自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...

真壕啊,羡慕

qwased 发表于 2026-8-22 11:04

自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...

可以研究网剧一条龙变现了

王兰花秀丽 发表于 2026-8-22 11:05

自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...

想知道这个跑minimaxh3 15秒需要多久出,真眼馋啊    Re:Source

qwased 发表于 2026-8-22 11:07

另外这几天蹬了gemini 3.7flash差不多30%的周限额,感觉哈基米用来许愿编程还是比flash0731笨很多,一个启动WSL对应项目+保活的脚本他先把之前flash0731一轮就做好的改坏了,我发现了之后聊了两轮才成功自己独立思考改回去flash0731的做法

自由之紫roy 发表于 2026-8-22 11:12

王兰花秀丽 发表于 2026-8-22 11:05
想知道这个跑minimaxh3 15秒需要多久出,真眼馋啊    Re:Source
比5090 32G慢15%,比4090快20%,就是质量高的纹理,长工作流不会爆

jinuzuktII 发表于 2026-8-22 11:24

本帖最后由 jinuzuktII 于 2026-8-22 11:31 编辑

波峰时段我这种非生产力用户蹬不起v4,先用gemini反代玩DSH吧……

大暴死 发表于 2026-8-22 11:29

我前几天刚通过ollama加载qwen2.5-vl-7B模型给DSH开了眼,现在就有官方多模态模型了

—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99

唠叨 发表于 2026-8-22 11:33

套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次怀疑是不是自己选错api模型了。
你们碰到这种情况了吗。

UncleDracula 发表于 2026-8-22 11:36

唠叨 发表于 2026-8-22 11:33
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次 ...

没错,我有几次也是猛蹬后发现额度没少,权当额度重置福利了

cscbzcbz 发表于 2026-8-22 11:53

唠叨 发表于 2026-8-22 11:33
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次 ...

国算这个延迟特别高,感觉一天才正真更新一次
今天国算特别顺滑,不知道是优化了部署和硬件,还是就是周末需求少了

囧Smith 发表于 2026-8-22 11:56

有楼友知道OpenCode go到底怎么计费的吗
我查了opencode自己和支付宝的记录都只有六月份的5刀支付,但go的api我到现在都还能正常用

城北无尘 发表于 2026-8-22 12:02

囧Smith 发表于 2026-8-22 11:56
有楼友知道OpenCode go到底怎么计费的吗
我查了opencode自己和支付宝的记录都只有六月份的5刀支付,但go的a ...

楼里好像不止你一个人的opencode go碰到这种问题

论坛助手,iPhone

半江瑟瑟半江红 发表于 2026-8-22 12:03

我设置的信用卡自动扣费怎么每个月都没算错

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

冤枉呐 发表于 2026-8-22 12:49

asier 发表于 2026-8-22 09:31
https://agentrouter.org/register?aff=gUnC
发现sol5.6烧得好快

问题又是程序员特供啊

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

小野賢章 发表于 2026-8-22 13:06

昨晚8点好像又更新了呀,现在直接把仓库clone下来用pnpm自己安装的

xiaohanne 发表于 2026-8-22 13:20

本帖最后由 xiaohanne 于 2026-8-22 13:29 编辑

实测算了一下gpt plus的额度被砍了20%,和网传数据基本一致。

舞以 发表于 2026-8-22 13:53

最近我codex都会弹提示建议我用更快更便宜的模型
o➗不会也在整蛊了吧

论坛助手,iPhone

cowji 发表于 2026-8-22 13:56

这两天基本干一样的活,codex 100刀套餐周额度直接干掉40%肉眼可见的比以前掉的快了

舞以 发表于 2026-8-22 14:04

装最大方的,然后偷偷砍额度
在网页/app和codex里都弹提示建议换更便宜的模型
o➗也被用户影响到训练agi了?

论坛助手,iPhone

qwased 发表于 2026-8-22 14:12

所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不多,蹬的越多蹬的越爽
现在被培养出来的对甜点模型的庞大需求无处可去了,到哪炸哪,OAI都顶不住,嘴上说luna管够实际上慢的要死

自由之紫roy 发表于 2026-8-22 14:19

qwased 发表于 2026-8-22 14:12
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不 ...

把我炸到自己高价买机器了。。。这真是dsv4flash惯出来的

phorcys02 发表于 2026-8-22 14:21

自由之紫roy 发表于 2026-8-22 14:19
把我炸到自己高价买机器了。。。这真是dsv4flash惯出来的

老哥你这个配置跑 v4f能有多少 pp和tg...长上下文的

LeoDT 发表于 2026-8-22 14:23

qwased 发表于 2026-8-22 14:12
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不 ...

刚才梁文谷又找回前阵子跟flash pair programming的感觉了,快速迭代反复验证太爽了。sol/luna试用的这一周总结下来就是这效率根本就是浪费时间,我刷网页等它的时间明显增多,而且context焦虑过于严重,经常handoff,以前被flash惯出来的工作流完全没法用。

plus的20刀肯定是压不住flash随便用,但是用量考虑真订100刀的话还不如全给flash了。

自由之紫roy 发表于 2026-8-22 14:27

phorcys02 发表于 2026-8-22 14:21
老哥你这个配置跑 v4f能有多少 pp和tg...长上下文的

本地模型会越做越好的。明年的27b完全超过现在的v4flash0731毫无问题的
页: 257 258 259 260 261 262 263 264 265 266 [267] 268 269 270 271 272 273 274 275 276
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼