qwased 发表于 2026-8-22 09:47
自有硬件了不能保持24小时占用60%以上感觉都是爆亏也不知道硬件涨价还能涨多久,不涨了的话折旧一点吓人 ...
极客湾的云飞在直播里说手机涨价可能要持续到29年,虽然不知道真的假的,不过硬件应该也有参考价值吧
last_regret 发表于 2026-8-22 09:49
网页版没有flash-vision-exp吧。开联网搜索后网页版能识别卡迪公,不能识别野兽;chatbox的flash-vision- ...
网页版当然更新了,识图模式就是。昨天api更新4v的时候识图模式一起挂了一会,然后联网搜索就上线了,怎么可能没更新模型。
本帖最后由 tillnight 于 2026-8-22 09:57 编辑
last_regret 发表于 2026-8-22 09:49
网页版没有flash-vision-exp吧。开联网搜索后网页版能识别卡迪公,不能识别野兽;chatbox的flash-vision- ...
另外chatbox是没有适配ds的api的联网搜索功能的,只能用chat接口,所以无法调用自带的搜索。在agent时代chatbox已经不太能用了。你现在测的识别人物功能谁家都得靠搜索功能来做的,本身的世界知识够也很容易幻觉。这本身是个工程实现问题,比如识图好用的豆包,他的基座模型肯定是一个比v4 flash小的量化模型,不然豆包不会舍得给c端免费用,但是他识图是sota的,显然依赖的是搜索的联网数据库数据。
tillnight 发表于 2026-8-22 09:54
另外chatbox是没有适配ds的api的联网搜索功能的,只能用chat接口。在agent时代chatbox已经不太能用了。你 ...
那我回去试试,手机上只有chatbox
怎么说,周六日是梁谷还是梁峰还是和周1-5一样划分
搜索对于认人这种场景基本没用吧,本来就认不出来难道还能用关键词搜几十张男的一一比对吗 Re:Source
jinuzuktII 发表于 2026-8-22 10:02
怎么说,周六日是梁谷还是梁峰还是和周1-5一样划分
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。
认人这个根本不是识图能力而是世界知识…
这个匿名的glm模型很有意思,思考强度开到max就是雷霆巨大思考,输出2wtoken思考半小时
开到high就是很dsv4flash的风格
开到low并不是不思考,而是把思考内容通过文件读写注释写到文件里面,然后再读文件强行思考
你这low何意味啊
LeoDT 发表于 2026-8-22 10:10
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。 ...
啊,梁叔叔太狠了
LeoDT 发表于 2026-8-22 10:10
试了一下看导出的用量表,周末也梁文峰梁文谷,简直了,不是说好不加班的么。 ...
啊 被ds骗了
我去,官方他这缓存保存超过12个小时!牛哇!
问个问题,4080s 16G 本地部署小的视觉模型,是Qwen2.5-VL:14b,Qwen3-VL:8b,还是Qwen3.5:9b,主要是识别画面里的内容,描述越清楚越好
周末也搞峰谷吗?梁子这么搞你就没意思了。
笑死,给大肥鱼识图塞了三张港产片利智和吴家丽穿和服的电影截图,无一例外被鉴定为艺妓回忆录的章子怡。
大肥鱼究竟有多喜欢章子怡。
本帖最后由 自由之紫roy 于 2026-8-22 10:57 编辑
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说又涨了2000。换了cpu,换了gpu,换了ssd,换了电源,相当于都换掉了。
-----------------------------------------------------------------
目前设备是
万兆交换机和路由器,2000M电信宽带有公网ip
1、绿联4800p 4*14T 512G*2 ssd缓存 ups 备份数据,docker下载,照片服务器 万兆网卡
2、8840HX 64G 5600ddr5 5070ti 12G 笔记本玩玩2k路径光追3a也足够了,日常就是远程操作端
3、macmini m4pro 24G 2Tssd,万兆网卡,主要放hermes,openclaw,codex等agent harness,远程用笔记本调用
4、新pc也是万兆网卡,做量化因子训练,挖掘,回测等,需要高精度的权重模型,附带圆一个电影梦想
目前的配置应该是足够折腾好久了,如果后续觉得要升级,还能加一块pro5000 72g 原生pcie 8x,可以跑更大模型
自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...
真壕啊,羡慕
自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...
可以研究网剧一条龙变现了
自由之紫roy 发表于 2026-8-22 10:48
我已经买了,家里是公网ip,有阿里的云域名解析服务,也想用非审查模型,玩玩ai视频。我下单后,客服和我说 ...
想知道这个跑minimaxh3 15秒需要多久出,真眼馋啊 Re:Source
另外这几天蹬了gemini 3.7flash差不多30%的周限额,感觉哈基米用来许愿编程还是比flash0731笨很多,一个启动WSL对应项目+保活的脚本他先把之前flash0731一轮就做好的改坏了,我发现了之后聊了两轮才成功自己独立思考改回去flash0731的做法
王兰花秀丽 发表于 2026-8-22 11:05
想知道这个跑minimaxh3 15秒需要多久出,真眼馋啊 Re:Source
比5090 32G慢15%,比4090快20%,就是质量高的纹理,长工作流不会爆
本帖最后由 jinuzuktII 于 2026-8-22 11:31 编辑
波峰时段我这种非生产力用户蹬不起v4,先用gemini反代玩DSH吧……
我前几天刚通过ollama加载qwen2.5-vl-7B模型给DSH开了眼,现在就有官方多模态模型了
—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次怀疑是不是自己选错api模型了。
你们碰到这种情况了吗。
唠叨 发表于 2026-8-22 11:33
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次 ...
没错,我有几次也是猛蹬后发现额度没少,权当额度重置福利了
唠叨 发表于 2026-8-22 11:33
套餐 Credits 用量两天没变了,但是最后统计时间:2026-08-22 11:32:16,明明这两天我都在猛猛蹬,已经多次 ...
国算这个延迟特别高,感觉一天才正真更新一次
今天国算特别顺滑,不知道是优化了部署和硬件,还是就是周末需求少了
有楼友知道OpenCode go到底怎么计费的吗
我查了opencode自己和支付宝的记录都只有六月份的5刀支付,但go的api我到现在都还能正常用
囧Smith 发表于 2026-8-22 11:56
有楼友知道OpenCode go到底怎么计费的吗
我查了opencode自己和支付宝的记录都只有六月份的5刀支付,但go的a ...
楼里好像不止你一个人的opencode go碰到这种问题
论坛助手,iPhone
我设置的信用卡自动扣费怎么每个月都没算错
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
asier 发表于 2026-8-22 09:31
https://agentrouter.org/register?aff=gUnC
发现sol5.6烧得好快
问题又是程序员特供啊
—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
昨晚8点好像又更新了呀,现在直接把仓库clone下来用pnpm自己安装的
本帖最后由 xiaohanne 于 2026-8-22 13:29 编辑
实测算了一下gpt plus的额度被砍了20%,和网传数据基本一致。
最近我codex都会弹提示建议我用更快更便宜的模型
o➗不会也在整蛊了吧
论坛助手,iPhone
这两天基本干一样的活,codex 100刀套餐周额度直接干掉40%肉眼可见的比以前掉的快了
装最大方的,然后偷偷砍额度
在网页/app和codex里都弹提示建议换更便宜的模型
o➗也被用户影响到训练agi了?
论坛助手,iPhone
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不多,蹬的越多蹬的越爽
现在被培养出来的对甜点模型的庞大需求无处可去了,到哪炸哪,OAI都顶不住,嘴上说luna管够实际上慢的要死
qwased 发表于 2026-8-22 14:12
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不 ...
把我炸到自己高价买机器了。。。这真是dsv4flash惯出来的
自由之紫roy 发表于 2026-8-22 14:19
把我炸到自己高价买机器了。。。这真是dsv4flash惯出来的
老哥你这个配置跑 v4f能有多少 pp和tg...长上下文的
qwased 发表于 2026-8-22 14:12
所以DS之前的白菜价flash算不算培养用户习惯了,flash0731的智力能满足90%以上的场景,又便宜到和电价差不 ...
刚才梁文谷又找回前阵子跟flash pair programming的感觉了,快速迭代反复验证太爽了。sol/luna试用的这一周总结下来就是这效率根本就是浪费时间,我刷网页等它的时间明显增多,而且context焦虑过于严重,经常handoff,以前被flash惯出来的工作流完全没法用。
plus的20刀肯定是压不住flash随便用,但是用量考虑真订100刀的话还不如全给flash了。
phorcys02 发表于 2026-8-22 14:21
老哥你这个配置跑 v4f能有多少 pp和tg...长上下文的
本地模型会越做越好的。明年的27b完全超过现在的v4flash0731毫无问题的