squallx 发表于 2026-8-19 03:45

现在市面上的第三方V4F基本都是没外审的? 随便选么

厍无春 发表于 2026-8-19 04:38

本帖最后由 厍无春 于 2026-8-19 14:30 编辑

邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bkuV2Fp0qZMTgllgVNRCvf_P

deepseek 涨价了,我再发一遍这个吧,注册就送68元额度,api哪里都能接,确实能用,白天偶尔429,晚上还挺快的,价格同官方。

邀请别人注册也会送68,不过需要被邀请的人用一下他们自己推的harness才给。

有需要的注册白嫖68,不过额度有效期只有一个月

我已经邀请满了,再邀请也不会加额度了,建议去找其他人的邀请链接,不要再用我的了,避免浪费。

neptunehs 发表于 2026-8-19 07:53

我用qwen3.8-27b iq3xss 都跑到500tps了 结果一个prompt跑了500多秒 这在大context下真的可用吗(

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

矮矮人 发表于 2026-8-19 08:47

现在办公用哪个厂商的比较好?在考虑付费
gpt在单位不方便用魔法
workbuddy用了下还行,但是积分消耗挺快的
豆包现在免费档,经常遇到算力不够要多刷新
ds没多模态,处理文件方面还是不方便



—— 来自 vivo V2405A, Android 16, 鹅球 v4.0

zhongjie 发表于 2026-8-19 08:48

矮矮人 发表于 2026-8-19 08:47
现在办公用哪个厂商的比较好?在考虑付费
gpt在单位不方便用魔法
workbuddy用了下还行,但是积分消耗挺快的 ...

mini max3,mimo2.5或者k3

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0

bartholo4 发表于 2026-8-19 08:52

办公如果在用飞书那就用 traework
最低档位即可 每天还可以签到领 200 积分
平时用 DeepSeek 模型,重一点的需求用 glm5.3 或者 qwen3.8max

小野賢章 发表于 2026-8-19 08:55

舞以 发表于 2026-8-19 00:06
第三方这区样,感觉反面证明0731之后梁子给大伙真调了不少推理算力吧,只是偶尔爆炸一下,我都没碰到过429 ...

我猜梁子应该整个公司一个算力池子,不限速也不保留算力,所以才会设置在北京时间的高峰期,因为用户用多了,员工就没得用了。

qwased 发表于 2026-8-19 08:58

小野賢章 发表于 2026-8-19 08:55
我猜梁子应该整个公司一个算力池子,不限速也不保留算力,所以才会设置在北京时间的高峰期,因为用户用多 ...

训练又不会因为员工下班就停了而且全球的算力需求又不会照顾北京时间

飞天荷兰人 发表于 2026-8-19 08:59

厍无春 发表于 2026-8-19 04:38
邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bkuV ...

哇噢,这个可以!感谢邀请,省了一波token。

邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_cobPrRDuQUaIZL0uvrWifL5c

冤枉呐 发表于 2026-8-19 09:03

厍无春 发表于 2026-8-19 04:38
邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bkuV ...

注册送的额度必须一个月用完

crow_wine 发表于 2026-8-19 09:12

本帖最后由 crow_wine 于 2026-8-19 09:15 编辑

国算平台上 0813 了,让我来尝尝咸淡

好像没部署好,连不上

GJRstone 发表于 2026-8-19 09:32

国算平台本质是个统一定价的菜市场吧,每次接到的算力节点会有不同的部属效能差异,首字延迟大很可能是单纯的对应末端机器不行

scikirbypoke 发表于 2026-8-19 09:35

scikirbypoke 发表于 2026-8-19 00:07
手里的pixel扫直接不过,可能是解了bl,这个不恢复出厂真没办法,但备份又巨麻烦 ...

成功了,有个早期大号无需验证就能登免费版反重力,通过家庭组共享过去就行了,太逆天了

jojog 发表于 2026-8-19 09:36

求问minimaxH3这个挂的LLM可以换么

看网上好多NSFW模感觉都不靠谱怕被坑
但是qwen3.8太大了感觉挂不上

绝地潜兵 发表于 2026-8-19 09:39

国算平台算力调度不知道效果稳定不

onezer0618 发表于 2026-8-19 09:49

本帖最后由 onezer0618 于 2026-8-19 09:51 编辑

咨询下各位,非程序员,现在建议用哪家的订阅当主力使用,我目前主用的是Hermes和ChatGPT,Hermes接的v4f当日常问答用的工具,ChatGPT处理工作上的事以及辅助做一些小玩意,开的plus订阅,gpt快到期了

站立风景 发表于 2026-8-19 09:51

onezer0618 发表于 2026-8-19 09:49
咨询各位的事,非程序员,现在建议用哪家的订阅当主力使用,我目前主用的是Hermes和ChatGPT,Hermes接的v4f ...

轻度问答,有plus感觉都不用v4f吧?网页端额度基本也用不完。

半江瑟瑟半江红 发表于 2026-8-19 09:52

onezer0618 发表于 2026-8-19 09:49
咨询下各位,非程序员,现在建议用哪家的订阅当主力使用,我目前主用的是Hermes和ChatGPT,Hermes接的v4f当 ...

那还是gpt罢

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

龙骑士尹志平 发表于 2026-8-19 09:59

gptplus必须要稳定的翻墙环境才能用吗,比如今天欧洲明天日本后天台湾是不是容易封号

真红之闪电 发表于 2026-8-19 10:00

龙骑士尹志平 发表于 2026-8-19 09:59
gptplus必须要稳定的翻墙环境才能用吗,比如今天欧洲明天日本后天台湾是不是容易封号 ...

没见过飞 ** 封号的,我 Claude 都没被封

—— 来自 S1Fun

蛋黄酱Release 发表于 2026-8-19 10:04

单位电脑+公网用不了外国模型国内多模态模型不是贵就是太菜,折磨

spaceblue 发表于 2026-8-19 10:06

龙骑士尹志平 发表于 2026-8-19 09:59
gptplus必须要稳定的翻墙环境才能用吗,比如今天欧洲明天日本后天台湾是不是容易封号 ...

Plus无所谓,PRO会员网页用PRO模式如果IP不干净会被路由到5.5mini

qwased 发表于 2026-8-19 10:07

蛋黄酱Release 发表于 2026-8-19 10:04
单位电脑+公网用不了外国模型国内多模态模型不是贵就是太菜,折磨
叫单位给你报销DS呗,又不是不能开票

onezer0618 发表于 2026-8-19 10:07

站立风景 发表于 2026-8-19 09:51
轻度问答,有plus感觉都不用v4f吧?网页端额度基本也用不完。

用Hermes轻度问答,它的排版什么很舒服,我不知道是d4f的原因还是Hermes本身的原因

孔祈 发表于 2026-8-19 10:09

飞天荷兰人 发表于 08-19 08:59
哇噢,这个可以!感谢邀请,省了一波token。


邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_cobPrRDuQUaIZL0uvrWifL5c



薅了一个试试水

——来自 S1er 客户端

蛋黄酱Release 发表于 2026-8-19 10:09

qwased 发表于 2026-8-19 10:07
叫单位给你报销DS呗,又不是不能开票

deepseek也不是多模态啊,报销也是有总额度的所以得找个平衡点

tsubasa9 发表于 2026-8-19 10:11

workbuddy的v4f和v4p暴涨,服了,用完积分不用了

孔祈 发表于 2026-8-19 10:13

onezer0618 发表于 08-19 10:07
用Hermes轻度问答,它的排版什么很舒服,我不知道是d4f的原因还是Hermes本身的原因



Hermes可以用OAuth登陆gpt账号使用Codex额度,你喜欢的排版+gpt模型,双份快乐?

——来自 S1er 客户端

onezer0618 发表于 2026-8-19 10:15

孔祈 发表于 2026-8-19 10:13
Hermes可以用OAuth登陆gpt账号使用Codex额度,你喜欢的排版+gpt模型,双份快乐?

——来自 S1er 客户 ...

有道理,我来试试,目前用下来感觉gpt各方面还是更均衡些,多端用着也方便

千千千千鸟 发表于 2026-8-19 10:21

gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT随便就触发自动压缩了。

冤枉呐 发表于 2026-8-19 10:22

阿刚 发表于 2026-8-19 00:13
说真的v4f哪怕开了智写文效果也很不错了,但是这个开智思维链只和dsh绑定就有点难受……hermes就算输入了提 ...

高级开头到底是啥啊
let's, we need, i am?

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

站立风景 发表于 2026-8-19 10:25

onezer0618 发表于 2026-8-19 10:15
有道理,我来试试,目前用下来感觉gpt各方面还是更均衡些,多端用着也方便 ...

这样的缺点就是占用codex额度了,plus相对会比较少的,网页端问答基本用不完。

站立风景 发表于 2026-8-19 10:25

千千千千鸟 发表于 2026-8-19 10:21
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT ...

是的,不过gpt压缩效果感觉还不错,实际使用体感没有太大的问题。

小野賢章 发表于 2026-8-19 10:27

千千千千鸟 发表于 2026-8-19 10:21
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT ...

gpt模型是支持1.05M的,但是默认限制272k是帮你省钱,因为超过272k的部分价格更贵

小野賢章 发表于 2026-8-19 10:33

hugosol 发表于 2026-8-19 10:43

这两天用了下gpt-5.6-sol,确实很强,逻辑比DS的模型要清晰很多
问题是太慢了(不知道是不是因为我开的只是plus套餐),而且只要不是做复杂规划,其实直接用DS系的模型可以快速反馈修正的路线用起来会更舒服
还是DeepSeek的infra太强了,其他家的模型再怎么强用起来都是便秘

crow_wine 发表于 2026-8-19 10:43

感觉后端能力上和实际的复杂算法推理上 qwen 3.8 max 比 kimi3 强很多,表现更贴合一个 2.4 万亿模型的表现。k3 这纯纯的绣花枕头

拯救节操希灵宅 发表于 2026-8-19 10:46

千千千千鸟 发表于 2026-8-19 10:21
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT ...

codex里面默认是272k,可以手动调到1m,但实测gpt的自动压缩还挺黑科技的

站立风景 发表于 2026-8-19 10:59

hugosol 发表于 2026-8-19 10:43
这两天用了下gpt-5.6-sol,确实很强,逻辑比DS的模型要清晰很多
问题是太慢了(不知道是不是因为我开的只是 ...

跟套餐关系不大,就是sol想的慢。我用的pro也是慢慢悠悠的。

千千千千鸟 发表于 2026-8-19 11:02

拯救节操希灵宅 发表于 2026-8-19 10:46
codex里面默认是272k,可以手动调到1m,但实测gpt的自动压缩还挺黑科技的

那看来要下载CODEX了,我用的是pi
页: 229 230 231 232 233 234 235 236 237 238 [239] 240 241 242 243 244 245 246 247 248
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼