唠叨 发表于 2026-8-26 11:02

王兰花秀丽 发表于 2026-8-26 10:57
试一下runinfra的

    Re:Source

有邀请链接吗

darktide 发表于 2026-8-26 11:03

意外的发现cursor的grok4.6还挺好用,额度非常经用,速度也快。

Gmlazy 发表于 2026-8-26 11:05

kinfox 发表于 2026-8-26 10:36
pi毫无配置。。我连skill都没装 就装了国内网友做的无限上下文压缩插件,就没有了。。模型本地部署是llm ...

我没用过pi,这个插件麻烦指路,谢谢~

neptunehs 发表于 2026-8-26 11:05

本帖最后由 neptunehs 于 2026-8-26 11:08 编辑

唠叨 发表于 2026-8-26 10:55
是gmicloud那吗 吐字速度怎么样

吐字速度还行 吐字前要排一下队
偶尔会断 偶尔会卡死不知道到底是排队还是断了

还有不知道oh my pi的问题还是模型的问题 我没看到思维链

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

空き地卯木 发表于 2026-8-26 11:11

唠叨 发表于 2026-8-26 10:46
模型名称        综合扣减倍率
GLM-5.3        2.29
GLM-5.2        0.90

算下来和梁文峰时段差不多价格了,这直接大改算法,用完不续了

星野あさみ 发表于 2026-8-26 11:13



赶在DGX Spark大涨前入了。按这个repo跑起来本地蓝色大肥鱼flash 0731:
https://github.com/MiaAI-Lab/DeepSeek-v4-Flash-One-DGX-Spark/

cc里除了自动模式分类器老超时,其他都还行。到时候写个代理把分类请求转到ocg的免费模型上

期待今天晚上的Qwen 3.8 flash next,125B A6B感觉特别合适

王兰花秀丽 发表于 2026-8-26 11:13

唠叨 发表于 2026-8-26 11:02
有邀请链接吗

没有,只有注册送一美元,另外他家tps比官方还快    Re:Source

goranger 发表于 2026-8-26 11:22

minimax这模型,年付用户表示只适合跑提炼总结agent定时监控等不需要脑子的任务

论坛助手,iPhone

cscbzcbz 发表于 2026-8-26 11:22

空き地卯木 发表于 2026-8-26 11:11
算下来和梁文峰时段差不多价格了,这直接大改算法,用完不续了

计算公式哪来的?我找了半天文档没有找到,问官方客服给了我个旧的截图,懒得和他吵了

qwased 发表于 2026-8-26 11:23

星野あさみ 发表于 2026-8-26 11:13
赶在DGX Spark大涨前入了。按这个repo跑起来本地蓝色大肥鱼flash 0731:
https://github.com/MiaAI-Lab/D ...

你也太有行动力了吧,反正不出测试之前我不信3.8flash能跟dsv4f一样

→熙← 发表于 2026-8-26 11:24

国算这涨价真恶心
一样的参数, 0731是预览版的4.7倍
还是梁文峰的价格
用完滚蛋了

→熙← 发表于 2026-8-26 11:25

cscbzcbz 发表于 2026-8-26 11:22
计算公式哪来的?我找了半天文档没有找到,问官方客服给了我个旧的截图,懒得和他吵了 ...

页面有基准价 以 Kimi-K2.6 为例,60,000 Credits 套餐按输入单价约合 720 万 tokens,输出约合 170 万 tokens,缓存命中输入约合 1.2 亿 tokens。综合测算约合 3000 万 tokens(因作业类型差异较大,仅供参考)。

然后除倍率

kinfox 发表于 2026-8-26 11:25

Gmlazy 发表于 2026-8-26 11:05
我没用过pi,这个插件麻烦指路,谢谢~

https://github.com/ranxianglei/billion-context-pi
我装的插件是这个。。

天桥夜风 发表于 2026-8-26 11:28

中国人 发表于 2026-8-25 11:48
有个疑问你们会在AI犯蠢的时候骂它吗……虽然我知道这样没意义,但有时就是血压高啊 ...


唠叨 发表于 2026-8-26 11:29

王兰花秀丽 发表于 2026-8-26 11:13
没有,只有注册送一美元,另外他家tps比官方还快    Re:Source

谢谢佬 已经蹬上了 刚好国算点数用完完美衔接

cscbzcbz 发表于 2026-8-26 11:31

本帖最后由 cscbzcbz 于 2026-8-26 11:35 编辑

→熙← 发表于 2026-8-26 11:25
页面有基准价

然后除倍率

这个只是kimi2.6的示例吧,不同模型应该有差异?不然我直接用k3不是爽爆?之前是有个清单的,现在直接把清单删除了,涨价都不敢**方方涨吗
国算这个余额延迟贼大,想实测都不好测

突然明白了,是不是说现在这个kimi2.6是基准(倍率是1),新的减扣倍率是乘法?之前还是倍率越高越省钱的

城北无尘 发表于 2026-8-26 11:34

超算平台怎么也开始模糊价格了,真tm恶心啊。国内这些plan全都是按自己的积分+倍率黑箱扣分,以前超算平台还能计算,现在不行

论坛助手,iPhone

→熙← 发表于 2026-8-26 11:34

本帖最后由 →熙← 于 2026-8-26 11:40 编辑

SCNet Token Plan 基础版(¥30/月)全模型价格表

基础版活动价 ¥30/月,含 60,000 Credits(Credits 单价 ¥0.0005)。
以下为全部 16 个模型按倍率从高到低排列的每百万 token 折算成本,单位:元/百万 tokens。


序号模型倍率输入(未命中)缓存命中输出
1Kimi-K34.1217.171.0372.71
2GLM-5.32.299.540.5740.41
3Qwen3.8-max2.008.330.5035.29
4DeepSeek-V4-Pro-08131.355.630.3423.82
5GLM-5.11.335.540.3323.47
6GLM-51.084.500.2719.06
7DeepSeek-V4-Pro1.064.420.2718.71
8Kimi-K2.7-Code1.004.170.2517.65
9Kimi-K2.61.004.170.2517.65
10GLM-5.20.903.750.2315.88
11Kimi-K2.50.652.710.1611.47
12DeepSeek-V4-Flash-07310.612.540.1510.76
13MiniMax-M30.431.790.117.59
14MiniMax-M2.70.431.790.117.59
15MiniMax-M2.50.301.250.085.29
16DeepSeek-V4-Flash0.130.540.032.29


额度换算参考(60,000 Credits 全部用完时)
[*]倍率 1.0 的模型:约 720 万输入 tokens,或 170 万输出 tokens,或 1.2 亿缓存命中 tokens
[*]其他模型按倍率折算:如全跑 Kimi-K3 只能跑约 175 万输入 / 41 万输出;全跑 DeepSeek-V4-Flash 可跑约 5,540 万输入 / 1,310 万输出

注意事项
[*]上表为活动价(¥30/月)口径;若按原价 ¥50/月 计算,所有价格 ×1.67
[*]单价前提是当月额度用满——Credits 到期作废不结转,用不满则单价按比例上浮
[*]模型扣减倍率平台每周动态调整,实际以控制台实时数据为准
[*]来源:scnet.cn Token Plan 官方文档页估算值反推,仅供参考

空き地卯木 发表于 2026-8-26 11:34

cscbzcbz 发表于 2026-8-26 11:22
计算公式哪来的?我找了半天文档没有找到,问官方客服给了我个旧的截图,懒得和他吵了 ...

ds根据他那个用kimi举的例子算的

cscbzcbz 发表于 2026-8-26 11:37

→熙← 发表于 2026-8-26 11:34
SCNet Token Plan 基础版(¥30/月)全模型价格表

基础版活动价 ¥30/月,含 60,000 Credits(Credits 单价 ¥ ...

明白了

城北无尘 发表于 2026-8-26 11:38

cscbzcbz 发表于 2026-8-26 11:22
计算公式哪来的?我找了半天文档没有找到,问官方客服给了我个旧的截图,懒得和他吵了 ...

就截图能发出来看一下嘛?

论坛助手,iPhone

misuzu0723 发表于 2026-8-26 11:44

城北无尘 发表于 2026-8-26 11:34
超算平台怎么也开始模糊价格了,真tm恶心啊。国内这些plan全都是按自己的积分+倍率黑箱扣分,以前超算平台 ...

不仅仅是国内,国外的也一样,额度说变就变

—— 来自 vivo V2405A, Android 15, 鹅球 v4.0-alpha

蜇灵 发表于 2026-8-26 11:44

kinfox 发表于 2026-8-26 09:02
我显卡24g的4090,现在日常占用是21.7

打扰了,告辞

cscbzcbz 发表于 2026-8-26 11:46

本帖最后由 cscbzcbz 于 2026-8-26 11:48 编辑

城北无尘 发表于 2026-8-26 11:38
就截图能发出来看一下嘛?

论坛助手,iPhone

就是之前的页面,我记得的,这个肯定是更新前的

最后还是都回梁叔叔那里了,用户还是赶不走

neptunehs 发表于 2026-8-26 11:48

cscbzcbz 发表于 2026-8-26 11:46
就是之前的页面,我记得的,这个肯定是更新前的

最后还是都回梁叔叔那里了,用户还是赶不走

主要是梁叔叔那一晚上15还因为进了死胡同0参出还是受不了 哎

在死胡同里碰壁慢慢摸出口还是应该交给免费模型

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

蜇灵 发表于 2026-8-26 11:52

王兰花秀丽 发表于 2026-8-26 10:57
试一下runinfra的

    Re:Source

这个怎么这么便宜

qwased 发表于 2026-8-26 11:56

蜇灵 发表于 2026-8-26 11:44
打扰了,告辞

有16g都可以用了,参考这个方案,我自己实测无mtp qwen3.8 apex nano(等效q3k量化)可以192k上下文,apex mini(等效q5ks)可以72k上下文

王兰花秀丽 发表于 2026-8-26 11:56

蜇灵 发表于 2026-8-26 11:52
这个怎么这么便宜

由他们名字可知这是真的自己部署的    Re:Source

cscbzcbz 发表于 2026-8-26 11:59

对比之下梁叔叔简直大善人
提前11天通知涨价,提前4天告知涨价具体方案,不爽还能随时退款

crow_wine 发表于 2026-8-26 12:00

国算新上的 0813 缓存命中有问题,缓存命中越来越低,只有23%,直接少了 5W 积分,相当于一个 30 元档位的 plan 被烧没了

→熙← 发表于 2026-8-26 12:03

王兰花秀丽 发表于 2026-8-26 10:57
试一下runinfra的

    Re:Source

缓存不便宜啊, 还是说有下面还有小数

crow_wine 发表于 2026-8-26 12:04

国算的蹬完走人了,我蹬的量是多,但是他这服务太烂了,而且价格也说不上好,各种bug。
260的套餐感觉很差,后面变回500更是路边一条

唠叨 发表于 2026-8-26 12:15

→熙← 发表于 2026-8-26 12:03
缓存不便宜啊, 还是说有下面还有小数

我知足了 先蹬为敬

ivly 发表于 2026-8-26 12:15

本帖最后由 ivly 于 2026-8-26 12:16 编辑

qwased 发表于 2026-8-26 11:56
有16g都可以用了,参考这个方案,我自己实测无mtp qwen3.8 apex nano(等效q3k量化)可以192k上下文,ape ...
速度如何?我4080玩27b q3 xxs 和q3 xl 分别到120k和80k,速度在40-70之间。为了给桌面留点显存。
哦,你把其他放内存或者cpu啊,我是全放显存。

UncleDracula 发表于 2026-8-26 12:22

唠叨 发表于 2026-8-26 12:15
我知足了 先蹬为敬

实际蹬起来体验不是很便宜,几个小任务就蹬了14块了,当作文峰时间的替代也有点肉疼

qwased 发表于 2026-8-26 12:25

ivly 发表于 2026-8-26 12:15
速度如何?我4080玩27b q3 xxs 和q3 xl 分别到120k和80k,速度在40-70之间。为了给桌面留点显存。
哦,你把 ...

视觉放cpu基本没有影响,反而可以解放一大块显存给上下文
跑mini的输出速度45tk/s,上下文到30k开始会慢慢降速,到60k之后降到20tk/s,配合无llm上下文压缩插件凑合能用了
iq3xxs体感比apex mini笨很多,虽然快但是全浪费在无效思考上了

唠叨 发表于 2026-8-26 12:27

UncleDracula 发表于 2026-8-26 12:22
实际蹬起来体验不是很便宜,几个小任务就蹬了14块了,当作文峰时间的替代也有点肉疼 ...

没办法啊同样的任务用其他模型要么更贵要么效率太低

王兰花秀丽 发表于 2026-8-26 12:29

我还是推荐火山coding plan(如果50块能买到),开auto模式    Re:Source

CCauchy 发表于 2026-8-26 12:30

codex的上下文不到1m?我还以为是我中转的问题

论坛助手,iPhone

真红之闪电 发表于 2026-8-26 12:33

CCauchy 发表于 2026-8-26 12:30
codex的上下文不到1m?我还以为是我中转的问题

论坛助手,iPhone

默认好像 295

—— 来自 S1Fun
页: 272 273 274 275 276 277 278 279 280 281 [282] 283 284 285 286 287 288 289 290 291
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼