真红之闪电 发表于 2026-8-18 12:19

windhawind2 发表于 2026-8-18 10:25
主要是原电脑真的太卡了 再加上想试试新东西(
24gb内存1tb存储 这样够用了吧应该? ...

32gm1 max,不够

—— 来自 S1Fun

cscbzcbz 发表于 2026-8-18 12:20

tonyunreal 发表于 2026-8-18 12:17
m3更贵吧,目前找下来价钱合适随便蹬的就只有mimo和luna
反正只是高峰期的备胎 ...

求教一下,随便蹬luna买哪个套餐?没用过GPT

neptunehs 发表于 2026-8-18 12:21

cscbzcbz 发表于 2026-8-18 12:20
求教一下,随便蹬luna买哪个套餐?没用过GPT

说的是opencode go吧 有luna 有mimo 有m3
虽然我感觉opencode go的luna如果哪天没有2x了 也不是可以随便蹬的价格就是了

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

tillnight 发表于 2026-8-18 12:22

cscbzcbz 发表于 2026-8-18 12:20
求教一下,随便蹬luna买哪个套餐?没用过GPT

Plus就随便蹬了。但是你确定要蹬luna吗,这玩意又慢能力又很一般,远不如纸面上的好看,和v4flash完全是两种东西。

tonyunreal 发表于 2026-8-18 12:24

cscbzcbz 发表于 2026-8-18 12:20
求教一下,随便蹬luna买哪个套餐?没用过GPT

是国内的autodl中转的
本来是用来托管comfyui画图的账号,看到有大模型中转功能就试了一下

cscbzcbz 发表于 2026-8-18 12:24

tillnight 发表于 2026-8-18 12:22
Plus就随便蹬了。但是你确定要蹬luna吗,这玩意又慢能力又很一般,远不如纸面上的好看,和v4flash完全是 ...

好吧,我还以为luna能代替flash

cscbzcbz 发表于 2026-8-18 12:29

tillnight 发表于 2026-8-18 12:22
Plus就随便蹬了。但是你确定要蹬luna吗,这玩意又慢能力又很一般,远不如纸面上的好看,和v4flash完全是 ...

plus会员的api只能在codex里用吗,如果作为子代理应该还可以吧

qwased 发表于 2026-8-18 12:32

cscbzcbz 发表于 2026-8-18 12:24
好吧,我还以为luna能代替flash

去买8块钱的gemini会员,我试了3.7flash蹬起来比v4flash要强,速度超快(300tk/s以上)还有多模态。但是它的一句话许愿不咋地

唠叨 发表于 2026-8-18 12:34

qwased 发表于 2026-8-18 12:32
去买8块钱的gemini会员,我试了3.7flash蹬起来比v4flash要强,速度超快(300tk/s以上)还有多模态。但是 ...

是闲鱼买吗

tillnight 发表于 2026-8-18 12:38

cscbzcbz 发表于 2026-8-18 12:29
plus会员的api只能在codex里用吗,如果作为子代理应该还可以吧

Openai的订阅会员不提供api额度(大多数公司都不提供)。你在codex内是直接登录的gpt账号,不是使用api。不过大多数agent软件现在都支持登录后调用订阅额度,openai用户手册也不反对这种使用方式。

王兰花秀丽 发表于 2026-8-18 12:41

Gemini会员能用API吗    Re:Source

qwased 发表于 2026-8-18 12:43

唠叨 发表于 2026-8-18 12:34
是闲鱼买吗

对,据说有5块钱的不过我没搜到

反正8块钱一年半也值了,一个月没掉就是胜利

qwased 发表于 2026-8-18 12:45

王兰花秀丽 发表于 2026-8-18 12:41
Gemini会员能用API吗    Re:Source

只能反重力,自己反代据说特别容易封号,反正我感觉拿来许愿的话反重力也没啥区别

tillnight 发表于 2026-8-18 12:45

本帖最后由 tillnight 于 2026-8-18 12:47 编辑

王兰花秀丽 发表于 2026-8-18 12:41
Gemini会员能用API吗    Re:Source

说实话,没有同时提供会员和api服务的大公司会在会员里提供api额度的,逻辑上就讲不通,因为这等于在开放给中转站打折买你的api当二道贩子(虽然实际上中转站也是走反代变相在这么干,但至少反代是明确违反用户规则的,有明确的风险随时可以掐掉)

LeoDT 发表于 2026-8-18 12:46

cscbzcbz 发表于 2026-8-18 12:29
plus会员的api只能在codex里用吗,如果作为子代理应该还可以吧

Pi也可以用,但是Luna是真不行,比Flash差远了,经常需要来回多次澄清需求,而且声称1M context,实测效果非常差,用Pi的话需要手动压缩或者找别人做好的codex适配。速度就不用说了,没有谁比得上Flash。

真红之闪电 发表于 2026-8-18 12:55

cscbzcbz 发表于 2026-8-18 12:24
好吧,我还以为luna能代替flash

Luna 要能代替 Flash,da 根本不会涨价

—— 来自 S1Fun

qwased 发表于 2026-8-18 12:58

真红之闪电 发表于 2026-8-18 12:55
Luna 要能代替 Flash,da 根本不会涨价

—— 来自 S1Fun
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米300+ 返工几分钟完事了
而且做UI之类的有多模态确实强不少

真红之闪电 发表于 2026-8-18 13:02

qwased 发表于 2026-8-18 12:58
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米3 ...

我最近不着急,这一波闹麻了,等几天看看。

—— 来自 S1Fun

UncleDracula 发表于 2026-8-18 13:04

qwased 发表于 2026-8-18 12:58
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米3 ...

哈基米做规划写代码比ds如何?现在主要还是想找个文峰时间的替代,文谷时间,咬咬牙还是用ds舒服

qwased 发表于 2026-8-18 13:11

UncleDracula 发表于 2026-8-18 13:04
哈基米做规划写代码比ds如何?现在主要还是想找个文峰时间的替代,文谷时间,咬咬牙还是用ds舒服 ...

你可以试试,反正不贵
我都是比较简单的用法,许愿写点小工具啥的,之前让v4flash写个宏编辑器一直不太顺手,让哈基米重写+返工四五轮修bug出来就很棒了

love4aids 发表于 2026-8-18 13:16

codex的lunamax干活应该还行吧,要求智力高的工作还得是sol来干。细分下来的活让luna max档位来干应该性价比不错。

UncleDracula 发表于 2026-8-18 13:33

qwased 发表于 2026-8-18 13:11
你可以试试,反正不贵
我都是比较简单的用法,许愿写点小工具啥的,之前让v4flash写个宏编辑器一直不太顺 ...

我问咸鱼卖家说是网页版,没有API,兄是咋买的?

qwased 发表于 2026-8-18 13:34

UncleDracula 发表于 2026-8-18 13:33
我问咸鱼卖家说是网页版,没有API,兄是咋买的?

只能用Antigravity,实在想接别的harness用就反代一下(据说反代用的越多封号概率越大)

scikirbypoke 发表于 2026-8-18 13:37

gemini要正经用得走Google AI Studio,所以算下来还是中转站比较划算

spaceblue 发表于 2026-8-18 13:40

用数据说话,Luna现在就是比V4F便宜好用太多还能识图。GPT Plus还带网页版无限聊天和生图。

startraveller 发表于 2026-8-18 13:50

qwased 发表于 2026-8-18 12:58
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米3 ...

快狠准还不如grok 4.6,gemini 3.7 flash虽然好了点,但是还是哈基米那桌。关键是grok支付宝可买且不用爬梯。

卡普空 发表于 2026-8-18 13:50

原来公司有免费的V4,爽翻了,猛蹬

tonyunreal 发表于 2026-8-18 13:56

Luna high到max干执行的活还可以的,medium和以下蠢比一个

hugosol 发表于 2026-8-18 13:58

本帖最后由 hugosol 于 2026-8-18 14:09 编辑

算了一下虽然flash的长上下文能力非常优秀,但是目前缓存命中价格大涨之后用到400多K的长上下文会非常贵,为了省钱可能要跟那些贵价模型一样要提早handoff或者尽量用subagent,属于成本拖累了模型能力上限了

不过实际上缓存命中和输出涨幅是一样的,其实以前跟现在的比例差不多,不过实在太便宜了根本没留意到。。。

舞以 发表于 2026-8-18 14:03

估计过个一周,主流后面就变成含泪继续给梁子送钱了
能咋办呢凑合过吧

论坛助手,iPhone

王兰花秀丽 发表于 2026-8-18 14:05

有人试过runinfra.ai的吗,应该是自部署的

    Re:Source

2017.05.04 发表于 2026-8-18 14:05

贵点就贵点,还没超过我的接受范围,继续用

小野賢章 发表于 2026-8-18 14:06

公司内部部署的v4flash只切了1/3到0731,还要抽奖,简直没法用,无语了

冤枉呐 发表于 2026-8-18 14:07

startraveller 发表于 2026-8-18 13:50
快狠准还不如grok 4.6,gemini 3.7 flash虽然好了点,但是还是哈基米那桌。关键是grok支付宝可买且不用爬 ...

不用爬梯了?

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

UncleDracula 发表于 2026-8-18 14:08

OCG的flash变得很耐用了啊,昨晚蹬了几下20%月用量就没了,好心痛

→熙← 发表于 2026-8-18 14:09

国算还没涨, 先用着, 今天也不429了, 速度飞快

舞以 发表于 2026-8-18 14:09

不知道pro下个检查点何时来,我现在怀疑0813这个unix超人模式完全不是ds自己炼炸了,估计更可能是后训练资源被挤压,又不想继续拖,就在这个模式达到了内部的评测标准之后就放出来了

论坛助手,iPhone

七氷 发表于 2026-8-18 14:11

下一次大概12月,一般三个月迭代

crow_wine 发表于 2026-8-18 14:12



给你们看下这个国超算的 kimi3 的429

hugosol 发表于 2026-8-18 14:13

舞以 发表于 2026-8-18 14:03
估计过个一周,主流后面就变成含泪继续给梁子送钱了
能咋办呢凑合过吧


无论是我还是梁子都不想看到这种情况发生啊
再观察一个月吧,估计第三方能支棱起来
页: 224 225 226 227 228 229 230 231 232 233 [234] 235 236 237 238 239 240 241 242 243
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼