windhawind2 发表于 2026-8-18 10:25
主要是原电脑真的太卡了 再加上想试试新东西(
24gb内存1tb存储 这样够用了吧应该? ...
32gm1 max,不够
—— 来自 S1Fun
tonyunreal 发表于 2026-8-18 12:17
m3更贵吧,目前找下来价钱合适随便蹬的就只有mimo和luna
反正只是高峰期的备胎 ...
求教一下,随便蹬luna买哪个套餐?没用过GPT
cscbzcbz 发表于 2026-8-18 12:20
求教一下,随便蹬luna买哪个套餐?没用过GPT
说的是opencode go吧 有luna 有mimo 有m3
虽然我感觉opencode go的luna如果哪天没有2x了 也不是可以随便蹬的价格就是了
—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
cscbzcbz 发表于 2026-8-18 12:20
求教一下,随便蹬luna买哪个套餐?没用过GPT
Plus就随便蹬了。但是你确定要蹬luna吗,这玩意又慢能力又很一般,远不如纸面上的好看,和v4flash完全是两种东西。
cscbzcbz 发表于 2026-8-18 12:20
求教一下,随便蹬luna买哪个套餐?没用过GPT
是国内的autodl中转的
本来是用来托管comfyui画图的账号,看到有大模型中转功能就试了一下
tillnight 发表于 2026-8-18 12:22
Plus就随便蹬了。但是你确定要蹬luna吗,这玩意又慢能力又很一般,远不如纸面上的好看,和v4flash完全是 ...
好吧,我还以为luna能代替flash
tillnight 发表于 2026-8-18 12:22
Plus就随便蹬了。但是你确定要蹬luna吗,这玩意又慢能力又很一般,远不如纸面上的好看,和v4flash完全是 ...
plus会员的api只能在codex里用吗,如果作为子代理应该还可以吧
cscbzcbz 发表于 2026-8-18 12:24
好吧,我还以为luna能代替flash
去买8块钱的gemini会员,我试了3.7flash蹬起来比v4flash要强,速度超快(300tk/s以上)还有多模态。但是它的一句话许愿不咋地
qwased 发表于 2026-8-18 12:32
去买8块钱的gemini会员,我试了3.7flash蹬起来比v4flash要强,速度超快(300tk/s以上)还有多模态。但是 ...
是闲鱼买吗
cscbzcbz 发表于 2026-8-18 12:29
plus会员的api只能在codex里用吗,如果作为子代理应该还可以吧
Openai的订阅会员不提供api额度(大多数公司都不提供)。你在codex内是直接登录的gpt账号,不是使用api。不过大多数agent软件现在都支持登录后调用订阅额度,openai用户手册也不反对这种使用方式。
Gemini会员能用API吗 Re:Source
唠叨 发表于 2026-8-18 12:34
是闲鱼买吗
对,据说有5块钱的不过我没搜到
反正8块钱一年半也值了,一个月没掉就是胜利
王兰花秀丽 发表于 2026-8-18 12:41
Gemini会员能用API吗 Re:Source
只能反重力,自己反代据说特别容易封号,反正我感觉拿来许愿的话反重力也没啥区别
本帖最后由 tillnight 于 2026-8-18 12:47 编辑
王兰花秀丽 发表于 2026-8-18 12:41
Gemini会员能用API吗 Re:Source
说实话,没有同时提供会员和api服务的大公司会在会员里提供api额度的,逻辑上就讲不通,因为这等于在开放给中转站打折买你的api当二道贩子(虽然实际上中转站也是走反代变相在这么干,但至少反代是明确违反用户规则的,有明确的风险随时可以掐掉)
cscbzcbz 发表于 2026-8-18 12:29
plus会员的api只能在codex里用吗,如果作为子代理应该还可以吧
Pi也可以用,但是Luna是真不行,比Flash差远了,经常需要来回多次澄清需求,而且声称1M context,实测效果非常差,用Pi的话需要手动压缩或者找别人做好的codex适配。速度就不用说了,没有谁比得上Flash。
cscbzcbz 发表于 2026-8-18 12:24
好吧,我还以为luna能代替flash
Luna 要能代替 Flash,da 根本不会涨价
—— 来自 S1Fun
真红之闪电 发表于 2026-8-18 12:55
Luna 要能代替 Flash,da 根本不会涨价
—— 来自 S1Fun
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米300+ 返工几分钟完事了
而且做UI之类的有多模态确实强不少
qwased 发表于 2026-8-18 12:58
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米3 ...
我最近不着急,这一波闹麻了,等几天看看。
—— 来自 S1Fun
qwased 发表于 2026-8-18 12:58
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米3 ...
哈基米做规划写代码比ds如何?现在主要还是想找个文峰时间的替代,文谷时间,咬咬牙还是用ds舒服
UncleDracula 发表于 2026-8-18 13:04
哈基米做规划写代码比ds如何?现在主要还是想找个文峰时间的替代,文谷时间,咬咬牙还是用ds舒服 ...
你可以试试,反正不贵
我都是比较简单的用法,许愿写点小工具啥的,之前让v4flash写个宏编辑器一直不太顺手,让哈基米重写+返工四五轮修bug出来就很棒了
codex的lunamax干活应该还行吧,要求智力高的工作还得是sol来干。细分下来的活让luna max档位来干应该性价比不错。
qwased 发表于 2026-8-18 13:11
你可以试试,反正不贵
我都是比较简单的用法,许愿写点小工具啥的,之前让v4flash写个宏编辑器一直不太顺 ...
我问咸鱼卖家说是网页版,没有API,兄是咋买的?
UncleDracula 发表于 2026-8-18 13:33
我问咸鱼卖家说是网页版,没有API,兄是咋买的?
只能用Antigravity,实在想接别的harness用就反代一下(据说反代用的越多封号概率越大)
gemini要正经用得走Google AI Studio,所以算下来还是中转站比较划算
用数据说话,Luna现在就是比V4F便宜好用太多还能识图。GPT Plus还带网页版无限聊天和生图。
qwased 发表于 2026-8-18 12:58
真可以试试gemini,特别快,虽然返工次数多但是也不难受
v4flash 110tk/s 返工一次就得等5~15分钟
哈基米3 ...
快狠准还不如grok 4.6,gemini 3.7 flash虽然好了点,但是还是哈基米那桌。关键是grok支付宝可买且不用爬梯。
原来公司有免费的V4,爽翻了,猛蹬
Luna high到max干执行的活还可以的,medium和以下蠢比一个
本帖最后由 hugosol 于 2026-8-18 14:09 编辑
算了一下虽然flash的长上下文能力非常优秀,但是目前缓存命中价格大涨之后用到400多K的长上下文会非常贵,为了省钱可能要跟那些贵价模型一样要提早handoff或者尽量用subagent,属于成本拖累了模型能力上限了
不过实际上缓存命中和输出涨幅是一样的,其实以前跟现在的比例差不多,不过实在太便宜了根本没留意到。。。
估计过个一周,主流后面就变成含泪继续给梁子送钱了
能咋办呢凑合过吧
论坛助手,iPhone
有人试过runinfra.ai的吗,应该是自部署的
Re:Source
贵点就贵点,还没超过我的接受范围,继续用
公司内部部署的v4flash只切了1/3到0731,还要抽奖,简直没法用,无语了
startraveller 发表于 2026-8-18 13:50
快狠准还不如grok 4.6,gemini 3.7 flash虽然好了点,但是还是哈基米那桌。关键是grok支付宝可买且不用爬 ...
不用爬梯了?
—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
OCG的flash变得很耐用了啊,昨晚蹬了几下20%月用量就没了,好心痛
国算还没涨, 先用着, 今天也不429了, 速度飞快
不知道pro下个检查点何时来,我现在怀疑0813这个unix超人模式完全不是ds自己炼炸了,估计更可能是后训练资源被挤压,又不想继续拖,就在这个模式达到了内部的评测标准之后就放出来了
论坛助手,iPhone
下一次大概12月,一般三个月迭代
给你们看下这个国超算的 kimi3 的429
舞以 发表于 2026-8-18 14:03
估计过个一周,主流后面就变成含泪继续给梁子送钱了
能咋办呢凑合过吧
无论是我还是梁子都不想看到这种情况发生啊
再观察一个月吧,估计第三方能支棱起来