红炉灰 发表于 2026-8-6 17:18

如何优化vibe coding的token使用量

本帖最后由 红炉灰 于 2026-8-6 17:20 编辑



今天看了数码区ai编程的帖子,尝试了一下,用git上的两个项目加上自己的需求拼了个新的格式转换软件(GUI),新增了自动识别参数功能
reasonix做完以后,一看网页端api计费整个用了1亿token,还好99%都是命中缓存的我看其他人编程使劲蹬也不需要这么多token,是提示词没写好还是单纯就需要这么多

推理强度之类的设置基本都是默认的,只有工具调用改了yolo

heerorelena 发表于 2026-8-6 17:36

找个最便宜的大模型(便宜且够用的),使劲用,完全不管用量。

宅🍐eriri 发表于 2026-8-6 17:44

还挺正常的,一是deepseek本身token efficiency就没那么出色,二是正常放开蹬一天消耗个三四亿都是正常的,如果跑并行任务消耗还能更高。
不过确实有一些声称能减少token消耗的skill能用,大致就是用skill约束agent的行为和消耗,但效果怎么样还真不好说

Onelooker 发表于 2026-8-6 18:02

如果要猛蹬v4f的话就买opengo的5🔪订阅
优化token用量只会增加返工率

红炉灰 发表于 2026-8-6 18:08

Onelooker 发表于 2026-8-6 18:02
如果要猛蹬v4f的话就买opengo的5🔪订阅
优化token用量只会增加返工率

好像也没有如此高的需求三十多可能够我烧两个月了,还是继续支持梁圣自家api得了,缓存命中实在够便宜

すぴぱら 发表于 2026-8-6 18:20

一个亿不多,没法优化

wx40217 发表于 2026-8-6 19:43

1.看看你的缓存率
2.

—— 来自 OnePlus PJZ110, Android 16, 鹅球 v4.0

wx40217 发表于 2026-8-6 19:46

1.看看你的缓存率
2.优化使用量还没那么容易 这个命题太大了 比较好操作的方向是减少低频mcp skill啥的接入 但是你刚开始用我估计也不会很多 另外就是把上下文和所需信息都放在ai好拿到的地方 比如能写成本地方案就不放在对话里一直读 能告诉他在哪里就不让他自己找

—— 来自 OnePlus PJZ110, Android 16, 鹅球 v4.0

firewings0607 发表于 2026-8-7 13:49

你的期望目标是多少呢

红炉灰 发表于 2026-8-7 18:32

firewings0607 发表于 2026-8-7 13:49
你的期望目标是多少呢

我看有人弄一周才和我这个差不多所以不知道是用多了还是少了

hollowd 发表于 2026-8-8 11:19

本帖最后由 hollowd 于 2026-8-8 11:23 编辑

先使用codegraph初始化一下,一点小功能修修改改用不了一亿多

这个鬼reasonix我用windows版的时候老是报命令执行失败,我换到linux命令行版的opencode了
页: [1]
查看完整版本: 如何优化vibe coding的token使用量