serj005 发表于 2026-8-13 23:48
非码农主要的问题可能是不知道node和npx咋用以及webui的运行,官方没做正常exe安装启动的桌面端对普通用 ...
我问了Gemini然后照抄的,很快
—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
公司内部计价也涨了,我们每天25$额度
1M输入 1M输出 模型
10.000 45.000 gpt-5.6-sol
*5.000 22.500 gpt-5.6-terra
*3.750 18.750 claude-opus-4-8
*2.950 14.760 kimi-k3
*2.000 *9.000 gpt-5.6-luna
*2.000 10.000 claude-sonnet-5
*1.180 *4.130 glm-5.2
*1.150 *3.460 qwen3.8-max
*0.750 *3.750 claude-haiku-4-5
*0.435 *0.870 deepseek-v4-pro
*0.140 *0.280 deepseek-v4-flash
*0.000 *0.000 deepseek-v4-flash(自建)
给 Pi 写了一个高峰期提醒切换模型的扩展,配置文件:~/.pi/agent/peak-pricing.json
{
"rules": [
{
"model": "deepseek/deepseek-*",
"timezone": "Asia/Shanghai",
"periods": [
{ "start": "09:00", "end": "12:00" },
{ "start": "14:00", "end": "18:00" }
]
}
],
"remindIntervalMinutes": 5,
"promptTimeoutSeconds": 0
}
涨价了,这个帖子的回复会开始变少吧
有点理解血精灵对太阳井的执念了
—— 来自 Xiaomi 2410DPN6CC, Android 16, 鹅球 v3.5.99-alpha
目前看涨价后,对于使用harness的轻量级用户那种许愿式编程不行了,真的贵啊
中国的程序员是不是最被歧视同时也是最贱的?
https://p.sda1.dev/34/1a32bff3f99ce9091cd6068fb0a5dc3e/image.jpg看了下 openrouter 上,未量化 1mb 上下文的 flash 差不多能做到 0.5 左右 的输入 1.1 左右 的输出,就是缓存还是贵了些
—— 来自 鹅球 v3.3.96-alpha
open code go还能继续爽蹬吗
发现ChatGPT web版 + Github Repo的读写检索能力能作为一个不错的内容管理笔记. 比如我刚和GPT讨论了一套解决方案计划, 就可以直接让gpt 更新某个repo里的txt文件, 把计划都写进去. 以后让gpt读这个repo里就能检索到这个计划. 不用依赖GPT的搜索/记忆/最近对话作为上下文的能力.
卡普空 发表于 2026-8-17 09:01
open code go还能继续爽蹬吗
ocg涨价还减额度了
—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0
趁人少来求问一下,单纯写文用是不是没必要折腾dsh,还是老老实实用之前的软件就行?
顺便求问有什么针对flash0731的写作提示词嘛
酱油拌饭s 发表于 2026-8-17 09:07
趁人少来求问一下,单纯写文用是不是没必要折腾dsh,还是老老实实用之前的软件就行?
顺便求问有什么针对fl ...
我捣鼓了一个网页版的小助手
捣鼓出来以后不知道写啥了
要不你试试?
—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
本帖最后由 dear81 于 2026-8-17 09:14 编辑
里奥哟西 发表于 2026-8-17 08:55
中国的程序员是不是最被歧视同时也是最贱的?
不,是劳动者和个体消费者是最贱的
这里 贱 指的是不值钱
看今天涨价后出不出现API性能下降了。不下降就忍痛祝梁圣AGI顺利,还下降直接滑动变阻到梁处
完全不懂的小白进来问一下,是不是用那个WSL部署DSH,然后再上某插件,就可以开启DS V4的觉醒模式了?
冤枉呐 发表于 2026-8-17 09:09
我捣鼓了一个网页版的小助手
捣鼓出来以后不知道写啥了
要不你试试?
求一下!
所以看下来没有便宜的api可用了?
token自由时代应该结束了。
以后ai程序员如何规划成本会变成手艺活。
显卡/ai芯片 性能靠堆规模 llm的智能也靠堆规模。
便宜的token本身就没有物质基础,纯烧钱抢市场,和当年的网约车大战没本质区别。
现在也只能说是补贴到头了。
科技新闻搬运工 发表于 2026-8-17 09:19
完全不懂的小白进来问一下,是不是用那个WSL部署DSH,然后再上某插件,就可以开启DS V4的觉醒模式了?
...
wsl和插件都不是必要的,重点是v4pro要在dsh极简模式的提示词下运行。
只是dsh极简模式目前不支持直接从windows环境调用git bash,所以很多人用wsl把dsh运行在linux虚拟机上解决bash的问题(这个有很多其他解法,wsl不是唯一选择),插件也只是为了模拟极简模式的初始提示词,直接运行极简模式就是完全体,代价就是没法用skill、mcp、插件等额外工具。
酱油拌饭s 发表于 2026-8-17 09:21
求一下!
等等啊,我让flash打个包,说明一下依赖,你给我个邮箱地址
https://www.scnet.cn/ac/openapi/doc/2.0/moduleapi/plans/token-plan.html
有人用过超算的0731flash吗,说是30块钱能蹬15亿左右
本帖最后由 冤枉呐 于 2026-8-17 09:57 编辑
酱油拌饭s 发表于 2026-8-17 09:07
趁人少来求问一下,单纯写文用是不是没必要折腾dsh,还是老老实实用之前的软件就行?
顺便求问有什么针对fl ...
还有个deepwrite项目
deepwrite免费模型发送!助力大家创作! https://xhslink.cn/o/HJPjPlEcGE 先复制这段文字,再进【小红书】查看完整笔记。
这个人自己搓的,但是一直不支持知识库。
不过至少开发的东西看起来很成熟的样子,还支持手机版,比我的小项目牛逼
你看着用用
酱油拌饭s 发表于 2026-8-17 09:07
趁人少来求问一下,单纯写文用是不是没必要折腾dsh,还是老老实实用之前的软件就行?
顺便求问有什么针对fl ...
小参数模型写作非常一般
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
看一下能不能用本地的千问了
deepseek写出来的东西就特别的……无趣,需要你自己大量润色
muermaru 发表于 2026-8-17 09:39
deepseek写出来的东西就特别的……无趣,需要你自己大量润色
其实AI写作不怕直出无趣,怕的是不遵循指令和注意力涣散,以及配套的专武工具调用不积极,文风是最容易纠正的,但是这三条非常难办。
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
打算试一下 Qwen3.8-27B 4bit 量化了
话说现在写文D4F和D4P差的多少?
半江瑟瑟半江红 发表于 2026-8-17 09:41
其实AI写作不怕直出无趣,怕的是不遵循指令和注意力涣散,以及配套的专武工具调用不积极,文风是最容易纠 ...
这个可以用多次切会话的方式解决吧,注意力涣散感觉是上下文过长降智了
好贵啊,贵的离谱了,高峰涨了11倍
muermaru 发表于 2026-8-17 09:45
这个可以用多次切会话的方式解决吧,注意力涣散感觉是上下文过长降智了 ...
不是。d指导本身就容易注意力涣散抓不住重点
另外写文肯定是把小说工作结构化在智能体里干活,并不考验大模型自己上下文记忆力,主要是考验工具调用能力、检索到新信息以后的注意力转移,这方面不到300k上下文的gpt比1m的d指导强得多
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
tillnight 发表于 2026-8-17 02:09
其实算上OAI是独一无二的网页版单独算额度来说,Gpt明显一直是在百亿补贴的,这种不可能不在上市前改过来 ...
但对于Rudin来说Luna部署成本可能真没那么高
冤枉呐 发表于 2026-8-17 09:34
还有个deepwrite项目
deepwrite免费模型发送!助力大家创作! https://xhslink.cn/o/HJPjPlEcGE 先复制这 ...
请问这个能写刘备文吗?
本帖最后由 noneoneone 于 2026-8-17 09:52 编辑
所以现在ocgo哪个模型更合适
我看luna和v4f的量差不多
把人赶走,资源都腾出来炼丹了吧,估计是想抓紧出下一个模型
英伟达平台目前不是还有免费的嘛,我看并发也不算太低,那个能用吗
半江瑟瑟半江红 发表于 2026-8-17 09:48
不是。d指导本身就容易注意力涣散抓不住重点
另外写文肯定是把小说工作结构化在智能体里干活,并不考验大 ...
是我的使用方法不对吗,体感GPT 免费版写文很拉胯,全是短句,一句话一段那种,细节描写很少,同样的提示词 ds 网页版就好很多,至少是正常的小说
最新一期屎山论剑的结果。
█████Gemini≈¥3.43 4分
████████ Grok ≈¥5.618分
██████████████ GLM ≈¥9.805分
████████████████▏ DeepSeek ¥12 5分
████████████████████ Kimi 5分 ≈¥13.8
██████████████████████████████████ Opus ≈¥23.44分
综合下来,火星AI的性价比非常高。
oct71952 发表于 2026-8-17 09:50
请问这个能写刘备文吗?
看你接什么模型了
模型能破甲就能,模型不破甲就不能
开发者还不知道从哪找了个免费的flash
感觉离商业化不远了