requiem116 发表于 2026-8-26 16:59
就简单搓个连模拟器的自动脚本结果吃了我20+
还得我自己手动截图一步一步给他说逻辑
本地小模型能干这活不 ...
你用v4fv啊 告诉他 你是多模态模型 可以自己截图看
德尔惠净水器 发表于 2026-8-26 17:05
qwen3.8 27b看起来应该是小模型,但是也不是一般条件能部署,可以试一试比较小的moe模型看看?再小的模型 ...
qwen 一般人真可以部署了 3 张魔改 2080ti 就行了
论坛助手,iPhone
→熙← 发表于 2026-8-26 15:48
不是吧, 消息哪里来的, 别最后只有梁叔叔可用了
这个几乎是一定的。用户的稳定度没有明显的确定之前。没有任何一家会有意愿去主动部署 DeepSeek 这种东西。
—— 来自 S1Fun
唠叨 发表于 2026-8-26 17:17
你用v4fv啊 告诉他 你是多模态模型 可以自己截图看
切换了v4fv,但是不知道是不是为我省钱还是咋的都是优先ocr,倒腾半天不行偶尔读一次图
读图反而很成功
requiem116 发表于 2026-8-26 17:32
切换了v4fv,但是不知道是不是为我省钱还是咋的都是优先ocr,倒腾半天不行偶尔读一次图
读图反而很成功 ...
你得提醒他你是一个多模态模型
蛋黄酱Release 发表于 2026-8-21 22:56
本来还说本地部署一个小视觉模型辅助,现在已经完全没必要了
我上周把这事儿做了,用的qwen2.5-vl-7B模型4bit量化版,通过ollama本地代理
—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
→熙← 发表于 2026-8-26 16:37
然后又手欠,写了确实确实是坑
没有真正的记忆能力,她意识不到注释是自己写的,这甚至比记忆碎片的主角还麻烦,那起码能认得出是自己的字。
御坂MKII 发表于 2026-8-26 16:00
现在是 272k,本来 5.6 发布的时候是 372 k,结果看起来是计费之类的没搞好,又直接缩回 272k 了。 ...
晕倒,我一直以为全世界都1m了
论坛助手,iPhone
梁文谷开始啦
codex其实可以开到1m,就是多了额度跑的快
本帖最后由 omnitoken 于 2026-8-26 18:26 编辑
Ilya 的SSI 又又又又又又又传出来消息说搞出来持续学习TTT了...
你不写是什么坑,我当然要试试,所以问题是后面补的注释还是没写
codex的上下文可以自己改设置文件解锁1m,但是官方应该也是明说了在272k以上时,token价格/限额消耗会明显升高,我记得是1.5倍还是两倍?
反正现在默认锁272k是为了让普通用户的限额维持用量,反正codex的上下文压缩做得还挺不错的
论坛助手,iPhone
然而一到晚上就被全球一起蹬爆
eno_emos 发表于 2026-8-26 18:35
然而一到晚上就被全球一起蹬爆
这个开源嘛?
看价格了,能不能正面重拳出击梁子
论坛助手,iPhone
eno_emos 发表于 2026-8-26 18:35
然而一到晚上就被全球一起蹬爆
都猜到了,毫无悬念
Z/的东西便宜不了,比flash峰值便宜算我输
智谱我还有plan, 能多蹬多少
估计折算成订阅消耗会更便宜吧,但是我不想订😢
论坛助手,iPhone
定价比V4FV高就没意义…
今晚好像要核爆瘫坐了,qwen、glm,以及hy4也有可能要发 Re:Source
坐等今晚核爆 非常期待qwen的flash next 还有hy4😂看看藤子会不会又来个免费大放送
需要更多的甜点级别的模型和价格, 有v4fv的智商就能完成我95%的工作
qwen3.8 27b apex mini跑出来的,中间他要识图debug才发现PI居然不是默认打开多模态的,还要在配置文件里面加上
感觉整体效果和不带视觉的v4flash差不多
不涉及视觉的方面也挺够用的了
然后哈基米3.7flash跑的,怎么用力这么猛,我以为他会随便写写交差
我最关心的是qwen3.8-next-flash的n-gram的效果
论坛助手,iPhone
本帖最后由 来都来了 于 2026-8-26 19:13 编辑
requiem116 发表于 2026-8-26 17:32
切换了v4fv,但是不知道是不是为我省钱还是咋的都是优先ocr,倒腾半天不行偶尔读一次图
读图反而很成功 ...
你的Agent有问题,换Pi解决这些乱七八糟的问题。
qwen这个新模是第一个明确挂了n-gram的吗? 关注关注~
来都来了 发表于 2026-8-26 19:11
你的Agent有问题,换Pi解决这些乱七八糟的问题。
我就用的dsh,也没咋倒腾
看来dsh还是有点区
DeepSeek 收入 4.75 亿、净亏损 7.15 亿
据 The Information 报道,DeepSeek 2026 年前 7 个月实现营收约 4.75 亿元人民币,约为 2025 年全年营收的 10 倍;同期净亏损约 7.15 亿元人民币,低于 2025 年全年 9.35 亿元人民币的净亏损。
今年前 7 个月,DeepSeek 整体毛利率达到 44.6%。其中,通过 API 向外部客户提供模型调用服务的毛利率高达 82.9%,显示模型推理业务已经具备较高的直接毛利水平。
作为对比,OpenAI 今年第一季度营收为 57 亿美元,毛利率约 39%;Anthropic 第二季度营收为 115 亿美元,预计 2026 年毛利率将由 2025 年的约 40% 提升至 63%。
你们再蹬的猛,infra 仙人还是猛赚,82.9 的毛利恐怖如斯
—— 来自 vivo V2309A, Android 16, 鹅球 v4.0
绕指流光 发表于 2026-8-26 19:28
DeepSeek 收入 4.75 亿、净亏损 7.15 亿
据 The Information 报道,DeepSeek 2026 年前 7 个月实现营收约 4 ...
ai企业基本就没有毛利低的,毕竟严格说成本就是电费,毛利低还怎么负担研发费用和固定资产摊销。
营收才这点?
那这api真卖便宜了
现在问题还是钱花不出去啊,太难了,梁子手里全是钱,没货 Re:Source
overflowal 发表于 2026-8-26 19:42
现在问题还是钱花不出去啊,太难了,梁子手里全是钱,没货 Re:Source
缺算力,缺卡呀!哎,什么时候才能够算力自由呀?
—— 来自 S1Fun
lly778 发表于 2026-8-26 19:34
ai企业基本就没有毛利低的,毕竟严格说成本就是电费,毛利低还怎么负担研发费用和固定资产摊销。 ...
这位坛友是否对毛利没啥概念,毛利 82.9 意味着利润快达到成本的 5 倍了,长江电力才 65再往上只有创新药跟茅台能到 90+
就 A➗这个水平都算是垄断行业才有的水平,相当于自来水厂的,A 股平均毛利率才 20+
—— 来自 vivo V2309A, Android 16, 鹅球 v4.0
不知道能不能算力自由,不过我还是决定把积蓄allin了。放纵一下。
自由之紫roy 发表于 2026-8-26 19:55
不知道能不能算力自由,不过我还是决定把积蓄allin了。放纵一下。
羡慕 不过这套的价格够把API蹬到爆炸了啊
The Information的数据根本不用看…
自由之紫roy 发表于 2026-8-26 19:55
不知道能不能算力自由,不过我还是决定把积蓄allin了。放纵一下。
看有不少团购dgx spark,两台可以跑v4f
除了老黄原版,华硕微星超聚变(从华为服务器业务拆出来的部门)都有换皮版本。
两台用200G网口互联。
绕指流光 发表于 2026-8-26 19:46
这位坛友是否对毛利没啥概念,毛利 82.9 意味着利润快达到成本的 5 倍了,长江电力才 65再往上只有创新药 ...
毛利和利润差好远的,ai企业大头在研发费用
绕指流光 发表于 2026-8-26 19:28
DeepSeek 收入 4.75 亿、净亏损 7.15 亿
据 The Information 报道,DeepSeek 2026 年前 7 个月实现营收约 4 ...
82.9,这是什么神仙毛利