qwased 发表于 2026-8-18 14:14

startraveller 发表于 2026-8-18 13:50
快狠准还不如grok 4.6,gemini 3.7 flash虽然好了点,但是还是哈基米那桌。关键是grok支付宝可买且不用爬 ...

轻度使用的话实在太贵了。。说实话原价的d4flash真的很甜点,能力够用,按量计费,单价还便宜到可以放心用

qwased 发表于 2026-8-18 14:15

crow_wine 发表于 2026-8-18 14:12
给你们看下这个国超算的 kimi3 的429

好像国超算的flash好起来不卡了?

xiaohanne 发表于 2026-8-18 14:16

舞以 发表于 2026-8-18 14:09
不知道pro下个检查点何时来,我现在怀疑0813这个unix超人模式完全不是ds自己炼炸了,估计更可能是后训练资 ...

梁子虽然涨价,但说真的,就算之前被蹬那么狠,都没有频繁429,说明梁子给C端API的算力分配应该是远超那几家总算力更多的国模,可以说依然是对C端用户最诚实的公司。

xiaohanne 发表于 2026-8-18 14:17

本帖最后由 xiaohanne 于 2026-8-18 14:21 编辑

qwased 发表于 2026-8-18 14:14
轻度使用的话实在太贵了。。说实话原价的d4flash真的很甜点,能力够用,按量计费,单价还便宜到可以放心 ...

到了现在这个发展阶段,甜点模型才是大家最需要的。
最前沿大模,也就是规划大项目的时候用一下。

xiaohanne 发表于 2026-8-18 14:19

OpenRoute上GPT 5.6 sol半价了。
看来新模型真要来了。

自由之紫roy 发表于 2026-8-18 14:23

qwen 3.8 27B如果是57G的满血版,到底能打过v4flash0731吗?
两块4080s 32G能不能跑生产力?

qwased 发表于 2026-8-18 14:25

自由之紫roy 发表于 2026-8-18 14:23
qwen 3.8 27B如果是57G的满血版,到底能打过v4flash0731吗?
两块4080s 32G能不能跑生产力? ...

看你几个人用?自己用的话部署个q4或者q6量化的拉满上下文就行,我看评价挺不错的,就是需要调整下思考强度,不然思考太久了

小野賢章 发表于 2026-8-18 14:26

说到底还是国内资源不足啊,kimi 都限售了还这样

xiaohanne 发表于 2026-8-18 14:28

小野賢章 发表于 2026-8-18 14:26
说到底还是国内资源不足啊,kimi 都限售了还这样

Kimi和GLM的总算力应该都是比Deepseek多的。Deepseek前两天被蹬那么狠,都没有频繁429,我感觉应该还是和给C端分配的算力有关,梁子实诚人。

舞以 发表于 2026-8-18 14:29

kimi的第一方托管感觉纯是仪式性业务

xiaohanne 发表于 2026-8-18 14:30

小野賢章 发表于 2026-8-18 14:26
说到底还是国内资源不足啊,kimi 都限售了还这样

另外,不要相信Minimax。Minimax在M3推出以前你不买他的HighSpeed套餐,到了高峰期根本就完全没法用。三次指令报一次429,用的我都快吐了。

自由之紫roy 发表于 2026-8-18 14:31

话说豆包到底在干嘛,不考虑出个api或者开源吗

自由之紫roy 发表于 2026-8-18 14:32

qwased 发表于 2026-8-18 14:25
看你几个人用?自己用的话部署个q4或者q6量化的拉满上下文就行,我看评价挺不错的,就是需要调整下思考强 ...

一般1-2人中度使用。

crow_wine 发表于 2026-8-18 14:32

受不了了,让kimi3 跑了2个小时用了2千万 token,还装模作样的给我分析3层原因,一层比一层深。我一看结果是一个很简单的错误。
区区
这就是 3万亿参数比肩 fable5 的水平

→熙← 发表于 2026-8-18 14:32

j-space应该是有点用的, 只是没一个量化数据
风神+ /j-space 强制调用后, 看思维链也在用起来了, 用了一天没啥篓子, 任务分析和完成挺漂亮
就是他的WORKSPACE.md只有一个, 不支持并发, 要优化

卡普空 发表于 2026-8-18 14:36

xiaohanne 发表于 2026-8-18 14:16
梁子虽然涨价,但说真的,就算之前被蹬那么狠,都没有频繁429,说明梁子给C端API的算力分配应该是远超那 ...

第三方应该要供很多模型吧,就算总算力多一分摊以后也没那么多了

qwased 发表于 2026-8-18 14:40

自由之紫roy 发表于 2026-8-18 14:32
一般1-2人中度使用。

那你两张卡搞下unsloth那个q6开满上下文就能用的很舒适了,思考时间充足的话和v4flash区别不大

tillnight 发表于 2026-8-18 14:42

七氷 发表于 2026-8-18 14:11
下一次大概12月,一般三个月迭代

检查点迭代和正式版本不同,静默更新是很正常的。比如gpt-5.6 sol实际这两个月已经更新了几次检查点。

zhongjie 发表于 2026-8-18 14:42

→熙← 发表于 2026-8-18 14:32
j-space应该是有点用的, 只是没一个量化数据
风神+ /j-space 强制调用后, 看思维链也在用起来了, 用了一天 ...

j space相当于让它运行五次,从五次中抽卡吧。性能不清楚,用量肯定是五倍了

crow_wine 发表于 2026-8-18 14:46

这个什么j space看起来特别民科,而且 github 也有人打假根本就没跑完测试

卡普空 发表于 2026-8-18 14:46

zhongjie 发表于 2026-8-18 14:42
j space相当于让它运行五次,从五次中抽卡吧。性能不清楚,用量肯定是五倍了 ...

j space 对flash有用吗

tonyunreal 发表于 2026-8-18 14:47

本帖最后由 tonyunreal 于 2026-8-18 14:51 编辑

自由之紫roy 发表于 2026-8-18 14:23
qwen 3.8 27B如果是57G的满血版,到底能打过v4flash0731吗?
两块4080s 32G能不能跑生产力? ...

还要算上 上下文占的显存,q8量化加256K上下文应该需要60GB左右显存

能力应该能打平flash同价位这些模型
前提是你不需要更大的上下文

—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99

果壳中的松鼠 发表于 2026-8-18 14:47

果壳中的松鼠 发表于 2026-8-18 11:37
https://github.com/Tiger3807861189/J-Space-Cognition-Suite-V3.6/issues/18
有人在打假之前的j-space sk ...

作者回应是删掉了这个issue

—— 来自 鹅球 v3.3.96

tillnight 发表于 2026-8-18 14:49

说实话除非ds之前是在巨亏吹牛皮的纯烂活,哪怕他只是非常薄利,现在的价格都给第三方很大的盈利想象空间,打不过第一方部署成本很正常,第一方翻了三五倍了你还没法更便宜就太扯淡了。理论上不应该是最后被迫都回去用官方水管,而是都开始琢磨租b300挣这个无本生意才对。

→熙← 发表于 2026-8-18 14:50

zhongjie 发表于 2026-8-18 14:42
j space相当于让它运行五次,从五次中抽卡吧。性能不清楚,用量肯定是五倍了 ...

实际运行效果像一个记录本
先设定一个goal, 然后模型随着发现一条条记录下来, 这个是我最近的一个
开始只写了一个goal,后面都是随着发现补上去的

模型是v4flash

# J-Space Workspace Ledger

## Goal
从用户端梳理 F18 主功能切换 + 吹风延时的规格矩阵,并在集成测试中覆盖所有可能测试。

## Core
- 遍历组合:AI制热↔热干燥/冷干燥、AI制热↔换气、换气↔热干燥/冷干燥、双氧净风↔AI制热
- 每个主功能覆盖:未开/刚开(<3s)/开了一段时间(>=3s)/关闭后吹风延时中/延时结束/切换到另一功能
- 校验:三板状态同步、显示板图标、warm/clear 继电器、BLDC 转速、吹风延时秒数

## Verified
- 新增 Test/integration_test/tests/basic/test_f18_main_switch.cpp(18 个用例)
- CMakeLists.txt 已加入 test_f18_main_switch
- 全量集成测试 23/23 通过(含新测试)
- 关键实现事实:吹风延时为全局单例(非按功能独立);主板上 MASTER_BLOW_DELAY=1 负责计数;
关闭加热后延时只保吹风不保 PTC;切换非加热功能时延时会继续递减。

## Open
- 如需原始数码管“剩余秒数”显示断言,需扩展 board_api 暴露显示缓冲(当前集成测试以功能状态+延时秒数代理)。

## Next
完成

crow_wine 发表于 2026-8-18 14:52

我也觉得,真的是不思进取。只要你琢磨下,研究一下,别说和第一方之前的价格一样,你就是稍微比涨价后的价格第一点,都是能赚满的

chaoswing 发表于 2026-8-18 15:09

spaceblue 发表于 2026-8-18 13:40
用数据说话,Luna现在就是比V4F便宜好用太多还能识图。GPT Plus还带网页版无限聊天和生图。 ...

这是用什么软件测的?

spaceblue 发表于 2026-8-18 15:11

chaoswing 发表于 2026-8-18 15:09
这是用什么软件测的?

https://deng.codexradar.com/

neptunehs 发表于 2026-8-18 15:17

crow_wine 发表于 2026-8-18 14:52
我也觉得,真的是不思进取。只要你琢磨下,研究一下,别说和第一方之前的价格一样,你就是稍微比涨价后的价 ...

也是怕你部署了梁子想变回梁圣降价的吧
真的有需求的只有10美元变60美元的opencode go

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

王兰花秀丽 发表于 2026-8-18 15:19

runinfra这个真的可以试一下,有180token/s用下来感觉人生都加速了

    Re:Source

卡普空 发表于 2026-8-18 15:25

crow_wine 发表于 2026-8-18 14:52
我也觉得,真的是不思进取。只要你琢磨下,研究一下,别说和第一方之前的价格一样,你就是稍微比涨价后的价 ...

说明大家都只想白嫖梁子

cscbzcbz 发表于 2026-8-18 15:27

如果成本这么低,众筹租服务器部署,有没有可能

qwased 发表于 2026-8-18 15:32

cscbzcbz 发表于 2026-8-18 15:27
如果成本这么低,众筹租服务器部署,有没有可能

你说的这玩意有个名字叫中转站

wuuuuuud 发表于 2026-8-18 15:34

qwased 发表于 2026-8-18 15:32
你说的这玩意有个名字叫中转站

中转站怎么会自己部署...

—— 来自 nubia NX737J, Android 15, 鹅球 v4.0-alpha

overflowal 发表于 2026-8-18 15:34

这什么j space玩意真有人信啊?这不就是AI版的量子养生水杯。觉得A/的术语高大上就随便整整骗人    Re:Source

onezer0618 发表于 2026-8-18 15:39

falsethen 发表于 2026-8-17 17:27
就正常买,跟着教程激活就好了。
保险点么开个GOOGLE小号,然后把大号拉进家庭组 ...

那个我买过了,我指的是反代怎么弄

GJRstone 发表于 2026-8-18 15:49

离开了梁圣,才发现外面怎么天天429啊

ST2002 发表于 2026-8-18 15:53

王兰花秀丽 发表于 2026-8-18 15:19
runinfra这个真的可以试一下,有180token/s用下来感觉人生都加速了

    Re:Source

这家部署的是 0731 和 0813 吗?官网上没写版本,不会是预览版吧

—— 来自 鹅球 v3.3.96

dear81 发表于 2026-8-18 15:55

startraveller 发表于 2026-8-18 13:50
快狠准还不如grok 4.6,gemini 3.7 flash虽然好了点,但是还是哈基米那桌。关键是grok支付宝可买且不用爬 ...

grok现在好点了么?之前就是路边一条

大概快五个月没用了

舞以 发表于 2026-8-18 15:56

dear81 发表于 2026-8-18 15:55
grok现在好点了么?之前就是路边一条

大概快五个月没用了

Cursor数据加上马圣不缺算力,这几代在coding上是突飞猛进了

论坛助手,iPhone
页: 225 226 227 228 229 230 231 232 233 234 [235] 236 237 238 239 240 241 242 243 244
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼