chronicle 发表于 2026-8-23 23:12

ox alpha就是 glm turbo

qwased 发表于 2026-8-23 23:12

冤枉呐 发表于 2026-8-23 22:39
佬,求指路
主要还是折腾,我现在得把基元的额度给蹬了
nsfw其实……整了个印区grok,文字比谁都放得开 ...

我记得pro正式版刚出来那会有楼友发过,我没存,你往前翻翻看

diohanmilton 发表于 2026-8-23 23:14

ox今天白天转出来接到zcode里用,果然专武还得是专武。晚上又不行了。

—— 来自 HONOR PGT-AN10, Android 16, 鹅球 v4.0-alpha

lactone 发表于 2026-8-23 23:28

不是,现在重训个基模这么容易吗?ds和glm都很快拿出来了水平不差的多模态模型,这种应该要换基模重训的吧?

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha

王兰花秀丽 发表于 2026-8-23 23:34

本帖最后由 王兰花秀丽 于 2026-8-23 23:38 编辑

这么看那个maxforai又在鬼扯,信誓旦旦的说ox alpha 不是我们猜的那几个,上次说ds内置鲸鱼娘人格也是他说的,完全炒作狗啊

冥冥之中感觉ds下周还有大的   

刚刚看见一张炒作图 Re:Source



wonderful259 发表于 2026-8-23 23:42

lactone 发表于 2026-8-23 23:28
不是,现在重训个基模这么容易吗?ds和glm都很快拿出来了水平不差的多模态模型,这种应该要换基模重训的吧 ...

加个多模态一般不需要

qwased 发表于 2026-8-23 23:42

王兰花秀丽 发表于 2026-8-23 23:34
这么看那个maxforai又在鬼扯,信誓旦旦的说ox alpha 不是我们猜的那几个,上次说ds内置鲸鱼娘人格也是他说 ...

实话说我对gemini一点信心都没有了,谷歌这种只有发布头几天好用后面直接上超绝降智版的策略是什么意思?谷歌也不缺算力啊

kylezy123 发表于 2026-8-23 23:45

本帖最后由 kylezy123 于 2026-8-23 23:46 编辑

冤枉呐 发表于 2026-8-23 16:15
我感觉可以拿pi改出一个酒馆来用
小红书上看有个人说拿dsh改酒馆
https://github.com/xumengke2025-sys

感谢坛友提供的灵感 靠v4f许愿试开发下 终于可以让酒馆用这个中转站了 就是非常慢

Gmlazy 发表于 2026-8-23 23:48

朋友们你们除了官方api,都用的哪些平台呢?感觉一看评论就是哪哪的plan都不行,要么额度不透明不如本家,要么高峰期不响应。

zhongjie 发表于 2026-8-24 00:07

Gmlazy 发表于 2026-8-23 23:48
朋友们你们除了官方api,都用的哪些平台呢?感觉一看评论就是哪哪的plan都不行,要么额度不透明不如本家, ...

openrouter,zenmux,charm hyper。靠谱程度依次递减

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0

杀人鲸 发表于 2026-8-24 00:16

最近更新怎么那么频繁?昨天还是前天才更新过,又更新到4.01了。所以,又有什么大的更新要来了吗?

—— 来自 S1Fun

jonarryn 发表于 2026-8-24 00:19

求问硅基流动的0731靠谱吗?我看好像挺便宜的,楼里也有朋友推荐了?

stackoverflow 发表于 2026-8-24 00:27

这opencodego真的有够慢的,开始一个任务八分钟思考四五行然后卡住了,受不了了

空き地卯木 发表于 2026-8-24 00:39

jonarryn 发表于 2026-8-24 00:19
求问硅基流动的0731靠谱吗?我看好像挺便宜的,楼里也有朋友推荐了?

说是50token/s,比官方慢一半

空き地卯木 发表于 2026-8-24 00:44

cscbzcbz 发表于 2026-8-23 18:01
周末这两天都挺爽的,国算也丝滑得很,但是明天上班又要开始pvp了

国算改了a/协议+上下文和最大输出就正常了,今天蹬了一整天搓出了个插件也是丝滑流畅,明天看看周中效果怎么样,可能负载下去了+配置对了又能用了
不得不说v4fv是真的爽,配完comfyui生图工作流还带质检,要是还是折扣价那真的要起飞了

nxmonitor 发表于 2026-8-24 00:44

这个价格不比V4FV低的话,根本没有什么水花的,雷霆大思考的毛病太严重了……

阿刚 发表于 2026-8-24 00:48

空き地卯木 发表于 2026-8-24 00:44
国算改了a/协议+上下文和最大输出就正常了,今天蹬了一整天搓出了个插件也是丝滑流畅,明天看看周中效果 ...

尽量别让他自己质检啊!每次新图都是未命中的,而且图片按大小算token他直接捞原图喂自己烧你token,手动给他截图好一点

王兰花秀丽 发表于 2026-8-24 00:48

杀人鲸 发表于 2026-8-24 00:16
最近更新怎么那么频繁?昨天还是前天才更新过,又更新到4.01了。所以,又有什么大的更新要来了吗?

——...

我将用最不绕弯子的话告诉你,相较于2.4.0就更新了版本号    Re:Source

王兰花秀丽 发表于 2026-8-24 00:50

阿刚 发表于 2026-8-24 00:48
尽量别让他自己质检啊!每次新图都是未命中的,而且图片按大小算token他直接捞原图喂自己烧你token,手动 ...

v4fv最多只支持720p左右,截图与否没区别    Re:Source

杀人鲸 发表于 2026-8-24 01:38

王兰花秀丽 发表于 2026-8-24 00:48
我将用最不绕弯子的话告诉你,相较于2.4.0就更新了版本号    Re:Source

其实这话还真是。很多时候更新都不知道到底更新了什么,更新内容栏里也就只显示“修复了已存在的问题”,而不是“增添了什么新功能”。

—— 来自 S1Fun

squallx 发表于 2026-8-24 02:02

王兰花秀丽 发表于 2026-8-24 00:50
v4fv最多只支持720p左右,截图与否没区别    Re:Source

会裁剪的 还要写个SKILL避免一次太大噎着

jojog 发表于 2026-8-24 02:19

ai质检真的信得过吗

我生图让codex a/ gemini qwen试过查多胳膊多腿还有牛子柰子精度都非常低……

squallx 发表于 2026-8-24 04:22

jojog 发表于 2026-8-24 02:19
ai质检真的信得过吗

我生图让codex a/ gemini qwen试过查多胳膊多腿还有牛子柰子精度都非常低…… ...

都信不过 只能粗筛。 但是目前V4FV Q3.8 K3 OPUS GPT5.6这些里V4FV表现最好

squallx 发表于 2026-8-24 04:23

OX解决了一个HERMES接入酒馆导致头像和TTS不能共存的问题 直接重写了个插件 DEBUG能力挺强的 但是墨迹 确实是GLM味儿

cscbzcbz 发表于 2026-8-24 07:40

OX别的都好太容易断了,而且是断了没有办法继续的那种
昨天晚上跑了一个多小时,断了,没法继续了

空き地卯木 发表于 2026-8-24 07:47

阿刚 发表于 2026-8-24 00:48
尽量别让他自己质检啊!每次新图都是未命中的,而且图片按大小算token他直接捞原图喂自己烧你token,手动 ...

有上限的,300多token一张图,约等于不要钱

阿刚 发表于 2026-8-24 08:22

空き地卯木 发表于 2026-8-24 07:47
有上限的,300多token一张图,约等于不要钱

那还好,一开始的时候他自己生图总是要捞出来看一眼

overflowal 发表于 2026-8-24 08:35

384 token上限这个分辨率还是太模糊了,训正式版应该要再加一下    Re:Source

冤枉呐 发表于 2026-8-24 08:44

kylezy123 发表于 2026-8-23 23:45
感谢坛友提供的灵感 靠v4f许愿试开发下 终于可以让酒馆用这个中转站了 就是非常慢
...

我看出来了你是用PI做了一下中转,牛逼

冤枉呐 发表于 2026-8-24 08:44

qwased 发表于 2026-8-23 23:12
我记得pro正式版刚出来那会有楼友发过,我没存,你往前翻翻看

我搜搜看,感谢

小野賢章 发表于 2026-8-24 08:45

我就是让pi改了一个简易版hermes在用,只有接入im、记忆、定时任务三个功能,然后用系统提示词把人格改了

小止 发表于 2026-8-24 08:56

dsh还不支持mermaid渲染吗,该搓一个了

空き地卯木 发表于 2026-8-24 09:06

jojog 发表于 2026-8-24 02:19
ai质检真的信得过吗

我生图让codex a/ gemini qwen试过查多胳膊多腿还有牛子柰子精度都非常低…… ...

用下来的感受是ai觉得不行的一般都有大问题,ai觉得行的细看可能还有问题
现在丢给GPT IMG去生一些结构上复杂一点的都很容易交付出一些奇形怪状的图片,要是质检真靠谱也就没这些事了,感觉应该还是空间识别上有些问题
不过现在还有个可以本地部署的minimax h3可以试试拿来质检,视频模型在这一块听说会更靠谱一些

冤枉呐 发表于 2026-8-24 09:09

kylezy123 发表于 2026-8-23 23:45
感谢坛友提供的灵感 靠v4f许愿试开发下 终于可以让酒馆用这个中转站了 就是非常慢
...

话说,老兄在酒馆玩啥啊
我捣鼓了几次索然无味

泰坦失足 发表于 2026-8-24 09:10

gemini3.7 flash快到是挺快的,习惯了5.6输出又慢又给你打10个甚至9个补丁/fallback/hash检查后。 挺不习惯的。 不过活干的也糙一点, 让它切换Kindle越狱后linux程序,它没关守护进程,让它搭环境训练,它开始训练后直接就跑了,刚开始就直接报错环境变量问题。

c月光咖啡 发表于 2026-8-24 09:29

空き地卯木 发表于 2026-8-24 09:06
用下来的感受是ai觉得不行的一般都有大问题,ai觉得行的细看可能还有问题
现在丢给GPT IMG去生一些结构上 ...

工业质检谁会用通用大模型啊,肯定得用YOLO这种定制小模型啊

—— 来自 HONOR MAA-AN10, Android 16, 鹅球 v3.5.99-debug

eno_emos 发表于 2026-8-24 09:29

牛来这个模型不能推理强度开max,开个high或者low正好
max有一种pro刚端上来的味,雷霆大思考爱好者,本来就慢的要死经常转半小时一看还在review自己
glm5.3没这感觉啊,难道他们也后训练丹爆炸了?

小野賢章 发表于 2026-8-24 10:07

重置卡都来了

培根芝士蛋堡XD 发表于 2026-8-24 10:11

ox alpha很可能只是用了glm的tokenizer,我这里是没听说glm有任何推新小模型的计划,他们重心都在1.x T的大模型上面

—— 来自 S1Fun

tillnight 发表于 2026-8-24 10:13

eno_emos 发表于 2026-8-24 09:29
牛来这个模型不能推理强度开max,开个high或者low正好
max有一种pro刚端上来的味,雷霆大思考爱好者,本来 ...

V4proga目前的情况更大可能是训练资源移向了其他方向,后训练随便训了一下交差。只在特定模式下激发更高智商本来也更像是只做了有限训练,之所以一开始都在说过拟合其实是都默认7月灰测中的模型就是预备发布的v4proga,能力差那么多只能猜是“练废了”。但是既然上周又掏出了神秘模型,说明什么检查点没留之类的奇葩猜测可以否定了,两者大概率就不是一个模型。你以现在眼光再看0813这个模型的话,他就很像后训练匆忙,远没有达到flash的后训练水平,而不是训练到过拟合了。
同理这个牛来,也确实可能是后训练还没训完,先扔出来了。
页: 264 265 266 267 268 269 270 271 272 273 [274] 275 276 277 278 279 280 281 282 283
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼