唠叨 发表于 2026-8-27 14:24

tonyunreal 发表于 2026-8-27 14:20
正常的,赠送的应该就是lite套餐水平,只能给入门用户尝尝鲜用

lite套餐周1万 这个体验总额2000   也能干不少活刚好让新人评估一下用量和能力 选择合适套餐   卡的挺好的

Freewolf 发表于 2026-8-27 14:30

qwased 发表于 2026-8-27 14:24
你的显卡是什么?有12G显存就能跑hy mt2 7b了,我觉得比跑在线大模型快很多,质量也没啥差别
...

谢谢,我去试试,刚好有台3080 12G的机器。

muermaru 发表于 2026-8-27 14:32

NaAgfykp 发表于 2026-8-27 13:45
我想用 fable 帮我做科研,就是探索一下潜在的创新点的话,是只要随便接一个 Agent 就行,还是说必须得要用 ...

中转站的肥波最大问题是不一定是真的肥波,啥agent倒是无所谓。要是真的肥波肯定放在自己的专武claude code里

qwased 发表于 2026-8-27 14:36

Freewolf 发表于 2026-8-27 14:30
谢谢,我去试试,刚好有台3080 12G的机器。

hy mt2 7b unsloth q6量化+ KV量化Q8 +上下文24K 4并发
lmstudio设置一下按需加载

整体使用就很舒服了


8G显存可以尝试Q4量化,感觉跑翻译用低精度量化影响不大

zhongjie 发表于 2026-8-27 14:42

Claude我就是fable离不开,想要个实惠的。Claude里面fable只能用50%

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0

CCauchy 发表于 2026-8-27 14:46

现在o & a都是对接学术库的吗?还是doi抄摘要

CCauchy 发表于 2026-8-27 14:48

gpt的网页的luna感觉就是把正文回答当思维链用了,nmd我苦苦看了一半直接一个雷霆大转折

自由之紫roy 发表于 2026-8-27 15:01

单卡12并发,我觉得还不错。

億万千 发表于 2026-8-27 15:13

GPT网页版感觉巨慢无比,有什么好姿势吗,Gemini就非常快

真红之闪电 发表于 2026-8-27 15:17

有 Mac 部署本地的老哥吗

—— 来自 S1Fun

serj005 发表于 2026-8-27 15:19

本帖最后由 serj005 于 2026-8-27 15:20 编辑

关于不说人话这点,reasonix最近的中文更新日志就是典型案例,都不知道在放的啥屁,自创黑话一大堆加主语宾语缺失还瞎搞比喻,看的人想骂人,太恶心了

hugosol 发表于 2026-8-27 15:32

GPT plus这加了5小时额度之后完全没法用啊,我用Sol一个对话就用掉大半额度了,这还用个鬼啊

傻吧喵 发表于 2026-8-27 15:40

有没有好用不受限的第三方api啊,deepseek官方api用来实时翻译动不动受限,自己架手上又没多余设备。

→熙← 发表于 2026-8-27 15:45

glm5.3flash没那么聪明, 自己写的代码测试失败后, 就各种无头苍蝇一样暴力枚举方法解决

qqq2142 发表于 2026-8-27 15:50

zfy1989 发表于 2026-8-27 09:03
可以的,https://github.com/yexi-by/dsh-unrestricted#readme,这个



我还是不行,难道是我姿势真的有问题?

来都来了 发表于 2026-8-27 15:57

傻吧喵 发表于 2026-8-27 15:40
有没有好用不受限的第三方api啊,deepseek官方api用来实时翻译动不动受限,自己架手上又没多余设备。 ...

你拿来翻译什么了,连 DeepSeek 甲这么薄都不愿意给你翻?

傻吧喵 发表于 2026-8-27 16:01

本帖最后由 傻吧喵 于 2026-8-27 16:05 编辑

来都来了 发表于 2026-8-27 15:57
你拿来翻译什么了,连 DeepSeek 甲这么薄都不愿意给你翻?

当然是黄油呀,不懂怎么破没研究这个,不过翻上面评论有说deepseek现在不好破的,对ai只会网页和填入相关软件api,完全不懂啊。

冤枉呐 发表于 2026-8-27 16:24

goranger 发表于 2026-8-27 09:36
我这个是在他公众号的官方发的

论坛助手,iPhone

我已经给他蹬完了

小ghoul 发表于 2026-8-27 16:33

基元律动蹬完了得楼友可以到咸鱼买助力号得cookies,1块4能蹬68,还能继续蹬几天

goranger 发表于 2026-8-27 16:49

Muse Spark 1.2 这模型拉不拉,看了看opencode套餐里最便宜的了,上午glm送的周卡5000w蹬完了,下午minimax5h限制一小时蹬完了,准备试试它

nxmonitor 发表于 2026-8-27 16:50

goranger 发表于 2026-8-27 16:49
Muse Spark 1.2 这模型拉不拉,看了看opencode套餐里最便宜的了,上午glm送的周卡5000w蹬完了,下午minimax ...

拉,完全不听指令,试一下就知道

zy450 发表于 2026-8-27 16:50

goranger 发表于 2026-8-27 16:49
Muse Spark 1.2 这模型拉不拉,看了看opencode套餐里最便宜的了,上午glm送的周卡5000w蹬完了,下午minimax ...

看人测试下来很强,但是这家有协议要允许拿你的数据训练

eno_emos 发表于 2026-8-27 16:57

goranger 发表于 2026-8-27 16:49
Muse Spark 1.2 这模型拉不拉,看了看opencode套餐里最便宜的了,上午glm送的周卡5000w蹬完了,下午minimax ...

meta的,首先不许大中华区ip用
其次这玩意agent能力非常拉,我让它自己提一个解决方案,他经历了提出方案A,我指出方案A问题,提出方案B,我指出方案B问题,然后又提出方案A的过程,而且你不问他他完全不读skill,也不探索有哪些skill

masonknight 发表于 2026-8-27 16:57

Hermes desktop新版居然自带opencode的免费模型,其中还有混元模型,蹬了一下,给我优化了一下桌面小工具,还行,就是慢了点

舞以 发表于 2026-8-27 16:59

本帖最后由 舞以 于 2026-8-27 18:19 编辑

我这边dsh接codex疯狂报错啊
本轮运行失败Codex error: Our servers are currently overloaded. Please try again later.编辑:让dsh自己改了下桥接插件,把错误重新分类了。

goranger 发表于 2026-8-27 17:02

@nxmonitor
@eno_emos
@zy450 感谢,训练就训练吧,我默认大模型公司都偷我数据,我准备蹬了试试了

因为我看opencode群里边,这两天glm flash公测的时候,有人说出问题,都是直接让报session id定位错误的,这不就是跟裸体洗澡一样

qwased 发表于 2026-8-27 17:52

chaoliu 发表于 2026-8-26 23:00
求助4070tis(16g显存)本地能跑什么模型目前智商比较高?对输出速度要求不高(能和kimi现在的垃圾速度打平 ...

https://stage1st.com/2b/thread-2288655-1-1.html
文档整理好了,你试试部署一下

mp5 发表于 2026-8-27 17:52

glm5.3flash 感觉还不如glm5.3加个多模态拐杖, glm5.3加了个拐杖之后能帮我搞定之前被d4pro弄成一坨的rust重构项目

startraveller 发表于 2026-8-27 18:00

所以 Qwen 那个 Flash 怎么样?好像没 glm flash 火呀

半江瑟瑟半江红 发表于 2026-8-27 18:03

億万千 发表于 2026-8-27 15:13
GPT网页版感觉巨慢无比,有什么好姿势吗,Gemini就非常快

没有,gpt就是想的慢,想的快得注意一下是不是后台给切成5.5mini了

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

serj005 发表于 2026-8-27 18:04

startraveller 发表于 2026-8-27 18:00
所以 Qwen 那个 Flash 怎么样?好像没 glm flash 火呀

感觉qwen被无视了,同一天发布两个flash,估计都只记得经过牛来炒作一波的glm了。
我昨天也把qwen和glm搞混了,还在想搜qwen的牛来关键词

nxmonitor 发表于 2026-8-27 18:12

startraveller 发表于 2026-8-27 18:00
所以 Qwen 那个 Flash 怎么样?好像没 glm flash 火呀

比GLM的强,但是也有雷霆大思考问题,不过价格也差不多感人

onezer0618 发表于 2026-8-27 18:15

gpt plus有啥替代品吗,现在5h额度,有点没法用了

qwased 发表于 2026-8-27 18:22

傻吧喵 发表于 2026-8-27 15:40
有没有好用不受限的第三方api啊,deepseek官方api用来实时翻译动不动受限,自己架手上又没多余设备。 ...

openrouter买DS3.2吧,翻译我一直感觉v4f不如3.2

neptunehs 发表于 2026-8-27 18:33

qwased 发表于 2026-8-27 18:22
openrouter买DS3.2吧,翻译我一直感觉v4f不如3.2

我甚至觉得纯粹逐句无思考翻译qwen3.8远不如3.6

不过后续的全盘检查因为需要tool 又得3.8或v4f上

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

qwased 发表于 2026-8-27 18:43

neptunehs 发表于 2026-8-27 18:33
我甚至觉得纯粹逐句无思考翻译qwen3.8远不如3.6

不过后续的全盘检查因为需要tool 又得3.8或v4f上
对质量有要求还是参数量大一点的模型吧
qwen 27b这个级别的模型我感觉根本不说人话,跑翻译完全没法用的水平
反而谷歌那个gemma 26a4b开了思考翻出来挺不错的

olo12138 发表于 2026-8-27 18:51

问下现在有2b能本地部署的ai吗,只用来翻译,质量什么都无所谓

UncleDracula 发表于 2026-8-27 18:56

olo12138 发表于 2026-8-27 18:51
问下现在有2b能本地部署的ai吗,只用来翻译,质量什么都无所谓

本地部署比网页版翻译有什么优势吗?

olo12138 发表于 2026-8-27 19:04

UncleDracula 发表于 2026-8-27 18:56
本地部署比网页版翻译有什么优势吗?

我主要是玩gal时要用来翻译一些galgame,本地部署方便点

斯卡文分则能成 发表于 2026-8-27 19:07

基元律动好用嘛
有邀请码嘛
页: 281 282 283 284 285 286 287 288 289 290 [291] 292 293
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼