goranger 发表于 2026-8-27 00:14
为了让更多新朋友能 0 成本上手体验 GLM-5.3-Flash,我们准备了一批 GLM Coding Plan 7 天体验卡(从未订阅 ...
怎么还要身份证和扫脸,不搞了
qwased 发表于 2026-8-27 00:21
怎么还要身份证和扫脸,不搞了
国内所有plan都需要实名啊
flash模型为什么那么慢, 5.3都感觉更快
今天开了commandcode虽然吐字比官方慢一半但是好歹找回没有后顾之忧随便蹬的感觉了
本来白天都要冲runinfra了 晚上找银行卡的功夫就看到了commandcode
runinfra挺好的 速度很快 比官网也便宜
用D指导算了一下实测数据 文峰8.5文谷4.2runinfra3.73
我选择commandcode
本帖最后由 城北无尘 于 2026-8-27 00:50 编辑
唠叨 发表于 2026-8-27 00:27
今天开了commandcode虽然吐字比官方慢一半但是好歹找回没有后顾之忧随便蹬的感觉了
本来白天都要冲run ...
commandcode跑v4f缓存0.03美元,是官网梁文峰时候的2倍了啊,梁文谷的4倍
给ai丢几百万的采样数据,让他弄弄一个识别的通讯数据的算法
flash 一个个穷举
pro直接卷积
参数量大就是了不起啊
黄金时代啊,你何日再来
f77887 发表于 2026-8-27 00:12
不能啊,我用5080+48g内存,用a3b还是很丝滑的
—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0 ...
上下文实际占多了就暴跌到10tps出头了
→熙← 发表于 2026-8-27 00:26
flash模型为什么那么慢, 5.3都感觉更快
雷霆大思考
5.3flash这消息没有阻击美股吗
—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
qwased 发表于 2026-8-26 22:06
pi vcc+64K上下文的qwen3.8 27b测试完了,长任务触发了2次上下文压缩也没有出现跑偏,装了思考修复之后也是 ...
思考修复是哪个
—— 来自 S1Fun
→熙← 发表于 2026-8-27 00:26
flash模型为什么那么慢, 5.3都感觉更快
现在的几个小参数模型为了编程跑分,都开始拼命后训练,代价就是雷霆大思考,速度慢,一点都不flash。
与其说是flash不如说是cheap更直接。
真红之闪电 发表于 2026-8-27 01:11
思考修复是哪个
—— 来自 S1Fun
https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没有改善。
王兰花秀丽 发表于 2026-8-26 23:30
歪个楼,这个晚点是新出的媒体吗,最近一年能看见很多他们独家的报道,信息量都不少 Re:Source ...
财经类播客出身
专业性嘛,我听过一期播客吹Alex Wang的,后来就取关了
goranger 发表于 2026-8-26 23:36
正常人都是拿新模型让大家免费体验,他到处搞活动免费两周,已经看到两三家了,拿自己家旗舰模型免费这么 ...
我之前是把M3作为便宜的多模态民工模型用,不过现在看来GLM5.3 Flash可以取代了
来都来了 发表于 2026-8-27 01:24
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没 ...
卵用没有 一样被各种转译坑肘击
来都来了 发表于 2026-8-27 01:24
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没 ...
gemini3.7在反重力里面写pwsh脚本倒是好像错误率还行,不像ds4f那样不停的重写
感觉可能是谷歌收集的数据里面有这方面的内容
https://agentrouter.org/register?aff=3YEd
传火
用了前面坛友的链接
Windows上powershell转义问题是修不好的,根源在llm上输出就错了,用了linux的语法。
傻逼powershell用`这个做转义符号。harness工具不太可能去机械的处理这个,因为llm输出的shell命令可以很复杂
根据我自己尝试学pwsh的经历来看,建议放弃pwsh。命令太多太复杂,实际上就那几个基本的命令常用,但一下子根本想不起来。
—— 来自 Xiaomi 25042PN24C, Android 16, 鹅球 v4.0-alpha
Minimax也在财报电话会上预告了3t的m3pro和即将上线的国产算力集群。
你用pwsh,怪不得你塞车
pro模型好像有变化了?
刚刚用它做审查,发现在极简/anchored模式下的思维链也是let me了,但是cot/工具调用的行为和标准还是有明显变化。
极简/anchored仍然是那种利索的感觉,标准上来就啰里八嗦,极简还会出中文思维链了。
梁叔叔不会真的在修了吧?
dhs 有没有破限的办法
我想让他帮我反推 r18 图片提提示词
—— 来自 鹅球 v3.3.96
DSH本地干活选哪种长期记忆?OpenViking树状还是dsh-memory简洁平铺? 我看GPT说现在的CODEX也改用多层复杂结构了
来都来了 发表于 2026-8-27 01:24
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没 ...
不会改善的,没有做额外约束或者转换(实际上也不可能专门去做这方面适配),只是相比老版本能一键切换使用,为了为未来可能出现的pwsh专训模型做准备或者有pwsh专门需求的用户用。现在的llm都对pwsh支持差的前提下没什么用。
自由之紫roy 发表于 2026-8-26 20:05
qwen 3.8 27b FP8 去审核版了解一下
这个可以租服务器,下半年到明年各种魔改卡会上了,算力扩张很多的。openai的辣椒卡,还有谷歌的下代tpu,老黄的大整合服务器柜。如果不冲agi,跑deekseek这种moe,等价算力得翻3倍以上。
而且现金流都开始吃紧了,有一家放水,token都会大降价的。
而且按价格Tonken算,5090虽然便宜,但输出性价比真不如B300那样的新卡(就在这个整租都租不起,得搞分租😒)
中午买了台dgx spark,晚上扭头看卖家已经涨了1000
有powershell支持就捏着鼻子用吧,git bash也很不行,Windows就这样了
—— 来自 Xiaomi 23127PN0CC, Android 16, 鹅球 v4.0-alpha
K3 太慢太慢了,实际上真干活速度还是很重要
你们尝试过拿 qwen3.8 写文的吗?老是打草稿怎么破
—— 来自 S1Fun
qqq2142 发表于 2026-8-27 07:28
dhs 有没有破限的办法
我想让他帮我反推 r18 图片提提示词
有专门的反推插件,本地运行,无任何限制,无token消耗,秒出结果。为什么要用LLM这种低效率的东西
笑死 前两天一大堆谷歌工程师暗示Ox Alpha是谷歌新模型
wsl解君愁,不要跟窗户和它那个见鬼的pwsh死磕,平白涨血压
现在我除了WorkBuddy直接装D盘,其他的pi/opencode/Hermes/dsh都一股脑塞Ubuntu虚拟机,丝滑又省心
来都来了 发表于 2026-8-27 08:19
有专门的反推插件,本地运行,无任何限制,无token消耗,秒出结果。为什么要用LLM这种低效率的东西 ...
本地反推不太行,因为我需要他更只能一些,比如替换角色提示词之类的
本帖最后由 zfy1989 于 2026-8-27 08:37 编辑
qqq2142 发表于 2026-8-27 07:28
dhs 有没有破限的办法
我想让他帮我反推 r18 图片提提示词
有个叫破限模式的插件,效果还可以
—— 来自 HONOR PTP-AN70, Android 16, 鹅球 v3.5.99
zfy1989 发表于 2026-8-27 08:35
有个叫破限模式的插件,效果还可以
—— 来自 HONOR PTP-AN70, Android 16, 鹅球 v3.5.99 ...
还是不行,看来只能老老实实用grok了
试了一下股票的基本面分析,glm连最基本的数据都不准,只能说梁文峰毕竟主业搞量化的,DeepSeek投资分析强太多了
goranger 发表于 2026-8-27 00:14
为了让更多新朋友能 0 成本上手体验 GLM-5.3-Flash,我们准备了一批 GLM Coding Plan 7 天体验卡(从未订阅 ...
第四个和第五个是不是没啥用啊