当光停止 发表于 2026-8-9 17:44

坛友在瞎想什么.....
27b的qwen打claude opus 4.6?
a处现在自己都端不出来实际体验上比4.6好的opus。指望qwen端出来个小模型打opus 4.6,还不如期待梁子把v4f优化优化,4.1 4.2之类的版本能打opus4.6有点可能性。

——来自 NX789J 上的 S1er 客户端

舞以 发表于 2026-8-9 17:51

v4flash不就是个大惊喜么
我看白皮玩dgx很爽啊
qwen要真能27b模型做出v4f的水平,那qwen旗舰还会这么垃圾么

qwased 发表于 2026-8-9 17:56

个人部署领域的大惊喜我只能想到一个16G/24G显存的卡真正能跑可用级别的模型了

CCauchy 发表于 2026-8-9 18:11

希望是输入法专用模型和推理程序,而且开源跨平台,可用SIMD指令集加速,使用socket跟Wayland im协议直接通信

squallx 发表于 2026-8-9 18:26

lactone 发表于 2026-8-9 17:34
x上qwen的社区大使说很快个人部署领域会有大惊喜。如果27b模型能力能打opus4.6,那么个人部署的春天就真的 ...

27b:我打opus46?真的假的

—— 来自 OnePlus PJZ110, Android 16, 鹅球 v3.5.99

cxj649 发表于 2026-8-9 18:30

于是明天是8月中旬了

startraveller 发表于 2026-8-9 18:35

舞以 发表于 2026-8-9 17:51
v4flash不就是个大惊喜么
我看白皮玩dgx很爽啊
qwen要真能27b模型做出v4f的水平,那qwen旗舰还会这么垃圾么 ...

DGX Spark性能还是太拉了。 Qwen 3.8 27b能追上上一版v4f就烧香了

neptunehs 发表于 2026-8-9 18:36

本帖最后由 neptunehs 于 2026-8-9 18:45 编辑

qwased 发表于 2026-8-9 17:56
个人部署领域的大惊喜我只能想到一个16G/24G显存的卡真正能跑可用级别的模型了 ...

27b本质上不是16g/24g能跑的模型
除非量化这块出了什么奇迹 让q4逼近q8的效果

35a3b因为3b的限制在很多任务不会比27b好
除非是qwencoder有续作了(印象中是80ba10b来着?

不过我倒是挺期待会不会在9b这搞出一个奇迹来

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

80后卢瑟 发表于 2026-8-9 18:58

startraveller 发表于 2026-8-9 11:49
下周理论上有Deepseek V4 Pro GA、Grok 4.6、GLM 5.3、Qwen 3.8 27B开源,说不定还有Fable5.1和Composer...

Composer 3 的一些爆料已经有了

qwased 发表于 2026-8-9 19:01

neptunehs 发表于 2026-8-9 18:36
27b本质上不是16g/24g能跑的模型
除非量化这块出了什么奇迹 让q4逼近q8的效果


我之前试过那个三元版bonsai 27b,其实能力挺惊喜的,速度也凑合,但是运行起来太麻烦了

zhongjie 发表于 2026-8-9 19:04

cxj649 发表于 2026-8-9 18:30
于是明天是8月中旬了

已知七月中旬为7.31。所以8月初为8.1-8.30不是很正常吗(

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0

wiwiluo 发表于 2026-8-9 19:04

想问一下opencode go订阅的DeepSeek V4 Pro和flash和官方的比有什么区别吗?现在是opencode自部署的V4Flash吗?Go订阅的性价比怎么样

noneoneone 发表于 2026-8-9 19:29

除非有隐私或涩涩的需求,否则部署在消费级显卡上的意义已经不大了。
一个是v4f太便宜了。全价订阅一个opencode go,蹬到死都蹬不完,也就几十块钱。自己搞不但要电费,还要考虑显卡的寿命。
另一个是现在ai的长任务能力够强了。往往下了任务就等着ai自己折腾。自己电脑上要跑起来那就别想干别的事儿了,而且风扇还嗷嗷叫。

——来自 2410DPN6CC 上的 S1er 客户端

qz66618 发表于 2026-8-9 19:36

看了眼X,目前harness还在招人内测,明天没啥可能了,感觉大概率下周五

qwased 发表于 2026-8-9 19:56

向DS许愿做了一个小工具,花了两块钱,其中一块钱花在他没有多模态,处理UI缩放的bug只能不停截图给多模态的模型让他描述细节再处理

nianiania 发表于 2026-8-9 20:01

noneoneone 发表于 2026-8-9 19:29
除非有隐私或涩涩的需求,否则部署在消费级显卡上的意义已经不大了。
一个是v4f太便宜了。全价订阅一个open ...

未来内存下去再加上国内厂商发力的话,类似DGX Spark这种专门用来跑AI的小型主机可能会比自己拿显卡跑要受欢迎吧,只不过现在还是太贵了

流浪的翅膀 发表于 2026-8-9 20:03

明天台风天,更新可能很小

蜇灵 发表于 2026-8-9 20:07

wiwiluo 发表于 2026-8-9 19:04
想问一下opencode go订阅的DeepSeek V4 Pro和flash和官方的比有什么区别吗?现在是opencode自部署的V4Flash ...

目前应该还不是,还是转发到官方API吧,基本上区别不大,哦可能就是没有resonse API,只能用chat API,一些搜索之类的工具不能直接调用

cscbzcbz 发表于 2026-8-9 20:23

wiwiluo 发表于 2026-8-9 19:04
想问一下opencode go订阅的DeepSeek V4 Pro和flash和官方的比有什么区别吗?现在是opencode自部署的V4Flash ...

速度似乎比官方慢一点

lactone 发表于 2026-8-9 20:30

本帖最后由 lactone 于 2026-8-9 20:48 编辑

知乎反DS帮已经成派了,从luna降价到ds涨价到musespark1.2,这几个问题下几个相同的ID后槽牙都咬断了黑


leia_rolando 发表于 2026-8-9 20:57

lactone 发表于 2026-8-9 20:30
知乎反DS帮已经成派了,从luna降价到ds涨价到musespark1.2,这几个问题下几个相同的ID后槽牙都咬断了黑




这话术难不成B站叫图灵坐标的也是其中一员?一个只有2万关注,做一下模型评分的小up。我平时就看一下新模型的跑分。luna降价,musespark1.2一出半天就更新视频,标题都拐ds。然后V4F出了两周都没评分,我以为他是等pro出来再看,原来是不敢出啊

phorcys02 发表于 2026-8-9 21:04

lactone 发表于 2026-8-9 20:30
知乎反DS帮已经成派了,从luna降价到ds涨价到musespark1.2,这几个问题下几个相同的ID后槽牙都咬断了黑




就好像殖畜都收敛成马教徒一样
殖畜也会收敛到反DS

goranger 发表于 2026-8-9 21:06

蜇灵 发表于 2026-8-9 20:07
目前应该还不是,还是转发到官方API吧,基本上区别不大,哦可能就是没有resonse API,只能用chat API,一 ...

现在好像已经有了

论坛助手,iPhone

qwased 发表于 2026-8-9 21:06

phorcys02 发表于 2026-8-9 21:04
就好像殖畜都收敛成马教徒一样
殖畜也会收敛到反DS

重仓美股的还能说利益相关,xhs那些拿ai文爱的也排斥ds有点搞笑,偶然刷到过报团说o/a文爱上等ds劣等的

lactone 发表于 2026-8-9 21:14

leia_rolando 发表于 2026-8-9 20:57
这话术难不成B站叫图灵坐标的也是其中一员?一个只有2万关注,做一下模型评分的小up。我平时就看一下新模 ...

批评ds的其实不少,正常批评也合理

有的明显是带情绪的,经典话术是哪个benchmark把0731排前十,就会拉入黑名单。还有musespark1.2出来之后,直接嘲讽ds连meta都打不过,路边一条之类的

这种不带点血海深仇不至于

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha

ryj 发表于 2026-8-9 21:15

请问 现在国产大模型里面直接写代码的能力强的有哪些?

当光停止 发表于 2026-8-9 21:17

ryj 发表于 2026-8-9 21:15
请问 现在国产大模型里面直接写代码的能力强的有哪些?

kimi、glm、现在更新了的deepseek都可以。
里边性价比最高是deepseek,前端最强是kimi(也最贵最慢),glm在等更新周期估计这两周就发。

舞以 发表于 2026-8-9 21:26

最爆笑的是那种拿中转站价格吹oa的模型有性价比的
你要是一个月花了200刀我还能理解

goranger 发表于 2026-8-9 21:29

市场会用脚投票的,好不好用用了就知道

论坛助手,iPhone

一般市民 发表于 2026-8-9 21:30

openrouter上的GLM最近一直在打折,现在最高95% off,也是不错

舞以 发表于 2026-8-9 21:30

tibo说是周一还会重置一次?
感觉该狠蹬了,我还有一张13号过期的重置卡
希望v4pro能让我不续gpt pro20x

当光停止 发表于 2026-8-9 21:38

Pathfounders 从行业消息人士处获悉,Hassabis 原本希望与 Dean 同时离职,但谷歌管理层认为这一消息将导致其股价崩盘。事实上,在上述宣布后,谷歌股价下跌了 5%。
相反,Hassabis 被说服升任(或降任)**一职,这让组织能够平稳过渡一段时间,直到他能以体面的方式离职。

谷歌啊谷歌。2.5和3是我去年用的最喜欢的模型。3.1就开始拉了,我过年时候还觉得只是个技术性调整。

sellboy 发表于 2026-8-9 21:46

当光停止 发表于 2026-8-9 21:38
Pathfounders 从行业消息人士处获悉,Hassabis 原本希望与 Dean 同时离职,但谷歌管理层认为这一消息将导致 ...

谷歌的模型很大程度上是作为自己旧应用的附加功能,这一点确实是字节路线,那豆包化也不奇怪。

舞以 发表于 2026-8-9 21:54

字节的巅峰能摸到哈基米2.5pro/3.0pro的好时光么
那时哈基米是sota是默认事实来着

半江瑟瑟半江红 发表于 2026-8-9 22:00

我谷歌pro订阅还有将近一年什么时候把那个风趣幽默二刺螈知识渊博活人感十足的gemini还回来

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

fat 发表于 2026-8-9 22:25

舞以 发表于 2026-8-9 21:54
字节的巅峰能摸到哈基米2.5pro/3.0pro的好时光么
那时哈基米是sota是默认事实来着 ...

Gemini掉落至美国豆包只用了半年时间。为什么会突然拉跨得这么快的……

spaceblue 发表于 2026-8-9 22:25

本帖最后由 spaceblue 于 2026-8-9 22:28 编辑

这两天DSV4F降智挺明显的,用的人还是太多了?

半江瑟瑟半江红 发表于 2026-8-9 22:28

spaceblue 发表于 2026-8-9 22:25
这两天DSV4F和5.6Luna降智都挺明显的,还是老老实实用sol吧

5.6sol从上周三开始也有些降智,甚至出现了我让它归纳项目结构时候蹦出来幻觉写入.md文档的情况

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

猫鱼狗带 发表于 2026-8-9 22:31

DeepSeek的版权甲怎么破 我让它帮我下个游戏Rom它都不帮我

王兰花秀丽 发表于 2026-8-9 22:32

本帖最后由 王兰花秀丽 于 2026-8-9 22:33 编辑

我说10号还不出真的有点牢吧

10号出的话,11号朱雀三回收,12号影之刃零开预购,多圆满    Re:Source
页: 143 144 145 146 147 148 149 150 151 152 [153] 154 155 156 157 158 159 160 161 162
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼