ycjiang1337 发表于 2026-7-27 23:15

Rowen233 发表于 2026-7-27 23:01
预告的预告来了 Coming Soon
我看杨哥也想要饮料瓶了

已经刷出来了

舞以 发表于 2026-7-27 23:20

harness还需要内测么,感觉挺奇怪的,扔个beta出来社区也能接受吧
除非真的第一方harness有很多巧思乃至工程创新?

论坛助手,iPhone

Sza 发表于 2026-7-27 23:26

goranger 发表于 2026-7-27 22:24
在L站看到说猫老板群发了公告,本周晚些时候开启harness内测了

论坛助手,iPhone ...

请问是L站的哪个帖子?

御坂MKII 发表于 2026-7-27 23:34

舞以 发表于 2026-7-27 23:20
harness还需要内测么,感觉挺奇怪的,扔个beta出来社区也能接受吧
除非真的第一方harness有很多巧思乃至工 ...

除了简洁和 diy 为主的 pi 之外
Claude code 的 app 写的一坨💩
codex 日志最近连着报出来俩吃内存的大问题,multi agent 更是一坨
opencode 的 v1 至今修不好内存占用
真创新吗,软件工程越急着塞一堆东西就一定会是屎山的定律现在也照样是存在的

7uly 发表于 2026-7-27 23:36

goranger 发表于 2026-7-27 22:24
在L站看到说猫老板群发了公告,本周晚些时候开启harness内测了

论坛助手,iPhone ...

L站是指哪个…

goranger 发表于 2026-7-28 00:10

Sza 发表于 2026-7-27 23:26
请问是L站的哪个帖子?

就是一张截图,应该是那个群的群公告,具体帖子已忘了,没啥有效信息,泥潭小画家群里也有人转。具体时间就是说了本周晚些时候,所以我觉得应该快了,没啥其他信息了

论坛助手,iPhone

goranger 发表于 2026-7-28 00:10

7uly 发表于 2026-7-27 23:36
L站是指哪个…

linux do

论坛助手,iPhone

scikirbypoke 发表于 2026-7-28 00:30

pi的rpiv全家桶真好用吧

培根芝士蛋堡XD 发表于 2026-7-28 09:29

dpsk v4再拖下去可能glm5.5都出来了,到时候真就除了便宜点几乎没什么优势

厍无春 发表于 2026-7-28 09:40

wonderful259 发表于 2026-7-27 22:14
现在hermes这块的自动路由做得怎么样了?

智能路由最新版本好像给砍了,现在就是辅助任务不指定模型默认 auto,跟随主模型

半江瑟瑟半江红 发表于 2026-7-28 10:41

培根芝士蛋堡XD 发表于 2026-7-28 09:29
dpsk v4再拖下去可能glm5.5都出来了,到时候真就除了便宜点几乎没什么优势

现在D指导就是除了便宜一无是处啊

goranger 发表于 2026-7-28 10:44

厍无春 发表于 2026-7-28 09:40
智能路由最新版本好像给砍了,现在就是辅助任务不指定模型默认 auto,跟随主模型 ...

你说这个,我是手动强制制定的辅助模型跑在minimax上,没用过智能路由

论坛助手,iPhone

厍无春 发表于 2026-7-28 10:57

goranger 发表于 2026-7-28 10:44
你说这个,我是手动强制制定的辅助模型跑在minimax上,没用过智能路由

论坛助手,iPhone ...

minimax 体验怎么样?

goranger 发表于 2026-7-28 11:13

厍无春 发表于 2026-7-28 10:57
minimax 体验怎么样?

便宜管饱是唯一的优点,跑个任务明确的子代理也没啥,日常对话、任务规划就算了。但是我觉得蛮好的,玩agent大部分时间消耗的token不都是很简单的事情么。目前我的minimax用来当辅助模型、跑子代理、用来当自己开发的记忆插件的llm,这些需求消耗很低,所以有些读长文档的任务也让他干,或者每次改代码前都让他去通读源代码。我是二等老用户,每周150%的消耗还没用完过,不过5h的窗口消耗使劲蹬蹬还是很快耗尽。

论坛助手,iPhone

ymm1030 发表于 2026-7-28 11:32

ds 的性能上处于追赶者我觉得是比较合适的,这样就有理由拒绝额外的对齐要求

—— 来自 S1Fun

darktide 发表于 2026-7-28 11:53

为啥我的用法和你们都不一样,我的v4 pro是作为核心管理用的(专业性强的技术方案会给gpt5.5进行专家评审做迭代),反而编码会用gpt 5.5这种能力最强的模型。用量上v4pro是毫无疑问的大头。目前整体感觉都还挺好

ycjiang1337 发表于 2026-7-28 12:40

ymm1030 发表于 2026-7-28 11:32
ds 的性能上处于追赶者我觉得是比较合适的,这样就有理由拒绝额外的对齐要求

—— 来自 S1Fun ...

法律角度上,“分类分级管控”本身就意味着任何监管部门都无权对模型本身提出任何对齐要求,而政治角度上AI现在已经提到了战略高度,没有哪个部门敢戴上“监管拖后腿”这顶大帽子。

现在至少在刘备文领域,K3仍然没什么限制,仅仅是有概率触发API外挂审核而已

一般市民 发表于 2026-7-28 12:55

本帖最后由 一般市民 于 2026-7-28 12:57 编辑

openrouter找到K3了,为啥在那么下面,为啥这么少的部署

holmesjerry 发表于 2026-7-28 12:56

ycjiang1337 发表于 2026-7-28 12:40
法律角度上,“分类分级管控”本身就意味着任何监管部门都无权对模型本身提出任何对齐要求,而政治角度上 ...

读读玉渊潭天前两天的稿子

ycjiang1337 发表于 2026-7-28 13:03

holmesjerry 发表于 2026-7-28 12:56
读读玉渊潭天前两天的稿子
文章明确说了支持模型开源,而开源模型天生就反对齐,因为任何模型开源之后都可以较为容易地进行反对齐后训练,这种情况下重度对齐就更政治不正确了。

倒不如说,支持开源本身就等价于反对过度监管

crow_wine 发表于 2026-7-28 13:58

opencode 里的 glm速度也是非常的慢,有点尴尬啊,兜兜转转还是回到v4吗

→熙← 发表于 2026-7-28 14:13

有消息了没

overflowal 发表于 2026-7-28 14:21

→熙← 发表于 2026-7-28 14:13
有消息了没

不可能有的    Re:Source

高粱河车神 发表于 2026-7-28 14:31

KIMI K3自从变成agent之后,我第一次把额度用完
而且我完全没有编程,只是在写工作材料而已
还要十几天就用完了,这是在逼我升级会员等级啊

杀人鲸 发表于 2026-7-28 14:31

话说为什么消息保密的那么好呀?说好的信息时代呢?

—— 来自 S1Fun

qz66618 发表于 2026-7-28 14:32

k3已经是激活100B参数的级别了,我感觉V4正式版就算出来也很难超越k3了,除非ds的架构和训练能抹平两倍的激活参数差距

zy450 发表于 2026-7-28 14:38

qz66618 发表于 2026-7-28 14:32
k3已经是激活100B参数的级别了,我感觉V4正式版就算出来也很难超越k3了,除非ds的架构和训练能抹平两倍的激 ...
我觉得有灰测的效果,加原价的半价,竞争力很猛了

目前再强的大模型,都不一定有重复抽卡效果好,K3那价格没办法日常用

goranger 发表于 2026-7-28 18:05

下午api性能下降了一会

论坛助手,iPhone

crow_wine 发表于 2026-7-28 18:26

下午自己的gpt的号触发手机号认证了,真的是麻烦得要死

—— 来自 HUAWEI ALN-AL00, Android 12, 鹅球 v3.5.99-alpha

80后卢瑟 发表于 2026-7-28 18:33

御坂MKII 发表于 2026-7-27 23:34
除了简洁和 diy 为主的 pi 之外
Claude code 的 app 写的一坨💩
codex 日志最近连着报出来俩吃内存的大问 ...

换 v2 就好了,都是 bun 的锅

—— 来自 Xiaomi 23013RK75C, Android 15, 鹅球 v4.0-alpha

舞以 发表于 2026-7-28 18:51

k3那个价格,用吧,一用一个不吱声
月之暗面最主要的产品不是k系列模型,是“国内最强炼丹”这个title。

论坛助手,iPhone

big9999 发表于 2026-7-28 18:55

培根芝士蛋堡XD 发表于 2026-7-28 09:29
dpsk v4再拖下去可能glm5.5都出来了,到时候真就除了便宜点几乎没什么优势

d师傅啥时候以性能著称了?不都是用一折钱换八折性能著称么

舞以 发表于 2026-7-28 18:57

big9999 发表于 2026-7-28 18:55
d师傅啥时候以性能著称了?不都是用一折钱换八折性能著称么

别尬黑,基本每代模型发出来的时候都是开源sota

论坛助手,iPhone

jamboo 发表于 2026-7-28 19:02

goranger 发表于 2026-7-28 11:13
便宜管饱是唯一的优点,跑个任务明确的子代理也没啥,日常对话、任务规划就算了。但是我觉得蛮好的,玩ag ...

+1,只是个便宜的多模态,用作虾粮也不错。

jamboo 发表于 2026-7-28 19:04

scikirbypoke 发表于 2026-7-28 00:30
pi的rpiv全家桶真好用吧

rpiv全家桶是啥,求解

wandeeees 发表于 2026-7-28 19:15

再等半个月GLM5.5都要出来了

novem 发表于 2026-7-28 19:20

这次鸽的有点久啊,有点赶不上趟了

杀人鲸 发表于 2026-7-28 19:23

novem 发表于 2026-7-28 19:20
这次鸽的有点久啊,有点赶不上趟了

突然不知道应该怎么评价,该说这是一如既往吗?总是不会独占鳌头,但是又往往中人之上之姿,应该说一流集团里面,大概可能有点垫底的那种。
就信任程度来说的话,你永远得相信,趟是肯定赶得上的。但是在另外一方面的话,能不能成为必源模型那种争一抢二的,又不太信任。

—— 来自 S1Fun

novem 发表于 2026-7-28 19:29

杀人鲸 发表于 2026-7-28 19:23
突然不知道应该怎么评价,该说这是一如既往吗?总是不会独占鳌头,但是又往往中人之上之姿,应该说一流集 ...

还是搞不清楚为什么中断了V4的发布,非要和Harness一起发布
这明显是计划之外的
但总不能说小鲸鱼一辈子就只占了便宜这一个优点吧

杀人鲸 发表于 2026-7-28 19:34

本帖最后由 杀人鲸 于 2026-7-28 19:36 编辑

novem 发表于 2026-7-28 19:29
还是搞不清楚为什么中断了V4的发布,非要和Harness一起发布
这明显是计划之外的
但总不能说小鲸鱼一辈子 ...

应该说便宜是大肥鱼毋庸置疑的护城河级的优点。至于说其他的优点,性能方面的也都处于一种中上的水平呀。
只不过为什么被打断发行最新版本,的确也是有点奇怪。但又没什么内部员工出来解释的情况下,也就没办法知道了呀。
另外应该怎么说呢?因为AI这种产物太过于趋同发展的情况下,正常来说,AI有的功能普遍都是作为同类都拥有的情况下,你真的很难说什么,某个AI具有着什么非常独特的功能,更多只是它在某个功能上深度开发,研发的力度更大,所以导致表现的更优秀而已。
顺便,这个楼层终于4000楼,100层了,不容易呀!

—— 来自 S1Fun
页: 90 91 92 93 94 95 96 97 98 99 [100] 101 102 103 104 105 106 107 108 109
查看完整版本: DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼