看了k3的评价,前端很好,但是逻辑有点差
—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0-alpha
真是逻辑差那就是没啥改进
K3目前看要做个前端的测试还行,但是比如搞一个MC和无人深空的混合游戏就不行了,说明推理能力有一定问题,那这样就有很大局限性了
本帖最后由 nxmonitor 于 2026-7-16 19:45 编辑
DS正式版推理能力这方面要强很多,前几天的那个拉弓射箭的SVG,今天我看到一个土星环上渡渡鸟和几维鸟比赛的SVG,都是以前给Fable测试用的,生成效果甚至更好。这两个偏门的东西。不太可能放进训练集专门来一下吧?
kimi的模型我是用不起
论坛助手,iPhone
nxmonitor 发表于 2026-7-16 19:44
DS正式版推理能力这方面要强很多,前几天的那个拉弓射箭的SVG,今天我看到一个土星环上渡渡鸟和几维鸟比赛 ...
那个射箭是6月中一个up提出来测fable的吧,不太可能专门训练
Promeus 发表于 2026-7-16 19:50
那个射箭是6月中一个up提出来测fable的吧,不太可能专门训练
是的,绝大多数模型生成起来基本都是乱七八糟的,那个土星环也是
现在还没邮件,估计到20号才能发了,要么前几天不涨价
蛋黄酱Release 发表于 2026-7-16 19:28
k3真的有那么神吗?要不要提前开个会员怕到时候跟glm一样抢不到
—— 来自 vivo V2405A, Android 16, 鹅球 ...
不要对 kimi 期望太高
许愿v4f有现在glm5.2的水平就好了
本帖最后由 nxmonitor 于 2026-7-16 20:17 编辑
v4f其实本身就是V4的杀手锏产品,真要有GLM5.2那都吃完了,除了Qwen更小的模型还有什么模型有活路?训练到现在V4P水平还是可以的,就是和GLM5.1差不多……
舞以 发表于 2026-7-16 19:45
kimi的模型我是用不起
论坛助手,iPhone
kimi最划算的是最低档套餐,几十块能拿一个顶级的搜索引擎,更高档的plan太贵太慢没有实用性
v4f正式版真有glm5.2的水平,咬咬牙是真的能本地部署的
kimi的模型,我感觉不要有太高期望?
不差,但是一般没有炒作的那么强
还贵喵
论坛助手,iPhone
v4ga搁着新三兵法呢,哀兵buff又叠起来了
k3应该还好,就是前端sota考虑到前辈是哈基米3p,有点…
只能明天发了吧,总不能周末发吧 Re:Source
overflowal 发表于 2026-7-16 20:40
只能明天发了吧,总不能周末发吧 Re:Source
也可能是下周一
—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0-alpha
发布和上线未必是同一天
—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
17号的大会发布,下周一上线吧?
—— 来自 HUAWEI HOP-AL10, Android 12, 鹅球 v4.0-alpha
发呆的龙虾 发表于 2026-7-16 20:49
17号的大会发布,下周一上线吧?
—— 来自 HUAWEI HOP-AL10, Android 12, 鹅球 v4.0-alpha ...
deepseek 从来不发布后上线,都是上线了,hf上上传了,最后再慢慢宣布 Re:Source
估计是先上线在改价格?
论坛助手,iPhone
好急啊,听说要提前宣布改价格,感觉明天很难了 Re:Source
K3先来了
—— 来自 HUAWEI VYG-AL00, Android 12上的 S1Next-鹅版 v2.5.4
kimi k3据说2.8T参数量ds正式版感觉很难打过啊https://media.discordapp.net/attachments/1471061306294538263/1527305219438940373/29ff2a04ef7fd81703a714bc422bfaf0.jpg?ex=6a5a2d54&is=6a58dbd4&hm=5185ee73dbedff00243acd8a300e5887a3e3689a4eb05a44191c8fbff6b6973d&=&format=webp&width=932&height=1860
参数量有用但是不是决定性的,要知道K3以前最大的国模是文心一言……
现在的一线模型厂商训练基本就是越大越好吧,百度那都是老黄历了,2.8T都快顶上两个ds了
K3来了,等跑分榜,希望不要只是前端碰瓷 Re:Source
qz66618 发表于 2026-7-16 21:26
kimi k3据说2.8T参数量ds正式版感觉很难打过啊
参数越大成本越高,预训练和后训练也越难
文心、qwen-max、gemini pro都是大参数大模型
果然如之前所说的,国模下半年都会上T级别的,明年是否能看到10T级别了?
本帖最后由 绝地潜兵 于 2026-7-16 21:45 编辑
【悲报】k3写文一坨,价格还贵得批爆
10T级别的感觉已经是极限了,规模线性增加所增加的计算量可不是线性的。不过目前最重要的是,我DS正式版呢k3一个意外泄漏的宣发都已经放出来了,DS这提前半个月的预告怎么还没消息
说实话,国内其他几家的infra跟deepseek 比简直是笑话。。。满血的k3竟然只能给超大杯用 Re:Source
绝地潜兵 发表于 2026-7-16 21:42
【悲报】k3写文一坨,价格还贵得批爆
它文档里写的是第三档那个就有了
Andante:暂不支持
Moderato:上下文窗口 256k
Allegretto 及以上:上下文窗口最高 1M
说实话,比gpt plus订阅贵啊……
—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99
要那么多t参数干什么,互联网信息就那么多,预训练你也玩不出更多花啊,最后还是堆人力搞后训练做Alignment
为什么今晚我的破甲提示词突然失效了
deepseek的infra真的是黑科技,导致目前第三方部署都达不到官方价格,所以才有大把的转发
参数量决定知识库能达到的广度,现在的规律肯定是越大越好
—— 来自 鹅球 v3.5.99
刚看了下,k3 agent集群已经在kimi桌面版的work可用了,我开的199会员。chat里面还用不了
个人用户花高价订阅kimi 真不如订gpt吧 价格竞争是实实在在的
论坛助手,iPhone