真田源次郎信繁 发表于 2026-7-16 22:18

之前用kimi干逆向任务,他直接说这会破坏内存他不干
这样的模型能收集到个锤子数据啊
钱都花给机场和全网做广告了是吧

tillnight 发表于 2026-7-16 22:19

宏. 发表于 2026-7-16 22:10
刚看了下,k3 agent集群已经在kimi桌面版的work可用了,我开的199会员。chat里面还用不了 ...

我这里对话也是默认k3max的,应该是在逐步推送。

justwul 发表于 2026-7-16 22:23

真田源次郎信繁 发表于 2026-7-16 22:18
之前用kimi干逆向任务,他直接说这会破坏内存他不干
这样的模型能收集到个锤子数据啊
钱都花给机场和全网做 ...

我让他帮我下载整理模拟器的固件都不干    Re:Source

tonyunreal 发表于 2026-7-16 22:25

本帖最后由 tonyunreal 于 2026-7-16 22:27 编辑

好想知道中美之外的国家,看到3T参数量的开源模型的时候是什么感觉

舞以 发表于 2026-7-16 22:36

刚刚重置的限额才用了5%就被官方重置了
订阅制还是不如按量收费
v4正式版,你快来罢!

御坂MKII 发表于 2026-7-16 22:50

本帖最后由 御坂MKII 于 2026-7-16 23:03 编辑

k3 这次可以解决目前国模里只有 glm5.2 可以查出来的一个 case 了,这个 case 最早只有 gpt 5.2 xhigh 这个级别的可以,是我觉得可以放心让它去查些奇怪的 bug 基准 case
不过 token efficiency 还是差太多了,和 glm 一样得跑快半个小时才能解出来。与此同时,都不用和 gpt 比,grok 只需要 4 分钟

实在太慢了,跑点儿自己的 bench case 都不知道要跑多久

zhongjie 发表于 2026-7-16 22:55

等k3.1了,这个token效率好像有点低啊,思考又长又慢

wszyc0308 发表于 2026-7-16 22:58

这K3还是和k2.6一样思考超级慢啊,
把我4000行html的工程计算小工具丢给他让他写个readme,半个小时还没出货

舞以 发表于 2026-7-16 23:02

我一直不太喜欢k系列,因为之前用就觉得高分低能,还又贵又慢。
其实主要是贵

御坂MKII 发表于 2026-7-16 23:04

又跑了个 case,这个 case 目前是 gpt5.5 xhigh 会错但是 5.6 sol 可以解决的

很不意外的 k3 也解不出来,暂时感觉属于预期内的提升,没有什么惊喜。长任务暂时不测了,目前大概来看就是和 glm5.2 一样真的可以干活了。至于极限 case 和 5.6 sol 以及 fable 就是有差距

飛霞精灵 发表于 2026-7-16 23:06

舞以 发表于 2026-7-16 23:02
我一直不太喜欢k系列,因为之前用就觉得高分低能,还又贵又慢。
其实主要是贵 ...
之前做过一个我自己的智障测试。
那就是贴出15轮对话的15章小说,要求AI进行分析,每章大概4000-6000字左右,幻觉能有多少。
也就是标准网文的日更体量。
K系列会出现幻觉,分析出完全不存在的信息。
GLM因为小说里可能的不适内容拒绝了(在其他AI里都没有)。
豆包会遗忘前面的内容。
D老师在这方面是最稳的。

当然也可能是自己做这个的时间比较老了,最差也是年初时候的事情。

overflowal 发表于 2026-7-16 23:07

如果还是之前那个全注意力和线性注意力混合的思路的话,k3 推理起来是要比deepseek 费劲的。deepseek v4的架构是真的能让人使用便宜又快的1m上下文模型。    Re:Source

chenyedgg 发表于 2026-7-16 23:07

Kimi K3 的 API 价格已正式公布,计费单位为每 1M tokens。具体定价如下:- 输入价格(缓存命中):¥2.10   - 输入价格(缓存未命中):¥21.00   - 输出价格:¥105.00   - 上下文窗口:1,048,576 tokens



我就知道

zhongjie 发表于 2026-7-16 23:07


这价格,3美元和15美元。对标sonnet啊

舞以 发表于 2026-7-16 23:09

哈哈这定价,月之暗面还是那个德性。

论坛助手,iPhone

御坂MKII 发表于 2026-7-16 23:09

输出 105 吗,以现在的 token efficiency 来说,感觉有可能实际来说不如 sol 的 api cost

绝地潜兵 发表于 2026-7-16 23:10

打不过GLM5.2,这是什么定价啊

舞以 发表于 2026-7-16 23:12


要订阅的话不如订北美几兄弟的

论坛助手,iPhone

舞以 发表于 2026-7-16 23:17

好像说k3的思维链还是源自d指导那套很细碎的东西?
k3没像v4正式版和glm一样做cot这方面的改进?
可能这也是词元效率低下的原因?

论坛助手,iPhone

overflowal 发表于 2026-7-16 23:21

zhongjie 发表于 2026-7-16 23:07
这价格,3美元和15美元。对标sonnet啊

这降本能力,完蛋啊    Re:Source

御坂MKII 发表于 2026-7-16 23:21

本帖最后由 御坂MKII 于 2026-7-16 23:32 编辑

舞以 发表于 2026-7-16 23:17
好像说k3的思维链还是源自d指导那套很细碎的东西?
k3没像v4正式版和glm一样做cot这方面的改进?
可能这也 ...
glm 的 token efficiency 也一般吧,之前试验的时候感觉也没啥大进步

刚才顺手跑了一下 k3 半个小时要跑出来的 case,glm 感觉这次撞上了,虽然最后解了,但是花了一个小时

wszyc0308 发表于 2026-7-16 23:25

wszyc0308 发表于 2026-7-16 22:58
这K3还是和k2.6一样思考超级慢啊,
把我4000行html的工程计算小工具丢给他让他写个readme,半个小时还没出 ...

199档订阅, 4000行代码小工具,让他出个更新plan,消耗了世界杯活动赠送的125万Token的76%,和5小时限额的55%,用时90分钟,plan还没出来

qz66618 发表于 2026-7-16 23:26

我宣布moonshot已经不是中国的AI公司了!
---发自我的手机
这API是给人用的啊
—— 来自 鹅球 v3.5.99

舞以 发表于 2026-7-16 23:28

wszyc0308 发表于 2026-7-16 23:25
199档订阅, 4000行代码小工具,让他出个更新plan,消耗了世界杯活动赠送的125万Token的76%,和5小时限 ...

感觉不如gpt plus的codex了

88316756 发表于 2026-7-16 23:34

我觉得这个世界上,之前不会有,之后可能也不会有模型能和DS在价格上对标了,一个个稍微升下级就急着和国外模型价格对齐。

nxmonitor 发表于 2026-7-16 23:34

看看DeepSeek的价格好了,B站那么多视频加起来都不花几个钱,估计要和V4刚出来一样,上线后匆忙降价或者优惠

Promeus 发表于 2026-7-16 23:38

nxmonitor 发表于 2026-7-16 23:34
看看DeepSeek的价格好了,B站那么多视频加起来都不花几个钱,估计要和V4刚出来一样,上线后匆忙降价或者优 ...

正式版可能有个哈人的特征,那就是反而花钱少了我看有个做手机小游戏的说比较起来预览版花了3块做的东西被正式版5分成品秒杀

nxmonitor 发表于 2026-7-16 23:39

看测试下来,用做flappybird测的原来三块五现在五分钱,所以DeepSeek正式版可能比测试版便宜,哪怕是在高峰期

舞以 发表于 2026-7-16 23:39

k3之前炒作的架构创新是啥到底 技术报告出了么

论坛助手,iPhone

半江瑟瑟半江红 发表于 2026-7-16 23:39

tonyunreal 发表于 2026-7-16 22:25
好想知道中美之外的国家,看到3T参数量的开源模型的时候是什么感觉

躺平了,现在ai领域就是中美超赛3和布欧对打,其他国家连撒旦先生都算不上

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

杀人鲸 发表于 2026-7-16 23:40

nxmonitor 发表于 2026-7-16 23:34
看看DeepSeek的价格好了,B站那么多视频加起来都不花几个钱,估计要和V4刚出来一样,上线后匆忙降价或者优 ...

正所谓有良心可以赚到钱,没良心可以赚到更多的钱。
只要产品足够好的话,涨价那也真的是没办法,人总还是要用的。
然而这也正因此衬托出了梁圣的可贵,感恩,梁门,鲸震恩!

—— 来自 S1Fun

nxmonitor 发表于 2026-7-16 23:40

Promeus 发表于 2026-7-16 23:38
正式版可能有个哈人的特征,那就是反而花钱少了我看有个做手机小游戏的说比较起来预览版花了3块做的东西 ...

应该是这样,but wait没了,代码没了肯定会低,还有BUG变少轮数也会降低,只不过没想到能低到这样

overflowal 发表于 2026-7-16 23:40

nxmonitor 发表于 2026-7-16 23:34
看看DeepSeek的价格好了,B站那么多视频加起来都不花几个钱,估计要和V4刚出来一样,上线后匆忙降价或者优 ...

搞不好看到友商这拉裤兜的定价,坚定了现在的定价策略。我们的api真是太便宜啦    Re:Source

nxmonitor 发表于 2026-7-16 23:42

杀人鲸 发表于 2026-7-16 23:40
正所谓有良心可以赚到钱,没良心可以赚到更多的钱。
只要产品足够好的话,涨价那也真的是没办法,人总还 ...
即使如此,DeepSeek好像也是最接近走通盈利的路线的,把token当话费卖确实才是出路,也能让AI应用有大爆发的基础

overflowal 发表于 2026-7-16 23:43

舞以 发表于 2026-7-16 23:39
k3之前炒作的架构创新是啥到底 技术报告出了么

论坛助手,iPhone

KDA之类的新注意力,跟qwen一样的线性注意力和全注意力混合。    Re:Source

overflowal 发表于 2026-7-16 23:46

杀人鲸 发表于 2026-7-16 23:40
正所谓有良心可以赚到钱,没良心可以赚到更多的钱。
只要产品足够好的话,涨价那也真的是没办法,人总还 ...

kimi智谱反而可能没赚到钱呢,根本没人直接买他们的api,都是用套餐。而且因为都是专业用户在用,没办法平衡成本。
反而最便宜的deepseek 是赚钱的,因为他们定价就是不亏本的,用越多越赚    Re:Source

nxmonitor 发表于 2026-7-16 23:47

有个完全想不通的地方,为什么神秘模型没多模态,但是空间理解能力这么强?不会是那个新多模态算法发力了吧?我甚至看到AR版MC了……

overflowal 发表于 2026-7-16 23:56

nxmonitor 发表于 2026-7-16 23:47
有个完全想不通的地方,为什么神秘模型没多模态,但是空间理解能力这么强?不会是那个新多模态算法发力了吧 ...

glm5.2空间理解不也挺强的嘛。
当然也可能是正式版就是个多模态模型,暂时没在api上支持图片而已    Re:Source

杀人鲸 发表于 2026-7-16 23:56

nxmonitor 发表于 2026-7-16 23:42
即使如此,DeepSeek好像也是最接近走通盈利的路线的,把token当话费卖确实才是出路,也能让AI应用有大爆发 ...

是这样的呀,说到底,这些定价高的,更多也或许存在着研发成本之类的更商业化的问题,很可能是想低价卖都做不到。
Deepseek本质上就是已经做到了,通过技术降低成本的情况下,低价也能够盈利。

—— 来自 S1Fun

杀人鲸 发表于 2026-7-16 23:58

overflowal 发表于 2026-7-16 23:46
kimi智谱反而可能没赚到钱呢,根本没人直接买他们的api,都是用套餐。而且因为都是专业用户在用,没办法 ...

其实这种专业的使用人,突然让我想起来电脑这个产品原始的时候,本身也是一些高薪人士或者军工领域专用的产品。
然而如果不能下沉到商品级,普及到每个人都能使用的话,那么这门技术基本上就没有发展的空间。
现如今在AI的领域,看上去好像也存在着类似的问题。
专门服务类似于程序员之类的专业人士,不是不可以。
但这种更多属于是开辟子类赛道的一种放弃了主流竞争的行为呀。

—— 来自 S1Fun
页: 54 55 56 57 58 59 60 61 62 63 [64] 65 66 67 68 69 70 71 72 73
查看完整版本: DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼