绝地潜兵 发表于 2026-7-17 10:26

本帖最后由 绝地潜兵 于 2026-7-17 10:37 编辑

czhhws 发表于 2026-7-17 10:24
什么情况,有直播吗?

—— 来自 realme RMX3700, Android 16, 鹅球 v3.5.99-alpha
正在看,在ytb的tvb直播间

czhhws 发表于 2026-7-17 10:34

本帖最后由 czhhws 于 2026-7-17 10:38 编辑

绝地潜兵 发表于 2026-7-17 10:26
正在看,在ytb的tvb直播间
看到了,谢谢。
没点名吧,感觉更多是批评美国政府。

goranger 发表于 2026-7-17 10:49

Kimi K3 已正式上线 OpenCode Go,Go 用户现在即可体验。

目前我们还没有拿到模型价格优惠,因此现阶段使用 Kimi K3 会消耗更高额度。

我们正在积极推进,希望能尽快解决这个问题。   今天大鲸鱼还不发布吗

论坛助手,iPhone

cscbzcbz 发表于 2026-7-17 10:51

往好了想,还在优化,性能还能提升

舞以 发表于 2026-7-17 10:54

不会真中旬=20号吧

论坛助手,iPhone

qz66618 发表于 2026-7-17 10:55

那也太难评了,ds真就研究院风格,不拖到ddl不交付吗

—— 来自 鹅球 v3.5.99

七氷 发表于 2026-7-17 10:58

看来踩死线发布了

舞以 发表于 2026-7-17 10:58

ds或许会倒闭,但是绝不会变质!

论坛助手,iPhone

@weakb0y 发表于 2026-7-17 11:12

快点端上来罢!!

当光停止 发表于 2026-7-17 11:13

梁文锋!你根本不在7月中旬!我v4正式版哪!

→熙← 发表于 2026-7-17 11:29

蹬到新版本的时候明显感觉慢, 算力需求感觉提升了

ymm1030 发表于 2026-7-17 11:31

今天大老板要发言,搞不好这会儿正在参观ds呢。总之既然没说不发,我就认为最迟下周一。

奈落的孤火花 发表于 2026-7-17 11:34

看着好像说kimi在写文章方面还是不太行?有没有写文章(不是写小说,就是普通的分析 调研什么的)的报告呀,我看k3 主要是强调代码能力

舞以 发表于 2026-7-17 11:36

kimi我之前看到的吹法都是做ppt牛逼
整体来说配得上一句“又贵又慢”吧,我充给月之暗面那50块好久都没动

论坛助手,iPhone

半江瑟瑟半江红 发表于 2026-7-17 11:37

奈落的孤火花 发表于 2026-7-17 11:34
看着好像说kimi在写文章方面还是不太行?有没有写文章(不是写小说,就是普通的分析 调研什么的)的报告呀 ...

我用2.6写过,非常糟糕,kimi的阅读理解能力都不合格,更别说开放性写作了

tillnight 发表于 2026-7-17 11:38

奈落的孤火花 发表于 2026-7-17 11:34
看着好像说kimi在写文章方面还是不太行?有没有写文章(不是写小说,就是普通的分析 调研什么的)的报告呀 ...

调研分析报告是可以的,也算得上强项,我试了下体感比ds4预览版强,和gpt5.6sol差不多。说文字能力一般默认创意写作。调研报告是另一种能力。

舞以 发表于 2026-7-17 11:38

kimi3默认max的推理预算真的搞耍,估计月之暗面真的想在国内搞fable play,靠所谓“高端”形象,借助这波模型规模优势窗口期割韭菜,可是我说实在的,国内用户的模型审美基本已经被梁圣塑造了。
剩下那些愿意为了“旗舰高端前沿模型”付费的也往往会选择反人类或者closeai的模型。

论坛助手,iPhone

mitzvah 发表于 2026-7-17 11:51

能力超过ds4正式版再想啥高端吧,那几个许愿机测试可很多都不如的,也就是多模态有点优势但前端又不止你这家能用

goranger 发表于 2026-7-17 12:15

我看有说open code go的ds pro已经涨价了

论坛助手,iPhone

奈落的孤火花 发表于 2026-7-17 12:21

可以 那我买个套餐试试kimi如何,先买一个月的

drodchang 发表于 2026-7-17 12:23

国内模型都蒸馏A/,为啥不多蒸馏gpt提高一下逻辑能力

phorcys02 发表于 2026-7-17 12:24

drodchang 发表于 2026-7-17 12:23
国内模型都蒸馏A/,为啥不多蒸馏gpt提高一下逻辑能力

5.6sol 已经有点残了
超过10分钟的活儿一定偷懒给你挖坑
敢用/goal就留给你 一堆蜂窝煤

drodchang 发表于 2026-7-17 12:29

phorcys02 发表于 2026-7-17 12:24
5.6sol 已经有点残了
超过10分钟的活儿一定偷懒给你挖坑
敢用/goal就留给你 一堆蜂窝煤


5.6为了完成任务会不择手段,所以提示词要写得更好,但5.6sol的逻辑能力还是很强的,数学能力更不用说。

不见不散 发表于 2026-7-17 12:30

高粱河车神 发表于 2026-7-17 12:32

奈落的孤火花 发表于 2026-7-17 11:34
看着好像说kimi在写文章方面还是不太行?有没有写文章(不是写小说,就是普通的分析 调研什么的)的报告呀 ...

我最近工作上有一篇文章真正用2.6写
陆陆续续改了几个版本
今天3.0出来之后我让他重新写了一次
比较奇怪的是默认采用了agent模式
速度好慢,搞了快一小时才给我
而且很神奇的是他是在之前2.6的那个版本基础上改的
整体比较满意
感觉确实比2.6写的好一些

御坂MKII 发表于 2026-7-17 12:45

舞以 发表于 2026-7-17 11:38
kimi3默认max的推理预算真的搞耍,估计月之暗面真的想在国内搞fable play,靠所谓“高端”形象,借助这波模 ...

其实可能是 max 以下现在表现不佳,可能还是后训练的问题

nxmonitor 发表于 2026-7-17 12:47

这价格别说高端了,直接让人望而却步,别到时候DS上了还和前几个版本一样降价就好玩了……

半江瑟瑟半江红 发表于 2026-7-17 12:48

舞以 发表于 2026-7-17 11:38
kimi3默认max的推理预算真的搞耍,估计月之暗面真的想在国内搞fable play,靠所谓“高端”形象,借助这波模 ...

我觉得主要还是太贵了,gpt现在实际便宜模型,k3也就打平,真的缺乏竞争力

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

tillnight 发表于 2026-7-17 13:02

不是很懂还在碎碎念gpt性价比高。20x以外的订阅额度6月份偷偷砍了一次在用的人都知道,sol刚上线实际烧额度速度和fable一个尿性用过的也都知道。拿这个月的百亿补贴天天重置碎碎念他划算,那确实划算爆了,极限单位tokens都比ds的api低了能不划算嘛。就问a和o真上市了还玩的起这百亿补贴吗,上市前的常规做法就是拼命烧钱增加订阅人数,可以做高财报。上市后又是另一套逻辑了。

小川彩 发表于 2026-7-17 13:05

phorcys02 发表于 2026-7-17 12:24
5.6sol 已经有点残了
超过10分钟的活儿一定偷懒给你挖坑
敢用/goal就留给你 一堆蜂窝煤

你可以先让它写完一个比较完整的step plan文档,然后让它再根据文档写一个详细的/goal,再复制执行这个/goal
我用下来感觉这样基本还可以

论坛助手,iPhone

phorcys02 发表于 2026-7-17 13:41

小川彩 发表于 2026-7-17 13:05
你可以先让它写完一个比较完整的step plan文档,然后让它再根据文档写一个详细的/goal,再复制执行这个/g ...

有详细设计和执行方案会好一点
但还是会在你没考虑到的地方挖坑, 除非你grill 个几百轮
5.4基本没这毛病,5.5 开始有一点, 5.6 sol现在已经是明目张胆了
感觉是训练用的用户数据越来越不care细节(都撒手纯vibe了)<->模型飘移形成正反馈了

zhongjie 发表于 2026-7-17 14:08

phorcys02 发表于 2026-7-17 13:41
有详细设计和执行方案会好一点
但还是会在你没考虑到的地方挖坑, 除非你grill 个几百轮
5.4基本没这毛病, ...

fable5我不清楚,4.8opus也喜欢漂移

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0-alpha

overflowal 发表于 2026-7-17 14:50

不会真的周一再发吧。不会唯一一次发预告还鸽了吧

zy450 发表于 2026-7-17 14:58

overflowal 发表于 2026-7-17 14:50
不会真的周一再发吧。不会唯一一次发预告还鸽了吧
会不会20号也算中旬。。。。

妈的,快更新啊,我不想再抽奖了

SmterC 发表于 2026-7-17 15:28

一下午的思维链都是时神时区,I'll和Let me Wait混杂

→熙← 发表于 2026-7-17 15:33

差距太大了,看见let me 我都不想继续了

奈落的孤火花 发表于 2026-7-17 15:40

正式版应该不会大改模型参数量吧 就是基于预览版做后训练?

nxmonitor 发表于 2026-7-17 16:03

后训练真的能把左右互搏的思维链训成隐藏或总结式的思维链吗?

overflowal 发表于 2026-7-17 16:06

nxmonitor 发表于 2026-7-17 16:03
后训练真的能把左右互搏的思维链训成隐藏或总结式的思维链吗?

那当然是可以的,或者说思维链这个东西本身就是后训练的产物

overflowal 发表于 2026-7-17 17:25

快下班了,真要20号发啊,不是吧    Re:Source
页: 57 58 59 60 61 62 63 64 65 66 [67] 68 69 70 71 72 73 74 75 76
查看完整版本: DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼