找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] 正式版到底什么时候来?|DeepSeek v4讨论专楼

 火.. [复制链接]
发表于 2026-7-22 16:04 | 显示全部楼层
斯卡文分则能成 发表于 2026-7-22 15:52
搜索模式挂了啊,大的要来了?

搜索挂了就是小的来了,api挂了可以勉强称之为大的来了    Re:Source
回复

使用道具 举报

     
发表于 2026-7-22 16:08 | 显示全部楼层
有没有可能是把网线拔了
回复

使用道具 举报

发表于 2026-7-22 16:35 | 显示全部楼层
overflowal 发表于 2026-7-22 16:04
搜索挂了就是小的来了,api挂了可以勉强称之为大的来了    Re:Source

啥时候恢复啊,7月下旬了吧
回复

使用道具 举报

     
发表于 2026-7-22 16:46 | 显示全部楼层
cscbzcbz 发表于 2026-7-22 16:08
有没有可能是把网线拔了

一定是间谍维亚切斯拉夫·巴兰尼科夫、安东·尤丁采夫、尼基塔·布亚诺夫干的
回复

使用道具 举报

     
发表于 2026-7-22 17:05 来自手机 | 显示全部楼层
修好了,看来今天也不会发了

—— 来自 realme RMX3700, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-7-22 18:51 | 显示全部楼层
肯定今天不会发呀,想都不用想,我猜,如果真的会发,就是二十四号了吧?估计最快就二十四号了现在比起新版的Deepseek,我还更期待他们的 agent
回复

使用道具 举报

发表于 2026-7-22 19:12 | 显示全部楼层
24号发的说法让我觉因为太绝望于是在文档上翻一个日期出来做发布日期的感觉    Re:Source
回复

使用道具 举报

     
发表于 2026-7-22 19:13 来自手机 | 显示全部楼层
看今天的消费金额比之前多了不少
回复

使用道具 举报

     
发表于 2026-7-22 19:18 | 显示全部楼层
我问了下 ChatGPT 和 Deepseek,祂们各自建议什么时候发。
提示词:“从狙击美国股市考虑,Deepseek 什么时候发比较好?最近有美国什么重要经济数据发表的时间吗?”

问前者第一次直接拒绝回答,第二次倒是给了回复:
想让影响更清晰:8月9日周日晚发布。
想赶在当前市场脆弱期形成共振:7月26日周日晚。
最不合适:7月29日FOMC前后直接发布,因为宏观新闻会淹没模型本身。


后者没有墨迹,很爽快地给了答案:
如果以最大化对美股的冲击为目标:
避开7月22日:科技巨头财报密集发布,市场注意力被分散。
避开7月30日:Q2 GDP初值公布,这是重磅宏观数据,会主导当日市场情绪。
考虑7月23日(周四)或7月24日(周五):这几天数据相对"清淡",市场注意力更容易被AI模型的消息吸引。尤其是7月24日的PMI数据本身就会影响市场对经济的预期,若叠加AI模型发布的冲击,可能产生共振效应。
周一(7月27日)也是一个潜在选项——延续"周一突袭"的传统,给市场一个周末去消化各种信息后在周一集中爆发。

回复

使用道具 举报

     
发表于 2026-7-22 19:34 | 显示全部楼层
灰度消失了确实金额会上升,灰测的模型不知道为什么会这么省token,缓存命中甚至更高了
回复

使用道具 举报

     
发表于 2026-7-22 20:46 | 显示全部楼层
本帖最后由 舞以 于 2026-7-22 20:48 编辑

模型后训练充分之后,有经验有“直觉”,不用花大量token做无意义的思考试错和回滚,能够快速进入正确的工作路径,token消耗降低是正常的。k3现在其实就像个规模翻倍有多模态的v4p预览版。
看3.1有没有惊喜吧,现在确实用起来难受。

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-7-22 20:47 来自手机 | 显示全部楼层
一个简单的任务,把视频拖拽到tkinter的窗口上导入视频路径,DS Pro反复试错好几次才成功,真是的,赶紧升级吧

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-7-22 20:47 来自手机 | 显示全部楼层
搜索功能已经好了,大的又走了。
回复

使用道具 举报

     
发表于 2026-7-22 21:04 | 显示全部楼层
目前就看周五,周五没有就下周一
回复

使用道具 举报

     
发表于 2026-7-22 21:08 来自手机 | 显示全部楼层
有种游戏区等直面会的美

评分

参与人数 1战斗力 +1 收起 理由
Casper-上弦月 + 1 一模一样

查看全部评分

回复

使用道具 举报

     
发表于 2026-7-22 21:11 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-7-22 21:13 编辑
舞以 发表于 2026-7-22 20:46
模型后训练充分之后,有经验有“直觉”,不用花大量token做无意义的思考试错和回滚,能够快速进入正确的工 ...

完全不一样,V3版本哪怕后训练充分思维链也是长得离谱。国内思维链都是从R1发展过来的,所以都这个样子从来没哪家练少过的,通过思维链穷举来提升性能,完成任务的时间都偏长。除了这个神秘模型,第一次做到token效率大幅提升,任务时长能和GPT接近。
回复

使用道具 举报

发表于 2026-7-22 21:54 | 显示全部楼层
我猜的话 7月27日-7月29日 的时候发, 27号的时候K3开放模型权重,






回复

使用道具 举报

     
发表于 2026-7-22 22:12 | 显示全部楼层
贴吧魔怔人已经开始算卦了
回复

使用道具 举报

发表于 2026-7-22 22:32 | 显示全部楼层





opencode构建者想当赛博大法官和犯罪者了




本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-7-23 08:07 | 显示全部楼层
有一家投资机构发出了 5 月中旬 DeepSeek 的 4 小时线上融资会议上,梁文锋分享里 52 句话。
感觉应该是真的吧,这说话格局真是梁圣了

1. 现在做产品不是收益最大化的时候。通往 AGI 的路上,要经过产品这个台阶,但我们不需要太多的心思和精力去做 C 端、B 端的产品。

当站在一个技术的高位上来做相对低一级别的技术,是降维打击。产品是在 AGI 路上的副产物。

2. 很多东西不在我们的主线上,比如 3D、视频生成;又比如世界模型,跟智能的上限也没有太大的关系。

3. 多模态对产品来讲很重要,对 C 端用户很重要。但它只是一个组件,不是主线和智能本身。

4. 大模型的幻觉当然有方法可以解决,但这是一个长命题。在内部,幻觉被我们归结为一个产品问题,会去解决,但不是重点。

5. 现阶段最重要的还是 Coding Agent。以国内的情况来看,最合理的做法应该是全力做通用的 Agent,金融、医疗等其他 Agent 的优先级较低。

6. 如果 AI 时代会产生很多家万亿级别的公司,DeepSeek 是其中一家(的话)就很好了。

7. AI 现在不缺品味和直觉,缺的是持续学习的能力。

8. 人类能够持续学习,但同一件事,就得给 AI 所有的上下文。这几乎是不可能的,所以 AI 并不能够替代员工。所以,下一代模型必须要有持续学习的能力,才能叫下一代模型。

9. 我们希望下一代模型能够帮助我们自己的开发。说得简单一点,我们做的模型,第一目标不是大家用得好用,而是我们自己用得好用。这是实现 AGI 最快的方法。

10. 目前全世界现在都还没有找到好的方法,因为「学习」是由很多东西组成的。

11. DeepSeek 的长期 Vision 是 AGI 。如果把实现的路线比作爬楼梯,去年的阶梯是 CoT(Chain-of-Thought,思维链),今年的阶梯就是 Agent。在 Agent 之后要解决的问题就是持续学习。

12. 实现持续学习之后,可能会来到一个渐进的奇点:模型可以完成人类能做的所有事情,包括自己开发更前沿的人工智能模型。即 AI 可以加速 AI 的研究。这一步走完才是具身智能。

13. 智能的终点可能都是具身。因为对一个正常人来讲,他的需求并不是电脑,而是人力。

14. 我们只赚一个合理的利润,不是利润最大化的定价。

15. 我们的一款模型一开始担心需求太多,价格定得比较高,后来降到四分之一,公司群里很多人欢呼。因为这是我们这么用心把这个模型做好的目的:能够让大家都充分地用。

16. 低成本是一个结果,我们的模型一直在架构上往更低成本走。我们也希望成本是负担得起的,特别是在算力紧缺的背景下。

还有一个原因:成本越低,越能承担更大的模型。算力有限时,计算效率高就能训更大的模型。大公司可以靠加资源解决,我们优先考虑成本效率。

17. 外面可能看起来,我们选了一个很难的模式。但其实我们做得非常轻松。降价对我们的竞争对手来讲,肯定不是个好事,他们一定不是欢呼的。

我并不觉得卖 API 这个事情有那么大吸引力。我只要搞几个人维护这个 API 就可以了,甚至客服都没有,也不用销售,用户自己就会来。

18. 我们一直在商业化,只是不以商业化为目标。DeepSeek 离彻底转向商业化的时间点,应该是很遥远的。

19. 我甚至不用考虑到时候在里面占一个位置。只要有那么大的商业机会,一定是有办法的。

DeepSeek 是一个时代的产物,是现实情况的反应,并不是模仿的结果。开源是我们这个规模公司的 sweet point.

20. 克制是一种战略:舍弃一些,换更多其他的东西。开源就是让利:对内,员工有成就感,公司有凝聚力;对社会也有好处,同行或者普通人都会高兴。

我毫不怀疑 AGI 会有非常大的商业价值。在这个基础上,我优先考虑的不是多拿份额,而是增加做成的概率。

21. 要把 AI 在商业上做成,开源是有好处的。这听起来有点违反直觉。历史上一个软件公司,市场一年可能就几十亿美金,开源了就没有了。

但是 AI 这个事情足够大,最终它可能得占掉人类社会 GDP 的百分之十。如果说我们想独占这个利益,那么一定是要被历史抛弃的。这是一个客观的规律,这是一个历史观。

22. 我们给的开源模型,跟我们自己部署的模型是一样的。我们不会开源一个差点的模型、自己部署时用更好的模型。

23. 我不担心别人部署我们的模型来跟我们竞争。不是每一家公司都有这个意愿和能力去达到这个目标。

创业公司如果太小,没有力量来做这个事情;大公司又很难组织。这是属于我们这个规模的公司的一个 sweet point.

24. 开源对我们的商业模式没有任何影响,前提是「只赚一定的利润」。如果你要赚一百倍利润,开源确实会影响你。

25. 我们不愿意跟任何一家互联网大厂或者小厂成为对手。在这个前提下,我们很愿意协助、帮助任何人,甚至包括阿里、智谱、月之暗面做得更好。

26. 未来我们要改写中美 AI 的叙事:用几分之一的算力,把差距缩得更短,缩到 6 个月、3 个月。

27. 中美 AI 的差距主要在资源上。我们相信 Scaling,肯定是规模越大,效果越好。训练这么大的模型,并不是因为我觉得这么大的模型就够了,而是只有这么多资源。

28. 人才几乎没有差距——就是同一批人。国内人才是不缺的。人才短缺是阶段性的,历史上从来没有长期缺某一类人的情况。

29. Anthropic 现在超过 OpenAI,不是长期的,是阶段性的。OpenAI 和 Google 未来大概率会交替上升。

30. 国内做模型的公司太多了,每一家都做同样的事情,资源比较分散。最终一定会收敛,但需要过程。

如果每家只拿合理的利润,不需要那么多人做大模型:可能两家大公司、两家小公司就够了。

31. 我绝对不认为大模型公司可以拿走(AI 行业的)大部分利润。

32. 大模型竞争最终的差距会体现在三个方面:成本、时间、用户体验。成本排在第一位——同样质量的服务,你能以什么成本提供。第二是时间,早几个月晚几个月就不一样。用户体验会有些粘性和壁垒,但不本质。

33. 我们不想做成下一个超级 App。做成下一个字节?下一个腾讯?完全没有这样的想法。

34. 不争这个东西,是因为后面还有西瓜,前面的可能都是芝麻。当然可能这个芝麻比较大,但我觉得都不算大。

35. 去年大家都抢 Chatbot 、抢 C 端流量,今年是抢 To B 收入。但我们不认为它重要,公司内部真正关心的是 AGI 的路线图、下一步技术怎么突破。

很奇怪,最想得到的东西得不到,没那么在意的反而容易得到。

36. 去年春节火了,不在我们的剧本里。

37. 只有一个是没法退让的:必须要保持团队的稳定性。这也是我们面临的一个非常大的风险。当然这个风险随着这一次融资,得到了比较大的解除。

38. 我们做很多事情都是为了保持团队稳定性。我们不愿意跟任何互联网大厂或小厂成为对手,我们希望给他们赋能,帮助他们。我们不想树敌。这样我们自己的环境也会更好。

39. 有些人觉得我们的组织是从上而下的,有些人觉得是从下而上的,我觉得两个都对。

从上到下叫「做正事」,一般希望「正事」不要占用员工所有时间的一半。他还有一半的时间是从下到上的,是不被安排的,想研究什么就研究什么,可以自己去探索,按照他觉得什么重要,就去探索什么,没有前置要求。

40. 我们一般也不太加班。第一个原因是做研究需要一个比较松弛的环境。第二个原因是我们非常聚焦。

产品很多都不完善,但我们也没有去补它,也算是一种克制的文化。

41. 组织是动态的,不是一成不变的。未来随着公司变大,可能会有一些调整。但不会完全变成传统的层级制,但可能会有一些必要的结构。但愿景驱动不会变。

42. 我们做这个公司,初衷没想要赚多少钱,要到资本市场去上市。最开始的几十个人完全没有这么想过。如果他这么想,他就不会来。

我们是怀着一个对这个世界非常大的善意来做这个事情,觉得这对人类有用。

43. 「要实现 XX KPI」不是我们的方式,我们是一个靠愿景驱动的组织。这有好处,也有坏处。未来会想办法扬长避短,但这个是我们的特色。

44. 愿景甚至也不是成文的,而是在做事情的方法中、对待世界的态度里。可能我们公司每个人对这个愿景的理解也不一样,但是在大的方向上是一致的。

45. 大概二十年前,我在管理上最崇拜的是杰克·韦尔奇( GE 的前 CEO)。现在来看,他说的大部分东西可能都已经不对了,但是他有一点说对了:一个公司最重要的是愿景。

愿景不是挂在墙上的标语,不是怎么说,而是怎么做。

46. AGI 是收益最大的。那其他事情,如果有精力,我们会做,没精力,我们就不做。克制是我们愿景里的一部分。

47. AI 这个事情太大了,利益也太大了。只要能够做成,随便分一点利益就非常大。而你越克制,就越有可能能够做成这件事。

48. 我觉得这是符合直觉的——至少是符合我的直觉。除了愿景,我们并没有非常多的其他优势。

49. 两年前成立这个公司的时候,没有很多钱,没有很多卡,没有什么知名度,又没有什么号召力,我们就是一群非常平凡的人。

我喜欢的叙事是「一群平凡的人做出了不平凡的事」,而不是「一群天才做出了不平凡的事」。

50. 开源也属于克制的一部分。在定价上,我们也肯定不是以公司收入最高或者利润最高作为出发点的。

从短期来讲,价格高一点,收入多一点;但从长期来讲,还真不好说。对我来讲,克制是一种战略。

51. 开源和低价,让员工觉得很有成就感,组织因此有凝聚力,对社会有好处,其他同行和普通人都会很高兴。

所以这种克制,从远景上来讲,能够增加我们做成 AGI 的概率。

52. 如果你的愿景是拿得多,你就先输了,你可能会面临着更大的困难。这个世界就是这样。
回复

使用道具 举报

     
发表于 2026-7-23 08:18 | 显示全部楼层
怎么opencode也魔怔了,非得逼着人去折腾PI吗
回复

使用道具 举报

发表于 2026-7-23 08:26 | 显示全部楼层
高粱河车神 发表于 2026-7-23 08:07
有一家投资机构发出了 5 月中旬 DeepSeek 的 4 小时线上融资会议上,梁文锋分享里 52 句话。
感觉应该是真 ...

有些好像之前就说过了,应该部分是真部分是假不好判断
回复

使用道具 举报

     
发表于 2026-7-23 08:55 来自手机 | 显示全部楼层
梁宫春日
回复

使用道具 举报

     
发表于 2026-7-23 08:58 | 显示全部楼层
一半时间干其他事这已经赶超早期谷歌了
回复

使用道具 举报

发表于 2026-7-23 08:59 来自手机 | 显示全部楼层
我喜欢的叙事是「一群平凡的人做出了不平凡的事」,而不是「一群天才做出了不平凡的事」。

你梁叔叔逗逗你,ds招人可不是这个标准

讲这话就有点虚伪了
回复

使用道具 举报

     
发表于 2026-7-23 09:03 来自手机 | 显示全部楼层
lowezack 发表于 2026-7-23 08:59
我喜欢的叙事是「一群平凡的人做出了不平凡的事」,而不是「一群天才做出了不平凡的事」。

你梁叔叔逗逗你 ...

他说这话的意思(前提是确实是他说的),大概是DS的开发不会受到少数人员变动的影响。

能被DS招募的人当然可以算普通人中的天才,但是像阿里那样一个人离职导致整个项目波动的情况大概率不会有,除非梁子自己甩手不干了。
回复

使用道具 举报

发表于 2026-7-23 09:09 | 显示全部楼层
lowezack 发表于 2026-7-23 08:59
我喜欢的叙事是「一群平凡的人做出了不平凡的事」,而不是「一群天才做出了不平凡的事」。

你梁叔叔逗逗你 ...

他确实没招什么在AI领域功成名就的人,最开始甚至没啥海龟,都是本土phd之类的。当然你可以说phd还不是平凡人。。
一个起点本来就高的领域平凡人在外面看来都不是很平凡    Re:Source
回复

使用道具 举报

发表于 2026-7-23 09:11 | 显示全部楼层
lowezack 发表于 2026-7-23 08:59
我喜欢的叙事是「一群平凡的人做出了不平凡的事」,而不是「一群天才做出了不平凡的事」。

你梁叔叔逗逗你 ...

他那些人在AI领域确实不算天才,他一开始甚至还招自动化专业的。。。。
回复

使用道具 举报

     
发表于 2026-7-23 09:29 | 显示全部楼层
这LLM跑到现在很明显有工程化倾向,DS最大的优势其实在Infra这一块,也能让他们往基础设施方向走
回复

使用道具 举报

     
发表于 2026-7-23 09:37 | 显示全部楼层
昨天谷歌的财报有点不妙,主营业务萎缩,现金流为负了
回复

使用道具 举报

     
发表于 2026-7-23 09:38 来自手机 | 显示全部楼层
高粱河车神 发表于 2026-7-23 08:07
有一家投资机构发出了 5 月中旬 DeepSeek 的 4 小时线上融资会议上,梁文锋分享里 52 句话。
感觉应该是真 ...

梁叔叔不会真是天网派回来的吧(
回复

使用道具 举报

     
发表于 2026-7-23 09:40 | 显示全部楼层
nxmonitor 发表于 2026-7-23 09:37
昨天谷歌的财报有点不妙,主营业务萎缩,现金流为负了

没啥大事,ai烧钱烧多了而已
回复

使用道具 举报

     
发表于 2026-7-23 09:49 来自手机 | 显示全部楼层
牢梁做的事确实能和这段话对得上,就算不是他说的也不重要

—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

发表于 2026-7-23 10:04 来自手机 | 显示全部楼层
高粱河车神 发表于 2026-7-23 08:07
有一家投资机构发出了 5 月中旬 DeepSeek 的 4 小时线上融资会议上,梁文锋分享里 52 句话。
感觉应该是真 ...
我只要搞几个人维护这个 API 就可以了,甚至客服都没有,也不用销售,用户自己就会来

梁鸽:市场的大手自己在调节.jpg

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-7-23 10:10 | 显示全部楼层
我到觉得很简单,他也做量化,热钱对他们来说是玩物。
相对的,自己创的业就不希望成为热钱的玩物。
回复

使用道具 举报

     
发表于 2026-7-23 10:41 | 显示全部楼层
ds感觉对梁叔叔确实是兴趣和愿景的载体
为了agi,什么都可以让步,甚至ds这家公司的形象和技术声誉都是副产物。
梁叔叔这人其实挺可怕的,一个定下目标就不动摇,把其他因素都用工具理性衡量的冷酷的人。

论坛助手,iPhone
回复

使用道具 举报

发表于 2026-7-23 10:43 来自手机 | 显示全部楼层
梁圣格局太大
把冯骥都炸出来了
英雄惜英雄

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-7-23 10:49 | 显示全部楼层
但是话又说回来了,梁工春日,七月中旬何时结束啊
回复

使用道具 举报

     
发表于 2026-7-23 10:50 | 显示全部楼层
舞以 发表于 2026-7-23 10:41
ds感觉对梁叔叔确实是兴趣和愿景的载体
为了agi,什么都可以让步,甚至ds这家公司的形象和技术声誉都是副产 ...

世界上财富自由后追寻自身兴趣的富豪多得是,但大多还是俗不可耐,像牢马这种就是典型欲望过多,梁叔叔某种意义上真算得脱离低级趣味了

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-7-23 10:53 | 显示全部楼层
话说qoder里面的神秘模型cantus是什么    Re:Source
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-7-28 04:51 , Processed in 0.159330 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表