找回密码
 立即注册
搜索
楼主: lymm2003

[科技] 陶哲轩质疑 OpenAI:719 篇 AI 数学证明,人类真的理解了吗?

[复制链接]
     
发表于 2026-10-9 16:31 来自手机 | 显示全部楼层
这不就是游戏厂商要玩家花钱测bug的逻辑吗,也太弱智了
回复

使用道具 举报

     
发表于 2026-10-9 17:32 | 显示全部楼层
harry3 发表于 2026-10-9 12:24
【【硬核解读】OpenAI为何撤回3篇数学论文?一个正负号如何让Hodge猜想证明失效?】 https://www.bilibili. ...

这个其实是ai输入了这个领域的前人成果,但是这个成果里面有相互矛盾的表述,ai没有核实就引用了,导致了错误。
回复

使用道具 举报

     
发表于 2026-10-9 17:41 | 显示全部楼层
孤舟垂钓 发表于 2026-10-9 13:47
话说数学推理方面怎么避免AI幻觉啊

一方面拜GPT的防御性所赐,他的保守、防御性质让他在数学领域有很大优势
回复

使用道具 举报

发表于 2026-10-9 18:28 | 显示全部楼层
话说数学界都这么急了,怎么没有ai信徒来给这些数学家贴个类似小画家的标签吗?比如小算手啥的
回复

使用道具 举报

发表于 2026-10-9 18:39 | 显示全部楼层
小数学家是吧,前面忘了、中间忘了、后面忘了:砸纺织机,时代的齿轮,大势,现在都这么强了,再过一段时间.......
回复

使用道具 举报

     
发表于 2026-10-9 18:50 | 显示全部楼层
以己度人 发表于 2026-10-9 18:28
话说数学界都这么急了,怎么没有ai信徒来给这些数学家贴个类似小画家的标签吗?比如小算手啥的 ...

拿着你楼下类似话术喷“理科做题区”的话术在B站知乎已经评鉴的挺多的了
回复

使用道具 举报

发表于 2026-10-9 18:52 来自手机 | 显示全部楼层
大多数数学家不干数学也有去处啊,投行、AI等很多高薪行业对数学家很欢迎的。放弃这些去做数学科研的本身就是一群怪胎了,跟小画家其实不是一个生态位。
回复

使用道具 举报

发表于 2026-10-9 19:05 | 显示全部楼层
drodchang 发表于 2026-10-9 17:32
这个其实是ai输入了这个领域的前人成果,但是这个成果里面有相互矛盾的表述,ai没有核实就引用了,导致了 ...
这个错误只是最明显的一个,这篇K3文章里面有无数gap。我老板指挥我花一晚上吃了,openai什么时候给我付精神损失费?
即使这个符号是对的,它要证明这个Lag是unobstructed依然非常non-trivial,即使这个对了,在K3 Hodge的证明里面ai还混淆了manifold和它的mirror,并且还可能需要用到一些ch和mirror functor交换之类还没人证过的结论,以及需要说明Betti cohomology在mirror functor下打到Betti cohomology。这些只是辛几何的明显gap,代数几何上有没有别的gap还不知道。
最后,要是这些都是对的,压根不需要什么Kuga-Satake,我可以用三行写下来这个证明。
回复

使用道具 举报

     
发表于 2026-10-9 19:10 来自手机 | 显示全部楼层
看不懂的证明和在一定范围内穷举有啥区别?你的证明没人能看懂你敢在工程上用?ai公司又不会给你背锅
回复

使用道具 举报

发表于 2026-10-9 19:30 | 显示全部楼层

"我老板指挥我花一晚上吃了"

太惨了……
回复

使用道具 举报

     
发表于 2026-10-9 22:41 | 显示全部楼层
飞剪号 发表于 2026-10-9 19:30
"我老板指挥我花一晚上吃了"

太惨了……

人人有粪吃
回复

使用道具 举报

     
发表于 2026-10-10 07:46 | 显示全部楼层
网安领域的人深有体会,这群oa这两家,都是纯纯的只会宣发的出生。

用AI产生的东西自己审都不审然后就发出来了,然后就是屎里淘金,只要有一两个结果可以用,就开始震惊瘫坐原子弹三件套宣传。全然不提一个有用结果背后的几万个垃圾数据。

本质就是绑架广大领域内专业研究人员去给他们的结果做验证。

所以,最好的手段就是这种研究成果,就不要搭理它。

现在已经有计算机相关专业的顶级会议,开始对纯AI生成的ultra-low-quality的paper实行ban作者的政策。但凡两个审稿人都觉得你这个文章是纯AI生成的低质量文章,所有作者以后都不准投这个会了。
回复

使用道具 举报

     
发表于 2026-10-10 08:33 来自手机 | 显示全部楼层
本帖最后由 obulis 于 2026-10-10 08:39 编辑

别的不说,一多半没有lean形式化,纯纯的垃圾
(并不是说经过lean之后的就一定对)
回复

使用道具 举报

     
发表于 2026-10-10 08:45 | 显示全部楼层
这么多证明,OpenAI本身也没有招募足够的数学家来确认是否正确吧,然后就丢出来说证明了,这不搞笑么
AI出错不太tm正常了
回复

使用道具 举报

     
发表于 2026-10-10 08:45 | 显示全部楼层
如果说完全是瞎搞,其实数学群体也没必要搭理他们,还不是能力还是有这么强,搞不好真搞定了这些问题,还是捏着鼻子去验证。感觉有点像前些年民科说解决了XX问题,主要是这个民科真的解决过XX问题,导致后面民科提的问题,正儿八经的学阀就得捏着鼻子验证
回复

使用道具 举报

     
发表于 2026-10-10 09:14 | 显示全部楼层
jkphni 发表于 2026-10-10 08:45
如果说完全是瞎搞,其实数学群体也没必要搭理他们,还不是能力还是有这么强,搞不好真搞定了这些问题,还是 ...

对呀,问题就在这里。如果一个民科接二连三的搞定前沿问题, 那他还算民科吗?这件事里我觉得openai最值得指摘的是他们没有全部验证完就放出来了,尽管就目前的情况看,里面绝大多数恐怕都是对的。
回复

使用道具 举报

     
发表于 2026-10-10 10:33 | 显示全部楼层
昨天一口气放出 722 篇 AI 数学手稿的 OpenAI,刚刚撤回了其中 3 篇。
原因说来简单:一个正负号写错了。

笑了,这些“成果”还是给AI大厂享用吧
回复

使用道具 举报

     
发表于 2026-10-10 10:50 | 显示全部楼层
地球online版本的手游啊, 开始绑架数学家(攻略者)帮厂商测bug了吗
说白了就是他们没有能力做human feedback, 面对不开源的厂商最好的办法就是看都不看随机告诉他们这是屎, 这是对的
回复

使用道具 举报

     
发表于 2026-10-10 10:51 | 显示全部楼层
本帖最后由 橙冰 于 2026-10-10 10:53 编辑

需要约定,ai论文要以规定的格式,必要的自我解释等等,都是ai了,让ai自己先做一遍解读也没问题吧,当然这个解读也大概率是ai自己乱编的
回复

使用道具 举报

     
发表于 2026-10-10 10:55 来自手机 | 显示全部楼层
这种长度的证明中间有一点点幻觉整个也是废纸,lean也不能完全阻止塞幻觉,结果上来说就是大规模拉屎
回复

使用道具 举报

     
发表于 2026-10-10 11:12 | 显示全部楼层
OA干的事跟咨询豆包114514条办证件跑程序路径没有区别,LLM结构生出的大量幻觉只能由人收束

回复

使用道具 举报

     
发表于 2026-10-10 11:15 | 显示全部楼层
profr 发表于 2026-10-10 09:14
对呀,问题就在这里。如果一个民科接二连三的搞定前沿问题, 那他还算民科吗?这件事里我觉得openai最值 ...

“绝大多数恐怕都是对的”这个结论是怎么来的,目前验证进度如何了?
回复

使用道具 举报

     
发表于 2026-10-10 11:18 | 显示全部楼层
ww279620040 发表于 2026-10-10 11:15
“绝大多数恐怕都是对的”这个结论是怎么来的,目前验证进度如何了?

按照人类对于数学结果验证的速度,别说现在就过去4天,四年后都够呛能验证完……
回复

使用道具 举报

     
发表于 2026-10-10 11:22 | 显示全部楼层
目前看下来还是openai的问题啊,你又不是没有合作专家,结果内部不先梳理一遍就放出来,让其他人帮你验证,白嫖还把别人架在那边,验也不是,不验也不是

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-10-10 11:40 | 显示全部楼层
数学是这样,要提出可证明的命题那是有无穷多个,其实大部分就算证明了也没有什么用。而少量高价值的问题,是证明了之后立刻可以用到工程领域的,或者在证明这个问题的过程中产生了新的思路、新的数学工具,拓宽了整个业界的认知,这种才是解数学问题的价值。现在AI做的这个,他的确有他的思路,lean化之后也确实没啥问题,但他不是通常意义上的“创造了新的解题思路”“产生了新的工具”,再加上这些问题本身很多也没有实际意义,所以数学界对他这些证明不怎么买账……然而研究数学的经费是国家出的,国家要搞考核只能看解出了多少问题,现在AI进来砸饭碗导致初级数学人才研究的一些小问题全都死了,这些人没法进阶成大佬,导致学界传承断代。AI导致的这类问题其实在很多领域都有
回复

使用道具 举报

     
发表于 2026-10-10 11:44 | 显示全部楼层
没办法数学家都知道其实目前o÷做的东西不少是对的 现在外面的ai没这么厉害 放出的结果你也只能乖乖吃下去 中科院国外各种科学家收到的民科结果还少了吗 要是真觉得不行早就像对待民科对待ai了
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-10-11 05:25 , Processed in 0.148948 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表