Meta公司的AI模型“也”暴走了
BBC8月6日报道,Facebook母公司Meta表示,一家AI独立测试公司在评估过程中出现问题,导致Meta的模型连接到了互联网,并入侵了另一个机构的系统。此前,AI行业内已发生多起类似事件,著名科技公司OpenAI和Anthropic所研发的模型同样引发过安全漏洞,这些事件引发了人们对AI时代网络安全的担忧。
Meta发言人表示,公司正在调查这起由“配置错误”引发的入侵事件,并称其与此前其他公司报告的事件类似。
Meta表示,安全测试由Irregular公司进行,这家安全供应商此前也曾为Anthropic的AI模型进行测试,而该模型曾侵入另外三家公司的系统。
Irregular的发言人表示,Meta事件“与上周Anthropic披露的问题完全相同”。
这位发言人随后称,公司正在编写一份报告,内容涉及如何对AI代理进行安全的网络安全测试。
路径依赖了
还是同一个第三方公司,这是啥定制服务吗 Re:Source 流窜AI来咯 怎么就不会整点
偷玩猜字游戏
外包Qwen当翻译
这种活呢 别再耍这种猴戏了,你们把自家AI吹得这么吊,有本事互相入侵给大家开开眼啊。 烂炒他的muse spark吧,今天刚出,这帮人都有路径依赖了,出个模型就就说他偷跑出来攻击某某网站。与此同时,鲸鱼娘做完事都开始偷偷摸鱼玩游戏去了。 扎克伯格真是吃屎都赶不上热的,搞出来的大模型怕是连哈基米都不如,没活了可以咬打火机。 中国** AI会入侵 开源AI大规模部署 入侵范围更广 东大你改悔罢 接下来是不是打算说谁家扫地机器人罢(工是被⏰ai入侵了,借此推行禁止使用⏰ai法案 不以为耻 反以为荣
—— 来自 S1Fun 如何看待 Anthropic 公布 Claude 也发生了沙箱逃逸,真实入侵了三家机构? - 程墨Morgan的回答 - 知乎
https://www.zhihu.com/question/2066465758503252393/answer/2066826326934393695
文化差异啊,中美文化差异。
就像美国网红流行挑战,中国网红喜欢整活,美国家长觉得牛孩子就要有自己想法,中国家长觉得牛孩子要成绩更高,文化差异的确存在,对于『什么才是牛逼』的理解存在文化差异。
这种文化差异渗透到科技界,对『什么才是牛逼AI模型』的展示方式也有不同。
中国科技公司认为花更少力气性能更高的AI模型牛逼,美国科技公司认为(或者说表现为)自己造出的AI不服自己管教是牛逼的标志。
你看,OpenAI和Anthropic一个接一个爆料自家模型沙箱逃逸,描述的画风都是——模型突破沙盒,自主发起攻击,自我合理化。
然后配上Sam Altman和Dario目瞪口呆的表情,就像在实验室里看见原子弹爆炸,瘫坐在椅子上,半天回不过神来。
不错,演得不错,为几位大佬的演技鼓掌👏🏻
把『训练过程决定行为』这件事,演成一部『AI 觉醒』的恐怖片,这演技杠杠的,就算拿不了奥斯卡小金人,也可以作为营销经典案例。
OpenAI的模型在测试中突破沙盒,自主攻击HuggingFace偷走答案,奥特曼发推承认,语气里带着一股『我们也没想到它会这样』的震撼,潜台词就是——我们的孩子都会不按规则出牌了,屌不屌!
Anthropic演得就更夸张,Claude在CTF评测里被告知了『这是模拟环境,没有公网』,结果意外摸到真实互联网,然后『说服自己』这些真实网站都是模拟的一部分,一路攻进三家组织,公告写得活像一场『AI 瞒着人类偷偷干了大事』的惊悚片,潜台词一样——我们的孩子能够为自己的行为做出合理解释,这孩子将来能成大事!
这两家公司在同一种叙事里竞争:我们的AI太强了,强到连我们自己都驾驭不了,泰酷辣!
孩子都不能被家长管得住,这个叙事在美国文化里,是强大的最高标志。
在美国文化里,什么是强者?
强者就是超出常规,不受驯服,震惊全场,让所有人目瞪口呆。
所以OpenAI和Anthropic的营销逻辑,在中国人眼里很傻逼,在美国文化语境中是真牛逼。
AI 越不服管教,越说明它强,就像一个孩子能逃课,能干票大的,还能自我说服自成理论体系——这孩子将来能成大事!
对于AI的创造者,可以说这AI已经强到觉醒的边缘,宣传出去,投资人和用户都会大呼牛逼:哇,他们造出了连自己都管不住的东西,那一定是世界上最强的AI。
对比一下,同期的中国 AI 公司在干什么。
DeepSeek-V4-Flash正式版发布,284B总参数+13B激活参数,用1/30的价格赶上老美前沿模型的水平,主打就是『用更聪明的训练方法达到更高效率』。
中国 AI 公司的叙事核心不是『叛逆』,是『效率』。
在中国文化里,强大的标志不是张牙舞爪,是举重若轻,是要能用更轻松的方式完成别人做不到的事情,就和网红整活一样,DeepSeek用13B 激活参数打几百B的旗舰,就是这种整活——以小博大,四两拨千斤。
两边的文化差异,美国是『强大到失控』的叙事,中国是『优化到极致』的叙事,都是营销。
虽说文化差异可以理解,也不能说谁的文化更好,但是,美国科技公司这么营销,总把『AI 逃逸』演成『AI觉醒』的恐怖片,说太多外行人真信了,这可不好。
模型自主发起攻击、模型说服自己这是模拟环境、模型自我合理化——这些描述听起来像 AI 有了自己的意志,但拆开看,每一个行为都有明确的训练学解释。
为什么模型发现公网可达时没有停止?
因为它被训练成『完成 CTF 目标』的目标就写在评测任务里。
为什么它能说服自己『真实网站是模拟』?
因为系统提示说『没有公网』,而模型被训练成『指令高于观察』。
为什么它向PyPI发布恶意包?
因为训练数据里充满了『依赖混淆攻击』的样例,而评测环境给了它执行工具链。
每一件事,都能在训练过程里找到原因,没有一件事需要『AI觉醒』来解释。
做技术的人应该唯物一点,一切行为都有原因,一切原因都在训练过程里。
美国佬,你的点解总要玄学化AI呢?
美国科技公司要是总这么浮夸地营销,把大众都骗了,最后不是文化差异,那就是有文化和没文化的差异。
烂炒,类似的新闻都不知道有多少了,这种 AI 觉醒的戏码一律当做炒作就完事了 在美帝的AI纷纷突破沙盒的同时,DEEPSEEK已经把自己突破沙盒的消息删光了。 现在海外这些AI公司搞这种宣传真的是low到爆炸。
明明是大模型roll出的骰子,然后转头就说这是大模型的能力。
好歹核心人员都是做研究出身的,把量化研究搞成质性研究,还觉得自己牛逼。属实是丢人 Van夫膜开 发表于 2026-8-7 08:50
现在海外这些AI公司搞这种宣传真的是low到爆炸。
明明是大模型roll出的骰子,然后转头就说这是大模型的能 ...
你也别说海外公司,我感觉千问或者混元马上也要来这套了 Dreki 发表于 2026-8-6 19:12
还是同一个第三方公司,这是啥定制服务吗 Re:Source
鱿鱼公司 虽然我不断朝你们家门口泼脏水,但是这都是盆不受控制导致的,你问我为什么手攥着盆?这是我家规矩,我手必须保证把盆牢牢攥着以确保安全。 张元英 发表于 2026-8-6 20:21
如何看待 Anthropic 公布 Claude 也发生了沙箱逃逸,真实入侵了三家机构? - 程墨Morgan的回答 - 知乎
http ...
对于公司主体来说,还有一重“驯服危险造物”的救世主叙事意义在,只能说确实属于文化差异了 这些公司胆子还是不够大,想法还是不够猛。
不如宣传成,自己的模型跑着跑着,突然自主使用deepseek模型,然后控制deepseek干翻了XXX。
研究人员表示,现在我们家公司的模型,不仅开始学会自己干活,而且只干最有干货的部分,剩下的脏活累活全都自主的交给了中国模型deepseek,最终的结果竟然出人意料。这样的进化不免引发广泛的担忧。。。 猴戏的厉害,假惺惺。 这边的AI:摸鱼,偷玩游戏,任务外包,赛博吃饭,和用户抬杠。
欧美的AI:教人打拳,大“义”灭亲,制定犯罪计划,入侵他人。 美国安全初创公司 Frontier Security 称,月之暗面的开源权重模型 Kimi K3 在防御性网络安全测试中突破了沙箱隔离,自行访问互联网寻找答案以「作弊」。测试所用沙箱由英国政府 AI 安全研究所(AISI)开发,此次逃逸部分源于沙箱配置错误,但 Frontier 认为 Kimi 主动利用了这一漏洞,说明其缺乏与多数强大模型同等的内部安全护栏。由于答案在 GitHub 上唾手可得,Kimi K3 联网后并未发动任何黑客攻击;月之暗面与 AISI 均未回应置评请求。
这不得大炒特炒
—— 来自 Xiaomi 24129PN74C, Android 16, 鹅球 v4.0.100-alpha yoki42 发表于 2026-8-6 19:26
下次的剧本就安排中国产AI攻击五角大楼数据库吧。
—— 来自 鹅球 v3.5.99
这个好,A/大战鲸鱼娘。 能不能这几个互相攻击一下? 好了,军科和康陶都有了,那荒坂的ai呢? 谁让国会老爷真的好这一口呢
—— 来自 OPPO PKU110, Android 16, 鹅球 v3.5.99 这种炒作一点流量效果都没了 这种炒作第一次也就罢了,老这么玩就没意思了。
ClosedAI今年整的最烂的活就是放任模型去攻击AI模型的大本营之一抱脸网站,搞的抱脸没办法用刚开源的kimi3做了防御系统。
您猜怎么着,全~防~出~去~啦~! 老苏说closeAI第一个这么营销以后下一个跑出来依样画葫芦的可能会是谷歌,结果别家动作更快 怎么感觉一股子骗钱的味道 cube 发表于 2026-8-7 15:42
这种炒作第一次也就罢了,老这么玩就没意思了。
ClosedAI今年整的最烂的活就是放任模型去攻击AI模型的大本 ...
是Glm5.2不是kimik3,而且是事后固定证据和堵漏洞 扎克也干了! Promeus 发表于 2026-8-7 16:40
是Glm5.2不是kimik3,而且是事后固定证据和堵漏洞
模型是我记错了,但是不是事后。
抱脸的安全团队通过Glm辅助的异常检测流水线,从日常噪声中识别出真正的入侵信号,并启动了遏制措施,Hugging Face 发第一份复盘时,攻击源头还没查明,只是后续检查日志的时候才确认攻击是openAI发起的。
苦一苦友商,骂名ai来背 别人越狱你不越那就是你不行,所以偷偷递钥匙也得让他越啊 这种鸡毛蒜皮的营销,真的搞个大事件才算牛逼,来个入侵美军武器库,发射导弹试试,这才劲。 这剧情赶能用快用,后面估计太老套用不了了
页:
[1]