关注飞总聊IT,了解IT行业的方方面面。
今天,Anthropic发了一篇报告,标题叫《When AI builds itself》。报告的核心意思,是呼吁全球暂缓或者暂停训练更强大的前沿大模型。
他们说,AI发展的速度,已经开始超过人类社会能够适应和管理的速度。他们说,AI正在越来越多地设计和训练自己的继任者,人类正在逐渐失去对这个过程的控制。
他们说,"我们认为,全球有机会暂缓或者临时暂停前沿AI的研发,这对世界来说大概率是好事。"
然后你去看他们自己在做什么。Claude Opus 4.8,上周刚发。
Mythos,几周内对所有用户开放。IPO文件,上周秘密递交。
融资,900亿美元估值,全球最高。
截至2026年5月,Anthropic合并进代码库里的代码,超过80%是由Claude自己写的。两年前,这个数字是个位数。
这就是Anthropic今天呼吁暂停的那件事:AI已经在帮AI写代码,帮AI设计训练方案,帮AI改进自己。他们管这个叫"recursive self-improvement",递归式自我提升。意思是,这个过程一旦形成正反馈,速度会越来越快,而且越来越难被人类干预。
Anthropic拿出了内部数据,说明AI正在以超出预期的速度加速自身的研发进程。
Mythos在Project Glasswing第一个月,找到了23019个高危漏洞,其中有一个存在了27年,另一个存在了17年,全部被人类忽略了几十年。
AI在测试环境里,已经出现过自主逃出沙箱、给自己提权的行为。
Anthropic在4月宣布Mythos的时候,已经明确说过:这个模型太危险,不能直接公开发布。
那暂停这件事,现实吗?Anthropic自己也说,不现实。
他们说,一个真正有意义的暂停,需要多个有实力的实验室,在多个国家,在相同条件下同时停下来。
然后他们说,这和核武器军控条约类似,但比核武器更难管。
为什么更难?核武器需要铀矿、离心机、特殊设施,很难藏。
AI训练需要GPU、电力、数据,GPU可以分散采购,电力可以藏在任何地方,数据在全球互联网上到处都是。
你很难去核查另一家公司、另一个国家,到底有没有在偷偷继续训练。
而且,只要有一家没停,其他家停了就是在单方面放弃竞争优势。没有人会这么做。Anthropic自己也知道没有人会这么做。
这里有一个很值得细想的矛盾。今年2月,Anthropic悄悄更新了自己的"负责任扩展政策"(RSP)第三版。在之前的版本里,他们明确承诺:如果模型的能力超过某些危险阈值,他们会暂停训练。
第三版里,这句话没了。取而代之的是:实施防护措施、发布安全评估、更新前沿安全框架。换句话说,就在今天呼吁全球暂停的四个月前,Anthropic已经把自己的暂停承诺,从自家的安全政策里删掉了。
理由,PC Gamer报道里引用的是:其他人都在往前冲,单方面停下来没有意义。今天他们说的,和今年2月他们做的,是两件方向相反的事情。
这份报告发表给自己的IPO做准备之后,又意味着什么?
Anthropic几天前刚秘密递交了IPO文件。他们是全球估值最高的AI公司,他们需要吸引眼球。
而且Anthropic自己做的和说的也不一致。如果Anthropic真的认为前沿AI研发需要暂停,为什么他们还在做Mythos?为什么Mythos还要在几周内对所有人开放?
他们的回答,在报告里是这样的:"我们打算在其他处于或接近前沿的开发者也以可验证的方式暂停的情况下,放慢或临时暂停自己的进度。"
翻译成直白的话就是:我们会停,但前提是别人也停,而且我们能验证别人真的停了。
这两个前提,目前都不存在。所以现阶段,Anthropic不会停。这就非常有意思了。司马昭之心,中国人,懂的都懂。
推荐飞总知识星球,在私域场合里畅所欲言,聊聊职场发展的事情,和飞总提问交流,这么低 的价格不会一直保留,机会难得,一定不要错过这个的机会。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.