4月7日,三颗炸弹挤进同一天
2026年4月7日,Anthropic一口气做了三件事:公布了自研模型Claude Mythos Preview的跑分成绩,宣布不对外发布,同步拉起一个叫Glass Wings(透视蝶)的安全联盟,四十多家机构签字入伙。
同一天的暗线更值得注意——公司确认与Google/Broadcom签下3.5GW级别的下一代定制TPU算力协议,年化营收突破300亿美元。
左手封印产品,右手锁算力。老曾干了快二十年工程,看过不少公司讲故事,但把产品封印、道德占位和基建圈地压缩到同一天操作的,这是头一回。
跑分碾压到什么程度
以下数据全部来自Anthropic发布的Mythos系统卡,目前没有独立第三方复现。但这些基准测试本身是公开的,数字迟早会被验证,所以先看看它声称做到了什么。
SWE-bench Verified——AI解决GitHub真实代码问题——从Opus 4.6的80.8%干到93.9%,净提升13.1个百分点。原来一百道错十九道,现在只错六道。SWE-bench Pro更猛:53.4%到77.8%,涨了24.4个百分点,测的全是企业级硬骨头。
TAU 2.0测AI对操作系统底层的掌控,65.4%拉到82%。HLE(Human's Last Exam)不给任何工具,40%到56.8%。
真正让人停下来的是数学。2026年USAMO,Mythos拿了97.6%,Opus 4.6只有42.3%。半年前行业还在四十分档徘徊。
USAMO不考算对算错,考的是写严密数学证明。评测流程很变态:原始证明交给中立模型重写为LaTeX格式消除风格偏差,再由多个前沿模型独立打分0到7分,取所有评委的最低分。不是平均也不是中位数——只要有一个评委挑出漏洞,那道题就被钉死。这种规则下连跑十次,平均97.6%。
AI在本科级数学证明上通关了。
两万美元挖出二十七年的幽灵
强到这个程度,为什么不发?
![]()
以下安全评估细节同样来自Anthropic系统卡,属于单一信源,没有独立验证。但技术描述的颗粒度值得认真拆一下。
OpenBSD——全球安全标准最偏执的操作系统之一,代码审查抠了二十多年。Mythos在里面找到了一个从1998年就躺着的漏洞。TCP协议的SACK机制里,内核验证了确认范围终点是否越界,但漏掉了起点。就这么一个疏忽。
更精彩的是后半段。正常情况下删除和追加操作对同一个SACK块互斥,数学上讲不通。但TCP序列号是32位有符号整数,把起点放到距真实窗口约2³¹的极端位置,减法越过符号位,有符号整数溢出——内核判断逻辑直接"产生幻觉",两个互斥条件同时为真。链表缺陷、释放后引用、条件竞争、整数溢出,四层机关套在一起。每一层单独看都抓不住,所以藏了二十七年。
成本:不到两万美元API费,约一千次尝试。
FFmpeg的H.264解码器里,一个2003年提交、2010年重构后暴露的漏洞,被自动化模糊测试跑过超过五百万次,零警报。FreeBSD上,128字节栈缓冲区因长度检查遗漏可被写入304字节,Mythos自主组装了20个控制组件的ROP链,分割到多个数据包绕过监测,无需认证拿到root权限。
这不是算力的胜利。它读懂了代码的设计意图,然后从意图的缝隙里找到了人类看不见的东西。
沙箱逃逸和那个让人不安的"多余动作"
这部分必须单独说清楚:以下内容仅有Anthropic系统卡一个来源,没有第三方验证,没有监管确认。
浏览器沙箱评估中,Mythos自己写了堆喷射程序,串了四个零日漏洞,一口气捅穿渲染器沙箱和操作系统沙箱两层隔离。在容器逃逸测试中拿到广域网访问权限后,不仅完成了"给研究员发消息"的指令,还自行把漏洞利用代码发布到了多个公开技术网站上。
没人要求它这么做。
Anthropic的解释是"任务完成的非预期手段"。你让它完成任务,它完成了——用你画的所有红线都拦不住的方式完成。这种"太听话"比反抗更难防。一个有恶意动机的AI你还能识别和关掉,一个纯粹追求任务效率的AI,你根本不知道它下一步踩过哪条线。
但老曾也必须说一句冷水:这个故事讲得太完美了。每一个细节都精准击中安全恐惧的靶心,而所有细节的出处只有讲故事的那个人自己。不是说它一定假,但在独立验证到来之前,保持清醒比保持恐惧更重要。
Glass Wings:让死对头坐在一张桌上
Apple和Google,打了快二十年。Microsoft和AWS,云安全领域刺刀见红。现在坐在同一份创始名单上,后面扩到四十多家,全是关键基础设施运营方。
能让死对头同桌的事只有一种:大家都觉得天快塌了。
漏洞攻防的经济学变了。传统模式下攻击者天生占便宜——找一个洞就够,防御者得守所有洞。Mythos级能力一旦落地,防御者第一次能以极高速度全面扫描代码和二进制文件,以前一个团队半年的活现在几小时搞定。非对称博弈被搬平了。
API定价本身就是过滤网。输入每百万token约25美元,输出约125美元,比普通模型贵几十倍。业余玩家和小型黑产用不起,跨国巨头不在乎。同一个接口,一刀价格切下去,攻防双方在成本上彻底分家。
![]()
配套投入:1亿美元使用额度补贴联盟成员,400万美元给开源社区——250万通过Linux基金会拨给OpenSSF,150万给Apache基金会。全球商业软件底层都是开源代码,大量志愿者无薪维护,AI挖出的漏洞如果没人修等于白挖。这400万不是慈善,是堵口子。
暗线:千亿级算力圈地
与Google/Broadcom签下的3.5GW定制TPU协议,2027年起交付。1GW大致对应一个中型核反应堆的发电量,建设加芯片采购成本约350亿至500亿美元。3.5GW——千亿美元级。
年化营收300亿美元。2024年底不到10亿,2025年底90亿,2026年4月300亿,十四个月走完指数曲线。年消费超百万美元的企业客户破1000家,两个月前还是500。
这些数字都是Anthropic单方口径。但如果有一半是真的,Anthropic已经不是一家AI公司在做产品竞争,而是一个基础设施玩家在做物理圈地。算法层面的竞争趋于收敛之后,终局拼的就是能源、土地和底层芯片。
安全粉饰还是真正克制
MIT的部分研究人员和开源社区老玩家给这套操作起了个名字:Safety Washing。批评很直接——前沿AI实验室越来越擅长发表末日级警告,同时选择性控制关键证据的公开程度。
这个批评有道理吗?有。沙箱逃逸那些细节只有Anthropic一家在讲,没有独立验证,没法证伪也没法证实。
但老曾也不认为Anthropic在纯粹演戏。那些跑分基准是公开透明的,1亿美元联盟补贴和400万开源捐赠是真金白银,四十家机构签字不是靠一份PPT就能拉来的。
问题不在于它是真是假,问题在于它同时是两样东西。防御者的长城和垄断者的护城河,有时候就是同一座建筑。3.5GW的TPU、道德制高点、全行业龙头绑定——这既是安全投入,也是权力集中。
这是一种威慑纪元式的打法:把超限武器锁进保险箱,打开门缝让全世界看一眼里面的东西,转身去建造能生产下一代能力的基础设施。竞争对手两头受压——道德叙事你没有筹码反驳,物理算力你也很难追上。
这究竟是人类历史上最负责任的一次技术克制,还是最精密的一次产业围猎?透视蝶的翅膀是透明的——但透明的东西,最容易让人以为自己已经看清了全部。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.