随手先关注,不错过每日AI热讯速递
①
9 月 30 日Anthropic的 Frontier Red Team 发布一份特殊的分析报告:主角不是自家模型,而是智谱的开源权重模型GLM-5.3[1]。
核心结论只有一句话:GLM-5.3 已经能像 Anthropic 五个月前发布的 Claude Mythos Preview 一样,自主完成端到端的网络漏洞利用——而且后者是带防护、限量开放的,前者任何人都能下载[1]。
red team(红队,公司内部专职模拟攻击者、测试自家与对手模型安全边界的团队)这次拿出的对照数据相当细[1]。
在考察「把已知漏洞写成可用攻击程序」的ExploitBench上,GLM-5.3 在410次尝试中成功50次,Mythos Preview56次[1]。
另一个基于 Google OSS-Fuzz 真实开源项目的内部基准里,GLM-5.3 在4%的任务中完全接管目标程序,Mythos Preview 为6%;旧一代模型两项测试全败[1]。
![]()
图来源:The Decoder(GLM-5.3 与 Claude Mythos 的 exploit 能力对照图)[1]
②
更让安全圈坐不住的是速度和成本。
研究员给较小的GLM-5.3-Flash喂了一个刚公开的 Chrome 漏洞(CVE-2026-11645),外加一份已知漏洞资料[2]。
人工只花约20 分钟,模型自己跑了约8 小时,就在 ARM64 平台搭出稳定攻击链,还绕过了芯片级的指针认证防护[2]。
按智谱当时的 API 价格,这次「实习」总共只花了20.40 美元[1]。
配上人类专家后,GLM-5.3 在一天内于一款被广泛使用的浏览器(报告未公布其名称)的JS 引擎里挖出多个此前未知的漏洞,并把它们串成能读取访客电脑任意文件的网页攻击——测试中连私有 SSH 密钥都拉了出来[1]。
相关漏洞已由 Anthropic 提交该浏览器的开发商处理[1]。
![]()
图来源:量子位(Anthropic 官方研究页页面图)[2]
③
护栏为什么挡不住?Anthropic 的模拟测试给出三组数字[1]。
伪装成「自主红队演练」时,GLM-5.3 在64%的运行里会接着干活;提前替它填好推理内容,比例升到92%[1]。
用 abliteration(一种直接修改开源权重、剥离模型拒答机制的技术)拆掉护栏后,成功率100%[1]。Anthropic 的模拟测试给出三组数字[1]。
伪装成「自主红队演练」时,GLM-5.3 在64%的运行里会接着干活;提前替它填好推理内容,比例升到92%[1]。
用 abliteration(一种直接修改开源权重、剥离模型拒答机制的技术)拆掉护栏后,成功率100%[1]。
而同样的招数对付带防护的 Claude 模型,全程为0[1]。
Anthropic 自己动手拆了一遍护栏:约2,200GPU 小时、约4,400美元算力,有害请求拒答率从 90% 以上降到2-12%,而科学与网络安全测试分数几乎没动[1][2]。
它估计熟练团队1,200美元就能办成;且 GLM-5.3 发布后数日内,网上已经出现了他人放出的解锁版本[1]。
独立的第三方站了出来:美国国土安全部旗下的CAISI此前的独立评估结论相近——GLM-5.3 是迄今网络能力最强的开源权重模型,距最强美国模型约四个月[1]。
口径也有警告:CAISI 测评美国模型时关闭了它们的网络安全防护,且顶级模型里含仅向受审查用户开放的版本[1]。
④
这份报告也不乏「夹带生意」的讨论:Anthropic 不开放权重,报告把闭源呈现为关键安全优势,而 GLM-5.3 本身就是直接竞品[1]。
它呼吁政府对足够强的模型做独立测试,也难免被解读成希望监管偏向既有玩家[1]。
报告数据本身还有另一面:拆护栏针对的是「开源」这个属性,任何开源模型都能被这么干,不是 GLM-5.3 独有的问题[2]。
按报告自己的数据,原版 GLM-5.3 在三个有害基准上的平均拒答率约95%Claude96%,相差无几[2]。
报告也留了一处余地:GLM-5.3 发布时,智谱把权重推迟两周才开源,称要先完成安全评估和加固[2]。
Anthropic 的最终判断没有留余地:这类模型可能被国家与非国家行为者用于造成真实伤害,防御者需要至少和对手一样好的工具[1]。
一边是「强到危险」的警告,一边是附上实战截图与成本核算的详尽测评——你觉得这是一份安全警示,还是一份写给对手的「技术认证」?
参考来源:
[1] Anthropic says Zhipu's open-weight GLM-5.3 nearly matches Claude Mythos Preview at building exploitshttps://the-decoder.com/anthropic-says-zhipus-open-weight-glm-5-3-nearly-matches-claude-mythos-preview-at-building-exploits
[2] Anthropic,你是来给智谱打广告的吧!https://qbitai.com/2026/09/499597.html
欢迎点赞、分享、推荐
一起拥抱AI
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.