OpenAI最近抛出一个新概念:Defense Factory(防御工厂)。简单说,这是一套持续性的自动化防御体系,用来不断发现、验证并修复系统漏洞。消息一出,评论区有人直接甩了句"互联网再也不安全了"。
为什么这么悲观?因为OpenAI点出了一个正在逼近的威胁——开源权重模型(open-weight models)的能力越来越强,而当前的安全防护水平并没有同步跟上。这两者之间的差距,就是他们所说的"防御者窗口"(Defender's window)。
![]()
窗口一旦关闭,后果很严重
OpenAI的警告很直接:如果不依靠前沿模型来建立持续防御机制,这个窗口会逐渐关闭。到那时,恶意攻击者就能自由利用那些有漏洞的系统,想怎么玩就怎么玩。
这不是危言耸听。OpenAI在公告里提到,智能体(Agents)现在已经能通过滥用越来越容易获取的开源权重模型,发起长时间、持续性的网络攻击。攻击的门槛在降低,而防御方如果还停留在"打补丁式"的被动响应,显然跟不上节奏。
防御方其实有两个结构性优势
不过OpenAI也不是只报忧不报喜。他们指出,防守方手里其实握着两张牌:
- 第一,防御方可以让智能体直接访问自己的代码库,这意味着AI能深入系统内部,做更精准的排查;
- 第二,防御方可以使用前沿模型(frontier models)来获得先发优势,跑在那些只会用开源模型的攻击者前面。
说白了,攻击者用的是"大路货",防御者如果能用上更顶级的模型,理论上就能在攻防博弈中抢回主动权。这也是Defense Factory的核心逻辑——不是修一次就完事,而是把防御变成一条永不停歇的流水线。
"持续防御"到底怎么运转?
从OpenAI的描述来看,Defense Factory更像是一个自动化作战单元:它负责持续扫描、验证漏洞,然后自动修复。整个过程不需要人工盯着,而是靠模型驱动的智能体来执行。这套机制的前提,是信任AI能直接接触代码——这本身就是一种观念上的转变。
过去的安全策略大多是"发现漏洞→人工修复→再测试",节奏慢,且依赖安全团队的经验。而Defense Factory的思路是让AI成为第一响应者,把修复周期从"周"压缩到"小时"甚至更短。能不能做到是另一回事,但方向已经很明确了。
为什么偏偏是现在提这个?
时间点很微妙。开源模型的性能正在快速逼近闭源模型,这意味着攻击者能用的工具越来越强,而且获取成本极低。OpenAI此时抛出"防御者窗口"的概念,本质上是在提醒整个行业:安全防御不能再靠老办法了,得用更先进的模型来对冲开源模型带来的风险。
当然,这套逻辑里也藏着OpenAI自己的商业叙事——前沿模型不只是用来生成文本和图片的,它还能当"安全卫士"。至于Defense Factory最终能跑出什么效果,目前还没有更多细节,但至少它把一个问题摆到了台面上:当攻击者都用上AI了,防御者还在手动打补丁,这仗还怎么打?
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.