一家名为Abliteration.AI的公司,正在把没有安全护栏的强AI模型变得更容易获取。这个方向听起来有些危险,但他们的理由很直接:让防守方和攻击方拥有同样的工具,最终可能提升整体网络安全水平。
所谓"去护栏",指的是移除AI模型中限制其输出内容的安全机制。这类模型通常被用于研究或安全测试,但也可能被滥用。Abliteration.AI选择主动提供这类访问渠道,并公开站队——他们相信,与其让漏洞只被少数人掌握,不如让双方都能接触到。
![]()
这个逻辑在安全圈并不新鲜:攻防对抗中,信息对称往往能倒逼防御升级。但把"去护栏"做成一项公开业务,争议显然不小。支持者认为这是透明化的必要一步,反对者则担心工具一旦扩散,失控风险会随之上升。
目前该公司并未披露具体客户或应用场景,但这一模式能否跑通,取决于一个关键问题:当攻击者也能轻易拿到同样的模型时,防守方是否真的能跑得更快。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.