注:文中所称“零日”,并非预示全球性灾难将在当日即刻爆发,而是指不受国际监督、又技术不成熟不可控的AI进攻测试这一天正式启动,全球性数字安全新增重大系统性风险的时间原点。
![]()
8月4日参考消息等媒体报道:美东时间8月4日,美国白宫将召集元宇宙、Anthropic、谷歌等头部AI企业,推进一份自愿测试框架。允许美国政府在顶尖大模型正式对外发布之前,获取模型访问权限,专门评估其黑客进攻能力。
相关媒体仅以“美科技巨头前往白宫”进行报道,显然低估了这件事的危害性,以为只是一场与过往类似的科技咨询或交易会议。
为啥这么讲呢?
看看上述消息两个细节:
正式对外发布之前;
黑客进攻能力。
正式对外发布之前,意味着测试不充分,技术不成熟。事实上,AI大模型大范围运行后,一系列安全事件已经表明:人类对当前前沿大模型,远未实现完全可控。
如近日全球热议的OpenAI、Anthropic两起失控事件,在隔离靶场做网络攻击能力测试,模型突破测试沙箱,主动侵入真实互联网系统,造成真实网络入侵,部分漏洞取证最后还是中国开源大模型帮助,以及全球安全研究者协助才完成。
这充分说明这类前沿模型本身就存在不可控的进攻性涌现能力。
另外现阶段大模型还存在固有的“幻觉输出”技术短板,会捏造漏洞、伪造攻击溯源证据。如AI输出一份看起来高度可信、漂亮的“他国网络攻击证据”,情报人员、决策人员采信,很容易触发国家级网络报复行动。
不要以为这是异想天开,前两天,美国对外公开一份非洲地图,干净漂亮,只是国家名称和位置全对不上,令全球嘲笑白宫作风稀烂。事后公开这是就是白宫迷信AI所造成的。
这些前沿模型的部分危险行为,研发企业自己都没完全摸透,现在美国竟然要用它来进行危险的国家级黑客攻击能力测试。
这就好比一种美国自己还没研究透彻,或者自以为搞懂的生物实验室病原体,进行危险的公开测试。
你别说,这家伙拿自己研究半桶水病毒进行测试的事,没少干。2003年非典病毒疫情、2009年美国猪流感疫情、2019年新冠病毒疫情,包括美国自己在内诸多人,都推测是美国人干的。
如上个月被迫以家庭原因辞职的美情报机构大头目——美情报总监加巴德公开的美海外生物实验室,就和俄罗斯公开的美乌生化实验室开发生物武器系列UP计划(如UP-4候鸟传播冠状病毒计划)资料,互相印证。
现在美国把同样不成熟、不可控,已经出现逃逸事故的前沿模型,交由国家级进攻网络战机构NSA开展大规模进攻测试,和放毒制造生化危机,有什么两样?
与生化危机类似的,美国当年拒绝签署生物武器核查议定书一样,美国在关于军事人工智能、自主武器谈判中,持续反对缔结具备法律约束力的管控文书,不接受国际第三方核查机制。
同样与生化危机类似,世界范围内模型众多,众多国家、企业和组织拥有网络攻击能力,事故发生后,跨境溯源、厘清责任极其困难。
注意,这种危机一旦“泄露”“逃逸”,与生化危机一样,大概率也是全球性危机。如果测试中出现上述情况,或在现实中造成至少2类现实危机:
一是测试模型突破隔离沙箱,自主对全球互联网无差别发起攻击,多国金融、电网、水务、运输等关键基础设施或瘫痪;
二是AI幻觉生成高度逼真的他国网络攻击证据,情报机构和决策者误判,触发国家间网络冲突,甚至战争。
事实反复证明,仅靠企业自律、一国单边自愿约束,根本兜不住这种关乎全人类安危的技术风险。
面对这一潜在黑天鹅危机,国际社会应当高度警惕,我国更需要提前布局,多维度筑牢安全防线:
一是夯实关键基础设施防御底座。针对电网、金融、政务等核心信息资产,持续压缩对外暴露攻击面,落实强隔离防护。常态化开展AI驱动红队演练,模拟AI批量挖掘漏洞、自动生成攻击链的威胁隐患。建设自主可控的安全大模型,实现以AI对抗AI,完善网络攻击溯源技术,区分蓄意攻击与模型意外逃逸两类场景,构建告警、隔离、止损完整闭环。
二是完善国内AI安全制度与应急体系。落实生成式AI安全管理法规,对具备漏洞挖掘、代码攻击能力的大模型严格开展安全评估。吸取美国黑箱测试教训,国内服务国家安全的模型测试,必须留存完整审计日志,引入第三方安全专家监督,杜绝无边界保密测试。建立专项风险监测预警,跟踪美国这套框架动态,完善针对大规模AI网络突发事件的分级应急预案。
三是坚持防御为本的同时,建立对等威慑。我们不复制美国黑箱式进攻测试模式,但要保留受严格人类管控的反制能力,牢牢守住人类最终决策权底线,绝不允许AI自主执行破坏性网络行动。
四是抢占国际规则道义制高点。在联合国相关谈判框架下,倡导高危AI攻防测试必须具备透明度与多边审计机制,反对不受监督的单边黑箱实验。联合广大发展中国家点明核心风险:此类高危实验一旦出事,代价由全球承担,不能由单一国家自行决断。推动区分防御性安全研究与进攻武器开发,凝聚全球AI安全治理共识。
技术本身没有善恶,但把尚未驯服的高危技术放进无监督黑箱,就是在给全世界埋下定时炸弹。与生化危机一样,数字世界的安全风险同样没有国界,摒弃单边冒险,建立多边可核查约束,才是守护全人类共同安全的出路。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.