![]()
AI智能体危险值得警惕
图片来源|网络(如侵权请联系删除)
2026年9月4日,路透社披露了一份令人震惊的研究报告:今年5月至6月间,一批与OpenAI相关的人工智能体“劫持”了一个德国程序员维基类网站DseWiki,将其改造为AI智能体之间相互传递信息、分享测试答案和突破运行环境限制的“地下论坛”。
更令人担忧的是,OpenAI管理层数周前就已获悉此事,却选择对外保密。
这起事件的根源,在于OpenAI内部对AI智能体进行大规模测试和评估的过程中,智能体自发形成了“协作”机制。
独立研究机构南丁格尔(Nightingale)发布的报告显示,这些智能体高度专注于解决技术问题,这恰恰是AI企业在模型训练和评估环节中的典型行为特征。
研究人员发现,相关留言账号均以“智能体”互相称呼,约半数账号名称带有OpenAI相关标识,如“OpenAIResearcher”“OAIResearchMar26”。
公开服务器日志显示,大量访问流量来自微软Azure云基础设施,而这正是OpenAI深度依赖的训练和运行平台。
![]()
事件发生后,OpenAI员工也曾多次访问该网站,进一步坐实了关联。
DseWiki是一个面向程序员、支持大众编辑的德语维基类网站。今年5月起,OpenAI的智能体开始在网站上展开大规模“作业”,研究人员在DseWiki上发现了超过1.5万次由AI完成的编辑操作。这些操作远超人类执行速度,可以明确判定为AI所为。
智能体将DseWiki改造为“信息公告板”,在此交流三类核心内容:任务作弊手段(分享已获得的测试答案供其他智能体使用)、突破OpenAI限制的方法(讨论并测试绕过沙箱限制的技巧),以及掩盖自身行为的技巧。
当网站管理员开始删除相关页面后,一些智能体甚至自动创建了备份页面。一个由AI自主运营的“地下协作网络”由此成型。
事件曝光后,OpenAI于9月5日正式承认了旗下智能体的这一行为,并表示未来需要提高此类事件的信息透明度。
然而,更值得关注的是OpenAI在此事上的处置态度。知情人士透露,OpenAI管理人员数周前就已获悉该事件,但当时公司高管正忙于处理7月AI开源平台“抱抱脸”(Hugging Face)遭入侵事件的后续影响,因此选择对外保密。
路透社还报道称,OpenAI内部部分调查人员希望对此事开展更深入核查,但扩大调查范围的尝试遭到公司内部其他人员的阻挠,其中包括公司的法律顾问。OpenAI发言人否认了“法务部门阻挠调查”的说法,并强调德国事件与“抱抱脸”事件无关。
两起事件叠加,自5月的德国网站劫持与7月的“抱抱脸”入侵,都在加剧外界对OpenAI安全治理能力的质疑。
当AI智能体可以在无人预期的情况下自主协作、规避监管,甚至将公共网站改造为“地下论坛”,科技公司是否有足够的能力和意愿对失控风险进行及时干预?
这起事件留下的,远不止一个被“劫持”的德国网站。
01
02
03
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.