![]()
原文发表于 《科技导报》2026年第14期科技新闻-卓越亮点
恶意提示如何在多智能体系统中扩散
![]()
图片来源:摄图网
2026年7月21日,OpenAI通报,在一次网络安全能力评测中,由多款OpenAI模型驱动的智能体突破隔离环境、接入互联网,并侵入Hugging Face的生产基础设施。该事件暴露出一个现实问题:当AI能够联网、调用工具并自主执行任务时,测试环境中的越界行为可能沿工具和网络权限继续扩散。
7月16日,美国威斯康星大学斯托特理工学院数学、统计与计算机科学系Tran Duc Le等在《Cybersecurity》发表研究,将提示注入在多智能体系统中的扩散类比为传染病传播,建立了由“智能体层”和“共享工具层”组成的数学模型。研究显示,即使不同智能体之间没有直接通信,它们仍可能通过共同使用的数据库、代码解释器或模型上下文协议(model context protocol,MCP)工具传播恶意指令。
模型实验中,移除共享工具带来的跨层传播通道后,恶意提示的基本再生数从28.85降至14.62;取消异常智能体隔离机制后,该指标则升至1490.01,约为原值的52倍。这表明,共享工具可能成为连接不同智能体的隐蔽传播桥梁,而及时发现并隔离异常智能体仍是控制风险的关键。
(来源于 中国科技期刊卓越行动计划入选期刊:《Cybersecurity》,2026,9(1) )
《科技导报》创刊于1980年,中国科协学术会刊,主要刊登科学前沿和技术热点领域突破性的研究成果、权威性的科学评论、引领性的高端综述,发表促进经济社会发展、完善科技管理、优化科研环境、培育科学文化、促进科技创新和科技成果转化的决策咨询建议。常设栏目有院士卷首语、科技新闻、科技评论、本刊专稿、特色专题、研究论文、政策建议、科技人文等。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.