过去,人们担心AI“回答错误”;现在,一个更现实的问题正在浮出水面:如果AI成为攻击者的廉价技术团队,会发生什么?
![]()
Anthropic最新公布的报告显示,2025年12月至2026年8月,公司发现并封禁了一批滥用Claude的账号,涉及网络攻击、舆情监控、虚假宣传、诈骗、常规武器研发以及具有潜在生物安全风险的研究。
![]()
其中一个案例尤其值得警惕。Anthropic称,一名疑似与俄罗斯有关的网络攻击者利用AI搭建自动化流程,从钓鱼攻击、窃取凭证到数据外传,都有Claude参与。当恶意软件被安全产品识别后,AI还会协助修改和重新编译,直到绕过检测。
![]()
但这并不是“AI自己发动攻击”。报告明确表示,人类仍然负责选择目标、下达任务和查看窃取的数据。AI真正改变的,是速度和成本:过去需要一支专业团队完成的工作,如今少数人甚至单个操作者,也可能借助AI持续推进。
在监控领域,Claude还被当成“软件工程团队”。报告称,一名顾问曾利用它协助设计覆盖约2500万张手机卡的监控平台;另一些账号则让Claude每天处理数十篇社交媒体和新闻内容,自动生成舆情简报。
距离普通人更近的,是AI诈骗。一个应用工作室被指利用Claude搭建20多款交友软件,制造超过4700个虚拟人物,在两周内与至少2.5万人聊天。真人只负责视频通话等AI暂时做不了的环节,形成大约“三个AI角色搭配一个真人”的运作模式。
生物研究部分则更加复杂。Anthropic披露了5起可能具有双重用途的案例,包括病毒传播、免疫逃逸和毒素研究。不过,公司同时强调:没有证据证明相关科研人员一定打算制造生物武器。因为同一项知识既可能用于研发疫苗,也可能被用于增强病原体,单靠关键词很难判断真实意图。
这份报告不能被解读成“Claude用户普遍在犯罪”。它展示的是Anthropic主动筛选出的少数重大、特殊案例,而且关键证据来自公司内部日志,外界目前无法完整独立核验。
但它发出的信号仍然清晰:AI最大的近期风险,未必是突然产生意识,而是把高级代码、数据分析和工程能力变成随叫随到的廉价劳动力。未来的安全防线不能只靠模型拒绝回答,还需要账号身份核验、异常行为监测、跨平台协作以及独立监督。
技术进步不该因为风险而停下,但当作恶成本开始明显下降,安全投入就不能继续落在能力增长后面。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.