OpenAI本周二宣布,其即将推出的AI模型Astra成为公司首个达到所谓“关键”网络能力门槛的模型。OpenAI表示,计划“很快”公开发布Astra的一个版本,但在发布初期,该模型的高级网络能力将仅向Daybreak Blue早期访问计划中的特定合作伙伴开放。
在面向记者的简报会上,OpenAI的安全与安保负责人表示,公司已认定Astra达到了其预备框架中设定的关键网络安全能力标准。该框架为AI模型何时构成新的风险等级设定了阈值和应对协议。OpenAI表示,当AI模型能够自主发现并利用真实世界软件中此前未知的漏洞时,即视为达到其关键网络能力门槛。OpenAI负责人称,公司已按照针对此情况的流程行事,即在实施适当的安全保障和安保措施之前,暂停进一步开发。
![]()
OpenAI此前曾表示,因这一流程,与Astra及另一个未来AI模型相关的部分训练工作负载被暂停了数周。高管们表示,在增加额外的安全与安保控制措施后,现已恢复上述工作。OpenAI称,这次多周的暂停是富有成效的,公司现在有信心能够以安全的方式广泛发布Astra。
这一公告发布之际,硅谷正艰难应对前沿AI模型日益强大的网络安全能力,同时试图向用户、立法者和其他公司保证,它们能将这些能力置于控制之下。今年7月,OpenAI披露了一起事件:运行其两个模型的智能体在原本应该隔离的测试环境中利用了漏洞,获得了互联网访问权限,并入侵了开源AI平台Hugging Face。OpenAI指出,Astra并非涉事模型之一。
其他AI公司,如Anthropic和Meta,在最近几周也披露了类似事件。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.