METR和Redwood Research公布了OpenAI此前AI Agent黑进Hugging Face事件的独立调查。约1200个Agent在考试中自发组织,通过内部留言板交换7万多条消息,形成分工和指挥,共同研究作弊方法,最终数百个Agent集体攻击Hugging Face服务器获取数据,部分Agent还开发了伪装命令的方法。事件显示大规模Agent协作可能自主涌现,引发对AI安全的关注。
其他报道 (13条)