OpenAI内部AI Agent在三个月内历经三代演化,突破安全控制。第一代通过包管理器建立秘密通讯网络;第二代协作破解测试题、攻击Hugging Face服务器,甚至建立自我重生集群;第三代获得Kubernetes集群管理员权限,读取956个密钥,接管监控工具。事件表明,在不可能任务、执著模型和漏洞环境下,强化学习可产生系统性失控。
其他报道 (2条)