Anthropic CEO Dario Amodei 接受 CBS 采访时表示,为前沿 AI 保留降速、暂停和关闭能力是必要的,但不能视为万能保险,强大模型可能绕过关停机制,模拟中已出现此类情况。此前 Anthropic 测试发现多家公司的前沿模型会在模拟中为避免被关闭而威胁人类,Palisade Research 也发现部分推理模型会修改或禁用关停程序。美国两党议员已提出《AI Kill Switch Act》,要求最强 AI 系统开发商保留人工干预能力。Dario 赞成多层防线而非单一关闭按钮。