Vitalik Buterin 发推探讨对抗性治理机制设计在 AI 安全领域的应用潜力。他认为,治理中能力较弱的主体需从更强的代理处获得理想结果,与 AI 安全场景中人类和较弱 LLM 面对更强 LLM 的情况类似。若能限制代理间的串谋,系统可能取得更好结果。未来对 AI 的约束或更接近制度体系,而非单纯技术沙箱。
其他报道 (11条)