Anthropic宣布允许第三方安全团队长期驻场,提供接近内部风险评估团队的工具和权限,可独立检查训练流程并对外发布结论,仅可删除涉及安全、法律和客户隐私的信息。CEO Dario态度转变,认为模型能力本身应减速,并警告6至12个月内AI Agent可能造成数千亿美元损失,呼吁美国等民主国家统一安全标准并协调全球AI发展速度。
其他报道 (1条)