Hugging Face CEO宣布成立Open Alignment Initiative,并公开申请加入Anthropic的嵌入式评估员计划。若获批,其评估人员可长期驻场,获得接近员工级的访问权限,直接检查模型训练和安全措施。Hugging Face认为AI对齐不应仅由少数前沿实验室内部解决,需引入更多外部研究者。Anthropic已承诺向第三方开放工位、门禁、公司电脑及接近内部风险团队的工具,并允许评估方独立公布结论。
其他报道 (3条)