Hugging Face申请进Anthropic内部做AI安全审查

BiRun 讯,Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,由联合创始人 Thomas Wolf 牵头,并公开申请加入 Anthropic 刚提出的「嵌入式评估员」计划。如果获批,Hugging Face 的评估人员可以长期驻场,拿到接近员工级的访问权限,直接检查模型训练和安全措施。

Delangue 称,AI 对齐不能继续关在少数前沿实验室内部解决,需要让更多外部研究者参与。Anthropic 已承诺向第三方开放这类权限,包括工位、门禁、公司电脑和接近内部风险团队的工具,并允许评估方独立公布结论。

信源

动察 Beating 频道 · 动察 Beating 交流群。
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯