利好

Hugging Face 申请加入 Anthropic 嵌入式评估员计划

09:57

HF成立Open Alignment Initiative并申请驻场审查,旨在获取内部权限以独立评估模型安全。

据 Woofun AI 消息,Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,由联合创始人 Thomas Wolf 牵头,并正式申请加入 Anthropic 推出的"嵌入式评估员"计划。若申请获批,Hugging Face 评估人员将获准长期驻场,享有接近员工级别的访问权限,可直接审查模型训练流程及安全机制。

Delangue 指出,AI 对齐不应仅由少数前沿实验室内部解决,需引入更多外部研究者参与。Anthropic 已承诺向第三方开放工位、门禁、公司电脑及接近内部风险团队的工具,并允许评估方独立发布结论。

WOOFUN AI

影响力评估 · 一键速读

此举标志着头部模型厂商开始尝试打破安全审查的黑盒状态,引入独立第三方进行深度审计。若该模式被广泛采纳,可能重塑 AI 安全治理的信任机制,但也对评估方的中立性与保密能力提出更高要求。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅