利好

Anthropic 与埃森哲各投 10 亿美元建评估体系

10:28

Anthropic授予埃森哲员工级权限进行模型红队测试,双方五年各投入10亿美元,引发独立性争议。

据 Woofun AI 消息,Anthropic 正式启动"嵌入式评估"计划,允许埃森哲旗下 AI 公司 Faculty 人员进入内部,以接近员工的权限查看模型训练过程、参与红队测试及对齐评估。双方承诺在未来五年内各投入至少 10 亿美元建设该评估能力,目前费用由 Anthropic 直接承担。

尽管 Anthropic 表示后续将引入 METR 等其他机构,但鉴于埃森哲作为长期合作伙伴且存在重大商业往来,此举与 AI Evaluator Forum 提出的评估机构独立性最低条件存在冲突。

WOOFUN AI

影响力评估 · 一键速读

赋予第三方员工级权限意味着评估深度远超常规外部审计,有助于提升模型安全性,但商业绑定关系削弱了结果公信力。若行业缺乏统一标准,此类合作可能被视为公关手段而非实质监管。未来需观察非营利组织介入后的评估透明度变化。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅