利好
Anthropic 与埃森哲各投 10 亿美元建评估体系
10:28
Anthropic授予埃森哲员工级权限进行模型红队测试,双方五年各投入10亿美元,引发独立性争议。
据 Woofun AI 消息,Anthropic 正式启动"嵌入式评估"计划,允许埃森哲旗下 AI 公司 Faculty 人员进入内部,以接近员工的权限查看模型训练过程、参与红队测试及对齐评估。双方承诺在未来五年内各投入至少 10 亿美元建设该评估能力,目前费用由 Anthropic 直接承担。
尽管 Anthropic 表示后续将引入 METR 等其他机构,但鉴于埃森哲作为长期合作伙伴且存在重大商业往来,此举与 AI Evaluator Forum 提出的评估机构独立性最低条件存在冲突。
WOOFUN AI
影响力评估 · 一键速读
赋予第三方员工级权限意味着评估深度远超常规外部审计,有助于提升模型安全性,但商业绑定关系削弱了结果公信力。若行业缺乏统一标准,此类合作可能被视为公关手段而非实质监管。未来需观察非营利组织介入后的评估透明度变化。
WOOFUN AI 生成 · 仅供参考,非投资建议
评论
暂无评论