百名顶尖AI专家提出AI外部评估要求
今天,超过 100 位顶尖 AI 专家签署了一套最低要求,以认真对待 AI 企业近期提出的引入外部评估员的倡议。
这些评估员需要真正独立、透明,并覆盖多个专业领域。还需要保证他们获得员工级别的访问权限,并且在他们发布让企业难堪的结论后,要保护他们不受报复。
我们欢迎模型开发者最近呼吁独立监督的表态,但他们接下来的行动才是关键。AI 实验室必须负责确保这些要求得到满足,这样公众才能对评估过程和结果抱有信心。
过去一周,AI 社区围绕外部评估的恰当角色展开了辩论,包括应该由谁来做评估、在什么条件下开展评估。我们可能不会在所有问题上达成一致,但存在许多共识。
为了让嵌入性评估变得可信,100 多位对 AI 风险有着不同背景和观点的专家在今天的公开信中一致认为,前沿 AI 开发者应当做到:
1. 保证嵌入评估员完全的编辑独立,消除利益冲突
2. 聘请持不同观点、来自不同专业领域的多名评估员
3. 公开记录评估员的工作条款,方便方法和结论的宽松公开
4. 保护评估员不受报复
5. 授予评估员与高权限员工同等的访问权限
目前,独立 AI 评估员已经形成了一个活跃且不断壮大的生态,他们每天都在推动这门科学进步——但我们需要统一标准、保障措施和独立资金。
这就是我们创建 AI Evaluator Forum 的原因。今天,我们进入了下一阶段。我们开放征集新成员、合作者和独立资金来源,帮助评估员抓住当前时机,要求开发者承担责任。
欢迎加入我们,共同建设评估生态。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖