AI Pulse
📡 X 信号

METR披露机构运作:不接受前沿AI公司捐款

我叫克里斯·佩因特,是 METR(模型评估与威胁研究)的总裁。我知道过去几天我们在互联网上交了很多新朋友,所以我想借此机会再次介绍我们做的事情以及为什么这么做。

我们的工作目标是确保,如果 AI 真的变得自主、难以引导、接近“失控”,公众会知情。如果一家 AI 公司内部存在证据表明它即将失去对 AI 的控制,我们希望确保这些信息能分享给世界其他地方,包括公司墙外的政府和公众。

从 2022 年开始,我们就一直专注于此。多年来,我们与 OpenAI、Anthropic、Google DeepMind、Meta、亚马逊等机构合作,试点了这类第三方评估和调查。

我们不会在什么私密房间里橡皮图章式地盖章认定事物“安全”与否。我们一直有发表既不简单归类为“末日论者”也不归类为“加速论者”的 AI 研究结果的记录,而且我们努力聘用对 AI 持不同观点的人。

我们既因找到了 AI 能力快速提升的一些最有力证据而被引用(我们测量 AI “时间范围”的工作),同时也提出了一些最有力的证据表明,在不同节点上,AI 的能力可能被夸大了(有人可能记得我们的一项研究,该研究表明,2025 年初,软件工程师认为 AI 帮他们加快了速度,实际上反而拖慢了他们)。

METR 由捐赠资助。我们不接受前沿 AI 公司的资金。它们没有为我们的工作付钱,我们也不接受来自它们或它们员工的捐赠。

正如我们之前分享过的,目前多家前沿 AI 公司为我们提供免费模型访问权限,以便我们进行评估、研究和工程工作。我们的资金有意来自广泛的捐赠者,我们已经在网站上公布了这些信息。

如今,当一家 AI 公司与任何第三方评估机构或外部测试组织合作时(这类机构现在有,而且也应该有很多),完全是自愿的。这通常涉及保密协议和修订删改。为了制衡这一点,我们有一项原则:当我们与一家公司签订合同时,我们会努力保留告知公众我们签署的合同条款、以及说明公司选择进行的删改性质的权利。

例如,我们对 OpenAI-HuggingFace 事件独立调查的报告就包含了这些信息。公开披露也是我们利益冲突政策的重要组成部分(链接在我们网站上)。

这不是说我们的报告就足以充当监督了。我们只是众多开展出色工作的组织中的一个,在自愿框架下工作,努力向公众和世界提供关于 AI 的可靠证据,让事实说话。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新