AI Pulse

授权官员将获AI工具独立审查政府AI决策

授权官员将获AI工具独立审查政府AI决策

政府机构在用AI做更多事:拦截网络攻击、保护关键基础设施、更早发现威胁,在危机中更快看清态势。但同一套技术也可能高速大规模出错。AI会基于缺失或过时的上下文、错误配置的目标、错位的假设行动,速度快、规模大,人很难在错误扩散前发现。

国家安全领域尤其如此。决策往往涉及保密,后果可能很严重,监督更难,也更重要。而现有监督方式是劳动密集型的。一个小团队用纸质时代的方法,去审查以机器速度运行的系统,几乎不可能完成。

OpenAI自己也认这一点,并把一句话当出发点:更强的系统需要更强的监督,这条原则也适用于OpenAI自己。它的“准备度框架”要求高级模型在部署前先过严格审查:弄清能力边界,确认安全措施够不够。部署后还要持续监控、做事件审查,学到的内容会变成更严格的安全措施,反馈给下一代模型。涉及国家安全的部署,OpenAI说会按自己的国家安全原则来:加保障、保留人的判断、施行监督,高风险场景尤其如此。

OpenAI在方案里划了条线:它不监督政府,也不该由它来监督。监督责任在民选官员和为此设立的公共机构。它能做的是用技术支撑这些机构去履行现有职责。

计划围绕三条原则展开。AI用来增强人和机构的判断,不是取而代之。政府用AI,要能对授权监督可追溯、可理解——审计员能弄清一个AI辅助决策用了什么输入、依据什么逻辑。AI要让民主监督机构更有力量,不能削弱它们。

接下来一年,OpenAI计划跟授权官员合作,找出哪些AI工具或技术支持能让监督更有效。它拿出500万美元,覆盖培训、技术支持和OpenAI使用额度。目的是让民主政府的监督机构稳妥采用和评估AI工具。它还会跟监督机构试点工具,让授权审查员能检查AI辅助政府决策的记录:输入、输出、工具使用情况都在内,好搞清AI是怎么影响结果的。

工具在可行时尽量做到可互操作,或者与具体模型无关,免得监督机构被绑死在OpenAI的模型上。参与机构保留对证据、输出和发现的控制权,这些材料只对授权政府官员开放。资金、培训、额度都来自OpenAI,控制权却在机构手里。这个关系接下来怎么运转,是方案里最需要观察的。

它没说清楚什么情况下互操作算“可行”。这个标准空白,会直接影响“模型无关”在实际里能走多远。OpenAI还邀请了民间社会和技术专家参与,让外部视角进入工具开发的早期。计划怎么算成功,它也讲了:授权审查员有没有更好地履行职责,公众有没有更强理由相信政府AI系统是按预期使用的。

很多细节还没有答案:500万美元怎么分配、哪些机构获得支持、如何跟现有法律框架协调、审查工具本身会不会被用于扩张监控。OpenAI的框架是:AI可以集中权力,也可以帮民主机构更有效地行使和制衡权力。接下来一年的实际操作,会检验它走的是哪一边。

阅读原文
📚 相关主题 OpenAI

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新