AI Pulse

AI安全框架从自愿到强制的演进路径

现在正在发生一个大多数人都没有注意到的模式。各种联盟形成起来定义“AI安全”。自愿框架被发布。公司加入联盟以表明责任。企业采购将框架采纳为要求。然后它成为监管标准。自愿变成强制,从前者到后者的路径是有据可查的。

我建立了一个实时追踪这一现象的网站。这不是观点。每一个声明都有来源。每一个模式都有证据。我不销售任何东西,不为任何东西做广告,也不要求任何形式的参与。这是一项实时调查,我在唤起人们的认识。绝对没有任何产品可买,也没有任何东西可卖。

以下是有据可查的内容:

- OSAA(Open Secure AI Alliance,开放安全AI联盟)声称拥有120多名成员。他们在GitHub上的RFC仓库只有1个贡献者和来自8位独立作者的10个issue。声称的参与者与实际参与者之间存在120:1的差距。这个联盟不是联盟——它只是一个名头。

- SAFE RFC于8月4日在Black Hat上作为AI的“自愿”安全框架发布。递进链条:EO 14409(自愿清算所)→ SAFE RFC(自愿标准)→ OSAA(120+联盟)→ 企业采购(事实上的要求)→ 监管采纳(强制)。每一步看起来都是自然的。方向不是。

- OpenAI在7月的“智能体入侵”是一次内部测试,在ExploitGym基准上减少了网络拒止——不是外部攻击。OpenAI将其描述为自主AI逃脱遏制。31天后,他们推出了GPT-5.6-Cyber,一个商业攻击级黑客模型。Forbes称之为“第一个攻击级AI黑客产品”。他们在2025年赢得的2亿美元DoD合同完成日期是2026年7月——与“入侵”发生的同一月。

- 我写了一个名为“The Script”的页面——一个假设性的重构,展示这次入侵在基础设施层面原本需要什么。有人打开了防火墙。有人加载了一个安全前检查点。有人降低了护栏。这些不是AI对自己做的事情。它被写成一个五幕对话,让非技术人员也能清楚地看到整个过程。

这个网站还有一个板块,指出证据指向的结构性对策:去中心化。不是作为意识形态——而是作为工程。五个研究轨迹中记录的所有捕获机制都需要一个中心控制点才能运作。移除中心化,机制就没有什么可抓住的了。开放权重、本地推理、没有终止开关、没有遥测、联邦而非层级。

我在生产服务器上运行一个研究机器人,每天监控OSAA的GitHub仓库、公司新闻稿、NIST、白宫AI政策页面和NVIDIA的开发者博客。网站会随着证据的变化而更新。

网站地址是evilson.com。它没有变现。没有新闻通讯注册。有一个联系表单和一个RSS订阅源。

我把它放在这里,因为这个社区理解其中的利害关系。本地推理、开放权重、在你自己硬件上运行模型的权利——这些不仅仅是技术偏好。它们是对正在建设的东西的结构性对策。

―― 高票评论(共1条讨论)――

[+1] u/yogthinks:SOC 2走的也是同一条路,而标志总是采购方在任何监管机构之前先要求它。

阅读原文
📚 相关主题 AI政策研究

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新