白宫拟要求开源AI模型发布前接受30天安全测试
白宫准备把开源AI模型纳入发布前安全测试框架。这套框架现在是自愿加入的,OpenAI、Anthropic这些实验室的闭源前沿模型都算在里面。开源模型预计在能力达到可比水平后加入,可能需要在公开发布前接受30天测试。
官员们卡在两个风险之间。排除开源模型,可能给闭源实验室一个政府认可的竞争优势。纳入进来,又可能拖慢美国开源模型的发展。
如果开源模型真要过30天测试,靠它做产品的团队上新版本就得晚一个月。
美国拦不住世界其他地方用开源模型。眼下真正拿得出手的开源模型,可能大多来自中国,美国怎么做未必影响全局。
白宫绕开国会就推行这套做法,法律依据存疑。测试由CAISER负责,框架几年前就在橡树岭搭起来了,并非临时起意。有人喊话:该把顶级AI实验室搬到欧盟去了。
框架何时正式扩展到开源模型,哪些模型算“达到可比能力”,目前都不清楚。