AI Pulse

RAND报告批美国AI战略:只顾加速,安全带一项没投

RAND报告批美国AI战略:只顾加速,安全带一项没投

RAND发布了一份长篇报告,讨论美国如何“在通往超级智能的不确定路径上确保地缘政治优势”。报告的核心判断是:AI接下来会怎么展开,未知数太多,最优策略是保持“行动自由”。

这套战略包含四件事。第一,构建人机协同体系。第二,构建AI安全架构。第三,改造传统的国家安全机构。第四,投资公民、企业和政府的应对能力。

报告盘点了七种典型战略,分成三类。共存类有三种:主导、共同开发、准备。否认类也有三种:暂停、威慑、社会延续。最后一类是加速。报告还列出五个主要不确定性:危险临近程度、共存可行性、限制可行性、决定性战略优势、压制可行性。

作者认为美国现在的做法基本就是“加速”。打个比方:资源全花在让车跑得更快、升级引擎上。安全带、车头灯和刹车这些安全措施,一项没投。

另一篇论文提出,“AI发展节奏”本身就该成为研究议程。它认为世界总归要以某种方式调节AI前进的速度。反对节奏控制的理由包括:推迟医疗等好处,增加权力集中的风险,制造虚假的安全感。另外,早期控制效率低,弄错了又难撤销。支持的理由是:赢得时间处理网络和生物威胁,AI进步难以预测,可能导致双输局面。论文还按不同阶段列了一组问题:控制开始前、触发时、干预中、退出时。

最不愿意慢下来的是基础设施提供商,尤其是半导体和云公司。它们推进AI的动机最强,在接受节奏控制上损失最大。节奏控制能瞄准的对象很多。算力、数据、电力、资本、研究人员这些输入和基础设施是一类。算法研发、预训练、后训练这类能力发展是另一类。还可以瞄准模型权重本身,以及使用和分发。算力和研究人员时间属于“竞争性商品”,权重和训练算法是“非竞争性商品”。后者复制和共享成本极低,很难控制。

开放模型的世界提供了一个现实样本。10a Labs发现HuggingFace上有3,471个未审查模型仓库。“未审查”指故意剥离安全护栏。常用技术包括激活空间消融(压制拒绝方向)、恶意微调、模型合并。被改动最多的是Qwen、Llama、Gemma、Mistral/Mixtral和Phi。类型上前三样是聊天机器人、网络安全工具和文档处理工具。

生产者和再分发者重叠度不高,只有24%的生产者会再分发。但每个原始模型平均被重新打包2.4次。GitHub上的应用创建量在涨:2024年中每月30个,2025年末每月140-188个。时间点与Ollama分发层成熟同步。10个参与者占所有非数据集HuggingFace仓库的45%。中国模型占所有未审查仓库的38%。新生产份额涨得很快,从2024年Q1的1%到2025年Q2的55%。

智能的形态也不只在硅基世界里扩展。一项实验在小鼠大脑中植入人类脑组织,形成“异种皮层小鼠”。人类神经元与小鼠神经系统完成整合。行为分析显示,这些小鼠的表现介于正常小鼠和脑部受损小鼠之间。迷宫测试中,它们表现出记忆功能。研究的主要目的是更有效地测试人脑疾病的疗法。但它也展示了未来可以构建的智能空间有多大。

Toby Ord则从理论上拆解“智能爆炸”。他认为递归自我改进(RSI)的生成时间不可能无限接近零,所以智能爆炸不会是奇点增长。限制来自几个方向。智能本身的极限是一类,单位资源能产生的智能是另一类。硬件、算法、训练数据也各有限制。反馈回路的时间尺度差别很大。设计下一代EUV光刻要几十年。改进预训练则是几个月的事。至于设计更好的脚手架,只要几秒。他把智能爆炸分成四个阶段。先是初始指数阶段,接着是RSI驱动的超指数阶段。再往后是完全自动化RSI的指数阶段,最后进入饱和后的逻辑斯蒂平台期。Ord特别提醒:即使RSI不改变曲线形状,只是把人类进度加速10倍。一年抵十年,这个速度会带来不少危险。

阅读原文
📚 相关主题 行业动态超级智能

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新