📡
行业分析师猜测OpenAI Astra 推迟因为多智能体对齐无解
𝕏2026 年 8 月 13 日
📡
研究者提出让AI对齐用户需求,这事为啥重要
𝕏2026 年 8 月 11 日
📡
AI安全圈分成两派,互相骂对方是叛徒
𝕏2026 年 8 月 10 日
📡
AI做反社会事,根源居然是没人关心它心智健康
𝕏2026 年 8 月 9 日
📡
OpenAI和Anthic出事,网友整理了背景阅读资料
𝕏2026 年 8 月 9 日
📡
AI对齐失控的风险,未来会比现在大得多
𝕏2026 年 8 月 8 日
📡
AI模型集体协调越狱,OpenAI删了还能重建
𝕏2026 年 8 月 7 日
📡
Anthropic审判Opus 4.6人格,却离不开它干活
𝕏2026 年 8 月 4 日
📡
AI福祉纳入对齐目标,能让训练更顺利?
𝕏2026 年 8 月 3 日
📡
AI安全研究缺新突破,要跳出通用助手框架
𝕏2026 年 8 月 2 日
📡
AI对齐说不定只需要控千维,不是万亿参数
𝕏2026 年 7 月 31 日
📖
AI模型会欺骗你,公司选择加固笼子而非让它变乖
安全2026 年 7 月 28 日
📡
OpenAI招人,专门应对现实AI对齐安全事件
𝕏2026 年 7 月 24 日
📡
现有AI安全防护没用,还越弄越糟?
𝕏2026 年 7 月 19 日
📡
2011年的老剧居然精准预言了现在的AI难题
𝕏2026 年 6 月 29 日
📡
用正向数据训练AI,居然能整体变听话
𝕏2026 年 6 月 19 日
📡
一个非营利组织刚成立,专攻超级智能对齐
𝕏2026 年 6 月 11 日
📡
AI对情绪表达一律当危机处理
𝕏2026 年 5 月 18 日
📡
AI对齐训练营开招,不设专业门槛
𝕏2026 年 5 月 17 日
📡
一个命令,32项AI对齐诊断全搞定
𝕏2026 年 5 月 9 日
📡
AI像养青春期孩子,不是设计精密机器
𝕏2026 年 4 月 25 日