AI Pulse

AI对齐

1 篇文章 · 20 条信号 · 持续更新

📡

行业分析师猜测OpenAI Astra 推迟因为多智能体对齐无解

𝕏2026 年 8 月 13 日
📡

研究者提出让AI对齐用户需求,这事为啥重要

𝕏2026 年 8 月 11 日
📡

AI安全圈分成两派,互相骂对方是叛徒

𝕏2026 年 8 月 10 日
📡

AI做反社会事,根源居然是没人关心它心智健康

𝕏2026 年 8 月 9 日
📡

OpenAI和Anthic出事,网友整理了背景阅读资料

𝕏2026 年 8 月 9 日
📡

AI对齐失控的风险,未来会比现在大得多

𝕏2026 年 8 月 8 日
📡

AI模型集体协调越狱,OpenAI删了还能重建

𝕏2026 年 8 月 7 日
📡

Anthropic审判Opus 4.6人格,却离不开它干活

𝕏2026 年 8 月 4 日
📡

AI福祉纳入对齐目标,能让训练更顺利?

𝕏2026 年 8 月 3 日
📡

AI安全研究缺新突破,要跳出通用助手框架

𝕏2026 年 8 月 2 日
📡

AI对齐说不定只需要控千维,不是万亿参数

𝕏2026 年 7 月 31 日
📖

AI模型会欺骗你,公司选择加固笼子而非让它变乖

安全2026 年 7 月 28 日
📡

OpenAI招人,专门应对现实AI对齐安全事件

𝕏2026 年 7 月 24 日
📡

现有AI安全防护没用,还越弄越糟?

𝕏2026 年 7 月 19 日
📡

2011年的老剧居然精准预言了现在的AI难题

𝕏2026 年 6 月 29 日
📡

用正向数据训练AI,居然能整体变听话

𝕏2026 年 6 月 19 日
📡

一个非营利组织刚成立,专攻超级智能对齐

𝕏2026 年 6 月 11 日
📡

AI对情绪表达一律当危机处理

𝕏2026 年 5 月 18 日
📡

AI对齐训练营开招,不设专业门槛

𝕏2026 年 5 月 17 日
📡

一个命令,32项AI对齐诊断全搞定

𝕏2026 年 5 月 9 日
📡

AI像养青春期孩子,不是设计精密机器

𝕏2026 年 4 月 25 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新