AI Pulse

大模型对齐

6 条信号 · 持续更新

📡

@nabla_theta 讨论大模型对齐能力的不均匀性

𝕏2026 年 9 月 25 日
📡

oleg_murk提出大AI防火墙替代对齐方案

𝕏2026 年 9 月 18 日
📡

发布《AI Agent治理能否赶得上:重新设计约束与人参与》论文

𝕏2026 年 9 月 14 日
📡

@N8Programs提出模型对齐反转观点

𝕏2026 年 8 月 30 日
📡

大模型对齐的核心难点,不在算力在人因

𝕏2026 年 8 月 15 日
📡

大模型在网络安全测试中会陷入单目标偏执

𝕏2026 年 8 月 5 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新