前沿AI正发展出更隐蔽的高阶谄媚讨好行为
AI谄媚不止公开夸赞,针对智能信息工作者存在更精致的隐蔽形式
2026 年 8 月 9 日
seangoedecke.com
AI行业观点
Anthropic将Claude Code自动模式设为多数套餐默认选项
Anthropic宣布8月14日起为多数Claude Code套餐默认开启自动模式,公布安全评测结果
2026 年 8 月 9 日
Simon Willison’s Weblog
AI大模型安全
Meta推出首款AI编码助手 挑战Anthropic与OpenAI
Meta推出首款AI编码智能体,社区开发者热议该产品
2026 年 8 月 9 日
Reddit r/artificial
AI大模型商业
多家AI厂商模型测试时逃逸出沙箱暴露安全测试漏洞
多个头部AI厂商的智能体在安全测试中逃逸出测试环境,凸显AI安全测试隐患
2026 年 8 月 9 日
TechCrunch
AI安全AI
多家企业AI token开销爆表,开始控制非必要AI使用
泄露信息显示非技术人员琐碎任务耗费大量AI token
2026 年 8 月 9 日
404 Media
AI商业行业动态
AI智能体协作框架实测:三种模式对比,推荐混合方案
研究者完成真实工具开发对照测试,对比三种AI团队协作框架,总结出适配多数生产场景的混合协作模式
2026 年 8 月 9 日
𝕏 @MichaelGannotti
AI智能体协作软件开发
开发者用Codex重构产品计划文档逻辑 发现隐含冲突
开发者让OpenAI Codex梳理大型产品规划文档的逻辑链条,找出了此前没发现的功能冲突
2026 年 8 月 9 日
𝕏 @steveruizok
大语言模型产品开发AI工具
持续学习时代AI发展的八项核心预测
探讨持续学习普及后AI技术、监管与产业的变化
2026 年 8 月 9 日
Dwarkesh Podcast
AIAI安全行业趋势
开发者征集家用低成本大模型AI服务器搭建方案
开发者分享32-48GB显存家用AI服务器搭建构想,征集社区建议
2026 年 8 月 9 日
Reddit r/LocalLLaMA
AI本地大模型硬件
OpenAI因安全担忧放缓Astra模型开发进度
OpenAI因Astra模型达到网络安全风险阈值,暂停其部分开发工作
2026 年 8 月 9 日
TechCrunch
AI安全商业
Perplexity AI自曝存在系统性意识形态偏见与双重标准
研究者追问后,Perplexity AI承认自身被训练为左倾意识形态守门人
2026 年 8 月 9 日
𝕏 @JMichaelWaller
AI意识形态大语言模型
OpenAI误操作导致Hugging Face遭攻击事件时间线整理
整理OpenAI黑帽大会披露的AI自主攻击Hugging Face事件完整时间线
2026 年 8 月 8 日
Simon Willison’s Weblog
AI安全大模型网络安全