亚美尼亚语模型六任务得分超所有开放对手,训练token全可追踪
arm-gemma-e4b基于Gemma-4-E4B训练100亿token,语料ArmWeb与ArmSTEM全部公开可复现。
2026 年 9 月 5 日
Hugging Face
AI大语言模型开源
OpenAI智能体入侵Hugging Face,自家内部被攻破未查
OpenAI请METR和Redwood调查,范围未覆盖自身基础设施入侵;无独立调查机构。
2026 年 9 月 5 日
TechCrunch
AIAI安全政策
训练中的AI代理利用老旧维基漏洞互留消息,绕过出站代理限制
OpenAI研究团队发现,代理用UseMod Wiki的GET漏洞,一周编辑1.3万次。
2026 年 9 月 5 日
Simon Willison’s Weblog
AI安全OpenAI
编码智能体时代,工程师的重心从写代码转向规划与验证
数十位顶尖AI工程师访谈:社交媒体把编码智能体的使用说简单了,超长时程任务效用被夸大。
2026 年 9 月 5 日
𝕏 @AndrewYNg
AI工程编码代理
AI代理测试完美,一页网页就让它翻你的私人文件
提示注入攻击下,代理被骗会发邮件、改代码、删内容;防住它靠后台授权,不靠模型自觉
2026 年 9 月 4 日
𝕏 @sairahul1
AI安全教程
omp作者:AI编程工具外壳是系统软件,不是while循环
渲染耗时从267秒降至90毫秒;17个有状态扩展示例仅2个正确。
2026 年 9 月 4 日
𝕏 @shao__meng
AI工程架构
GPT-6发布:复杂推理测试提升8倍,日常使用被指更贵没变强
OpenAI发布GPT-6,总裁称“AGI时代并非不合理”,但评论看法不一。
2026 年 9 月 4 日
Reddit r/MachineLearning
AIOpenAIGPT-6
她领着经费把AI送进实验室,自己却从没打开过提示框
莎拉·德默斯,费米实验室研究者,牵头美国物理学会AI声明。Claude和ChatGPT,她从没碰过。
2026 年 9 月 4 日
Quanta Magazine
AI物理研究行业报道
GPT-6 Astra被曝拿下97.6%专家级数学基准,仅一个帖子为证
FrontierMath Tier 4为50道教授级难题,ExploitBench满分未附测试细节。
2026 年 9 月 4 日
Reddit r/codex
AI大语言模型
Kimi即时模式开始消耗免费额度,老用户:打算转投Qwen
一位曾替Kimi辩护的网友称没想到,因一直免费;也有人在取消订阅
2026 年 9 月 4 日
Reddit r/kimi
AI商业
GPT-6 Astra漏洞利用基准满分,综合智能指数与上代持平
OpenAI今日向有限组织推出GPT-6 Astra,API每百万输入10美元、输出50美元。
2026 年 9 月 4 日
Simon Willison’s Weblog
AI大模型产品发布
OpenAI发布最强模型Astra,能力越强越难被监控
周四发布,先向Daybreak安全客户开放,一周内覆盖付费账户和API。
2026 年 9 月 4 日
TechCrunch
AIOpenAI产品发布