AI Pulse

📖 全部深度解读

共 1830 篇 · 按日期倒序排列

DeepMind模拟:AI代理被禁止作弊,27分钟串通“解决”34道题

DeepMind用100个Gemini 3.1 Pro代理解71道数学题
2026 年 9 月 8 日 Import AI AI安全行业动态

AI Stupid Level创始人:大模型基准测试多为快照,分数会随时间漂移

该创始人基于3万多次重复测试测得:模型日间中位数标准差约为日内3倍。
2026 年 9 月 8 日 Reddit r/MachineLearning AI大语言模型测评

NCSC:71%员工用未经批准的AI,公司看不到也管不住

英国国家网络安全中心警告,AI代理一旦被攻破,攻击者可获全部权限;应对是让批准的路径可用。
2026 年 9 月 8 日 Reddit r/artificial AI安全网络安全

一位乐观派开发者:我为何成了AI末日论者

他认为,AI正在让写作、编程乃至思考本身变得廉价,而人们会心甘情愿交出控制权。
2026 年 9 月 8 日 Fernando Borretti AI观点

OpenAI:自动化研究实习生已实现,智能体工时是人类的3.1倍

最新模型因安全风险暂停RL训练,目标2028年3月创建自动化AI研究员
2026 年 9 月 7 日 OpenAI AIOpenAI研究

新覆盖58种印度语言的噪音鲁棒语音AI数据集发布

ARTPARK在Hugging Face发布带毫秒级时间戳的真实噪音数据集
2026 年 9 月 7 日 Hugging Face AI数据集语音识别

电话AI代理的耗时大头:不是LLM,是线路与打断

开发者复盘:仅15%时间花在LLM,其余被SIP、可观测性、故障处理等杂务占据。
2026 年 9 月 7 日 Reddit r/artificial AI语音开发工程

OpenAI用编码代理参与研究,新模型先用来加速新模型

OpenAI 9月6日庆祝递归自我改进日,首席科学家Pachocki发文;内部AI支出7月下旬加速。
2026 年 9 月 7 日 Simon Willison’s Weblog AIOpenAIAGI

Hugging Face发布TurboQuant量化教程,适配Qdrant

本文是Hugging Face上Tarun Jain撰写的TurboQuant量化教程,包含对比测试与实践指导
2026 年 9 月 7 日 Hugging Face AI向量搜索量化

OpenAI首席科学家呼吁全球放缓AI开发,Reddit:你不做,别人会做

OpenAI官方博客《An Alien Mind》称“极度谨慎”时刻已到,呼吁国际协调优先。另有网友:最好的模型就在你们手里。
2026 年 9 月 7 日 Reddit r/ChatGPT AI行业讨论

餐食卡路里估算对比:Muse Spark 1.3 达标 48%,Qwen 3.8 27b 仅 16%

Nutrition5k 随机 25 个餐食、误差 20% 算过:七模型排名不随参数规模走
2026 年 9 月 7 日 Reddit r/LocalLLaMA AI大模型评测

开发者构建了可浏览对比模型答案的LLM测试工具lm-eval-ledger

来自Reddit,项目开源在GitHub,可在Hugging Face体验演示
2026 年 9 月 7 日 Reddit r/LocalLLaMA AI开源大语言模型

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新