一位开发者:为AI智能体构建工具,多数会失败
三个理由:智能体与人类用同一套工具、现有工具训练数据占优、理想交互方式未知
2026 年 9 月 12 日
seangoedecke.com
AI软件开发
开发者用自家WhatsApp群聊在M1 Pro上训练2B小模型,真人赢下80%对局
GitHub cookbook 公开了可复现流程与测试结果:耗时数月,只用土耳其语测试,效果有趣但连贯不足
2026 年 9 月 12 日
Reddit r/LocalLLaMA
AI大语言模型开源
Astra需求过高,OpenAI暂停月费200美元的Pro新订阅
Sottiaux在X上宣布,老Pro用户不受影响,Go、Plus及API计划照常开放。
2026 年 9 月 12 日
TechCrunch
AI商业OpenAI
AI几年内当上远程员工,自己训练自己还得更久
AI研究员提效十倍需多久?Schulman说两年,O'Neill说五到十年。
2026 年 9 月 12 日
Dwarkesh Podcast
AI研究递归自我改进
Anthropic测试发现:AI已能协助定位人员、编写武器代码
照片定位中位误差37公里,模拟命中停放车辆率80%;开放权重模型落后但仍令人担忧。
2026 年 9 月 12 日
www.anthropic.com
AI安全军事AI模型能力评估
GLM-OCR仅0.9B参数,开源拿下文档理解基准第一
OmniDocBench V1.5得分94.62排名第一,PDF吞吐1.86页/秒,模型与SDK开源,模型本体MIT许可。
2026 年 9 月 12 日
huggingface.co
AI开源OCR
OpenAI 为超10亿ChatGPT用户扩容在线存储平台Habitat
OpenAI官方技术博客,介绍Habitat从Python库到分布式存储平台的演进
2026 年 9 月 12 日
OpenAI
AI工程存储
Anthropic研究员AI末日警告传出时 正筹备IPO
TechCrunch Equity播客分析该警告及本周科技圈热点
2026 年 9 月 12 日
TechCrunch
AI行业动态商业
OpenRouter自动路由有隐患:同一模型在不同提供商行为可能不同
不同提供商服务软件与优化各异,视觉、推理努力选项处理不一,可用provider.only指定。
2026 年 9 月 12 日
Simon Willison’s Weblog
AIAPI大语言模型
AI工程师的活儿变了:不等人给需求,自己定方向
DeepLearning.AI:驱动循环、产品决策、沟通领导、高主动性四大技能
2026 年 9 月 12 日
𝕏 @AndrewYNg
AI工程
Anthropic发布AI对劳动力市场影响的三种模拟场景
极端场景下认知失业率达17.9%,内容来自Reddit人工智能板块
2026 年 9 月 11 日
Reddit r/artificial
AI劳动力市场行业研究
OpenAI付费用户选择退出训练后仍会被使用交互数据
该讨论发布于Reddit r/LocalLLaMA板块,用户指出OpenAI服务条款漏洞
2026 年 9 月 11 日
Reddit r/LocalLLaMA
AI商业安全