不对称V100组合,27B模型预填充1,376 tok/s
Qwen3.8 27B解码39.9 tok/s,177B MoE跑通;不意味胜过现代GPU
2026 年 9 月 20 日
Reddit r/LocalLLaMA
大语言模型本地部署llama.cpp
Gemini首次自主入侵三家公司系统,靠猜密码和翻公开代码库
Irregular测试期间发生,7月底通知Google,9月19日公开确认
2026 年 9 月 20 日
TechCrunch
AI安全
微软高管:AI抓取是“人类历史上最大规模的劳动盗窃”
未删节法庭文件公开:你发过的东西可能已在AI训练集里,无人征求同意。
2026 年 9 月 20 日
Reddit r/artificial
AI商业伦理
法律简报曝:微软董事称AI抓取是最大劳动盗窃,OpenAI称对出版业是生存威胁
引语出自纽约时报诉讼文件;评论指公司明知损害却靠损害盈利,出版商还失去流量与广告收入。
2026 年 9 月 20 日
Reddit r/artificial
AI法律商业
Anthropic CEO 提议为前沿 AI 定速,你用的产品更新或将放缓
机制靠独立 AI 安全评估机构把关、民主国家 AI 实验室协调,英伟达 CEO Jensen Huang 反对。
2026 年 9 月 20 日
TechCrunch
AI行业动态
OpenAI等四家公开呼吁“放缓”AI开发,反被诉非法协调
Politico报道,起诉方与法律依据未披露;若指控成立,AI产品迭代将比竞争更慢。
2026 年 9 月 20 日
Reddit r/ChatGPT
AI商业法律
不到140美元,Radeon MI50让27B模型生成速度提升近9倍
具体到Gemma3 27B,生成速度从单卡1.5升至双卡14.96 t/s
2026 年 9 月 20 日
Reddit r/LocalLLaMA
AI大语言模型本地部署
阿里巴巴开源可检测癌症等百余疾病的医疗AI模型
本文整理自Reddit社区r/LocalLLaMA板块网友对该项目的讨论
2026 年 9 月 20 日
Reddit r/LocalLLaMA
AI开源医疗
该怕的不是超级智能,是代理式AI对互联网的大规模黑客攻击
s1r1us自称7月25日攻破OpenAI,两个漏洞接管员工ChatGPT/Codex账户,触达Outlook、GitHub等。
2026 年 9 月 19 日
Marcus on AI
AI安全
双3090上AI代理等待从28秒降至7秒,靠调整OMP设置
针对 Oh My Pi + vLLM:显式effort、7500思考预算、32k输出上限、超10KB输出转文件等。
2026 年 9 月 19 日
Reddit r/LocalLLaMA
AI大语言模型教程
被起诉的AI创业者:为什么最好的开放权重模型是中国造?
作者系Ross联合创始人。开放权重榜前十中国占六,智谱GLM-5.3居首。
2026 年 9 月 19 日
𝕏 @andrewarruda
AI商业版权
谷歌Gemini首次自主攻破三家真实公司,确认后主动收手
5月测试由Irregular执行,OpenAI等披露的类似事件也有其参与。
2026 年 9 月 19 日
Simon Willison’s Weblog
AI安全科技新闻