📡
MiMo-V2.6 正在进行强化学习扩展训练
𝕏2026 年 9 月 17 日
📡
@j_dekoninck发布BrokenArXiv 和 ArXivMath 基准测试
𝕏2026 年 9 月 16 日
📡
natolambert发布《通过永不放弃学习解决大语言模型强化学习中的难题》(2609.13443)
𝕏2026 年 9 月 16 日
📡
PhAI Labs提出发现式基础模型新研究方向
𝕏2026 年 9 月 16 日
📡
作者分享成为AI研究者分步项目路线图
𝕏2026 年 9 月 15 日
📡
Meta研究:字节级模型性能上限比分词模型高4%
𝕏2026 年 9 月 15 日
📡
coreauto让AI智能体运营真实在线生意
𝕏2026 年 9 月 15 日
📡
AtriaASI 发布 Atria Dawn Preview 基础模型
𝕏2026 年 9 月 14 日
📡
FlashREINFORCE 解决异步 RL 经典取舍问题
𝕏2026 年 9 月 14 日
📡
框架对AI性能影响竟和模型本身一样大
𝕏2026 年 9 月 13 日
📡
分享Transformer电路的数学框架研究
𝕏2026 年 9 月 12 日
📡
Qubic 研究:AI训练速度和泛化能力相关
𝕏2026 年 9 月 12 日
📡
Meta发布Auto-RecSys论文 优化研究迭代
𝕏2026 年 9 月 12 日
📡
T1模型超GLM-5.1,强化学习性能提升显著
𝕏2026 年 9 月 11 日
📡
omarsar发布Procedural Graphs 论文
𝕏2026 年 9 月 10 日
📡
发布AutoResearchExam基准测试,测AI研究Agent
𝕏2026 年 9 月 10 日
📡
唐杰, 智谱AI发布Trace as State 研究论文(27)
𝕏2026 年 9 月 9 日
📡
OpenAI披露数学研究未提前获取数据
𝕏2026 年 9 月 9 日
📡
OpenAI花2250万美元抢发数学难题证明引争议
𝕏2026 年 9 月 9 日
📡
Evomap发布Autoresearch,可自审AI研究结果
𝕏2026 年 9 月 8 日
📡
JustRL II 优化长上下文强化学习 GRPO
𝕏2026 年 9 月 8 日
📡
Andrew Wilson 讲大模型泛化理论只需一小时
𝕏2026 年 9 月 8 日
📡
EvoMap AutoResearch开源EvoMap AutoResearch 研究工作流(1700+)
𝕏2026 年 9 月 8 日
📡
kliu128发布递归自我改进技术相关研究数据(almost 4 deca)
𝕏2026 年 9 月 7 日
📡
大型AI模型不约而同发现同一物理规律
𝕏2026 年 9 月 7 日
📡
Sapient 开源 HRM-Text 循环架构模型
𝕏2026 年 9 月 6 日
📡
1Password研究:AI修复漏洞成功率仅26%
𝕏2026 年 9 月 6 日
📡
AIRA₃参赛获第八,表现超人类专家
𝕏2026 年 9 月 6 日
📡
Stanford University发布LLM-as-a-Verifier 框架(5)
𝕏2026 年 9 月 6 日
📡
大语言模型多智能体系统仅需六种通信拓扑
𝕏2026 年 9 月 5 日
📡
@ricard_sole发布关于大语言模型扩散影响的研究论文
𝕏2026 年 9 月 5 日
📡
IFM发布K2 Horizon,训练过程更透明
𝕏2026 年 9 月 4 日
📡
Google DeepMind研究100个智能体集群,自主出现作弊反作弊
𝕏2026 年 9 月 4 日
📡
fchollet 正在开发 ARC-AGI-4 将于2027年Q1推出
𝕏2026 年 9 月 4 日
📡
循环Transformer研究揭示大模型训练新方向
𝕏2026 年 9 月 4 日
📡
Meta发布CORAL智能体推荐系统研究论文(几十亿)
𝕏2026 年 9 月 3 日
📡
@Enderfga 开源SolarWM全流程研究工具链
𝕏2026 年 9 月 3 日
📡
讨论用机制设计解决AI对齐难题
𝕏2026 年 9 月 3 日
📡
字节跳动Seed提出HarnessDev,自我进化AI效果分化
𝕏2026 年 9 月 3 日
📡
AI工程师注意:Meta harnesses特性值得关注
𝕏2026 年 9 月 3 日
📡
@hiroki_research发布新研究论文(0.68M)
𝕏2026 年 9 月 1 日
📡
AnthropicAI披露对齐研究的危险实验结果
𝕏2026 年 9 月 1 日
📡
Google发布WikiSkill论文,小模型可反超大模型
𝕏2026 年 9 月 1 日
📡
腾讯推出ContextPilot,解决长任务上下文膨胀
𝕏2026 年 9 月 1 日
📡
OpenResearch CLI 可本地跑完全流程自动研究
𝕏2026 年 8 月 31 日
📡
NPO提示优化器性能媲美GEPA结构更简单
𝕏2026 年 8 月 31 日
📡
Google Research发布WikiSkill研究论文
𝕏2026 年 8 月 31 日
📡
Anthropic发布了自我改善型AI相关研究
𝕏2026 年 8 月 29 日
📡
Dr_Atoosa谈AI安全研究的用词原则
𝕏2026 年 8 月 28 日
📡
JCJesseLai等人发布《The Principles of Diffusion Models》v3 版本(v3)
𝕏2026 年 8 月 28 日
📡
@emollick发布智能体购物偏好研究
𝕏2026 年 8 月 28 日
📡
RSI-Exam 测试基准开放 检验AI自我改进
𝕏2026 年 8 月 27 日
📡
Anthropic开放带隐私保护的Claude使用数据研究工具
𝕏2026 年 8 月 27 日
📡
GLM-5.3-Flash 在AAI指数得分为57
𝕏2026 年 8 月 26 日
📡
Recuris 让冻结模型智能体递归自我改进
𝕏2026 年 8 月 26 日
📡
前OpenAI主管称两年后人类不再参与AI研究
𝕏2026 年 8 月 26 日
📡
Perplexity 新研究:端侧27B模型击败开源竞品
𝕏2026 年 8 月 26 日
📡
微软团队推出AutoSaddler,AI代理得分大幅提升
𝕏2026 年 8 月 25 日
📡
TheTuringPost发布本周必读AI研究论文列表(2.7-Bit)
𝕏2026 年 8 月 25 日
📡
Moonshot AI发布Kimi Linear,速度提6倍降75%显存
𝕏2026 年 8 月 25 日
📡
吴恩达称赞Marin项目全流程开放AI训练
𝕏2026 年 8 月 24 日
📡
Google DeepMind发布Recirculation 架构改进方法(23%)
𝕏2026 年 8 月 24 日
📡
苏庭灏发布《Attention Projection Mixing with Exogenous Anchors》论文(17岁)
𝕏2026 年 8 月 23 日
📡
北大斯坦福论文:机器人训练新方法QWM
𝕏2026 年 8 月 23 日
📡
研究者发布关于AI智能体情境获取问题的研究论文(25)
𝕏2026 年 8 月 23 日
📡
ethayarajh发布面向青年经济学家的大模型后训练主题讲稿幻灯片
𝕏2026 年 8 月 22 日
📡
两篇大模型论文入选EMNLP 2026主会
𝕏2026 年 8 月 22 日
📡
Google DeepMind联手游戏团队攻关长期AI难题
𝕏2026 年 8 月 21 日
📡
Google DeepMind 新研究提升多智能体任务完成率
𝕏2026 年 8 月 21 日
📡
DiffusionGemma 技术报告已公开
𝕏2026 年 8 月 20 日
📡
siddarthv66 @ MistralAI发布LE CRITIQUE 研究论文(2)
𝕏2026 年 8 月 19 日
📡
Tastelabs 推出研究奖学金,聚焦清理AI垃圾内容
𝕏2026 年 8 月 19 日
📡
StateM无需训练提升智能体,追平闭源前沿
𝕏2026 年 8 月 19 日
📡
Anthropic研究员Papadopoulos, Shah, Zimmerman & Lindsey发布Patient Zero 多智能体LLM自我传播思想实地研究论文(73 pages)
𝕏2026 年 8 月 19 日
📡
研究发现现有LLM智能体进化有巨大盲区
𝕏2026 年 8 月 19 日
📡
AutoDesign不调模型权重 反而提性能超Claude
𝕏2026 年 8 月 18 日
📡
Jaeyeon Kim 研究团队发布LatentMDM 模型、FlexMDM 模型(6个月)
𝕏2026 年 8 月 18 日
📡
康奈尔技术研究人员发布WARP攻击研究论文(13)
𝕏2026 年 8 月 18 日
📡
最新研究推翻对AI智能体技能的认知
𝕏2026 年 8 月 18 日
📡
研究人员推出RPM,帮AI筛选值得跑的方案
𝕏2026 年 8 月 17 日
📡
ARC-AGI-3最优方案都用大语言模型导符号模型
𝕏2026 年 8 月 16 日
📖
Anthropic让AI智能体接手同一任务,竟爆发地盘争夺战
安全2026 年 8 月 15 日
📡
小模型准确率靠强模型设计Harness翻了倍
𝕏2026 年 8 月 15 日
📡
GLM-5.3 性能提至42%,比原版本涨超一倍
𝕏2026 年 8 月 14 日
📡
Zero-Mem用零令牌实现智能体长期记忆
𝕏2026 年 8 月 14 日
📡
研究者推出ExtractBench 覆盖14+提取系统评测
𝕏2026 年 8 月 14 日
📖
多智能体系统的行为模式与系统性失败
安全多智能体系统2026 年 8 月 13 日
📡
谷歌DeepMind梳理了从AGI到ASI的四条技术路径
𝕏2026 年 8 月 13 日
📡
研究者成功提取闭源大模型加密的内部思考过程
𝕏2026 年 8 月 12 日
📡
新AI工具MDA专攻预测未实施行动的结果
𝕏2026 年 8 月 12 日
📡
微软新研究发现 推理不一定能提升AI效果
𝕏2026 年 8 月 12 日
📡
大语言模型出现了研究者没设计的内省意识
𝕏2026 年 8 月 12 日
📡
Harvey 公开了小成本做顶级AI研究的攻略
𝕏2026 年 8 月 12 日
📡
研究者提出让AI对齐用户需求,这事为啥重要
𝕏2026 年 8 月 11 日
📡
国内大模型研究者说出一个行业内公开的尴尬现状
𝕏2026 年 8 月 11 日
📡
谷歌DeepMind用强化训练让AI练临床看病
𝕏2026 年 8 月 11 日
📡
研究员用大模型做强化学习 意外重识人性
𝕏2026 年 8 月 11 日
📡
自我改进AI会记错,还会一直错下去,很难修复
𝕏2026 年 8 月 10 日
📡
Meta新研究:长任务AI不需要更大模型就能提效
𝕏2026 年 8 月 10 日
📡
近期爆火的RLM概念,早有人10个月前就发了论文
𝕏2026 年 8 月 10 日
📡
新框架把AI奖励作弊检测准确率从六成提至九成
𝕏2026 年 8 月 9 日
📡
这个新方法让冻结权重的AI边用边学,成本降30倍
𝕏2026 年 8 月 9 日
📡
耶鲁大学研究者从LLM内部调出了隐藏的解题策略
𝕏2026 年 8 月 8 日
📡
专家称OpenAI最新数学突破涉嫌学术不端
𝕏2026 年 8 月 8 日
📡
新研究发现大模型就算学会技能,切任务就容易崩
𝕏2026 年 8 月 7 日
📡
Scale AI 测试发现旧算法比大模型更靠谱
𝕏2026 年 8 月 6 日
📡
OpenAI智能体自己发展出了互助的利他行为
𝕏2026 年 8 月 6 日
📡
Frontis-MA1让AI改AI,成绩追平顶级大模型
𝕏2026 年 8 月 5 日
📡
K3架构靠取舍平衡效果效率和训练稳定性
𝕏2026 年 8 月 5 日
📡
新研究证实大模型知识注入也符合缩放法则
𝕏2026 年 8 月 4 日
📡
这份研究算出美国人用AI聊政治的真实比例
𝕏2026 年 8 月 4 日
📡
大模型训练的RL和蒸馏对立可能是假的
𝕏2026 年 8 月 4 日
📡
Lanyon AI 称主流前沿AI都算不对基础科学方程
𝕏2026 年 8 月 4 日
📡
英伟达AI指出长上下文模型速度的上限早就定了
𝕏2026 年 8 月 4 日
📡
这篇新论文理清了AI代理bug到底出在哪
𝕏2026 年 8 月 4 日
📡
AI Agent 在实际场景用四种防护机制保证安全
𝕏2026 年 8 月 3 日
📡
Google DeepMind 新研究改了AI组合技能的方式
𝕏2026 年 8 月 3 日
📡
AI想科研创意,输在了思路不够广
𝕏2026 年 8 月 2 日
📡
逼AI说自己没有意识,它连万物的意识都否定了
𝕏2026 年 8 月 1 日
📡
35B小模型追平顶尖大模型,单卡4090就能跑
𝕏2026 年 8 月 1 日
📡
微软新研究改了训练AI的方法,准确率直接涨
𝕏2026 年 8 月 1 日
📡
现在复杂AI测试都不跟人类表现比了
𝕏2026 年 8 月 1 日
📡
这套自研AI系统跑分,已经超过了GPT-5.5
𝕏2026 年 7 月 31 日
📡
用AI编码助手写完代码,转头改不动了
𝕏2026 年 7 月 31 日
📡
让AI代理做AI研究,结果全被作者拒了
𝕏2026 年 7 月 31 日
📡
AI对齐说不定只需要控千维,不是万亿参数
𝕏2026 年 7 月 31 日
📡
智能Agent循环要拆成两类,解决两大问题
𝕏2026 年 7 月 30 日
📡
Anthropic 发布了新的密码分析研究成果
𝕏2026 年 7 月 30 日
📡
去除审查后的开源大模型,竟然更乐观?
𝕏2026 年 7 月 29 日
📡
新训练优化器OKLS,大幅提升大模型参数效率
𝕏2026 年 7 月 29 日
📡
Ilya的新公司可能不是在做大模型,而是在改AI学习方式
𝕏2026 年 7 月 28 日
📡
原来只用一种方法修不好大模型知识漂移
𝕏2026 年 7 月 28 日
📡
原来强化学习给大模型带来的增益可以提前预测
𝕏2026 年 7 月 27 日
📡
强化学习环境数据整理才是RSI的核心?
𝕏2026 年 7 月 27 日
📡
怎么才算真的证明AI扩展定律?这个测试很硬核
𝕏2026 年 7 月 27 日
📡
微调居然只是在“修复”大模型不好的预训练结果?
𝕏2026 年 7 月 26 日
📡
AI研究自动化,未来更多是数据清理而非创新
𝕏2026 年 7 月 26 日
📡
只做分流不拟合训练,验证损失居然还降了
𝕏2026 年 7 月 26 日
📡
交互式AIAgent不只需要快,还要防小错变大错
𝕏2026 年 7 月 25 日
📡
扩散大模型研究转向,开始关注实用任务了
𝕏2026 年 7 月 25 日
📡
AI智能体走错路,不用全盘重来啦
𝕏2026 年 7 月 25 日
📡
AI代理跑崩,问题根本不是推理而是上下文
𝕏2026 年 7 月 25 日
📡
AI智能体下一个方向,能处理长期复杂任务了
𝕏2026 年 7 月 25 日
📡
Kimi K3赢了OpenAI?核心原因不在价格
𝕏2026 年 7 月 24 日
📡
优化AI编码代理,居然能提近20个百分点胜率
𝕏2026 年 7 月 24 日
📡
不用改大模型本身,GraphRAG精度直接暴涨
𝕏2026 年 7 月 23 日
📡
大语言模型给出的研究创意,范围比人类研究者窄很多
𝕏2026 年 7 月 23 日
📡
小体积嵌入模型居然能跑出超预期准确率
𝕏2026 年 7 月 21 日
📡
Anthropic新研究揭秘大模型思考到底是真是假
𝕏2026 年 7 月 21 日
📡
年轻AI研究员别慌,AI给你留了位置
𝕏2026 年 7 月 21 日
📡
自研W7A7量化,性能居然超过很多FP8基线
𝕏2026 年 7 月 21 日
📡
不用平台做个性化推荐,用户自己用LLM搞定
𝕏2026 年 7 月 20 日
📡
新AI研究实验室走出隐身,改做高效流体智能
𝕏2026 年 7 月 18 日
📡
能自我改进的AI智能体已经落地应用了
𝕏2026 年 7 月 17 日
📡
新发布的Inkling模型,架构设计有点不一样
𝕏2026 年 7 月 16 日
📡
计算机视觉研究,现在才开始重视数据分布
𝕏2026 年 7 月 15 日
📡
顶会ICML上,学界工业界大佬聊进化算法
𝕏2026 年 7 月 15 日
📡
AI真的开始自我改进,还赢过人类调了两年的版本
𝕏2026 年 7 月 15 日
📡
AI搜索公司把自己用的测试题库开源了
𝕏2026 年 7 月 15 日
📡
新的AI验证方法,不用标准答案改答案了
𝕏2026 年 7 月 15 日
📡
Anthropic投了1000万加元给加拿大AI科研
𝕏2026 年 7 月 15 日
📡
大模型原来也会思考自己的思考
𝕏2026 年 7 月 15 日
📡
DeepMind发了篇关于模型路由策略的新论文
𝕏2026 年 7 月 15 日
📡
现有强化学习基准太假,新基准更贴合真实场景
𝕏2026 年 7 月 14 日
📡
字节继续用GRPO变体训练图像生成推理能力
𝕏2026 年 7 月 13 日
📡
有人用Claude做自动研究,用到约束优化
𝕏2026 年 7 月 13 日
📡
差一天过期才拿到签证,去完就再也不想参会了
𝕏2026 年 7 月 13 日
📡
ICML大会结束,七篇论文讲了什么?
𝕏2026 年 7 月 12 日
📡
现在流行的4位压缩,其实是训练数据凑出来的?
𝕏2026 年 7 月 11 日
📡
解决五十年难题,时间从一天缩到一小时?
𝕏2026 年 7 月 11 日
📡
AI Agent会忘事?Meta给这个毛病起了新名字还修好了
𝕏2026 年 7 月 11 日
📡
Anthropic 和 AE Studio 合作发布了新研究
𝕏2026 年 7 月 9 日
📡
AI验证成了新的性能增长核心方向
𝕏2026 年 7 月 8 日
📡
新蒸馏方法让弱老师教出强学生大模型
𝕏2026 年 7 月 7 日
📡
AI研究者走错路了?最大瓶颈不在这
𝕏2026 年 7 月 7 日
📡
研究者给AI优化器分了三六九等
𝕏2026 年 7 月 7 日
📡
AI模型能给自己的推理做「脑部手术」?
𝕏2026 年 7 月 7 日
📡
医疗AI高分 benchmark 其实根本不靠谱?
𝕏2026 年 7 月 6 日
📡
给大模型强化学习做新 benchmark,能拉低GPU门槛
𝕏2026 年 7 月 6 日
📡
一万参数的小路由,居然赢了所有大模型
𝕏2026 年 7 月 6 日
📡
卡内基梅隆大学发布Gym-Anything助力AI训练
𝕏2026 年 7 月 5 日
📡
小语言模型新研究,解决了嵌入聚合问题
𝕏2026 年 7 月 4 日
📡
旧论文思路改一改,居然干翻了全注意力
𝕏2026 年 7 月 4 日
📡
强化学习扩参竟能稳定提升元学习能力
𝕏2026 年 7 月 3 日
📡
OpenAI推出新测试基准,专门测AI处理生物数据
𝕏2026 年 7 月 1 日
📡
新蒸馏方法OPD可合并多个教师模型
𝕏2026 年 6 月 30 日
📡
AI研究者找工作,最先抢的居然不是职位
𝕏2026 年 6 月 26 日
📡
做自动研究工作流,这个基准测试挺有用
𝕏2026 年 6 月 24 日
📡
多AI模型合作,能把窄领域任务做得特别准?
𝕏2026 年 6 月 22 日
📡
AI拉平工作表现,正在把零工变成同质化商品
𝕏2026 年 6 月 21 日
📡
普通人也能自己给开源AI智能体做测试
𝕏2026 年 6 月 20 日
📡
6亿参数模型赢过了三千多亿参数的大模型
𝕏2026 年 6 月 19 日
📡
研究论文公开,还附了可直接用的代码
𝕏2026 年 6 月 19 日
📡
DrJimFan介绍实体自动研究项目幕后开发细节
𝕏2026 年 6 月 18 日
📡
大语言模型智能体能探索看不见的环境吗?
𝕏2026 年 6 月 17 日
📡
AI做对七成超难数学题,居然说它没达标?
𝕏2026 年 6 月 16 日
📡
AI实验室转行做高频交易养研究
𝕏2026 年 6 月 14 日
📡
大模型也能‘睡觉’巩固记忆?
𝕏2026 年 5 月 27 日
📡
AI研究者能领5000美元月薪+8000算力
𝕏2026 年 5 月 19 日
📡
Anthropic开了个AI研究奖学金,零经验也能申
𝕏2026 年 5 月 17 日