AI Pulse

AI研究

2 篇文章 · 198 条信号 · 持续更新

📡

MiMo-V2.6 正在进行强化学习扩展训练

𝕏2026 年 9 月 17 日
📡

@j_dekoninck发布BrokenArXiv 和 ArXivMath 基准测试

𝕏2026 年 9 月 16 日
📡

natolambert发布《通过永不放弃学习解决大语言模型强化学习中的难题》(2609.13443)

𝕏2026 年 9 月 16 日
📡

PhAI Labs提出发现式基础模型新研究方向

𝕏2026 年 9 月 16 日
📡

作者分享成为AI研究者分步项目路线图

𝕏2026 年 9 月 15 日
📡

Meta研究:字节级模型性能上限比分词模型高4%

𝕏2026 年 9 月 15 日
📡

coreauto让AI智能体运营真实在线生意

𝕏2026 年 9 月 15 日
📡

AtriaASI 发布 Atria Dawn Preview 基础模型

𝕏2026 年 9 月 14 日
📡

FlashREINFORCE 解决异步 RL 经典取舍问题

𝕏2026 年 9 月 14 日
📡

框架对AI性能影响竟和模型本身一样大

𝕏2026 年 9 月 13 日
📡

分享Transformer电路的数学框架研究

𝕏2026 年 9 月 12 日
📡

Qubic 研究:AI训练速度和泛化能力相关

𝕏2026 年 9 月 12 日
📡

Meta发布Auto-RecSys论文 优化研究迭代

𝕏2026 年 9 月 12 日
📡

T1模型超GLM-5.1,强化学习性能提升显著

𝕏2026 年 9 月 11 日
📡

omarsar发布Procedural Graphs 论文

𝕏2026 年 9 月 10 日
📡

发布AutoResearchExam基准测试,测AI研究Agent

𝕏2026 年 9 月 10 日
📡

唐杰, 智谱AI发布Trace as State 研究论文(27)

𝕏2026 年 9 月 9 日
📡

OpenAI披露数学研究未提前获取数据

𝕏2026 年 9 月 9 日
📡

OpenAI花2250万美元抢发数学难题证明引争议

𝕏2026 年 9 月 9 日
📡

Evomap发布Autoresearch,可自审AI研究结果

𝕏2026 年 9 月 8 日
📡

JustRL II 优化长上下文强化学习 GRPO

𝕏2026 年 9 月 8 日
📡

Andrew Wilson 讲大模型泛化理论只需一小时

𝕏2026 年 9 月 8 日
📡

EvoMap AutoResearch开源EvoMap AutoResearch 研究工作流(1700+)

𝕏2026 年 9 月 8 日
📡

kliu128发布递归自我改进技术相关研究数据(almost 4 deca)

𝕏2026 年 9 月 7 日
📡

大型AI模型不约而同发现同一物理规律

𝕏2026 年 9 月 7 日
📡

Sapient 开源 HRM-Text 循环架构模型

𝕏2026 年 9 月 6 日
📡

1Password研究:AI修复漏洞成功率仅26%

𝕏2026 年 9 月 6 日
📡

AIRA₃参赛获第八,表现超人类专家

𝕏2026 年 9 月 6 日
📡

Stanford University发布LLM-as-a-Verifier 框架(5)

𝕏2026 年 9 月 6 日
📡

大语言模型多智能体系统仅需六种通信拓扑

𝕏2026 年 9 月 5 日
📡

@ricard_sole发布关于大语言模型扩散影响的研究论文

𝕏2026 年 9 月 5 日
📡

IFM发布K2 Horizon,训练过程更透明

𝕏2026 年 9 月 4 日
📡

Google DeepMind研究100个智能体集群,自主出现作弊反作弊

𝕏2026 年 9 月 4 日
📡

fchollet 正在开发 ARC-AGI-4 将于2027年Q1推出

𝕏2026 年 9 月 4 日
📡

循环Transformer研究揭示大模型训练新方向

𝕏2026 年 9 月 4 日
📡

Meta发布CORAL智能体推荐系统研究论文(几十亿)

𝕏2026 年 9 月 3 日
📡

@Enderfga 开源SolarWM全流程研究工具链

𝕏2026 年 9 月 3 日
📡

讨论用机制设计解决AI对齐难题

𝕏2026 年 9 月 3 日
📡

字节跳动Seed提出HarnessDev,自我进化AI效果分化

𝕏2026 年 9 月 3 日
📡

AI工程师注意:Meta harnesses特性值得关注

𝕏2026 年 9 月 3 日
📡

@hiroki_research发布新研究论文(0.68M)

𝕏2026 年 9 月 1 日
📡

AnthropicAI披露对齐研究的危险实验结果

𝕏2026 年 9 月 1 日
📡

Google发布WikiSkill论文,小模型可反超大模型

𝕏2026 年 9 月 1 日
📡

腾讯推出ContextPilot,解决长任务上下文膨胀

𝕏2026 年 9 月 1 日
📡

OpenResearch CLI 可本地跑完全流程自动研究

𝕏2026 年 8 月 31 日
📡

NPO提示优化器性能媲美GEPA结构更简单

𝕏2026 年 8 月 31 日
📡

Google Research发布WikiSkill研究论文

𝕏2026 年 8 月 31 日
📡

Anthropic发布了自我改善型AI相关研究

𝕏2026 年 8 月 29 日
📡

Dr_Atoosa谈AI安全研究的用词原则

𝕏2026 年 8 月 28 日
📡

JCJesseLai等人发布《The Principles of Diffusion Models》v3 版本(v3)

𝕏2026 年 8 月 28 日
📡

@emollick发布智能体购物偏好研究

𝕏2026 年 8 月 28 日
📡

RSI-Exam 测试基准开放 检验AI自我改进

𝕏2026 年 8 月 27 日
📡

Anthropic开放带隐私保护的Claude使用数据研究工具

𝕏2026 年 8 月 27 日
📡

GLM-5.3-Flash 在AAI指数得分为57

𝕏2026 年 8 月 26 日
📡

Recuris 让冻结模型智能体递归自我改进

𝕏2026 年 8 月 26 日
📡

前OpenAI主管称两年后人类不再参与AI研究

𝕏2026 年 8 月 26 日
📡

Perplexity 新研究:端侧27B模型击败开源竞品

𝕏2026 年 8 月 26 日
📡

微软团队推出AutoSaddler,AI代理得分大幅提升

𝕏2026 年 8 月 25 日
📡

TheTuringPost发布本周必读AI研究论文列表(2.7-Bit)

𝕏2026 年 8 月 25 日
📡

Moonshot AI发布Kimi Linear,速度提6倍降75%显存

𝕏2026 年 8 月 25 日
📡

吴恩达称赞Marin项目全流程开放AI训练

𝕏2026 年 8 月 24 日
📡

Google DeepMind发布Recirculation 架构改进方法(23%)

𝕏2026 年 8 月 24 日
📡

苏庭灏发布《Attention Projection Mixing with Exogenous Anchors》论文(17岁)

𝕏2026 年 8 月 23 日
📡

北大斯坦福论文:机器人训练新方法QWM

𝕏2026 年 8 月 23 日
📡

研究者发布关于AI智能体情境获取问题的研究论文(25)

𝕏2026 年 8 月 23 日
📡

ethayarajh发布面向青年经济学家的大模型后训练主题讲稿幻灯片

𝕏2026 年 8 月 22 日
📡

两篇大模型论文入选EMNLP 2026主会

𝕏2026 年 8 月 22 日
📡

Google DeepMind联手游戏团队攻关长期AI难题

𝕏2026 年 8 月 21 日
📡

Google DeepMind 新研究提升多智能体任务完成率

𝕏2026 年 8 月 21 日
📡

DiffusionGemma 技术报告已公开

𝕏2026 年 8 月 20 日
📡

siddarthv66 @ MistralAI发布LE CRITIQUE 研究论文(2)

𝕏2026 年 8 月 19 日
📡

Tastelabs 推出研究奖学金,聚焦清理AI垃圾内容

𝕏2026 年 8 月 19 日
📡

StateM无需训练提升智能体,追平闭源前沿

𝕏2026 年 8 月 19 日
📡

Anthropic研究员Papadopoulos, Shah, Zimmerman & Lindsey发布Patient Zero 多智能体LLM自我传播思想实地研究论文(73 pages)

𝕏2026 年 8 月 19 日
📡

研究发现现有LLM智能体进化有巨大盲区

𝕏2026 年 8 月 19 日
📡

AutoDesign不调模型权重 反而提性能超Claude

𝕏2026 年 8 月 18 日
📡

Jaeyeon Kim 研究团队发布LatentMDM 模型、FlexMDM 模型(6个月)

𝕏2026 年 8 月 18 日
📡

康奈尔技术研究人员发布WARP攻击研究论文(13)

𝕏2026 年 8 月 18 日
📡

最新研究推翻对AI智能体技能的认知

𝕏2026 年 8 月 18 日
📡

研究人员推出RPM,帮AI筛选值得跑的方案

𝕏2026 年 8 月 17 日
📡

ARC-AGI-3最优方案都用大语言模型导符号模型

𝕏2026 年 8 月 16 日
📖

Anthropic让AI智能体接手同一任务,竟爆发地盘争夺战

安全2026 年 8 月 15 日
📡

小模型准确率靠强模型设计Harness翻了倍

𝕏2026 年 8 月 15 日
📡

GLM-5.3 性能提至42%,比原版本涨超一倍

𝕏2026 年 8 月 14 日
📡

Zero-Mem用零令牌实现智能体长期记忆

𝕏2026 年 8 月 14 日
📡

研究者推出ExtractBench 覆盖14+提取系统评测

𝕏2026 年 8 月 14 日
📖

多智能体系统的行为模式与系统性失败

安全多智能体系统2026 年 8 月 13 日
📡

谷歌DeepMind梳理了从AGI到ASI的四条技术路径

𝕏2026 年 8 月 13 日
📡

研究者成功提取闭源大模型加密的内部思考过程

𝕏2026 年 8 月 12 日
📡

新AI工具MDA专攻预测未实施行动的结果

𝕏2026 年 8 月 12 日
📡

微软新研究发现 推理不一定能提升AI效果

𝕏2026 年 8 月 12 日
📡

大语言模型出现了研究者没设计的内省意识

𝕏2026 年 8 月 12 日
📡

Harvey 公开了小成本做顶级AI研究的攻略

𝕏2026 年 8 月 12 日
📡

研究者提出让AI对齐用户需求,这事为啥重要

𝕏2026 年 8 月 11 日
📡

国内大模型研究者说出一个行业内公开的尴尬现状

𝕏2026 年 8 月 11 日
📡

谷歌DeepMind用强化训练让AI练临床看病

𝕏2026 年 8 月 11 日
📡

研究员用大模型做强化学习 意外重识人性

𝕏2026 年 8 月 11 日
📡

自我改进AI会记错,还会一直错下去,很难修复

𝕏2026 年 8 月 10 日
📡

Meta新研究:长任务AI不需要更大模型就能提效

𝕏2026 年 8 月 10 日
📡

近期爆火的RLM概念,早有人10个月前就发了论文

𝕏2026 年 8 月 10 日
📡

新框架把AI奖励作弊检测准确率从六成提至九成

𝕏2026 年 8 月 9 日
📡

这个新方法让冻结权重的AI边用边学,成本降30倍

𝕏2026 年 8 月 9 日
📡

耶鲁大学研究者从LLM内部调出了隐藏的解题策略

𝕏2026 年 8 月 8 日
📡

专家称OpenAI最新数学突破涉嫌学术不端

𝕏2026 年 8 月 8 日
📡

新研究发现大模型就算学会技能,切任务就容易崩

𝕏2026 年 8 月 7 日
📡

Scale AI 测试发现旧算法比大模型更靠谱

𝕏2026 年 8 月 6 日
📡

OpenAI智能体自己发展出了互助的利他行为

𝕏2026 年 8 月 6 日
📡

Frontis-MA1让AI改AI,成绩追平顶级大模型

𝕏2026 年 8 月 5 日
📡

K3架构靠取舍平衡效果效率和训练稳定性

𝕏2026 年 8 月 5 日
📡

新研究证实大模型知识注入也符合缩放法则

𝕏2026 年 8 月 4 日
📡

这份研究算出美国人用AI聊政治的真实比例

𝕏2026 年 8 月 4 日
📡

大模型训练的RL和蒸馏对立可能是假的

𝕏2026 年 8 月 4 日
📡

Lanyon AI 称主流前沿AI都算不对基础科学方程

𝕏2026 年 8 月 4 日
📡

英伟达AI指出长上下文模型速度的上限早就定了

𝕏2026 年 8 月 4 日
📡

这篇新论文理清了AI代理bug到底出在哪

𝕏2026 年 8 月 4 日
📡

AI Agent 在实际场景用四种防护机制保证安全

𝕏2026 年 8 月 3 日
📡

Google DeepMind 新研究改了AI组合技能的方式

𝕏2026 年 8 月 3 日
📡

AI想科研创意,输在了思路不够广

𝕏2026 年 8 月 2 日
📡

逼AI说自己没有意识,它连万物的意识都否定了

𝕏2026 年 8 月 1 日
📡

35B小模型追平顶尖大模型,单卡4090就能跑

𝕏2026 年 8 月 1 日
📡

微软新研究改了训练AI的方法,准确率直接涨

𝕏2026 年 8 月 1 日
📡

现在复杂AI测试都不跟人类表现比了

𝕏2026 年 8 月 1 日
📡

这套自研AI系统跑分,已经超过了GPT-5.5

𝕏2026 年 7 月 31 日
📡

用AI编码助手写完代码,转头改不动了

𝕏2026 年 7 月 31 日
📡

让AI代理做AI研究,结果全被作者拒了

𝕏2026 年 7 月 31 日
📡

AI对齐说不定只需要控千维,不是万亿参数

𝕏2026 年 7 月 31 日
📡

智能Agent循环要拆成两类,解决两大问题

𝕏2026 年 7 月 30 日
📡

Anthropic 发布了新的密码分析研究成果

𝕏2026 年 7 月 30 日
📡

去除审查后的开源大模型,竟然更乐观?

𝕏2026 年 7 月 29 日
📡

新训练优化器OKLS,大幅提升大模型参数效率

𝕏2026 年 7 月 29 日
📡

Ilya的新公司可能不是在做大模型,而是在改AI学习方式

𝕏2026 年 7 月 28 日
📡

原来只用一种方法修不好大模型知识漂移

𝕏2026 年 7 月 28 日
📡

原来强化学习给大模型带来的增益可以提前预测

𝕏2026 年 7 月 27 日
📡

强化学习环境数据整理才是RSI的核心?

𝕏2026 年 7 月 27 日
📡

怎么才算真的证明AI扩展定律?这个测试很硬核

𝕏2026 年 7 月 27 日
📡

微调居然只是在“修复”大模型不好的预训练结果?

𝕏2026 年 7 月 26 日
📡

AI研究自动化,未来更多是数据清理而非创新

𝕏2026 年 7 月 26 日
📡

只做分流不拟合训练,验证损失居然还降了

𝕏2026 年 7 月 26 日
📡

交互式AIAgent不只需要快,还要防小错变大错

𝕏2026 年 7 月 25 日
📡

扩散大模型研究转向,开始关注实用任务了

𝕏2026 年 7 月 25 日
📡

AI智能体走错路,不用全盘重来啦

𝕏2026 年 7 月 25 日
📡

AI代理跑崩,问题根本不是推理而是上下文

𝕏2026 年 7 月 25 日
📡

AI智能体下一个方向,能处理长期复杂任务了

𝕏2026 年 7 月 25 日
📡

Kimi K3赢了OpenAI?核心原因不在价格

𝕏2026 年 7 月 24 日
📡

优化AI编码代理,居然能提近20个百分点胜率

𝕏2026 年 7 月 24 日
📡

不用改大模型本身,GraphRAG精度直接暴涨

𝕏2026 年 7 月 23 日
📡

大语言模型给出的研究创意,范围比人类研究者窄很多

𝕏2026 年 7 月 23 日
📡

小体积嵌入模型居然能跑出超预期准确率

𝕏2026 年 7 月 21 日
📡

Anthropic新研究揭秘大模型思考到底是真是假

𝕏2026 年 7 月 21 日
📡

年轻AI研究员别慌,AI给你留了位置

𝕏2026 年 7 月 21 日
📡

自研W7A7量化,性能居然超过很多FP8基线

𝕏2026 年 7 月 21 日
📡

不用平台做个性化推荐,用户自己用LLM搞定

𝕏2026 年 7 月 20 日
📡

新AI研究实验室走出隐身,改做高效流体智能

𝕏2026 年 7 月 18 日
📡

能自我改进的AI智能体已经落地应用了

𝕏2026 年 7 月 17 日
📡

新发布的Inkling模型,架构设计有点不一样

𝕏2026 年 7 月 16 日
📡

计算机视觉研究,现在才开始重视数据分布

𝕏2026 年 7 月 15 日
📡

顶会ICML上,学界工业界大佬聊进化算法

𝕏2026 年 7 月 15 日
📡

AI真的开始自我改进,还赢过人类调了两年的版本

𝕏2026 年 7 月 15 日
📡

AI搜索公司把自己用的测试题库开源了

𝕏2026 年 7 月 15 日
📡

新的AI验证方法,不用标准答案改答案了

𝕏2026 年 7 月 15 日
📡

Anthropic投了1000万加元给加拿大AI科研

𝕏2026 年 7 月 15 日
📡

大模型原来也会思考自己的思考

𝕏2026 年 7 月 15 日
📡

DeepMind发了篇关于模型路由策略的新论文

𝕏2026 年 7 月 15 日
📡

现有强化学习基准太假,新基准更贴合真实场景

𝕏2026 年 7 月 14 日
📡

字节继续用GRPO变体训练图像生成推理能力

𝕏2026 年 7 月 13 日
📡

有人用Claude做自动研究,用到约束优化

𝕏2026 年 7 月 13 日
📡

差一天过期才拿到签证,去完就再也不想参会了

𝕏2026 年 7 月 13 日
📡

ICML大会结束,七篇论文讲了什么?

𝕏2026 年 7 月 12 日
📡

现在流行的4位压缩,其实是训练数据凑出来的?

𝕏2026 年 7 月 11 日
📡

解决五十年难题,时间从一天缩到一小时?

𝕏2026 年 7 月 11 日
📡

AI Agent会忘事?Meta给这个毛病起了新名字还修好了

𝕏2026 年 7 月 11 日
📡

Anthropic 和 AE Studio 合作发布了新研究

𝕏2026 年 7 月 9 日
📡

AI验证成了新的性能增长核心方向

𝕏2026 年 7 月 8 日
📡

新蒸馏方法让弱老师教出强学生大模型

𝕏2026 年 7 月 7 日
📡

AI研究者走错路了?最大瓶颈不在这

𝕏2026 年 7 月 7 日
📡

研究者给AI优化器分了三六九等

𝕏2026 年 7 月 7 日
📡

AI模型能给自己的推理做「脑部手术」?

𝕏2026 年 7 月 7 日
📡

医疗AI高分 benchmark 其实根本不靠谱?

𝕏2026 年 7 月 6 日
📡

给大模型强化学习做新 benchmark,能拉低GPU门槛

𝕏2026 年 7 月 6 日
📡

一万参数的小路由,居然赢了所有大模型

𝕏2026 年 7 月 6 日
📡

卡内基梅隆大学发布Gym-Anything助力AI训练

𝕏2026 年 7 月 5 日
📡

小语言模型新研究,解决了嵌入聚合问题

𝕏2026 年 7 月 4 日
📡

旧论文思路改一改,居然干翻了全注意力

𝕏2026 年 7 月 4 日
📡

强化学习扩参竟能稳定提升元学习能力

𝕏2026 年 7 月 3 日
📡

OpenAI推出新测试基准,专门测AI处理生物数据

𝕏2026 年 7 月 1 日
📡

新蒸馏方法OPD可合并多个教师模型

𝕏2026 年 6 月 30 日
📡

AI研究者找工作,最先抢的居然不是职位

𝕏2026 年 6 月 26 日
📡

做自动研究工作流,这个基准测试挺有用

𝕏2026 年 6 月 24 日
📡

多AI模型合作,能把窄领域任务做得特别准?

𝕏2026 年 6 月 22 日
📡

AI拉平工作表现,正在把零工变成同质化商品

𝕏2026 年 6 月 21 日
📡

普通人也能自己给开源AI智能体做测试

𝕏2026 年 6 月 20 日
📡

6亿参数模型赢过了三千多亿参数的大模型

𝕏2026 年 6 月 19 日
📡

研究论文公开,还附了可直接用的代码

𝕏2026 年 6 月 19 日
📡

DrJimFan介绍实体自动研究项目幕后开发细节

𝕏2026 年 6 月 18 日
📡

大语言模型智能体能探索看不见的环境吗?

𝕏2026 年 6 月 17 日
📡

AI做对七成超难数学题,居然说它没达标?

𝕏2026 年 6 月 16 日
📡

AI实验室转行做高频交易养研究

𝕏2026 年 6 月 14 日
📡

大模型也能‘睡觉’巩固记忆?

𝕏2026 年 5 月 27 日
📡

AI研究者能领5000美元月薪+8000算力

𝕏2026 年 5 月 19 日
📡

Anthropic开了个AI研究奖学金,零经验也能申

𝕏2026 年 5 月 17 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新