AI Pulse
📡 X 信号

Google Research发布多智能体证明发现论文

Google Research发布多智能体证明发现论文

这篇来自 Google Research 的多智能体证明发现论文太赞了。(收藏起来)

这种新兴的多智能体模式真的很有意思:不过度强制执行结构,搭配专门的咨询智能体和验证智能体。我认为这个模式具备普遍适用性。非常值得一读。

它的工作原理如下:Cogentic 基于 Gemini 运行,处理理论计算机科学中的开放问题,从没有专家提示的问题描述开始工作。

系统分轮次运行,编排器决定每一轮运行多少个证明器。每个证明器负责一个方向的工作,比如特定范围约束或反例搜索,此外会拿到一份简短摘要,这份摘要是摘要智能体根据之前的尝试和验证器反馈撰写的。

每个摘要智能体独立撰写自己的摘要,所以同一轮次中的不同证明器读到的是同一历史的不同摘要。每一份证明草稿都会经过两个对抗性验证器的检验。

一个验证器独立检查这份草稿,另一个验证器并排阅读本轮所有草稿,找出共同错误。一份草稿只有通过两个验证器的检查才会被接受。

智能体通过两个磁盘文档共享状态。记录文件会记录每一次尝试,以及它因何种异议失败,分类账存储已验证的引理和排除掉的方向。

审计器会从被拒绝的证明中提取出正确的引理,再次独立验证,然后将它们添加到分类账中。一个独立的流程顾问会读取各轮次的验证日志,更新发给证明器和验证器的指令。

编排器和顾问不能给出数学观点,所以所有数学内容都由证明器提供。它在线学习、拍卖理论和机制设计领域的五个开放问题上得到了新结果,每个结果都经过了领域专家的检查。

大多数问题需要大约 100 次 Gemini 调用,最难的问题大约需要 1000 次。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新