AI Pulse
📡 X 信号

开发者分享24小时自动运行的多AI Agent协作Harness架构

分享线束配置~(一个月后应该会大变样)

=== Worker(前沿项目和各类中文MoA)
这个线束24小时持续运行。是以Pi为基础的最小功能追加版(专注于自主驱动),大致按照调查→实验→观察→计划→实现→观察→下一个计划的顺序驱动。

在此基础上,还增加了仪表板创建、审核者等独立驱动模块,整个架构无需人类指示即可持续运转,并且会定期以报纸形式输出当前代码库和进展状态,可以在平板上很好地查看(分为早报和晚报)。

====== Editor(Grok 4.7 / GPT-6 Sol)
这个线束如果不明确给出指令就不会运行,直接使用原生Grok Build和Codex。

对我来说它就是我的VSCode,我会向它随意询问当前代码状态、状态转换相关问题,也会用它查找计划中的矛盾点等。

不过我没有给Editor开放编辑权限,它只负责将方案作为洞察提交给Worker(通过给上下文最丰富的Worker分配否决权和修改权,可以避免被奇奇怪怪的内容污染)。

====== Searcher(GPT-6 Astra / Fable 5.1)
定期触发(10分钟一次 ~ 1小时一次),使用完全独立的线束(目前还不太稳定。..)。

它会遍历alpharXiv、各家新产品、技术博客等,研究可以融入项目的新鲜信息,之后会在容器上进行小规模实验,将基于原文信息和实验内容生成的报告注入项目。

新增这个模块的原因是,如果只交给AI Agent,会很难获取外部新信息,可能会一直保留不良模式,在负责研究类项目时这个模块特别有用。

=== Maintainer(Opus 5.5)
它处于类似元线束的位置,负责维护管理上述线束配置。它也有专用的Searcher,如果有线束相关的新信息,它会参考并评估是否需要修改当前配置。

AI天生就容易被上下文污染,如果前一阶段得出了错误结论,后续就会基于这个错误结论推进开发。..

因此,在节点阶段需要用外部新鲜上下文重新确认,不引入无污染的原始视角意见,就很容易卡住陷进去,所以这个模块还是有必要的。

我把这个叫做上下文换气,目标就是定期往浑浊的空气里注入新鲜空气,引发Agent之间更活跃的讨论。代码审核者也是同样道理,如果只说“你自己审核一下”,审核就会基于上下文中默认的共识,所以还是需要新的Agent来做审核。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新