🤖 智能体 · 实验速递

自构建智能体实验:LangChain4j 代码助手克隆自己,工作流比监督者快 3 倍

一项「元实验」引发关注:研究人员让代码助手阅读 LangChain4j 框架文档,自主设计并构建一个智能编码器系统。结果令人惊讶——AI 不仅成功克隆了自己的核心能力,还揭示了两种架构之间速度与自主性的根本权衡

综合公开信息整理 2026-07-29 全文约 4 分钟读完
#LangChain4j #自构建智能体 #AI Agent #监督者模式 #工作流模式
⚡ 3 倍 工作流模式比监督者模式快
2 种 架构模式:监督者 vs 工作流
11/11 测试全部通过

⚡ 30 秒速览

  • 做了什么:让代码助手通过阅读 LangChain4j 文档,自主设计并构建一个多智能体编码系统——相当于让 AI 克隆自己的编码能力。
  • 两种架构:监督者模式(4 个子代理,自主协调)vs 工作流模式(5 步确定性序列,含评估循环),后者速度快 3 倍。
  • 实战验证:用包含 4 个 bug 的 Calculator 类测试,两种架构均成功修复所有错误,11 项测试全部通过。
  • 模型选择:gpt-4o 在监督者模式下陷入工具调用循环(超 100 次),gpt-5-mini 成功完成任务——模型能力直接影响系统稳定性。
  • 核心权衡:工作流模式用确定性换速度,监督者模式用自主性换灵活。没有银弹,按场景选择。

01实验核心:让 AI 构建自己的克隆体

研究团队给代码助手下了一道不寻常的指令:「研究 LangChain4j 智能体框架的 API 和功能,在此基础上设计一个智能编码器,使其成为你自己的克隆体。」

代码助手在几分钟内给出了方案——它选择了监督者模式,设计了一个包含 4 个子代理的架构:

🔍 ExplorerAgent 📋 PlannerAgent ⚙️ ImplementerAgent 🚀 ExecutorAgent

每个子代理负责一道工序:探索代码库、制定执行计划、编写/修改代码、编译并运行测试。监督者代理在运行时自主生成子代理调用及其参数,协调整个流程。

一个诚实的注脚:

首次运行时,gpt-4o 在监督者模式下陷入了工具调用循环,超过 100 次调用后被框架中断。更换为 gpt-5-mini 后,系统成功运行。模型选择对智能体系统的稳定性影响显著。

02架构对决:监督者 vs 工作流

研究团队没有止步于监督者模式。他们要求代码助手再设计一种更确定性、更高效的替代方案——工作流模式由此诞生。

监督者模式

主智能体在运行时自主生成子代理调用及参数,协调所有子代理。灵活性高,但 LLM 协调开销大,速度慢。

工作流模式

严格五步序列:探索→计划(含审查循环)→实现→执行(含评估与重构循环)→总结。确定性高,速度快。

4子代理(监督者)
5步骤(工作流)
~6 min监督者执行时间
~2 min工作流执行时间

注:工作流模式包含 PlanReviewLoop 和 ExecutionLoop 两个内嵌循环,前者用于审查计划,后者用于迭代评估与重构。退出条件为评估分数 ≥ 0.8 或达到最大迭代次数 5 次。

速度差异的核心原因:监督者模式中,LLM 需要自主生成所有子代理的调用参数,协调开销巨大;工作流模式则通过确定性架构和严格的步骤序列,消除了这部分开销。

03实战检验:修复 Calculator 的 4 个 bug

为了测试自构建智能编码器的实际能力,团队创建了一个包含 4 个隐蔽 bug 的 Calculator 类,然后用系统来修复它。

🧮 Calculator.java — 4 个 bug 待修复 两种架构均修复成功

  • sum():循环条件 i <= size() 导致索引越界,应改为 i < size() 或使用 for-each。
  • average():整数除法丢失精度,应转换为浮点数除法 (double) sum / size。
  • max():初始值设为 0,全负数列表时返回错误结果,应初始化为第一个元素。
  • factorial():循环条件 i < n 漏乘 n,应改为 i <= n。
两种架构均成功修复所有 4 个 bug,11 项测试全部通过。工作流模式用时 2 分钟,监督者模式用时 6 分钟,速度差异明显。

值得注意的是,监督者模式虽然速度慢,但在修复过程中展示了更强的自主性——它自行决定先探索代码库,再制定计划,最后执行修复,整个过程无需人工干预。

04关键洞察:速度与自主性的根本权衡

两种架构都成功完成了任务,但它们代表了两种截然不同的设计哲学。

工作流模式是「确定性优先」——把流程拆解为固定的步骤序列,用内置循环处理迭代优化。它的优势是可预测、速度快、开销低。代价是灵活性受限:如果任务超出了预设步骤的范畴,系统可能无法适应。

监督者模式是「自主性优先」——让 LLM 在运行时动态决策,协调子代理、分配任务。它的优势是灵活、适应性强,能处理非结构化任务。代价是速度慢、开销大,且对底层模型的能力要求更高(gpt-4o 失败,gpt-5-mini 成功)。

这不是一个「谁更好」的问题,而是一个「什么场景用什么」的问题。

编辑核心判断

智能体架构设计没有银弹。工作流模式用确定性换速度,适合流程明确、效率至上的场景;监督者模式用自主性换灵活,适合探索性强、路径不确定的任务。真正的工程智慧,是在两者之间找到正确的平衡点。

实验已开源

完整项目代码已公开发布,包含两种架构的全部实现、测试用例及执行日志,可复现验证。

GitHub → langchain4j-agentic 实验仓库