Skip to content
🔗 分享本题
查看我的学习进度 →

Agent 从问答调用工具自主规划主动发起到组织多智能体的五级成熟度阶梯

🧠 图解记忆: 成熟度看自主权如何增长:回答、执行、规划、主动、组织;业务只选需要的级别。

难度: ⭐⭐⭐⭐
更新: 2026-04-06

💡 答案要点

为什么需要 Agent 成熟度模型?

行业现状: 市场上"绝大多数产品仍停留在 L1-L2 级别"

市场预测: Gartner 预测到 2028 年,70% 的 AI 应用将使用多智能体系统(L5)

IDC 数据(2026):

  • 超过 64% 的中国企业已进入 Agent 的测试验证和采购培训阶段
  • 预计 2028 年中国企业级 Agent 应用市场规模将达到 270 亿美元
  • 生成式 AI 占 AI 市场总投资规模比例将达到 30.6%,突破 300 亿美元

L1-L5 能力分级框架

等级名称能力描述典型场景技术栈
L1被动执行"你问我答":能理解指令,但依赖预设提示词或 RAG智能客服,知识库问答Prompt + RAG
L2项目助理"你让我做,我就做":能调用工具,但必须在预定义工作流内执行自动查订单、发邮件、预订会议Workflow + RAG + Function Calling
L3初级项目负责人"你说目标,我来规划":能理解模糊任务,自主规划多步骤,动态调用工具生成会议纪要、写周报、规划旅行ReAct / Plan-and-Execute
L4专业骨干"我发现问题,我来解决":能主动感知环境(如 CRM 数据变化),自主发起任务智能营销(发现客户流失风险并主动触达)环境感知 + L3 能力
L5领导者"我来组织":能定义目标,将复杂系统工程分解给其他 L2-L4 Agent(或人类)协同完成自动化软件开发、虚拟项目组Multi-Agent 协同

L1-L5 面试核心问答

Q: 如何判断一个 Agent 是 L3 还是 L4?

L3 是"被动接收目标后执行",L4 是"主动感知环境变化后自主发起"。L4 能监控 CRM 数据变化,当发现客户流失风险时主动触达,不需要人类先下指令。

Q: L5 Agent 和 L3 Multi-Agent 的核心区别?

L3 Multi-Agent 是"多个 Agent 配合完成一个任务",L5 是"主 Agent 定义目标、协调其他 Agent,像一个团队一样工作"。L5 的主 Agent 具备目标拆解、任务分配、结果整合的完整能力。

Q: 当前企业落地的实际情况?

绝大多数企业落地的"数字员工"主要是 L1(智能知识库)和 L2(流程自动化助手)。L3 及以上的 Agent 需要更复杂的技术栈和更成熟的 AI 基础设施。

Coze vs Dify vs n8n 平台对比

平台定位优势劣势适合场景
Coze(扣子)C端创作者平台免费、插件丰富、一键发布(飞书/豆包)私有化能力弱、资源限制(10GB知识库/10分钟超时)互联网产品经理,快速验证 C 端创意和 Demo
Dify.ai开源+企业级 LLM 应用平台平衡易用性与专业性,支持私有化部署、国产模型流程编排能力相对 n8n 较弱企业应用专家,私有化/国产化环境构建严肃 B 端应用
n8n自动化工作流引擎极强大的流程编排,连接器极多LLM 能力是"外挂"而非原生,Agent 概念较弱解决方案架构师,核心是"流程自动化"(RPA+AI)而非"智能体"

LangChain vs LlamaIndex 核心思想

框架核心思想适用场景
LangChain"链"(Chains) 和"智能体"(AI Agents),提供构建复杂多步骤 Agent 工作流的所有模块(记忆、提示词、工具)一个对话式 Agent,需要执行多步骤、调用多种工具、拥有复杂记忆
LlamaIndex"高级 RAG"(Advanced RAG)RAG 需求复杂时(层级检索、GraphRAG、融合多文档)

面试话术

示例表达(仅在能用本人经历或可复现实验佐证时使用): "Agent 成熟度 L1-L5 是 2026 年面试的高频考点。L1 是问答客服,L2 是工具使用者,L3 能自主规划,L4 能主动发起,L5 能协调多 Agent 团队干活。当前市场绝大多数产品停在 L1-L2,但 Gartner 预测 2028 年 70% 应用会到 L5。我做过的项目大部分是 L2-L3 级别,L4 以上的核心挑战是环境感知和主动决策能力。选平台要看场景:快速验证用 Coze,企业严肃应用用 Dify,流程自动化用 n8n。"