四个阶段、32 个知识点。每阶段末有"过关标准"——达不到就回去补。全程约 4-6 周(每天 1-2 小时)。
第一阶段 · 建立心智模型( kp-001 ~ kp-008 )
目标:分清 Agent / Chatbot / Workflow / Copilot,理解 LLM 为什么能撑起一个循环。
顺序与理由:先立定义(kp-001),再补 LLM 底层直觉(kp-002),因为 Agent 的所有限制——上下文有限、采样随机、幻觉——都来自 kp-002。然后学这个领域真正的"新地基":上下文工程(kp-003)与提示工程(kp-004),以及结构化输出(kp-005)。最后用 kp-006 把循环拼出来,用 kp-007 认清产品形态光谱,用 kp-008 建立历史坐标系。
- kp-001 什么是 AI Agent
- kp-002 LLM 基础:Agent 视角的最小必懂集
- kp-003 上下文工程:窗口是最稀缺的资源
- kp-004 提示工程:与模型沟通的语法
- kp-005 结构化输出:让模型说机器能读的话
- kp-006 Agent 解剖:think-act-observe 循环
- kp-007 形态光谱:Chatbot → Copilot → Workflow → Agent
- kp-008 发展简史:六十年,三次浪潮
过关标准:能向同事白板讲清"为什么 Workflow 不会取代 Agent,两者各自适合什么场景"(kp-007);能说出上下文腐烂的三个症状(kp-003)。
第二阶段 · 掌握四大支柱( kp-009 ~ kp-020 )
目标:吃透 Agent 循环的燃料——工具、推理结构、记忆、检索。
支柱一:工具(kp-009 函数调用原理 → kp-010 工具设计学 → kp-011 MCP 协议 → kp-018 代码执行与沙箱)。支柱二:推理结构(kp-012 ReAct → kp-013 规划分解 → kp-014 反思修正)。支柱三:记忆(kp-015)。支柱四:检索(kp-016)。然后是三篇"组合拳":kp-017 手写最小 Agent(本知识库的枢纽篇,务必亲手跑通)、kp-019 子 Agent 与编排、kp-020 多 Agent 系统。
- kp-009 Function Calling:工具使用的底层协议
- kp-010 工具设计学:给模型造一把好用的锤子
- kp-011 MCP:模型上下文协议
- kp-012 ReAct:推理与行动的交织
- kp-013 规划与任务分解
- kp-014 反思与自我修正
- kp-015 记忆系统:短期、长期与文件记忆
- kp-016 RAG:检索增强生成
- kp-017 手写最小 Agent:100 行的完整循环
- kp-018 代码执行与沙箱
- kp-019 子 Agent 与编排模式
- kp-020 多 Agent 系统
过关标准:kp-017 的最小 Agent 你亲手扩展过至少一个自定义工具;能画出"查询天气并写进表格"任务的完整消息序列图(工具调用请求/结果如何进上下文)。
第三阶段 · 工程化与生产( kp-021 ~ kp-027 )
目标:从"能跑的 demo"到"敢上线的系统"。
先看框架解决了什么(kp-021),但顺序上应先懂 kp-017 再懂框架。然后是 Agent 工程的"三面镜子":上下文工程进阶(kp-022,长任务的命门)、人机协同(kp-023,给自主性装刹车)、评测(kp-024,没有它一切优化都是玄学)。最后三篇是运营面:可观测性(kp-025)、安全(kp-026,提示注入是这个时代的 SQL 注入)、成本与生产化(kp-027)。
- kp-021 框架巡礼:LangGraph / Agents SDK / Claude Agent SDK
- kp-022 上下文工程进阶:压缩、分层与即时检索
- kp-023 人机协同:审批门与自主性分级
- kp-024 Agent 评测(Evals)
- kp-025 可观测性与调试
- kp-026 Agent 安全:提示注入与权限设计
- kp-027 成本、延迟与生产化
过关标准:为你的最小 Agent 设计一个 10 条用例的评测集并跑出分数;列出你的 Agent 的三个攻击面与对应缓解。
第四阶段 · 前沿与实战( kp-028 ~ kp-032 )
目标:读懂当今最强的 Agent 系统如何设计,看清这个领域的方向。
- kp-028 编程 Agent 解剖:Claude Code 与 SWE-bench
- kp-029 Computer Use:让 Agent 操控 GUI
- kp-030 Deep Research:信息聚合型 Agent
- kp-031 Agent 训练:SFT、RL 与蒸馏
- kp-032 未来路线:A2A、通用 Agent 与伦理
过关标准:能解释 Claude Code 为什么选择"单上下文 + 子 Agent 隔离"而非"多 Agent 对话";能就"Agent 会不会吞掉 SaaS"形成有论据的立场。
三条学习建议
- 代码不停手:每学完一个机制,就回到 kp-017 的骨架上加一块——学完 kp-011 加 MCP 客户端,学完 kp-015 加记忆文件,学完 kp-019 加子 Agent。
- 用真实 Agent 做参照:装一个 Claude Code 或开源 Agent(如 OpenHands),遇到新概念就去它的系统提示与架构里找对应物。
- 按矩阵查漏:学完四个阶段后对照 00-coverage-matrix 自查,薄弱模块重读。