说明:本知识库撰写于 2026-09,基于模型知识与公开资料;标注 ★ 的为该主题下优先级最高的阅读材料。链接为官方域名,具体路径可能随版本更新。
官方工程指南(优先级最高)
- ★ **Anthropic, *Building Effective Agents***(2024)——workflow 五模式与 agent 的定义,被引最多的一篇工程指南 → kp-007
- ★ **Anthropic Engineering, *How we built our multi-agent research system***(2025)——token ×15 换质量的一手数据与架构决策 → kp-019/030
- **Anthropic, *Effective context engineering for AI agents***(2025)——增删压隔离与 JIT 的原始论述 → kp-003/022
- modelcontextprotocol.io——MCP 官方规范与 SDK → kp-011
- **OpenAI, Function Calling / Structured Outputs / Agents SDK 文档与发布博客**(2023-2025)→ kp-005/009/021
- Claude Code 官方文档(memory / permissions / subagents / hooks 各章)→ kp-015/023/028
奠基论文(按主题)
推理与行动
- ★ Yao et al., ReAct: Synergizing Reasoning and Acting in Language Models(2022, ICLR'23)→ kp-012
- Wei et al., Chain-of-Thought Prompting Elicits Reasoning in LLMs(NeurIPS 2022)→ kp-004
- Wang et al., Plan-and-Solve Prompting(2023)→ kp-013
- Shinn et al., Reflexion: Language Agents with Verbal Reinforcement Learning(2023)→ kp-014
- Madaan et al., Self-Refine(2023)→ kp-014
记忆与检索
- ★ Lewis et al., Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks(2020)→ kp-016
- Park et al., Generative Agents: Interactive Simulacra of Human Behavior(2023)→ kp-015
- Liu et al., Lost in the Middle(2023)→ kp-003
多 Agent 与系统
- Wu et al., AutoGen(2023);Hong et al., MetaGPT(2023)→ kp-020
- Du et al., Improving Factuality by Multi-Agent Debate(2023)→ kp-020
训练
- ★ DeepSeek-AI, DeepSeek-R1: Incentivizing Reasoning via RL(2025)→ kp-031
- Schick et al., Toolformer(2023)→ kp-008/009
评测与安全
- Jimenez et al., SWE-bench(2023)→ kp-028
- Xie et al., OSWorld(2024)→ kp-029
- Yao et al., τ-bench: Tool-Agent-User Interaction(2024)→ kp-024
- Schmid et al., GATES(2025)→ kp-023
- OWASP, Top 10 for LLM Applications(2025 版)→ kp-026
框架与工具文档
- LangGraph(langchain 文档的 LangGraph 章节)→ kp-021
- OpenTelemetry GenAI Semantic Conventions(规范进行中)→ kp-025
- LangSmith / Langfuse 文档(tracing 与 evals 章节)→ kp-024/025
- E2B / Modal(沙箱即服务)→ kp-018
深度跟进(博客与年度报告)
- Simon Willison 博客——prompt injection 与 agent 边界的持续一手思考 → kp-026
- Lilian Weng(lilianweng.github.io)——LLM/Agent 技术长文,教科书级 → kp-002
- Andrej Karpathy 演讲(Intro to LLMs 等)→ kp-002
- Stanford HAI, AI Index(年度)→ kp-032
- Anthropic Economic Index / 各家 agentic 使用报告(季度)→ kp-032
经典教科书背景
- Russell & Norvig, Artificial Intelligence: A Modern Approach(ch.2 Agent 定义)→ kp-001
- Sutton & Barto, Reinforcement Learning: An Introduction(RL 基础,选读)→ kp-031
阅读路径建议
- 最小闭环(4 篇,一个周末):Building Effective Agents → ReAct → MCP quickstart → Claude Code 文档 memory 章
- 工程深潜(+4 篇):多 Agent 复盘 → 上下文工程博客 → SWE-bench → OWASP Top 10
- 研究向(+3 篇):Reflexion → R1 → Generative Agents