AI Agent完整课程

AI Agent 全栈实战

141课双路线:零基础用户先完成29课前置,开发者可直接进入112课Agent主线。每课包含中文讲解、代码与可验证的实践路径。

141节课程6个模块29节可选前置112节Agent主线
进入学习目录

零基础:先学习29节前置,再进入Agent主线。

有开发经验:可直接从Agent主线开始。

CURRICULUM / 课程地图

六个阶段,双路线进入

可选前置

前置 A|环境与工程工具

Python、终端、Git与AI工程环境。零基础路线选修。

12
  1. 01
    开发环境~45 分钟
    已锁定
  2. 02
    Git 与协作~30 分钟
    已锁定
  3. 03
    GPU 配置与云端~45 分钟
    已锁定
  4. 04
    API 与密钥~30 分钟
    已锁定
  5. 05
    Jupyter 笔记本~30 分钟
    已锁定
  6. 06
    Python 环境管理~30 分钟
    已锁定
  7. 07
    AI 项目的 Docker 容器~60 分钟
    已锁定
  8. 08
    编辑器配置~20 分钟
    已锁定
  9. 09
    数据管理~45 分钟
    已锁定
  10. 10
    终端与 Shell~35 分钟
    已锁定
  11. 11
    AI 工程中的 Linux~30 分钟
    已锁定
  12. 12
    调试与性能分析~60 分钟
    已锁定
可选前置

前置 B|LLM应用工程

补齐LLM API、RAG、评估与服务化知识。零基础路线选修。

17
  1. 01
    Prompt Engineering:技巧与模式~90 分钟
    已锁定
  2. 02
    Few-Shot、Chain-of-Thought、Tree-of-Thought~45 分钟
    已锁定
  3. 03
    结构化输出:JSON、Schema 校验、约束解码~90 分钟
    已锁定
  4. 04
    嵌入(embedding)与向量表示~75 分钟
    已锁定
  5. 05
    Context Engineering:窗口、预算、记忆与检索~90 分钟
    已锁定
  6. 06
    RAG(检索增强生成)~90 分钟
    已锁定
  7. 07
    进阶 RAG(分块、重排、混合搜索)~90 分钟
    已锁定
  8. 08
    用 LoRA 和 QLoRA 微调~75 分钟
    已锁定
  9. 09
    Function Calling 与 Tool Use~75 分钟
    已锁定
  10. 10
    评估与测试 LLM 应用~45 分钟
    已锁定
  11. 11
    缓存、限流与成本优化~45 分钟
    已锁定
  12. 12
    护栏、安全与内容过滤~45 分钟
    已锁定
  13. 13
    构建一个生产级 LLM 应用~120 分钟
    已锁定
  14. 14
    Model Context Protocol(MCP)~75 分钟
    已锁定
  15. 15
    Prompt Caching 与上下文缓存~60 分钟
    已锁定
  16. 16
    Agent 状态机——图、节点与检查点~75 分钟
    已锁定
  17. 17
    Agent 框架取舍——图、角色与 Actor 编排~45 分钟
    已锁定
Agent主线

主线 1|工具、MCP与协议

从工具接口和结构化输出到MCP Server、Client、安全与Agent协议。

23
  1. 01
    工具接口——为什么 agent 需要结构化 I/O~45 分钟
    免费试看
  2. 02
    Function Calling 深入剖析——OpenAI、Anthropic、Gemini~75 分钟
    已锁定
  3. 03
    并行工具调用与带工具的流式~75 分钟
    已锁定
  4. 04
    结构化输出——JSON Schema、Pydantic、Zod、受约束解码~75 分钟
    已锁定
  5. 05
    工具 Schema 设计——命名、描述、参数约束~45 分钟
    已锁定
  6. 06
    MCP 基础——基元、生命周期、JSON-RPC 底座~45 分钟
    已锁定
  7. 07
    构建一个 MCP Server——Python + TypeScript SDK~75 分钟
    已锁定
  8. 08
    构建一个 MCP Client——发现、调用、会话管理~75 分钟
    已锁定
  9. 09
    MCP 传输——stdio vs Streamable HTTP vs SSE 迁移~45 分钟
    已锁定
  10. 10
    MCP Resources 与 Prompts——工具之外的上下文暴露~45 分钟
    已锁定
  11. 11
    MCP Sampling——server 请求的 LLM 补全与 agent 循环~75 分钟
    已锁定
  12. 12
    Roots 与 Elicitation——范围限定与中途用户输入~45 分钟
    已锁定
  13. 13
    异步 Tasks(SEP-1686)——现在调用、稍后取结果,应对长跑工作~75 分钟
    已锁定
  14. 14
    MCP Apps——经由 ui:// 的交互式 UI 资源~75 分钟
    已锁定
  15. 15
    MCP 安全 I——工具投毒、Rug Pull、跨 server 影子覆盖~45 分钟
    已锁定
  16. 16
    MCP 安全 II——OAuth 2.1、Resource Indicator、增量 Scope~75 分钟
    已锁定
  17. 17
    MCP 网关与注册表——企业控制面~45 分钟
    已锁定
  18. 18
    生产环境的 MCP Auth——入册、JWKS 刷新、受众钉定的 token~90 分钟
    已锁定
  19. 19
    A2A——Agent-to-Agent 协议~75 分钟
    已锁定
  20. 20
    OpenTelemetry GenAI——端到端追踪工具调用~75 分钟
    已锁定
  21. 21
    LLM 路由层——LiteLLM、OpenRouter、Portkey~45 分钟
    已锁定
  22. 22
    Skills 与 Agent SDK——Anthropic Skills、AGENTS.md、OpenAI Apps SDK~45 分钟
    已锁定
  23. 23
    综合项目——构建一套完整的工具生态~120 分钟
    已锁定
Agent主线

主线 2|Agent工程

Agent循环、规划、记忆、评估、调试与生产级工程方法。

42
  1. 01
    Agent 循环:观察、思考、行动~60 分钟
    免费试看
  2. 02
    ReWOO 与 Plan-and-Execute:解耦的规划~60 分钟
    已锁定
  3. 03
    Reflexion:言语强化学习~60 分钟
    已锁定
  4. 04
    Tree of Thoughts 与 LATS:刻意搜索~75 分钟
    已锁定
  5. 05
    Self-Refine 与 CRITIC:迭代式输出改进~60 分钟
    已锁定
  6. 06
    工具使用与函数调用~60 分钟
    已锁定
  7. 07
    Agent 记忆——虚拟上下文与记忆分页~75 分钟
    已锁定
  8. 08
    记忆块与休眠时计算~75 分钟
    已锁定
  9. 09
    混合记忆:向量 + 图 + KV~75 分钟
    已锁定
  10. 10
    技能库与终身学习(Voyager)~75 分钟
    已锁定
  11. 11
    用 HTN 和演化搜索做规划~75 分钟
    已锁定
  12. 12
    Anthropic 的工作流模式:简单胜过复杂~60 分钟
    已锁定
  13. 13
    有状态图编排——持久执行与检查点~75 分钟
    已锁定
  14. 14
    Agent 的 Actor 模型——异步消息与类型化运行时~75 分钟
    已锁定
  15. 15
    基于角色的 Agent 团队——角色、任务与流程~75 分钟
    已锁定
  16. 16
    OpenAI Agents SDK:Handoffs、Guardrails、Tracing~75 分钟
    已锁定
  17. 17
    Harness 即库——子 agent 与会话存储~75 分钟
    已锁定
  18. 18
    生产级 Agent 运行时——快速实例化与类型化工作流~45 分钟
    已锁定
  19. 19
    基准:SWE-bench、GAIA、AgentBench~60 分钟
    已锁定
  20. 20
    基准:WebArena 与 OSWorld~60 分钟
    已锁定
  21. 21
    Computer Use:Claude、OpenAI CUA、Gemini~60 分钟
    已锁定
  22. 22
    语音 Agent:Pipecat 与 LiveKit~60 分钟
    已锁定
  23. 23
    OpenTelemetry GenAI 语义约定~60 分钟
    已锁定
  24. 24
    Agent 可观测性:Langfuse、Phoenix、Opik~45 分钟
    已锁定
  25. 25
    多 Agent 辩论与协作~60 分钟
    已锁定
  26. 26
    失败模式:agent 为什么会坏~60 分钟
    已锁定
  27. 27
    Prompt 注入与 PVE 防御~75 分钟
    已锁定
  28. 28
    编排模式:Supervisor、Swarm、Hierarchical~60 分钟
    已锁定
  29. 29
    生产运行时:Queue、Event、Cron~60 分钟
    已锁定
  30. 30
    评估驱动的 Agent 开发~60 分钟
    已锁定
  31. 31
    Agent 工作台工程:能干的模型为什么还会失败~45 分钟
    已锁定
  32. 32
    最小 Agent 工作台~45 分钟
    已锁定
  33. 33
    Agent 指令即可执行约束~50 分钟
    已锁定
  34. 34
    仓库记忆与持久状态~60 分钟
    已锁定
  35. 35
    Agent 初始化脚本~45 分钟
    已锁定
  36. 36
    范围契约与任务边界~50 分钟
    已锁定
  37. 37
    运行时反馈循环~50 分钟
    已锁定
  38. 38
    验证关卡~55 分钟
    已锁定
  39. 39
    审查者 Agent:把构建者和打分者分开~55 分钟
    已锁定
  40. 40
    多会话交接~50 分钟
    已锁定
  41. 41
    真实仓库上的工作台~60 分钟
    已锁定
  42. 42
    综合项目:交付一个可复用的 Agent 工作台包~75 分钟
    已锁定
Agent主线

主线 3|自主系统

研究Agent、长期任务、浏览器与代码执行等自主能力。

22
  1. 01
    从聊天机器人到长程 agent 的转变~45 分钟
    已锁定
  2. 02
    STaR、V-STaR、Quiet-STaR —— 自学推理~60 分钟
    已锁定
  3. 03
    AlphaEvolve —— 进化式编码 agent~60 分钟
    已锁定
  4. 04
    Darwin Godel Machine —— 开放式自我修改 agent~60 分钟
    已锁定
  5. 05
    AI Scientist v2 —— workshop 级别的自主研究~60 分钟
    已锁定
  6. 06
    自动化对齐研究(Anthropic AAR)~60 分钟
    已锁定
  7. 07
    递归自我改进 —— 能力 vs 对齐~60 分钟
    已锁定
  8. 08
    有界自我改进的设计~60 分钟
    已锁定
  9. 09
    自主编码 agent 全景(2026)~45 分钟
    已锁定
  10. 10
    自主 Agent 的权限模式~45 分钟
    已锁定
  11. 11
    浏览器 agent 与长程网页任务~45 分钟
    已锁定
  12. 12
    长时运行的后台 agent:持久化执行~60 分钟
    已锁定
  13. 13
    动作预算、迭代上限与成本调控器~60 分钟
    已锁定
  14. 14
    急停开关、断路器与金丝雀 token~60 分钟
    已锁定
  15. 15
    人在回路:先提议后提交(Propose-Then-Commit)~60 分钟
    已锁定
  16. 16
    Checkpoint 与回滚~60 分钟
    已锁定
  17. 17
    Constitutional AI 与规则覆盖~60 分钟
    已锁定
  18. 18
    Llama Guard 与输入/输出分类~45 分钟
    已锁定
  19. 19
    Anthropic 负责任扩展政策 v3.0~45 分钟
    已锁定
  20. 20
    OpenAI Preparedness Framework 与 DeepMind Frontier Safety Framework~45 分钟
    已锁定
  21. 21
    METR 时间跨度与外部能力评估~60 分钟
    已锁定
  22. 22
    CAIS、CAISI 与社会尺度风险~45 分钟
    已锁定
Agent主线

主线 4|多智能体与蜂群

多Agent通信、协作、编排、涌现与蜂群系统。

25
  1. 01
    为什么要用多 agent?~60 分钟
    已锁定
  2. 02
    FIPA-ACL 与言语行为理论的遗产~60 分钟
    已锁定
  3. 03
    通信协议~120 分钟
    已锁定
  4. 04
    多 agent 原语模型~60 分钟
    已锁定
  5. 05
    Supervisor / Orchestrator-Worker 模式~75 分钟
    已锁定
  6. 06
    层级架构及其故障模式~60 分钟
    已锁定
  7. 07
    心智社会与多 agent 辩论~60 分钟
    已锁定
  8. 08
    角色专精 —— Planner、Critic、Executor、Verifier~60 分钟
    已锁定
  9. 09
    并行 / Swarm / 网络化架构~75 分钟
    已锁定
  10. 10
    群聊与发言者选择~60 分钟
    已锁定
  11. 11
    Handoff 与 Routine —— 无状态 orchestration~60 分钟
    已锁定
  12. 12
    A2A —— Agent 对 Agent 协议~75 分钟
    已锁定
  13. 13
    共享内存与黑板模式~75 分钟
    已锁定
  14. 14
    Agent 的共识与拜占庭容错~75 分钟
    已锁定
  15. 15
    投票、自洽性与辩论拓扑~75 分钟
    已锁定
  16. 16
    谈判与议价~75 分钟
    已锁定
  17. 17
    生成式 agent 与涌现式仿真~75 分钟
    已锁定
  18. 18
    心智理论与涌现式协调~75 分钟
    已锁定
  19. 19
    面向 LLM 的 Swarm 优化(PSO、ACO)~75 分钟
    已锁定
  20. 20
    MARL —— MADDPG、QMIX、MAPPO~90 分钟
    已锁定
  21. 21
    Agent 经济、token 激励、声誉~75 分钟
    已锁定
  22. 22
    生产环境扩展 —— 队列、检查点、持久性~75 分钟
    已锁定
  23. 23
    故障模式 —— MAST、群体思维、单一栽培、级联错误~75 分钟
    已锁定
  24. 24
    评估与协调基准~75 分钟
    已锁定
  25. 25
    案例研究与 2026 年的最新进展~90 分钟
    已锁定