Logo
CMU 11-768: AI Agents 学习笔记
CMU 11-768 是卡内基梅隆大学语言技术研究所面向研究生开设的 AI Agents 课程,由 Graham Neubig 与 Daniel Fried 联合授课。课程围绕 LLM 智能体的工具调用、上下文管理、技能与记忆、规划、评测、SFT/RL 训练、安全、交互和搜索展开,并通过三次个人作业与研究项目串联完整的智能体工程流程。

CMU 11-768: AI Agents 是卡内基梅隆大学语言技术研究所 2026 年秋季开设的研究生课程,由 Graham NeubigDaniel Fried 联合授课。课程把 LLM 智能体视为一个需要构建、评测、训练和保障安全的完整系统,兼顾理论、工程实践与开放研究。

这套笔记按官网课表建立初始结构。课程资料仍在学期中持续更新,讲义、视频和作业状态以官网为准。

官方资料

网络资料

赞助商

参考导读

学习路线

课程围绕两条互相咬合的主线展开:

  1. 知识主线:智能体能力 → 应用领域 → 训练方法 → 安全与框架 → 交互、搜索与进阶。
  2. 实践主线:搭建 Harness → 设计 Eval → 使用 SFT/RL 训练 → 完成研究项目。

学完后应能在开源 LLM 之上实现智能体,设计多步任务评测,训练和改进智能体能力,分析安全与可靠性取舍,并围绕智能体提出和验证一个开放研究问题。

课程目录

编号日期课程笔记资料
0108-25Course Overview: What Is an Agent?课程概览:什么是智能体Slides · YouTube · B 站
0208-27Agent Capabilities 1: Tool Use工具调用Slides · YouTube · B 站
0309-01Agent Capabilities 2: Context Management for Long-Context Agents长上下文智能体的上下文管理Slides · YouTube · B 站
0409-03Agent Capabilities 3: Skills and Memory技能与记忆Slides · YouTube · B 站
0509-08Agent Capabilities 4: Planning, Task Decomposition, and Multi-Agent Coordination规划、任务分解与多智能体协同Slides
0609-10Domains 1: Coding Agents编程智能体Slides
0709-15Domains 2: GUI AgentsGUI 智能体待更新
0809-17Training 1: Supervised Fine-Tuning (SFT)监督微调待更新
0909-22Training 2: Reinforcement Learning Basics强化学习基础待更新
1009-24Domains 3: Deep Research Agents深度研究智能体待更新
1109-29Training 3: Advanced RL Algorithms高级强化学习算法待更新
1210-01Training 4: RL Systems强化学习系统待更新
1310-06Safety 1: Sandboxing and Credential Management沙箱与凭证管理待更新
1410-08Frameworks 1: OpenHandsOpenHands待更新
1510-20Frameworks 2: LangGraphLangGraph待更新
1610-22Safety 2: Observability and Monitoring可观测性与监控待更新
1710-27Agents and the Future of Work智能体与工作的未来待更新
1810-29Interaction 1: Multi-Agent Interaction多智能体交互待更新
1911-10Interaction 2: Human-Agent Interaction人机交互待更新
2011-12Search 1: Reranking and Critic Models重排序与评论模型待更新
2111-17Search 2: Tree Search树搜索待更新
2211-19Guest Lecture: Karthik Narasimhan客座讲座:Karthik Narasimhan待更新
2311-24Guest Lecture: Sasha Rush客座讲座:Sasha Rush待更新

课程另安排两次 Project Hours、三次假期停课和两次期末海报展示。本项目将这些非主题讲次统一记录在研究项目笔记中。

实践项目

项目截止时间笔记
Assignment 1: Harness2026-09-14搭建智能体 Harness
Assignment 2: Eval2026-09-24(暂定)设计智能体评测
Assignment 3: Training2026-10-22(暂定)训练智能体
Half-semester Research Project2026-12-01 至 12-03 展示研究项目