CS329A Self-Improving AI Agents
斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。
讲师阵容Azalia Mirhoseini:AlphaCode 与 LLM 大规模训练调度优化("Circuit Training")的核心人物,现为 Reflection AI 联合创始人Aakanksha Chowdhery:PaLM 2 与 Gemma 的负责人,同样在 Reflection AI
嘉宾名单Misha Laskin(Reflection AI CEO)多位 Google DeepMind 研究员(Denny Zhou、Thang Luong、Melvin Johnson)、Physical Intelligence(Danny Driess,机器人)
课程主线:一条完整的自我改进技术栈1. 推理时自我改进(Test-time)2. 从反馈中学习(Feedback → Learning)3. 开放式进化与搜索(Open-endedness)4. 工程化与瓶颈(Agentic Engineering & Bottlenecks)
课程详细信息:cs329a.stanford.edu/index.html
