塔斯娱乐资讯网

CS329A Self-Improving AI Agents 斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。 讲师阵容 Azalia Mirhoseini:AlphaCode 与 LLM 大规模训练调度优化("Circuit Training")的核心人物,现为 Reflection AI 联合创始人 Aakanksha Chowdhery:PaLM 2 与 Gemma ​

CS329A Self-Improving AI Agents

斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。

讲师阵容Azalia Mirhoseini:AlphaCode 与 LLM 大规模训练调度优化("Circuit Training")的核心人物,现为 Reflection AI 联合创始人Aakanksha Chowdhery:PaLM 2 与 Gemma 的负责人,同样在 Reflection AI

嘉宾名单Misha Laskin(Reflection AI CEO)多位 Google DeepMind 研究员(Denny Zhou、Thang Luong、Melvin Johnson)、Physical Intelligence(Danny Driess,机器人)

课程主线:一条完整的自我改进技术栈1. 推理时自我改进(Test-time)2. 从反馈中学习(Feedback → Learning)3. 开放式进化与搜索(Open-endedness)4. 工程化与瓶颈(Agentic Engineering & Bottlenecks)

课程详细信息:cs329a.stanford.edu/index.html