斯坦福推出自我改进AI Agents课程
CS329A Self-Improving AI Agents 斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。 讲师阵容 Azalia Mirhosei...
斯坦福新课程,两位主讲曾参与PaLM、Gemini、Claude开发,教你理解AI自我改进全流程。
斯坦福大学开设CS329A课程,聚焦自我改进AI Agents。课程由Reflection AI联合创始人Azalia Mirhoseini和PaLM 2与Gemma负责人Aakanksha Chowdhery主讲。课程涵盖推理时自我改进、从反馈中学习、开放式进化与搜索四大技术栈。课程包含9讲,完整讲解采样→验证→筛选→训练→更强模型的循环过程。
CS329A Self-Improving AI Agents 斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。 讲师阵容 Azalia Mirhosei...
CS329A Self-Improving AI Agents 斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。 讲师阵容 Azalia Mirhoseini:AlphaCode 与 LLM 大规模训练调度优化("Circuit Training")的核心人物,现为 Reflection AI 联合创始人 Aakanksha Chowdhery:PaLM 2 与 Gemma 的负责人,同样在 Reflection AI 嘉宾名单 Misha Laskin(Reflection AI CEO) 多位 Google DeepMind 研究员(Denny Zhou、Thang Luong、Melvin Johnson)、Physical Intelligence(Danny Driess,机器人) 课程主线:一条完整的自我改进技术栈 1. 推理时自我改进(Test-time) 2. 从反馈中学习(Feedback → Learning) 3. 开放式进化与搜索(Open-endedness) 4. 工程化与瓶颈(Agentic Engineering & Bottlenecks) 课程详细信息: cs329a.stanford.edu/index.html meng shao @shao__meng 斯坦福大学把 CS329A Self-Improving AI Agents 视频都公布到 Youtube 了。 两位主讲老师做过 PaLM、Gemini、Claude。9 讲讲透一个循环: 采样 → 验证 → 筛选 → 训练 → 更强的模型 想知道为什么 coding agent 最新普及,写作却不行? 完整解读 👇 x.com/i/article/2096… P 🔗 View Quoted Tweet 💬 1 🔄 0 ❤️ 0 👀 153 📊 1 ⚡