斯坦福大学 2026 秋季新课 CME 295: Transformers & Large Language Models 已开课(第一讲公开)
@stanfordnlp 这门课程由双胞胎兄弟
@afshinea @shervinea 主讲,9 讲走完 LLM 全部版图:从 Transformer 架构、注意力变体、RoPE,到 LoRA 微调、RLHF/GRPO 训练,再到 Flash Attention 推理优化、MCP 与 AI Agent、扩散语言模型。
第一讲 Transformers 课件和课程视频都已公开: