第三方系统课整理 · 大模型实践
动手学大模型(上海交大)
Dive into LLMs (SJTU)
上海交通大学《自然语言处理前沿技术》(NIS8021)与《人工智能安全技术》(NIS3353)课程讲义拓展而来的公益编程实践教程,从微调部署、提示学习一路做到水印、越狱、隐写与智能体安全。
课程目录
- 01 微调与部署:把预训练模型跑成一个 DemoFine-tuning and Deployment 对应官方章节:documents/chapter1 微调与部署
- 02 提示学习与思维链:从 API 调用到推理分解Prompt Learning and Chain-of-Thought 对应官方章节:documents/chapter2 提示学习与思维链
- 03 知识编辑:用 EasyEdit 改掉模型记住的一条事实Knowledge Editing 对应官方章节:documents/chapter3 知识编辑
- 04 数学推理:蒸馏一个迷你 R1Mathematical Reasoning 对应官方章节:documents/chapter4 数学推理
- 05 模型水印:给生成文本盖一个看不见的章Model Watermarking 对应官方章节:documents/chapter5 模型水印
- 06 越狱攻击:用 EasyJailbreak 量出安全边界Jailbreak Attacks 对应官方章节:documents/chapter6 越狱攻击
- 07 大模型隐写:把比特藏进流畅的句子里LLM Steganography 对应官方章节:documents/chapter7 大模型隐写
- 08 多模态模型:编码器—LLM—解码器怎么拼起来Multimodal Large Language Models 对应官方章节:documents/chapter8 多模态模型
- 09 GUI 智能体:让模型自己点手机GUI Agents 对应官方章节:documents/chapter9 GUI智能体
- 10 智能体安全:模型能不能意识到自己闯了祸Agent Safety 对应官方章节:documents/chapter10 智能体安全
- 11 RLHF 安全对齐:把 PPO 跑通一遍RLHF Safety Alignment 对应官方章节:documents/chapter11 RLHF安全对齐