课程目录

第三方系统课整理 · 大模型实践

动手学大模型(上海交大)

Dive into LLMs (SJTU)

上海交通大学《自然语言处理前沿技术》(NIS8021)与《人工智能安全技术》(NIS3353)课程讲义拓展而来的公益编程实践教程,从微调部署、提示学习一路做到水印、越狱、隐写与智能体安全。

学习状态
可学习
难度
进阶
预计时长
11 章 · 自定进度

课程目录

  1. 01 微调与部署:把预训练模型跑成一个 DemoFine-tuning and Deployment 对应官方章节:documents/chapter1 微调与部署
  2. 02 提示学习与思维链:从 API 调用到推理分解Prompt Learning and Chain-of-Thought 对应官方章节:documents/chapter2 提示学习与思维链
  3. 03 知识编辑:用 EasyEdit 改掉模型记住的一条事实Knowledge Editing 对应官方章节:documents/chapter3 知识编辑
  4. 04 数学推理:蒸馏一个迷你 R1Mathematical Reasoning 对应官方章节:documents/chapter4 数学推理
  5. 05 模型水印:给生成文本盖一个看不见的章Model Watermarking 对应官方章节:documents/chapter5 模型水印
  6. 06 越狱攻击:用 EasyJailbreak 量出安全边界Jailbreak Attacks 对应官方章节:documents/chapter6 越狱攻击
  7. 07 大模型隐写:把比特藏进流畅的句子里LLM Steganography 对应官方章节:documents/chapter7 大模型隐写
  8. 08 多模态模型:编码器—LLM—解码器怎么拼起来Multimodal Large Language Models 对应官方章节:documents/chapter8 多模态模型
  9. 09 GUI 智能体:让模型自己点手机GUI Agents 对应官方章节:documents/chapter9 GUI智能体
  10. 10 智能体安全:模型能不能意识到自己闯了祸Agent Safety 对应官方章节:documents/chapter10 智能体安全
  11. 11 RLHF 安全对齐:把 PPO 跑通一遍RLHF Safety Alignment 对应官方章节:documents/chapter11 RLHF安全对齐