No.08工程开发

开源模型微调与部署

Fine-tuning & Serving Open Models

基于 Qwen、Llama 等开源模型,完成数据构造、LoRA 微调、量化与推理服务部署的完整链路。

难度
高阶
课时
22 节
时长
12 小时
更新
2026-08-15
开源模型微调与部署 课程封面

许衡AI 平台架构师

01你将收获

  1. 01

    构造高质量指令微调数据集

  2. 02

    完成 LoRA / QLoRA 微调

  3. 03

    使用 vLLM 部署高并发推理服务

02课程大纲

  1. Chapter 01

    数据

    2 节
    • 1.1指令数据构造
    • 1.2清洗与去重
  2. Chapter 02

    训练

    3 节
    • 2.1LoRA 与 QLoRA
    • 2.2超参数与显存优化
    • 2.3效果评估
  3. Chapter 03

    部署

    3 节
    • 3.1量化
    • 3.2vLLM 推理服务
    • 3.3监控与扩容

03适合人群

  • 需要私有化部署模型的企业团队
  • 有 Python 与深度学习基础的工程师
  • 算法与 MLOps 从业者

04讲师介绍

许衡

AI 平台架构师