返回学习地图
trainingPhase D · 第 28

D3.2 QLoRA(量化 + LoRA)

6GB 显存微调 7B 模型,笔记本也能跑

1 个章节·按类别展开/折叠
知识

QLoRA 三大创新

QLoRA = 4-bit 量化基础模型 + LoRA 适配器。

相比 LoRA(FP16 基础模型):基础模型显存 14 GB → 7 GB(-50%),总显存 ~20 GB → ~6 GB(-70%)。

关键组件:

  1. NF4 数据类型(NormalFloat 4-bit)
  2. Double Quantization(量化常量也量化)
  3. Paged Optimizers(CPU-GPU 内存分页)

精度损失:通常 < 1%。

适用:消费级 GPU(16GB 以下)、笔记本、Colab 免费版。