1 个章节·按类别展开/折叠
知识
QLoRA 三大创新
QLoRA = 4-bit 量化基础模型 + LoRA 适配器。
相比 LoRA(FP16 基础模型):基础模型显存 14 GB → 7 GB(-50%),总显存 ~20 GB → ~6 GB(-70%)。
关键组件:
- NF4 数据类型(NormalFloat 4-bit)
- Double Quantization(量化常量也量化)
- Paged Optimizers(CPU-GPU 内存分页)
精度损失:通常 < 1%。
适用:消费级 GPU(16GB 以下)、笔记本、Colab 免费版。