返回 ppt-master
04_limitations.md
根目录 / examples / ppt169_lora_hu_2021 / notes / 04_limitations.md
1 那已有的高效适配方法为什么不够好?主要有三类局限。第一,Adapter 在网络里插入额外的层,加深了模型,会带来推理延迟,在线上、短序列、小批量的场景下尤其明显。第二,prefix 或 prompt tuning 用可训练的前缀 token 来适配,会挤占本就宝贵的输入序列长度。第三,也是最关键的,这些方法往往达不到全量微调的质量基线,逼着大家在效率和质量之间二选一。LoRA 想打破的,正是这个权衡。
1 lines MARKDOWN