2106.09685
arxiv.org · 7,955 words · saved by 1 readers
N/A
L O RA: L OW-R ANK A DAPTATION OF L ARGE L AN - GUAGE M ODELS Edward Hu∗ Yelong Shen∗ Phillip Wallis Zeyuan Allen-Zhu Yuanzhi Li Shean Wang Lu Wang Weizhu Chen Microsoft Corporation {edwardhu, yeshe, phwallis, zeyuana, yuanzhil, swang, luw, wzchen}@microsoft.com…
related reading
- [2106.09685] LoRA: Low-Rank Adaptation of Large Language Modelsarxiv.org
- LoRA Without Regret - Thinking Machines Labthinkingmachines.ai
- Parameter-Efficient LLM Finetuning With Low-Rank Adaptation (LoRA) - Lightning AIlightning.ai
- Recent Advances in Language Model Fine-tuningruder.io
- [2506.06105] Text-to-LoRA: Instant Transformer Adaptionarxiv.org
- LoRA vs Full Fine-tuning: An Illusion of Equivalencearxiv.org
- Learning to Reason in 13 Parametersarxiv.org
- Understanding Large Language Modelsmagazine.sebastianraschka.com
- PEFT Method Overview [implementing Adapters in PyTorch] | Eva Korolevaxmarva.github.io
- [2005.14165] Language Models are Few-Shot Learnersarxiv.org
- Large Language Models Reading List | Sebastian Raschka, PhDsebastianraschka.com
- Getting Caught Up to Modern LLM Research | Samarth Goeldev.samarthgoel.com