2112.04426
arxiv.org · 7,418 words · saved by 1 readers
N/A
Improving language models by retrieving from trillions of tokens Sebastian Borgeaud† , Arthur Mensch† , Jordan Hoffmann† , Trevor Cai, Eliza Rutherford, Katie Millican, George van den Driessche, Jean-Baptiste Lespiau, Bogdan Damoc, Aidan Clark, Diego de Las Casas, Aurelia Guy, Jacob Menick, Roman Ring, Tom Hennigan, Saffron Huang, Loren Maggiore, Chris Jones, Albin Cassirer, Andy Brock, Michela…
related reading
- Improving language models by retrieving from trillions of tokensarxiv.org
- [2005.11401] Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasksarxiv.org
- Recursive Language Models | Alex L. Zhangalexzhang13.github.io
- Patterns for Building LLM-based Systems & Productseugeneyan.com
- [2002.08909] REALM: Retrieval-Augmented Language Model Pre-Trainingarxiv.org
- Getting Caught Up to Modern LLM Research | Samarth Goeldev.samarthgoel.com
- [2005.14165] Language Models are Few-Shot Learnersarxiv.org
- [2605.15156] MeMo: Memory as a Modelarxiv.org
- 2025.findings-emnlp.313.pdfaclanthology.org
- Generalized Language Models | Lil'Loglilianweng.github.io
- Large Language Models Reading List | Sebastian Raschka, PhDsebastianraschka.com
- The Bitter Lesson is coming for Tokenization – ⛰️ lucalplucalp.dev