✳flâneur — a map of the web's best reading
Transformers are RNNs: Fast Autoregressive Transformers with Linear Attention
arxiv.org · saved by 1 readers
N/A
Explore this link on the map →related reading
- Transformer Explainer: LLM Transformer Model Visually Explainedpoloclub.github.io
- The Annotated Transformernlp.seas.harvard.edu
- Transformers from Scratche2eml.school
- Set Transformer: A Framework for Attention-basedPermutation-Invariant Neural Networksarxiv.org
- Efficiently Scaling Transformer Inferencearxiv.org
- The Annotated Transformernlp.seas.harvard.edu
- Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Modelsarxiv.org
- Transformers Explained Visually (Part 1): Overview of Functionality | Towards Data Sciencetowardsdatascience.com
- Transformer (deep learning) - Wikipediaen.wikipedia.org
- Full Stack Optimization of Transformer Inference: a Surveyarxiv.org
- Transformers Explained Visually (Part 1): Overview of Functionality | Towards Data Sciencetowardsdatascience.com
- Language Models are Unsupervised Multitask Learnerscdn.openai.com