2005.14165
arxiv.org · 8,656 words · saved by 1 readers
N/A
Language Models are Few-Shot Learners Tom B. Brown∗ Benjamin Mann∗ Nick Ryder∗ Melanie Subbiah∗ Jared Kaplan† Prafulla Dhariwal Arvind Neelakantan Pranav Shyam Girish Sastry Amanda Askell Sandhini Agarwal Ariel Herbert-Voss Gretchen Krueger Tom Henighan arXiv:2005.14165v4 [cs.CL] 22 Jul 2020…
saved by
related reading
- [2005.14165] Language Models are Few-Shot Learnersarxiv.org
- 1810.04805arxiv.org
- 2305.14314arxiv.org
- [2005.14165] Language Models are Few-Shot Learnersarxiv.org
- Review for NeurIPS paper: Language Models are Few-Shot Learnersproceedings.neurips.cc
- Generalized Language Models | Lil'Loglilianweng.github.io
- Pathways Language Model (PaLM): Scaling to 540 Billion Parameters for Breakthrouai.googleblog.com
- Recent Advances in Language Model Fine-tuningruder.io
- gpt-4.pdfcdn.openai.com
- Language Models are Unsupervised Multitask Learnerscdn.openai.com
- The upcoming GPT-3 moment for RL | Mechanize, Inc.mechanize.work
- More Efficient In-Context Learning with GLaMblog.research.google