Toward Training Superintelligent Software Agents through Self-Play SWE-RL
arxiv.org · 5,138 words · saved by 1 readers
N/A
Toward Training Superintelligent Software Agents through Self-Play SWE-RL Yuxiang Wei 12 Zhiqing Sun 3 Emily McMilin 1 Jonas Gehring 1 David Zhang 1 Gabriel Synnaeve 1 Daniel Fried 14 Lingming Zhang 2 Sida Wang 1 Abstract 2025b; FAIR CodeGen team et al., 2025; ByteDance Seed While current software agents powered by large…
saved by
related reading
- [2512.18552] Toward Training Superintelligent Software Agents through Self-Play SWE-RLarxiv.org
- 2502.18449arxiv.org
- Harness Engineering for Self-Improvement | Lil'Loglilianweng.github.io
- Composer2.pdfcursor.com
- SWE-1.7: Frontier Intelligence at a Fraction of the Costcognition.com
- LLM Powered Autonomous Agents | Lil'Loglilianweng.github.io
- Scaling Self-Play with Self-Guidancearxiv.org
- Scaling Agentic RL: 365,000+ Environments for SWE, Terminal, and Searchprimeintellect.ai
- How to fully automate software engineering | Mechanize, Inc.mechanize.work
- A Taxonomy of RL Environments for LLM Agentsleehanchung.github.io
- [2607.00053] SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasksarxiv.org
- [2603.08640] PostTrainBench: Can LLM Agents Automate LLM Post-Training?arxiv.org