QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Management
arxiv.org · 5,747 words · saved by 1 readers
N/A
December 16, 2025 QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Management Weizhou Shen∗ Ziyi Yang∗ Chenliang Li∗ Zhiyuan Lu Miao Peng Huashan Sun Yingcheng Shi Shengyi Liao Shaopeng Lai Bo Zhang Dayiheng Liu Fei Huang…
saved by
related reading
- DeepSeek-V3.2: Pushing the Frontier of Open Large Language Modelsarxiv.org
- Google Scholarscholar.google.com
- DeepSeek-R1arxiv.org
- Explore | alphaXivalphaxiv.org
- Recursive Language Models | Alex L. Zhangalexzhang13.github.io
- Generalizing an LLM from 8k to 1M Context using Qwen-Agent | Qwenqwenlm.github.io
- Extending Context is Hard | kaiokendevkaiokendev.github.io
- State of RL for reasoning LLMs | A. Weersaweers.de
- GLM-5.2: Built for Long-Horizon Tasksz.ai
- [2505.17373] Value-Guided Search for Efficient Chain-of-Thought Reasoningarxiv.org
- Reimagining LLM Memory: Using Context as Training Data Unlocks Models That Learn at Test-Time | NVIDIA Technical Blogdeveloper.nvidia.com
- Explore | alphaXivalphaxiv.org