From Bits to Rounds: Parallel Decoding with Exploration for Diffusion Language Models
arxiv.org · 6,983 words · saved by 1 readers
N/A
From Bits to Rounds: Parallel Decoding with Exploration for Diffusion Language Models Hengyu Fu∗† Baihe Huang∗† Virginia Adams ‡ Charles Wang‡ Venkat Srinivasan‡ Jiantao Jiao∗‡ arXiv:2511.21103v1 [cs.LG] 26 Nov 2025 Abstract Diffusion…
related reading
- Speculative Decoding - philkravphilkrav.com
- CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Creditsarxiv.org
- Speculative Decoding: How It Evolved, When It Stays Lossless, and What's Nextneurips2026-speculative-decoding.vercel.app
- 2409.02908arxiv.org
- Fast Inference from Transformers via Speculative Decodingarxiv.org
- Esoteric Language Modelsarxiv.org
- Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decodingarxiv.org
- Fast Inference from Transformers via Speculative Decodingarxiv.org
- Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusionarxiv.org
- Accelerating Diffusion LLMs via Adaptive Parallel Decodingarxiv.org
- Decoding Speculative Decoding from First Principlesjwlabs.vercel.app
- How can LLM RL Work Despite Information-Theoretic Inefficiencyberen.io