MultiDiffusion: Fusing Diffusion Paths for Controlled Image Generation
multidiffusion.github.io · 366 words · saved by 1 readers
Project page for 'MultiDiffusion: Fusing Diffusion Paths for Controlled Image Generation.'
Abstract Recent advances in text-to-image generation with diffusion models present transformative capabilities in image quality. However, user controllability of the generated image, and fast adaptation to new tasks still remains an open challenge, currently mostly addressed by costly and long re-training and fine-tuning or ad-hoc adaptations to specific image generation tasks. In this work, we present MultiDiffusion, a unified framework that enables versatile and controllable image generation, using a pre-trained text-to-image diffusion model, without any further training or finetuning. At…
saved by
related reading
- What are Diffusion Models?lilianweng.github.io
- The Illustrated Stable Diffusion – Jay Alammar – Visualizing machine learning one concept at a time.jalammar.github.io
- What are Diffusion Models? | Lil'Loglilianweng.github.io
- ⭐️ Diffusion Modelsandrewkchan.dev
- Universal Guidance for Diffusion Modelsarxiv.org
- An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversiontextual-inversion.github.io
- 2311.15980arxiv.org
- Bare-bones Diffusion Modelsmadebyoll.in
- VectorFusion: Text-to-SVG by Abstracting Pixel-Based Diffusion Modelsajayj.com
- GitHub - CompVis/stable-diffusion: A latent text-to-image diffusion modelgithub.com
- [2112.10752] High-Resolution Image Synthesis with Latent Diffusion Modelsarxiv.org
- google/diffusiongemma-26B-A4B-it · Hugging Facehuggingface.co