arXiv · 2502.12146
Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening
Abstract
We propose Diffusion-Sharpening, a fine-tuning approach that enhances downstream alignment by optimizing sampling trajectories. Existing RL-based fine-tuning methods focus on single training timesteps and neglect trajectory-level alignment, while recent sampling trajectory optimization methods incur significant inference NFE costs. Diffusion-Sharpening overcomes this by using a path integral framework to select optimal trajectories during training, leveraging reward feedback, and amortizing inference costs. Our method demonstrates superior training efficiency with faster convergence, and best inference efficiency without requiring additional NFEs. Extensive experiments show that Diffusion-Sharpening outperforms RL-based fine-tuning methods (e.g., Diffusion-DPO) and sampling trajectory optimization methods (e.g., Inference Scaling) across diverse metrics including text alignment, compositional capabilities, and human preferences, offering a scalable and efficient solution for future diffusion model fine-tuning. Code: https://github.com/Gen-Verse/Diffusion-Sharpening
Explore related subjects
Keep this discovery
Explore connections, maps & timelines
Ye Tian, Ling Yang, Xinchen Zhang, Yunhai Tong, Mengdi Wang, Bin Cui. 2025-02-17. Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening. https://arxiv.org/abs/2502.12146
Cite the original work for its findings. Save a collection to share your selection of sources.