Discrete Diffusion Bridges for Spatiotemporally Aligned Image Translation and Generation
Paper β’ 2608.29997 β’ Published β’ 2
How to use xing0916/DDB_Edit with Diffusers:
pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import load_image
# switch to "mps" for apple devices
pipe = DiffusionPipeline.from_pretrained("xing0916/DDB_Edit", dtype=torch.bfloat16, device_map="cuda")
prompt = "Turn this cat into a dog"
input_image = load_image("https://huggingface.co/datasets/huggingface/documentation-images/resolve/main/diffusers/cat.png")
image = pipe(image=input_image, prompt=prompt).images[0]import torch
from diffusers import DiffusionPipeline
from diffusers.utils import load_image
# switch to "mps" for apple devices
pipe = DiffusionPipeline.from_pretrained("xing0916/DDB_Edit", dtype=torch.bfloat16, device_map="cuda")
prompt = "Turn this cat into a dog"
input_image = load_image("https://huggingface.co/datasets/huggingface/documentation-images/resolve/main/diffusers/cat.png")
image = pipe(image=input_image, prompt=prompt).images[0]Paper: Discrete Diffusion Bridges for Spatiotemporally Aligned Image Translation and Generation
Code: GitHub
DDB (Discrete Diffusion Bridges) is a framework for spatially and temporally aligned image translation and generation. It introduces:
DDB supports text-guided image editing, structural image translation, and text-to-image generation.