Zippo: Zipping Color and Transparency Distributions into a Single Diffusion Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Kangyang, Yang, Binbin, Chen, Hao, Wang, Meng, Zou, Cheng, Xue, Hui, Yang, Ming, Shen, Chunhua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
par: Wang, Wen, et autres
Publié: (2023)
par: Wang, Wen, et autres
Publié: (2023)
What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?
par: Xu, Guangkai, et autres
Publié: (2024)
par: Xu, Guangkai, et autres
Publié: (2024)
Generative Video Matting
par: Ge, Yongtao, et autres
Publié: (2025)
par: Ge, Yongtao, et autres
Publié: (2025)
ZipGait: Bridging Skeleton and Silhouette with Diffusion Model for Advancing Gait Recognition
par: Min, Fanxu, et autres
Publié: (2024)
par: Min, Fanxu, et autres
Publié: (2024)
StyleTokenizer: Defining Image Style by a Single Instance for Controlling Diffusion Models
par: Li, Wen, et autres
Publié: (2024)
par: Li, Wen, et autres
Publié: (2024)
Diffusion Models are Efficient Data Generators for Human Mesh Recovery
par: Ge, Yongtao, et autres
Publié: (2024)
par: Ge, Yongtao, et autres
Publié: (2024)
FreeCompose: Generic Zero-Shot Image Composition with Diffusion Prior
par: Chen, Zhekai, et autres
Publié: (2024)
par: Chen, Zhekai, et autres
Publié: (2024)
Unleashing the Potential of the Diffusion Model in Few-shot Semantic Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024)
par: Zhu, Muzhi, et autres
Publié: (2024)
Traffic Scene Parsing through the TSP6K Dataset
par: Jiang, Peng-Tao, et autres
Publié: (2023)
par: Jiang, Peng-Tao, et autres
Publié: (2023)
Active-O3: Empowering Multimodal Large Language Models with Active Perception via GRPO
par: Zhu, Muzhi, et autres
Publié: (2025)
par: Zhu, Muzhi, et autres
Publié: (2025)
DiverGen: Improving Instance Segmentation by Learning Wider Data Distribution with More Diverse Generative Data
par: Fan, Chengxiang, et autres
Publié: (2024)
par: Fan, Chengxiang, et autres
Publié: (2024)
ForensicZip: More Tokens are Better but Not Necessary in Forensic Vision-Language Models
par: Lai, Yingxin, et autres
Publié: (2026)
par: Lai, Yingxin, et autres
Publié: (2026)
SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories
par: Zhu, Muzhi, et autres
Publié: (2025)
par: Zhu, Muzhi, et autres
Publié: (2025)
Diffusion Knows Transparency: Repurposing Video Diffusion for Transparent Object Depth and Normal Estimation
par: Xu, Shaocong, et autres
Publié: (2025)
par: Xu, Shaocong, et autres
Publié: (2025)
ZipIR: Latent Pyramid Diffusion Transformer for High-Resolution Image Restoration
par: Yu, Yongsheng, et autres
Publié: (2025)
par: Yu, Yongsheng, et autres
Publié: (2025)
Video Virtual Try-on with Conditional Diffusion Transformer Inpainter
par: Zou, Cheng, et autres
Publié: (2025)
par: Zou, Cheng, et autres
Publié: (2025)
UnZipLoRA: Separating Content and Style from a Single Image
par: Liu, Chang, et autres
Publié: (2024)
par: Liu, Chang, et autres
Publié: (2024)
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
par: Mao, Shizhuo, et autres
Publié: (2025)
par: Mao, Shizhuo, et autres
Publié: (2025)
Unpaired Deblurring via Decoupled Diffusion Model
par: Cheng, Junhao, et autres
Publié: (2025)
par: Cheng, Junhao, et autres
Publié: (2025)
RGM: A Robust Generalizable Matching Model
par: Zhang, Songyan, et autres
Publié: (2023)
par: Zhang, Songyan, et autres
Publié: (2023)
A Single Neuron Works: Precise Concept Erasure in Text-to-Image Diffusion Models
par: He, Qinqin, et autres
Publié: (2025)
par: He, Qinqin, et autres
Publié: (2025)
DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks
par: Zhao, Canyu, et autres
Publié: (2025)
par: Zhao, Canyu, et autres
Publié: (2025)
Tinker: Diffusion's Gift to 3D--Multi-View Consistent Editing From Sparse Inputs without Per-Scene Optimization
par: Zhao, Canyu, et autres
Publié: (2025)
par: Zhao, Canyu, et autres
Publié: (2025)
Matcher: Segment Anything with One Shot Using All-Purpose Feature Matching
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Object-aware Inversion and Reassembly for Image Editing
par: Yang, Zhen, et autres
Publié: (2023)
par: Yang, Zhen, et autres
Publié: (2023)
A Geometric Perspective on Diffusion Models
par: Chen, Defang, et autres
Publié: (2023)
par: Chen, Defang, et autres
Publié: (2023)
FIND: Fine-tuning Initial Noise Distribution with Policy Optimization for Diffusion Models
par: Chen, Changgu, et autres
Publié: (2024)
par: Chen, Changgu, et autres
Publié: (2024)
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
par: Wang, Tao, et autres
Publié: (2024)
par: Wang, Tao, et autres
Publié: (2024)
Distribution-Aware Data Expansion with Diffusion Models
par: Zhu, Haowei, et autres
Publié: (2024)
par: Zhu, Haowei, et autres
Publié: (2024)
MARBLE: Multi-Aspect Reward Balance for Diffusion RL
par: Zhao, Canyu, et autres
Publié: (2026)
par: Zhao, Canyu, et autres
Publié: (2026)
Controllable-Continuous Color Editing in Diffusion Model via Color Mapping
par: Yang, Yuqi, et autres
Publié: (2025)
par: Yang, Yuqi, et autres
Publié: (2025)
Paragraph-to-Image Generation with Information-Enriched Diffusion Model
par: Wu, Weijia, et autres
Publié: (2023)
par: Wu, Weijia, et autres
Publié: (2023)
DiffuMask: Synthesizing Images with Pixel-level Annotations for Semantic Segmentation Using Diffusion Models
par: Wu, Weijia, et autres
Publié: (2023)
par: Wu, Weijia, et autres
Publié: (2023)
HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion
par: Zeng, Yu, et autres
Publié: (2024)
par: Zeng, Yu, et autres
Publié: (2024)
Distribution Backtracking Builds A Faster Convergence Trajectory for Diffusion Distillation
par: Zhang, Shengyuan, et autres
Publié: (2024)
par: Zhang, Shengyuan, et autres
Publié: (2024)
Enhancing Single Image to 3D Generation using Gaussian Splatting and Hybrid Diffusion Priors
par: Basak, Hritam, et autres
Publié: (2024)
par: Basak, Hritam, et autres
Publié: (2024)
Towards a Transparent and Interpretable AI Model for Medical Image Classifications
par: Wen, Binbin, et autres
Publié: (2025)
par: Wen, Binbin, et autres
Publié: (2025)
TransDiff: Diffusion-Based Method for Manipulating Transparent Objects Using a Single RGB-D Image
par: Wang, Haoxiao, et autres
Publié: (2025)
par: Wang, Haoxiao, et autres
Publié: (2025)
Single Image Rolling Shutter Removal with Diffusion Models
par: Yang, Zhanglei, et autres
Publié: (2024)
par: Yang, Zhanglei, et autres
Publié: (2024)
VisionZip: Longer is Better but Not Necessary in Vision Language Models
par: Yang, Senqiao, et autres
Publié: (2024)
par: Yang, Senqiao, et autres
Publié: (2024)
Documents similaires
-
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
par: Wang, Wen, et autres
Publié: (2023) -
What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?
par: Xu, Guangkai, et autres
Publié: (2024) -
Generative Video Matting
par: Ge, Yongtao, et autres
Publié: (2025) -
ZipGait: Bridging Skeleton and Silhouette with Diffusion Model for Advancing Gait Recognition
par: Min, Fanxu, et autres
Publié: (2024) -
StyleTokenizer: Defining Image Style by a Single Instance for Controlling Diffusion Models
par: Li, Wen, et autres
Publié: (2024)