LeftRefill: Filling Right Canvas based on Left Reference through Generalized Text-to-Image Diffusion Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Cao, Chenjie, Cai, Yunuo, Dong, Qiaole, Wang, Yikai, Fu, Yanwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AnyRefill: A Unified, Data-Efficient Framework for Left-Prompt-Guided Vision Tasks
por: Xie, Ming, et al.
Publicado: (2025)
por: Xie, Ming, et al.
Publicado: (2025)
Repositioning the Subject within Image
por: Wang, Yikai, et al.
Publicado: (2024)
por: Wang, Yikai, et al.
Publicado: (2024)
MemFlow: Optical Flow Estimation and Prediction with Memory
por: Dong, Qiaole, et al.
Publicado: (2024)
por: Dong, Qiaole, et al.
Publicado: (2024)
Online Dense Point Tracking with Streaming Memory
por: Dong, Qiaole, et al.
Publicado: (2025)
por: Dong, Qiaole, et al.
Publicado: (2025)
Towards Enhanced Image Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
por: Wang, Yikai, et al.
Publicado: (2023)
por: Wang, Yikai, et al.
Publicado: (2023)
MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model
por: Cao, Chenjie, et al.
Publicado: (2024)
por: Cao, Chenjie, et al.
Publicado: (2024)
Aligned Stable Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
por: Wang, Yikai, et al.
Publicado: (2026)
por: Wang, Yikai, et al.
Publicado: (2026)
MVSFormer++: Revealing the Devil in Transformer's Details for Multi-View Stereo
por: Cao, Chenjie, et al.
Publicado: (2024)
por: Cao, Chenjie, et al.
Publicado: (2024)
Improving Neural Surface Reconstruction with Feature Priors from Multi-View Image
por: Ren, Xinlin, et al.
Publicado: (2024)
por: Ren, Xinlin, et al.
Publicado: (2024)
Enhancing Video Inpainting with Aligned Frame Interval Guidance
por: Xie, Ming, et al.
Publicado: (2025)
por: Xie, Ming, et al.
Publicado: (2025)
The World is Your Canvas: Painting Promptable Events with Reference Images, Trajectories, and Text
por: Wang, Hanlin, et al.
Publicado: (2025)
por: Wang, Hanlin, et al.
Publicado: (2025)
The Pictorial Cortex: Zero-Shot Cross-Subject fMRI-to-Image Reconstruction via Compositional Latent Modeling
por: Huo, Jingyang, et al.
Publicado: (2026)
por: Huo, Jingyang, et al.
Publicado: (2026)
Cross-Chirality Palmprint Verification: Left is Right for the Right Palmprint
por: Gao, Chengrui, et al.
Publicado: (2024)
por: Gao, Chengrui, et al.
Publicado: (2024)
No Concept Left Behind: Test-Time Optimization for Compositional Text-to-Image Generation
por: Sameti, Mohammad Hossein, et al.
Publicado: (2025)
por: Sameti, Mohammad Hossein, et al.
Publicado: (2025)
Cross from Left to Right Brain: Adaptive Text Dreamer for Vision-and-Language Navigation
por: Zhang, Pingrui, et al.
Publicado: (2025)
por: Zhang, Pingrui, et al.
Publicado: (2025)
MVInpainter: Learning Multi-View Consistent Inpainting to Bridge 2D and 3D Editing
por: Cao, Chenjie, et al.
Publicado: (2024)
por: Cao, Chenjie, et al.
Publicado: (2024)
Text Image Inpainting via Global Structure-Guided Diffusion Models
por: Zhu, Shipeng, et al.
Publicado: (2024)
por: Zhu, Shipeng, et al.
Publicado: (2024)
SafeCtrl: Region-Based Safety Control for Text-to-Image Diffusion via Detect-Then-Suppress
por: Zhang, Lingyun, et al.
Publicado: (2025)
por: Zhang, Lingyun, et al.
Publicado: (2025)
Telling Left from Right: Identifying Geometry-Aware Semantic Correspondence
por: Zhang, Junyi, et al.
Publicado: (2023)
por: Zhang, Junyi, et al.
Publicado: (2023)
Using Left and Right Brains Together: Towards Vision and Language Planning
por: Cen, Jun, et al.
Publicado: (2024)
por: Cen, Jun, et al.
Publicado: (2024)
NSFW-Classifier Guided Prompt Sanitization for Safe Text-to-Image Generation
por: Xie, Yu, et al.
Publicado: (2025)
por: Xie, Yu, et al.
Publicado: (2025)
PPMStereo: Pick-and-Play Memory Construction for Consistent Dynamic Stereo Matching
por: Wang, Yun, et al.
Publicado: (2025)
por: Wang, Yun, et al.
Publicado: (2025)
CorrFill: Enhancing Faithfulness in Reference-based Inpainting with Correspondence Guidance in Diffusion Models
por: Liu, Kuan-Hung, et al.
Publicado: (2025)
por: Liu, Kuan-Hung, et al.
Publicado: (2025)
EgoSound: Benchmarking Sound Understanding in Egocentric Videos
por: Zhu, Bingwen, et al.
Publicado: (2026)
por: Zhu, Bingwen, et al.
Publicado: (2026)
Canvas-to-Image: Compositional Image Generation with Multimodal Controls
por: Dalva, Yusuf, et al.
Publicado: (2025)
por: Dalva, Yusuf, et al.
Publicado: (2025)
MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation
por: Xing, Jinbo, et al.
Publicado: (2025)
por: Xing, Jinbo, et al.
Publicado: (2025)
UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models
por: Zhang, Yihua, et al.
Publicado: (2024)
por: Zhang, Yihua, et al.
Publicado: (2024)
Controllable Generation with Text-to-Image Diffusion Models: A Survey
por: Cao, Pu, et al.
Publicado: (2024)
por: Cao, Pu, et al.
Publicado: (2024)
Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation
por: Cao, Chenjie, et al.
Publicado: (2025)
por: Cao, Chenjie, et al.
Publicado: (2025)
Pinterest Canvas: Large-Scale Image Generation at Pinterest
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
No Modality Left Behind: Dynamic Model Generation for Incomplete Medical Data
por: Fürböck, Christoph, et al.
Publicado: (2025)
por: Fürböck, Christoph, et al.
Publicado: (2025)
LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion
por: Zhang, Yisu, et al.
Publicado: (2025)
por: Zhang, Yisu, et al.
Publicado: (2025)
Divide and Conquer: A Large-Scale Dataset and Model for Left-Right Breast MRI Segmentation
por: Rokuss, Maximilian, et al.
Publicado: (2025)
por: Rokuss, Maximilian, et al.
Publicado: (2025)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
por: Wang, Zhendong, et al.
Publicado: (2025)
por: Wang, Zhendong, et al.
Publicado: (2025)
Towards Global Optimal Visual In-Context Learning Prompt Selection
por: Xu, Chengming, et al.
Publicado: (2024)
por: Xu, Chengming, et al.
Publicado: (2024)
3D StreetUnveiler with Semantic-aware 2DGS -- a simple baseline
por: Xu, Jingwei, et al.
Publicado: (2024)
por: Xu, Jingwei, et al.
Publicado: (2024)
DiffRIS: Enhancing Referring Remote Sensing Image Segmentation with Pre-trained Text-to-Image Diffusion Models
por: Dong, Zhe, et al.
Publicado: (2025)
por: Dong, Zhe, et al.
Publicado: (2025)
TurboFill: Adapting Few-step Text-to-image Model for Fast Image Inpainting
por: Xie, Liangbin, et al.
Publicado: (2025)
por: Xie, Liangbin, et al.
Publicado: (2025)
Text-DiFuse: An Interactive Multi-Modal Image Fusion Framework based on Text-modulated Diffusion Model
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
Fill in the ____ (a Diffusion-based Image Inpainting Pipeline)
por: Gebre, Eyoel, et al.
Publicado: (2024)
por: Gebre, Eyoel, et al.
Publicado: (2024)
Ejemplares similares
-
AnyRefill: A Unified, Data-Efficient Framework for Left-Prompt-Guided Vision Tasks
por: Xie, Ming, et al.
Publicado: (2025) -
Repositioning the Subject within Image
por: Wang, Yikai, et al.
Publicado: (2024) -
MemFlow: Optical Flow Estimation and Prediction with Memory
por: Dong, Qiaole, et al.
Publicado: (2024) -
Online Dense Point Tracking with Streaming Memory
por: Dong, Qiaole, et al.
Publicado: (2025) -
Towards Enhanced Image Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
por: Wang, Yikai, et al.
Publicado: (2023)