VIRES: Video Instance Repainting via Sketch and Text Guided Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Weng, Shuchen, Zheng, Haojie, Zhang, Peixuan, Hong, Yuchen, Jiang, Han, Li, Si, Shi, Boxin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Deeper Emotional Reflection: Crafting Affective Image Filters with Generative Priors
par: Zhang, Peixuan, et autres
Publié: (2025)
par: Zhang, Peixuan, et autres
Publié: (2025)
InstructAV2AV: Instruction-Guided Audio-Video Joint Editing
par: Zheng, Haojie, et autres
Publié: (2026)
par: Zheng, Haojie, et autres
Publié: (2026)
AVI-Edit: Audio-sync Video Instance Editing with Granularity-Aware Mask Refiner
par: Zheng, Haojie, et autres
Publié: (2025)
par: Zheng, Haojie, et autres
Publié: (2025)
Audio-Sync Video Generation with Multi-Stream Temporal Control
par: Weng, Shuchen, et autres
Publié: (2025)
par: Weng, Shuchen, et autres
Publié: (2025)
Affective Image Editing: Shaping Emotional Factors via Text Descriptions
par: Zhang, Peixuan, et autres
Publié: (2025)
par: Zhang, Peixuan, et autres
Publié: (2025)
STAGE: Storyboard-Anchored Generation for Cinematic Multi-shot Narrative
par: Zhang, Peixuan, et autres
Publié: (2025)
par: Zhang, Peixuan, et autres
Publié: (2025)
ReContraster: Making Your Posters Stand Out with Regional Contrast
par: Zhang, Peixuan, et autres
Publié: (2026)
par: Zhang, Peixuan, et autres
Publié: (2026)
Lighting-grounded Video Generation with Renderer-based Agent Reasoning
par: Cai, Ziqi, et autres
Publié: (2026)
par: Cai, Ziqi, et autres
Publié: (2026)
Personalized Image Filter: Mastering Your Photographic Style
par: Zhu, Chengxuan, et autres
Publié: (2025)
par: Zhu, Chengxuan, et autres
Publié: (2025)
L-C4: Language-Based Video Colorization for Creative and Consistent Color
par: Chang, Zheng, et autres
Publié: (2024)
par: Chang, Zheng, et autres
Publié: (2024)
Language-guided Image Reflection Separation
par: Zhong, Haofeng, et autres
Publié: (2024)
par: Zhong, Haofeng, et autres
Publié: (2024)
A Benchmark and Multi-Agent System for Instruction-driven Cinematic Video Compilation
par: Zhang, Peixuan, et autres
Publié: (2026)
par: Zhang, Peixuan, et autres
Publié: (2026)
PanoWan: Lifting Diffusion Video Generation Models to 360° with Latitude/Longitude-aware Mechanisms
par: Xia, Yifei, et autres
Publié: (2025)
par: Xia, Yifei, et autres
Publié: (2025)
InstanceAnimator: Multi-Instance Sketch Video Colorization
par: Zhang, Yinhan, et autres
Publié: (2026)
par: Zhang, Yinhan, et autres
Publié: (2026)
Colorizing Monochromatic Radiance Fields
par: Cheng, Yean, et autres
Publié: (2024)
par: Cheng, Yean, et autres
Publié: (2024)
Text-Guided Multi-Instance Learning for Scoliosis Screening via Gait Video Analysis
par: Li, Haiqing, et autres
Publié: (2025)
par: Li, Haiqing, et autres
Publié: (2025)
SketchAnimator: Animate Sketch via Motion Customization of Text-to-Video Diffusion Models
par: Yang, Ruolin, et autres
Publié: (2025)
par: Yang, Ruolin, et autres
Publié: (2025)
SketchVideo: Sketch-based Video Generation and Editing
par: Liu, Feng-Lin, et autres
Publié: (2025)
par: Liu, Feng-Lin, et autres
Publié: (2025)
Prune and Repaint: Content-Aware Image Retargeting for any Ratio
par: Shen, Feihong, et autres
Publié: (2024)
par: Shen, Feihong, et autres
Publié: (2024)
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
par: Cheng, Zesen, et autres
Publié: (2024)
par: Cheng, Zesen, et autres
Publié: (2024)
Spin-UP: Spin Light for Natural Light Uncalibrated Photometric Stereo
par: Li, Zongrui, et autres
Publié: (2024)
par: Li, Zongrui, et autres
Publié: (2024)
InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption
par: Fan, Tiehan, et autres
Publié: (2024)
par: Fan, Tiehan, et autres
Publié: (2024)
FlipSketch: Flipping Static Drawings to Text-Guided Sketch Animations
par: Bandyopadhyay, Hmrishav, et autres
Publié: (2024)
par: Bandyopadhyay, Hmrishav, et autres
Publié: (2024)
Planning with Sketch-Guided Verification for Physics-Aware Video Generation
par: Huang, Yidong, et autres
Publié: (2025)
par: Huang, Yidong, et autres
Publié: (2025)
VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control
par: Jiang, Lifan, et autres
Publié: (2025)
par: Jiang, Lifan, et autres
Publié: (2025)
InstanceV: Instance-Level Video Generation
par: Chen, Yuheng, et autres
Publié: (2025)
par: Chen, Yuheng, et autres
Publié: (2025)
Follow-Your-Color: Multi-Instance Sketch Colorization
par: Zhang, Yinhan, et autres
Publié: (2025)
par: Zhang, Yinhan, et autres
Publié: (2025)
Sketch-Guided Scene Image Generation
par: Zhang, Tianyu, et autres
Publié: (2024)
par: Zhang, Tianyu, et autres
Publié: (2024)
Text to Sketch Generation with Multi-Styles
par: Li, Tengjie, et autres
Publié: (2025)
par: Li, Tengjie, et autres
Publié: (2025)
E2VIDiff: Perceptual Events-to-Video Reconstruction using Diffusion Priors
par: Liang, Jinxiu, et autres
Publié: (2024)
par: Liang, Jinxiu, et autres
Publié: (2024)
SketchTriplet: Self-Supervised Scenarized Sketch-Text-Image Triplet Generation
par: Wu, Zhenbei, et autres
Publié: (2024)
par: Wu, Zhenbei, et autres
Publié: (2024)
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
par: Brioschi, Riccardo, et autres
Publié: (2025)
par: Brioschi, Riccardo, et autres
Publié: (2025)
VRMDiff: Text-Guided Video Referring Matting Generation of Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
ReAlign: Bilingual Text-to-Motion Generation via Step-Aware Reward-Guided Alignment
par: Weng, Wanjiang, et autres
Publié: (2025)
par: Weng, Wanjiang, et autres
Publié: (2025)
MonoInstance: Enhancing Monocular Priors via Multi-view Instance Alignment for Neural Rendering and Reconstruction
par: Zhang, Wenyuan, et autres
Publié: (2025)
par: Zhang, Wenyuan, et autres
Publié: (2025)
PolGS++: Physically-Guided Polarimetric Gaussian Splatting for Fast Reflective Surface Reconstruction
par: Han, Yufei, et autres
Publié: (2026)
par: Han, Yufei, et autres
Publié: (2026)
Instance Segmentation of Scene Sketches Using Natural Image Priors
par: Tang, Mia, et autres
Publié: (2025)
par: Tang, Mia, et autres
Publié: (2025)
SketchAgent: Language-Driven Sequential Sketch Generation
par: Vinker, Yael, et autres
Publié: (2024)
par: Vinker, Yael, et autres
Publié: (2024)
Instruction-Guided Scene Text Recognition
par: Du, Yongkun, et autres
Publié: (2024)
par: Du, Yongkun, et autres
Publié: (2024)
UTA-Sign: Unsupervised Thermal Video Augmentation via Event-Assisted Traffic Signage Sketching
par: Han, Yuqi, et autres
Publié: (2025)
par: Han, Yuqi, et autres
Publié: (2025)
Documents similaires
-
Towards Deeper Emotional Reflection: Crafting Affective Image Filters with Generative Priors
par: Zhang, Peixuan, et autres
Publié: (2025) -
InstructAV2AV: Instruction-Guided Audio-Video Joint Editing
par: Zheng, Haojie, et autres
Publié: (2026) -
AVI-Edit: Audio-sync Video Instance Editing with Granularity-Aware Mask Refiner
par: Zheng, Haojie, et autres
Publié: (2025) -
Audio-Sync Video Generation with Multi-Stream Temporal Control
par: Weng, Shuchen, et autres
Publié: (2025) -
Affective Image Editing: Shaping Emotional Factors via Text Descriptions
par: Zhang, Peixuan, et autres
Publié: (2025)