VideoSketcher: Video Models Prior Enable Versatile Sequential Sketch Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Hui, Alaluf, Yuval, Tal, Omer Bar, Schwing, Alexander, Torralba, Antonio, Vinker, Yael |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SketchAgent: Language-Driven Sequential Sketch Generation
par: Vinker, Yael, et autres
Publié: (2024)
par: Vinker, Yael, et autres
Publié: (2024)
NeuralSVG: An Implicit Representation for Text-to-Vector Generation
par: Polaczek, Sagi, et autres
Publié: (2025)
par: Polaczek, Sagi, et autres
Publié: (2025)
Generative Visual Communication in the Era of Vision-Language Models
par: Vinker, Yael
Publié: (2024)
par: Vinker, Yael
Publié: (2024)
SwiftSketch: A Diffusion Model for Image-to-Vector Sketch Generation
par: Arar, Ellie, et autres
Publié: (2025)
par: Arar, Ellie, et autres
Publié: (2025)
Instance Segmentation of Scene Sketches Using Natural Image Priors
par: Tang, Mia, et autres
Publié: (2025)
par: Tang, Mia, et autres
Publié: (2025)
Piece it Together: Part-Based Concepting with IP-Priors
par: Richardson, Elad, et autres
Publié: (2025)
par: Richardson, Elad, et autres
Publié: (2025)
DynVFX: Augmenting Real Videos with Dynamic Content
par: Yatim, Danah, et autres
Publié: (2025)
par: Yatim, Danah, et autres
Publié: (2025)
MultiModal Action Conditioned Video Generation
par: Li, Yichen, et autres
Publié: (2025)
par: Li, Yichen, et autres
Publié: (2025)
Teaching an Agent to Sketch One Part at a Time
par: Du, Xiaodan, et autres
Publié: (2026)
par: Du, Xiaodan, et autres
Publié: (2026)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
par: Zhang, Yabo, et autres
Publié: (2024)
par: Zhang, Yabo, et autres
Publié: (2024)
SketchVideo: Sketch-based Video Generation and Editing
par: Liu, Feng-Lin, et autres
Publié: (2025)
par: Liu, Feng-Lin, et autres
Publié: (2025)
DiffSketcher: Text Guided Vector Sketch Synthesis through Latent Diffusion Models
par: Xing, Ximing, et autres
Publié: (2023)
par: Xing, Ximing, et autres
Publié: (2023)
GoMAvatar: Efficient Animatable Human Modeling from Monocular Video Using Gaussians-on-Mesh
par: Wen, Jing, et autres
Publié: (2024)
par: Wen, Jing, et autres
Publié: (2024)
StableSketcher: Enhancing Diffusion Model for Pixel-based Sketch Generation via Visual Question Answering Feedback
par: Park, Jiho, et autres
Publié: (2025)
par: Park, Jiho, et autres
Publié: (2025)
Enabling Versatile Controls for Video Diffusion Models
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
Implicit Style-Content Separation using B-LoRA
par: Frenkel, Yarden, et autres
Publié: (2024)
par: Frenkel, Yarden, et autres
Publié: (2024)
Lumiere: A Space-Time Diffusion Model for Video Generation
par: Bar-Tal, Omer, et autres
Publié: (2024)
par: Bar-Tal, Omer, et autres
Publié: (2024)
OW-VISCapTor: Abstractors for Open-World Video Instance Segmentation and Captioning
par: Choudhuri, Anwesa, et autres
Publié: (2024)
par: Choudhuri, Anwesa, et autres
Publié: (2024)
V-Bridge: Bridging Video Generative Priors to Versatile Few-shot Image Restoration
par: Zheng, Shenghe, et autres
Publié: (2026)
par: Zheng, Shenghe, et autres
Publié: (2026)
On Inductive Biases That Enable Generalization of Diffusion Transformers
par: An, Jie, et autres
Publié: (2024)
par: An, Jie, et autres
Publié: (2024)
pOps: Photo-Inspired Diffusion Operators
par: Richardson, Elad, et autres
Publié: (2024)
par: Richardson, Elad, et autres
Publié: (2024)
Pseudo-Generalized Dynamic View Synthesis from a Video
par: Zhao, Xiaoming, et autres
Publié: (2023)
par: Zhao, Xiaoming, et autres
Publié: (2023)
Putting the Object Back into Video Object Segmentation
par: Cheng, Ho Kei, et autres
Publié: (2023)
par: Cheng, Ho Kei, et autres
Publié: (2023)
UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors
par: Chen, Houyuan, et autres
Publié: (2026)
par: Chen, Houyuan, et autres
Publié: (2026)
MyVLM: Personalizing VLMs for User-Specific Queries
par: Alaluf, Yuval, et autres
Publié: (2024)
par: Alaluf, Yuval, et autres
Publié: (2024)
VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
par: Huang, Ziqi, et autres
Publié: (2024)
par: Huang, Ziqi, et autres
Publié: (2024)
Versatile Transition Generation with Image-to-Video Diffusion
par: Yang, Zuhao, et autres
Publié: (2025)
par: Yang, Zuhao, et autres
Publié: (2025)
AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark
par: Chai, Wenhao, et autres
Publié: (2024)
par: Chai, Wenhao, et autres
Publié: (2024)
DriveWAM: Video Generative Priors Enable Scalable World-Action Modeling for Autonomous Driving
par: Shi, Chen, et autres
Publié: (2026)
par: Shi, Chen, et autres
Publié: (2026)
SketchAnimator: Animate Sketch via Motion Customization of Text-to-Video Diffusion Models
par: Yang, Ruolin, et autres
Publié: (2025)
par: Yang, Ruolin, et autres
Publié: (2025)
VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control
par: Jiang, Lifan, et autres
Publié: (2025)
par: Jiang, Lifan, et autres
Publié: (2025)
PriorNet: Prior-Guided Engagement Estimation from Face Video
par: Vedernikov, Alexander
Publié: (2026)
par: Vedernikov, Alexander
Publié: (2026)
LiveSVG: Zero-Shot SVG Animation via Video Generation
par: Levy, Matan, et autres
Publié: (2026)
par: Levy, Matan, et autres
Publié: (2026)
Generative Neural Video Compression via Video Diffusion Prior
par: Mao, Qi, et autres
Publié: (2025)
par: Mao, Qi, et autres
Publié: (2025)
Image-Guided Geometric Stylization of 3D Meshes
par: Choi, Changwoon, et autres
Publié: (2026)
par: Choi, Changwoon, et autres
Publié: (2026)
DeepSketcher: Internalizing Visual Manipulation for Multimodal Reasoning
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
DVD: Deterministic Video Depth Estimation with Generative Priors
par: Zhang, Hongfei, et autres
Publié: (2026)
par: Zhang, Hongfei, et autres
Publié: (2026)
VideoJAM: Joint Appearance-Motion Representations for Enhanced Motion Generation in Video Models
par: Chefer, Hila, et autres
Publié: (2025)
par: Chefer, Hila, et autres
Publié: (2025)
VIRES: Video Instance Repainting via Sketch and Text Guided Generation
par: Weng, Shuchen, et autres
Publié: (2024)
par: Weng, Shuchen, et autres
Publié: (2024)
The Curse of Conditions: Analyzing and Improving Optimal Transport for Conditional Flow-Based Generation
par: Cheng, Ho Kei, et autres
Publié: (2025)
par: Cheng, Ho Kei, et autres
Publié: (2025)
Documents similaires
-
SketchAgent: Language-Driven Sequential Sketch Generation
par: Vinker, Yael, et autres
Publié: (2024) -
NeuralSVG: An Implicit Representation for Text-to-Vector Generation
par: Polaczek, Sagi, et autres
Publié: (2025) -
Generative Visual Communication in the Era of Vision-Language Models
par: Vinker, Yael
Publié: (2024) -
SwiftSketch: A Diffusion Model for Image-to-Vector Sketch Generation
par: Arar, Ellie, et autres
Publié: (2025) -
Instance Segmentation of Scene Sketches Using Natural Image Priors
par: Tang, Mia, et autres
Publié: (2025)