Interactive Video Generation via Domain Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | Rawal, Ishaan, Kumar, Suryansh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing
di: Gu, Jing, et al.
Pubblicazione: (2024)
di: Gu, Jing, et al.
Pubblicazione: (2024)
Layer-wise Model Merging for Unsupervised Domain Adaptation in Segmentation Tasks
di: Alcover-Couso, Roberto, et al.
Pubblicazione: (2024)
di: Alcover-Couso, Roberto, et al.
Pubblicazione: (2024)
Image Conductor: Precision Control for Interactive Video Synthesis
di: Li, Yaowei, et al.
Pubblicazione: (2024)
di: Li, Yaowei, et al.
Pubblicazione: (2024)
Spotlighting Partially Visible Cinematic Language for Video-to-Audio Generation via Self-distillation
di: Huang, Feizhen, et al.
Pubblicazione: (2025)
di: Huang, Feizhen, et al.
Pubblicazione: (2025)
Moiré Video Authentication: A Physical Signature Against AI Video Generation
di: Qing, Yuan, et al.
Pubblicazione: (2026)
di: Qing, Yuan, et al.
Pubblicazione: (2026)
A Survey on Generative AI and LLM for Video Generation, Understanding, and Streaming
di: Zhou, Pengyuan, et al.
Pubblicazione: (2024)
di: Zhou, Pengyuan, et al.
Pubblicazione: (2024)
Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation
di: Yan, Xin, et al.
Pubblicazione: (2024)
di: Yan, Xin, et al.
Pubblicazione: (2024)
InteractiveVideo: User-Centric Controllable Video Generation with Synergistic Multimodal Instructions
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
Advance Fake Video Detection via Vision Transformers
di: Battocchio, Joy, et al.
Pubblicazione: (2025)
di: Battocchio, Joy, et al.
Pubblicazione: (2025)
DIBS: Enhancing Dense Video Captioning with Unlabeled Videos via Pseudo Boundary Enrichment and Online Refinement
di: Wu, Hao, et al.
Pubblicazione: (2024)
di: Wu, Hao, et al.
Pubblicazione: (2024)
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
di: Cao, Pu, et al.
Pubblicazione: (2023)
di: Cao, Pu, et al.
Pubblicazione: (2023)
Beyond Audio and Pose: A General-Purpose Framework for Video Synchronization
di: Shin, Yosub, et al.
Pubblicazione: (2025)
di: Shin, Yosub, et al.
Pubblicazione: (2025)
EvAnimate: Event-conditioned Image-to-Video Generation for Human Animation
di: Qu, Qiang, et al.
Pubblicazione: (2025)
di: Qu, Qiang, et al.
Pubblicazione: (2025)
UniVid: Pyramid Diffusion Model for High Quality Video Generation
di: Xiao, Xinyu, et al.
Pubblicazione: (2026)
di: Xiao, Xinyu, et al.
Pubblicazione: (2026)
Relational Retrieval: Leveraging Known-Novel Interactions for Generalized Category Discovery
di: Xu, Yulin, et al.
Pubblicazione: (2026)
di: Xu, Yulin, et al.
Pubblicazione: (2026)
Composing Concepts from Images and Videos via Concept-prompt Binding
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
AutoAWG: Adverse Weather Generation with Adaptive Multi-Controls for Automotive Videos
di: Hu, Jiagao, et al.
Pubblicazione: (2026)
di: Hu, Jiagao, et al.
Pubblicazione: (2026)
TimeSuite: Improving MLLMs for Long Video Understanding via Grounded Tuning
di: Zeng, Xiangyu, et al.
Pubblicazione: (2024)
di: Zeng, Xiangyu, et al.
Pubblicazione: (2024)
OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation
di: Gan, Qijun, et al.
Pubblicazione: (2025)
di: Gan, Qijun, et al.
Pubblicazione: (2025)
Official-NV: An LLM-Generated News Video Dataset for Multimodal Fake News Detection
di: Wang, Yihao, et al.
Pubblicazione: (2024)
di: Wang, Yihao, et al.
Pubblicazione: (2024)
Regularizing Subspace Redundancy of Low-Rank Adaptation
di: Zhu, Yue, et al.
Pubblicazione: (2025)
di: Zhu, Yue, et al.
Pubblicazione: (2025)
SIDA: Synthetic Image Driven Zero-shot Domain Adaptation
di: Kim, Ye-Chan, et al.
Pubblicazione: (2025)
di: Kim, Ye-Chan, et al.
Pubblicazione: (2025)
Enhanced Multimodal Hate Video Detection via Channel-wise and Modality-wise Fusion
di: Zhang, Yinghui, et al.
Pubblicazione: (2025)
di: Zhang, Yinghui, et al.
Pubblicazione: (2025)
Video Seal: Open and Efficient Video Watermarking
di: Fernandez, Pierre, et al.
Pubblicazione: (2024)
di: Fernandez, Pierre, et al.
Pubblicazione: (2024)
Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective
di: Yuan, Hangjie, et al.
Pubblicazione: (2025)
di: Yuan, Hangjie, et al.
Pubblicazione: (2025)
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
DIRECT: Video Mashup Creation via Hierarchical Multi-Agent Planning and Intent-Guided Editing
di: Li, Ke, et al.
Pubblicazione: (2026)
di: Li, Ke, et al.
Pubblicazione: (2026)
EVAN: Evolutional Video Streaming Adaptation via Neural Representation
di: Liu, Mufan, et al.
Pubblicazione: (2024)
di: Liu, Mufan, et al.
Pubblicazione: (2024)
Programmable-Room: Interactive Textured 3D Room Meshes Generation Empowered by Large Language Models
di: Kim, Jihyun, et al.
Pubblicazione: (2025)
di: Kim, Jihyun, et al.
Pubblicazione: (2025)
FedVideoMAE: Efficient Privacy-Preserving Federated Video Moderation
di: Tao, Ziyuan, et al.
Pubblicazione: (2025)
di: Tao, Ziyuan, et al.
Pubblicazione: (2025)
Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding
di: Wang, Yun, et al.
Pubblicazione: (2025)
di: Wang, Yun, et al.
Pubblicazione: (2025)
Open-o3-Video: Grounded Video Reasoning with Explicit Spatio-Temporal Evidence
di: Meng, Jiahao, et al.
Pubblicazione: (2025)
di: Meng, Jiahao, et al.
Pubblicazione: (2025)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input
di: Liu, Jiajun, et al.
Pubblicazione: (2024)
di: Liu, Jiajun, et al.
Pubblicazione: (2024)
DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion Transformer for Tuning-Free Multi-Prompt Longer Video Generation
di: Cai, Minghong, et al.
Pubblicazione: (2024)
di: Cai, Minghong, et al.
Pubblicazione: (2024)
Diffusion Models for Joint Audio-Video Generation
di: La Torre, Alejandro Paredes
Pubblicazione: (2026)
di: La Torre, Alejandro Paredes
Pubblicazione: (2026)
How Far Are Surgeons from Surgical World Models? A Pilot Study on Zero-shot Surgical Video Generation with Expert Assessment
di: Chen, Zhen, et al.
Pubblicazione: (2025)
di: Chen, Zhen, et al.
Pubblicazione: (2025)
AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks
di: Ku, Max, et al.
Pubblicazione: (2024)
di: Ku, Max, et al.
Pubblicazione: (2024)
Question-Answering Dense Video Events
di: Qin, Hangyu, et al.
Pubblicazione: (2024)
di: Qin, Hangyu, et al.
Pubblicazione: (2024)
ASR-enhanced Multimodal Representation Learning for Cross-Domain Product Retrieval
di: Zhao, Ruixiang, et al.
Pubblicazione: (2024)
di: Zhao, Ruixiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing
di: Gu, Jing, et al.
Pubblicazione: (2024) -
Layer-wise Model Merging for Unsupervised Domain Adaptation in Segmentation Tasks
di: Alcover-Couso, Roberto, et al.
Pubblicazione: (2024) -
Image Conductor: Precision Control for Interactive Video Synthesis
di: Li, Yaowei, et al.
Pubblicazione: (2024) -
Spotlighting Partially Visible Cinematic Language for Video-to-Audio Generation via Self-distillation
di: Huang, Feizhen, et al.
Pubblicazione: (2025) -
Moiré Video Authentication: A Physical Signature Against AI Video Generation
di: Qing, Yuan, et al.
Pubblicazione: (2026)