ESA: Energy-Based Shot Assembly Optimization for Automatic Video Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Yaosen, Wang, Wei, Zheng, Tianheng, Wen, Xuming, Yang, Han, Zhang, Yanru |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SKALD: Learning-Based Shot Assembly for Coherent Multi-Shot Video Creation
par: Lu, Chen Yi, et autres
Publié: (2025)
par: Lu, Chen Yi, et autres
Publié: (2025)
Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing
par: Su, Tongtong, et autres
Publié: (2025)
par: Su, Tongtong, et autres
Publié: (2025)
TVG: A Training-free Transition Video Generation Method with Diffusion Models
par: Zhang, Rui, et autres
Publié: (2024)
par: Zhang, Rui, et autres
Publié: (2024)
Text Guided Image Editing with Automatic Concept Locating and Forgetting
par: Li, Jia, et autres
Publié: (2024)
par: Li, Jia, et autres
Publié: (2024)
DIVE: Taming DINO for Subject-Driven Video Editing
par: Huang, Yi, et autres
Publié: (2024)
par: Huang, Yi, et autres
Publié: (2024)
Mining Fine-Grained Image-Text Alignment for Zero-Shot Captioning via Text-Only Training
par: Qiu, Longtian, et autres
Publié: (2024)
par: Qiu, Longtian, et autres
Publié: (2024)
Shot Sequence Ordering for Video Editing: Benchmarks, Metrics, and Cinematology-Inspired Computing Methods
par: Li, Yuzhi, et autres
Publié: (2025)
par: Li, Yuzhi, et autres
Publié: (2025)
PRIME: Protect Your Videos From Malicious Editing
par: Li, Guanlin, et autres
Publié: (2024)
par: Li, Guanlin, et autres
Publié: (2024)
DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing
par: Jeong, Hyeonho, et autres
Publié: (2024)
par: Jeong, Hyeonho, et autres
Publié: (2024)
NCST: Neural-based Color Style Transfer for Video Retouching
par: Jiang, Xintao, et autres
Publié: (2024)
par: Jiang, Xintao, et autres
Publié: (2024)
AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks
par: Ku, Max, et autres
Publié: (2024)
par: Ku, Max, et autres
Publié: (2024)
ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search
par: Yu, Tao, et autres
Publié: (2026)
par: Yu, Tao, et autres
Publié: (2026)
Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance
par: Lin, Yiqi, et autres
Publié: (2026)
par: Lin, Yiqi, et autres
Publié: (2026)
VACT: A Video Automatic Causal Testing System and a Benchmark
par: Yang, Haotong, et autres
Publié: (2025)
par: Yang, Haotong, et autres
Publié: (2025)
PostEdit: Posterior Sampling for Efficient Zero-Shot Image Editing
par: Tian, Feng, et autres
Publié: (2024)
par: Tian, Feng, et autres
Publié: (2024)
Visual Prompting for One-shot Controllable Video Editing without Inversion
par: Zhang, Zhengbo, et autres
Publié: (2025)
par: Zhang, Zhengbo, et autres
Publié: (2025)
VideoGuard: Protecting Video Content from Unauthorized Editing
par: Cao, Junjie, et autres
Publié: (2025)
par: Cao, Junjie, et autres
Publié: (2025)
Dynamic-Aware Video Distillation: Optimizing Temporal Resolution Based on Video Semantics
par: Zhao, Yinjie, et autres
Publié: (2025)
par: Zhao, Yinjie, et autres
Publié: (2025)
REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing
par: Xu, Weihan, et autres
Publié: (2025)
par: Xu, Weihan, et autres
Publié: (2025)
O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing
par: Chen, Yuqing, et autres
Publié: (2025)
par: Chen, Yuqing, et autres
Publié: (2025)
EntityBench: Towards Entity-Consistent Long-Range Multi-Shot Video Generation
par: He, Ruozhen, et autres
Publié: (2026)
par: He, Ruozhen, et autres
Publié: (2026)
Sharp Eyes and Memory for VideoLLMs: Information-Aware Visual Token Pruning for Efficient and Reliable VideoLLM Reasoning
par: Qin, Jialong, et autres
Publié: (2025)
par: Qin, Jialong, et autres
Publié: (2025)
Re-Attentional Controllable Video Diffusion Editing
par: Wang, Yuanzhi, et autres
Publié: (2024)
par: Wang, Yuanzhi, et autres
Publié: (2024)
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
par: Zhao, Yuyang, et autres
Publié: (2026)
par: Zhao, Yuyang, et autres
Publié: (2026)
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
par: Zhao, Haoyu, et autres
Publié: (2023)
par: Zhao, Haoyu, et autres
Publié: (2023)
STR-Match: Matching SpatioTemporal Relevance Score for Training-Free Video Editing
par: Lee, Junsung, et autres
Publié: (2025)
par: Lee, Junsung, et autres
Publié: (2025)
Semantic Communication based on Large Language Model for Underwater Image Transmission
par: Chen, Weilong, et autres
Publié: (2024)
par: Chen, Weilong, et autres
Publié: (2024)
Zero-Shot Temporal Interaction Localization for Egocentric Videos
par: Zhang, Erhang, et autres
Publié: (2025)
par: Zhang, Erhang, et autres
Publié: (2025)
MoCA-Video: Motion-Aware Concept Alignment for Consistent Video Editing
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
Pack and Force Your Memory: Long-form and Consistent Video Generation
par: Wu, Xiaofei, et autres
Publié: (2025)
par: Wu, Xiaofei, et autres
Publié: (2025)
Consistent Video Editing as Flow-Driven Image-to-Video Generation
par: Wang, Ge, et autres
Publié: (2025)
par: Wang, Ge, et autres
Publié: (2025)
MVOC: a training-free multiple video object composition method with diffusion models
par: Wang, Wei, et autres
Publié: (2024)
par: Wang, Wei, et autres
Publié: (2024)
FADE: Frequency-Aware Diffusion Model Factorization for Video Editing
par: Zhu, Yixuan, et autres
Publié: (2025)
par: Zhu, Yixuan, et autres
Publié: (2025)
DIRECT: Video Mashup Creation via Hierarchical Multi-Agent Planning and Intent-Guided Editing
par: Li, Ke, et autres
Publié: (2026)
par: Li, Ke, et autres
Publié: (2026)
VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation
par: He, Xuan, et autres
Publié: (2024)
par: He, Xuan, et autres
Publié: (2024)
Object-Shot Enhanced Grounding Network for Egocentric Video
par: Feng, Yisen, et autres
Publié: (2025)
par: Feng, Yisen, et autres
Publié: (2025)
VIVID-10M: A Dataset and Baseline for Versatile and Interactive Video Local Editing
par: Hu, Jiahao, et autres
Publié: (2024)
par: Hu, Jiahao, et autres
Publié: (2024)
Efficient Video Diffusion with Sparse Information Transmission for Video Compression
par: Zhou, Mingde, et autres
Publié: (2026)
par: Zhou, Mingde, et autres
Publié: (2026)
RARE: Refine Any Registration of Pairwise Point Clouds via Zero-Shot Learning
par: Zheng, Chengyu, et autres
Publié: (2025)
par: Zheng, Chengyu, et autres
Publié: (2025)
ShoulderShot: Generating Over-the-Shoulder Dialogue Videos
par: Zhang, Yuang, et autres
Publié: (2025)
par: Zhang, Yuang, et autres
Publié: (2025)
Documents similaires
-
SKALD: Learning-Based Shot Assembly for Coherent Multi-Shot Video Creation
par: Lu, Chen Yi, et autres
Publié: (2025) -
Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing
par: Su, Tongtong, et autres
Publié: (2025) -
TVG: A Training-free Transition Video Generation Method with Diffusion Models
par: Zhang, Rui, et autres
Publié: (2024) -
Text Guided Image Editing with Automatic Concept Locating and Forgetting
par: Li, Jia, et autres
Publié: (2024) -
DIVE: Taming DINO for Subject-Driven Video Editing
par: Huang, Yi, et autres
Publié: (2024)