EditDuet: A Multi-Agent System for Video Non-Linear Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sandoval-Castaneda, Marcelo, Russell, Bryan, Sivic, Josef, Shakhnarovich, Gregory, Heilbron, Fabian Caba |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ResidualViT for Efficient Temporally Dense Video Encoding
par: Soldan, Mattia, et autres
Publié: (2025)
par: Soldan, Mattia, et autres
Publié: (2025)
Discovering Divergent Representations between Text-to-Image Models
par: Dunlap, Lisa, et autres
Publié: (2025)
par: Dunlap, Lisa, et autres
Publié: (2025)
Improving Personalized Search with Regularized Low-Rank Parameter Updates
par: Ryan, Fiona, et autres
Publié: (2025)
par: Ryan, Fiona, et autres
Publié: (2025)
Generative Timelines for Instructed Visual Assembly
par: Pardo, Alejandro, et autres
Publié: (2024)
par: Pardo, Alejandro, et autres
Publié: (2024)
Adapting Dual-encoder Vision-language Models for Paraphrased Retrieval
par: Cheng, Jiacheng, et autres
Publié: (2024)
par: Cheng, Jiacheng, et autres
Publié: (2024)
VideoMap: Supporting Video Editing Exploration, Brainstorming, and Prototyping in the Latent Space
par: Lin, David Chuan-En, et autres
Publié: (2022)
par: Lin, David Chuan-En, et autres
Publié: (2022)
Sync from the Sea: Retrieving Alignable Videos from Large-Scale Datasets
par: Dave, Ishan Rajendrakumar, et autres
Publié: (2024)
par: Dave, Ishan Rajendrakumar, et autres
Publié: (2024)
Grounded Video Caption Generation
par: Kazakos, Evangelos, et autres
Publié: (2024)
par: Kazakos, Evangelos, et autres
Publié: (2024)
Large-scale Pre-training for Grounded Video Caption Generation
par: Kazakos, Evangelos, et autres
Publié: (2025)
par: Kazakos, Evangelos, et autres
Publié: (2025)
NewMove: Customizing text-to-video models with novel motions
par: Materzynska, Joanna, et autres
Publié: (2023)
par: Materzynska, Joanna, et autres
Publié: (2023)
Videogenic: Identifying Highlight Moments in Videos with Professional Photographs as a Prior
par: Lin, David Chuan-En, et autres
Publié: (2022)
par: Lin, David Chuan-En, et autres
Publié: (2022)
Scaling Up Video Summarization Pretraining with Large Language Models
par: Argaw, Dawit Mureja, et autres
Publié: (2024)
par: Argaw, Dawit Mureja, et autres
Publié: (2024)
FocalPose++: Focal Length and Object Pose Estimation via Render and Compare
par: Cífka, Martin, et autres
Publié: (2023)
par: Cífka, Martin, et autres
Publié: (2023)
CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition
par: Phung, Quynh, et autres
Publié: (2025)
par: Phung, Quynh, et autres
Publié: (2025)
GenHowTo: Learning to Generate Actions and State Transformations from Instructional Videos
par: Souček, Tomáš, et autres
Publié: (2023)
par: Souček, Tomáš, et autres
Publié: (2023)
Concept Weaver: Enabling Multi-Concept Fusion in Text-to-Image Models
par: Kwon, Gihyun, et autres
Publié: (2024)
par: Kwon, Gihyun, et autres
Publié: (2024)
Persistent Robot World Models: Stabilizing Multi-Step Rollouts via Reinforcement Learning
par: Bardhan, Jai, et autres
Publié: (2026)
par: Bardhan, Jai, et autres
Publié: (2026)
Towards Automated Movie Trailer Generation
par: Argaw, Dawit Mureja, et autres
Publié: (2024)
par: Argaw, Dawit Mureja, et autres
Publié: (2024)
Edit As You Wish: Video Caption Editing with Multi-grained User Control
par: Yao, Linli, et autres
Publié: (2023)
par: Yao, Linli, et autres
Publié: (2023)
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
par: Zhang, Youyuan, et autres
Publié: (2024)
par: Zhang, Youyuan, et autres
Publié: (2024)
AlignPose: Generalizable 6D Pose Estimation via Multi-view Feature-metric Alignment
par: Mikeštíková, Anna Šárová, et autres
Publié: (2025)
par: Mikeštíková, Anna Šárová, et autres
Publié: (2025)
LoopDraw: a Loop-Based Autoregressive Model for Shape Synthesis and Editing
par: Dinh, Nam Anh, et autres
Publié: (2022)
par: Dinh, Nam Anh, et autres
Publié: (2022)
ParallelEdits: Efficient Multi-object Image Editing
par: Huang, Mingzhen, et autres
Publié: (2024)
par: Huang, Mingzhen, et autres
Publié: (2024)
Edit3K: Universal Representation Learning for Video Editing Components
par: Gu, Xin, et autres
Publié: (2024)
par: Gu, Xin, et autres
Publié: (2024)
EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning
par: Ju, Xuan, et autres
Publié: (2025)
par: Ju, Xuan, et autres
Publié: (2025)
Video4Edit: Viewing Image Editing as a Degenerate Temporal Process
par: Li, Xiaofan, et autres
Publié: (2025)
par: Li, Xiaofan, et autres
Publié: (2025)
OphEdit: Training-Free Text-Guided Editing of Ophthalmic Surgical Videos
par: Jangir, Ritul, et autres
Publié: (2026)
par: Jangir, Ritul, et autres
Publié: (2026)
ExpertEdit: Learning Skill-Aware Motion Editing from Expert Videos
par: Somayazulu, Arjun, et autres
Publié: (2026)
par: Somayazulu, Arjun, et autres
Publié: (2026)
VidEdit: Zero-Shot and Spatially Aware Text-Driven Video Editing
par: Couairon, Paul, et autres
Publié: (2023)
par: Couairon, Paul, et autres
Publié: (2023)
MLV-Edit: Towards Consistent and Highly Efficient Editing for Minute-Level Videos
par: Cao, Yangyi, et autres
Publié: (2026)
par: Cao, Yangyi, et autres
Publié: (2026)
6D Object Pose Tracking in Internet Videos for Robotic Manipulation
par: Ponimatkin, Georgy, et autres
Publié: (2025)
par: Ponimatkin, Georgy, et autres
Publié: (2025)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
par: Zhu, Hongyang, et autres
Publié: (2025)
par: Zhu, Hongyang, et autres
Publié: (2025)
AlbedoEdit: Unified Instance-Level Video Editing with Albedo Guidance
par: Zhou, Xilong, et autres
Publié: (2026)
par: Zhou, Xilong, et autres
Publié: (2026)
FlexiEdit: Frequency-Aware Latent Refinement for Enhanced Non-Rigid Editing
par: Koo, Gwanhyeong, et autres
Publié: (2024)
par: Koo, Gwanhyeong, et autres
Publié: (2024)
MoEdit: On Learning Quantity Perception for Multi-object Image Editing
par: Li, Yanfeng, et autres
Publié: (2025)
par: Li, Yanfeng, et autres
Publié: (2025)
Edit-Your-Interest: Efficient Video Editing via Feature Most-Similar Propagation
par: Zuo, Yi, et autres
Publié: (2025)
par: Zuo, Yi, et autres
Publié: (2025)
UniEdit: A Unified Tuning-Free Framework for Video Motion and Appearance Editing
par: Bai, Jianhong, et autres
Publié: (2024)
par: Bai, Jianhong, et autres
Publié: (2024)
Edit-Your-Motion: Space-Time Diffusion Decoupling Learning for Video Motion Editing
par: Zuo, Yi, et autres
Publié: (2024)
par: Zuo, Yi, et autres
Publié: (2024)
AVI-Edit: Audio-sync Video Instance Editing with Granularity-Aware Mask Refiner
par: Zheng, Haojie, et autres
Publié: (2025)
par: Zheng, Haojie, et autres
Publié: (2025)
EditCtrl: Disentangled Local and Global Control for Real-Time Generative Video Editing
par: Litman, Yehonathan, et autres
Publié: (2026)
par: Litman, Yehonathan, et autres
Publié: (2026)
Documents similaires
-
ResidualViT for Efficient Temporally Dense Video Encoding
par: Soldan, Mattia, et autres
Publié: (2025) -
Discovering Divergent Representations between Text-to-Image Models
par: Dunlap, Lisa, et autres
Publié: (2025) -
Improving Personalized Search with Regularized Low-Rank Parameter Updates
par: Ryan, Fiona, et autres
Publié: (2025) -
Generative Timelines for Instructed Visual Assembly
par: Pardo, Alejandro, et autres
Publié: (2024) -
Adapting Dual-encoder Vision-language Models for Paraphrased Retrieval
par: Cheng, Jiacheng, et autres
Publié: (2024)