Ada-VE: Training-Free Consistent Video Editing Using Adaptive Motion Prior
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Mahmud, Tanvir, Munir, Mustafa, Marculescu, Radu, Marculescu, Diana |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PipeFlow: Pipelined Processing and Motion-Aware Frame Selection for Long-Form Video Editing
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
AdaptViG: Adaptive Vision GNN with Exponential Decay Gating
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
RapidNet: Multi-Level Dilated Convolution Based Mobile Backbone
von: Munir, Mustafa, et al.
Veröffentlicht: (2024)
von: Munir, Mustafa, et al.
Veröffentlicht: (2024)
VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
Multi-Scale High-Resolution Logarithmic Grapher Module for Efficient Vision GNNs
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
GreedyViG: Dynamic Axial Graph Construction for Efficient Vision GNNs
von: Munir, Mustafa, et al.
Veröffentlicht: (2024)
von: Munir, Mustafa, et al.
Veröffentlicht: (2024)
PaPr: Training-Free One-Step Patch Pruning with Lightweight ConvNets for Faster Inference
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
Q-Sched: Pushing the Boundaries of Few-Step Diffusion Models with Quantization-Aware Scheduling
von: Frumkin, Natalia, et al.
Veröffentlicht: (2025)
von: Frumkin, Natalia, et al.
Veröffentlicht: (2025)
Scaling Graph Convolutions for Mobile Vision
von: Avery, William, et al.
Veröffentlicht: (2024)
von: Avery, William, et al.
Veröffentlicht: (2024)
T-VSL: Text-Guided Visual Sound Source Localization in Mixtures
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
Video Compression Meets Video Generation: Latent Inter-Frame Pruning with Attention Recovery
von: Menn, Dennis, et al.
Veröffentlicht: (2026)
von: Menn, Dennis, et al.
Veröffentlicht: (2026)
Fuel Gauge: Estimating Chain-of-Thought Length Ahead of Time in Large Multimodal Models
von: Yang, Yuedong, et al.
Veröffentlicht: (2026)
von: Yang, Yuedong, et al.
Veröffentlicht: (2026)
EMCAD: Efficient Multi-scale Convolutional Attention Decoding for Medical Image Segmentation
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2024)
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2024)
QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
von: Chi, Tien-Yu, et al.
Veröffentlicht: (2025)
von: Chi, Tien-Yu, et al.
Veröffentlicht: (2025)
ObjectAlign: Neuro-Symbolic Object Consistency Verification and Correction
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)
MA-AVT: Modality Alignment for Parameter-Efficient Audio-Visual Transformers
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
AttentionViG: Cross-Attention-Based Dynamic Neighbor Aggregation in Vision GNNs
von: Gedik, Hakan Emre, et al.
Veröffentlicht: (2025)
von: Gedik, Hakan Emre, et al.
Veröffentlicht: (2025)
PP-SAM: Perturbed Prompts for Robust Adaptation of Segment Anything Model for Polyp Segmentation
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2024)
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2024)
OpenSep: Leveraging Large Language Models with Textual Inversion for Open World Audio Separation
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
von: Mahmud, Tanvir, et al.
Veröffentlicht: (2024)
MK-UNet: Multi-kernel Lightweight CNN for Medical Image Segmentation
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2025)
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2025)
LoMix: Learnable Weighted Multi-Scale Logits Mixing for Medical Image Segmentation
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2025)
von: Rahman, Md Mostafijur, et al.
Veröffentlicht: (2025)
MoCA-Video: Motion-Aware Concept Alignment for Consistent Video Editing
von: Zhang, Tong, et al.
Veröffentlicht: (2025)
von: Zhang, Tong, et al.
Veröffentlicht: (2025)
NeuS-QA: Grounding Long-Form Video Understanding in Temporal Logic and Neuro-Symbolic Reasoning
von: Shah, Sahil, et al.
Veröffentlicht: (2025)
von: Shah, Sahil, et al.
Veröffentlicht: (2025)
AdaVid: Adaptive Video-Language Pretraining
von: Patel, Chaitanya, et al.
Veröffentlicht: (2025)
von: Patel, Chaitanya, et al.
Veröffentlicht: (2025)
Mitigating Intra- and Inter-modal Forgetting in Continual Learning of Unified Multimodal Models
von: Wei, Xiwen, et al.
Veröffentlicht: (2025)
von: Wei, Xiwen, et al.
Veröffentlicht: (2025)
Online-LoRA: Task-free Online Continual Learning via Low Rank Adaptation
von: Wei, Xiwen, et al.
Veröffentlicht: (2024)
von: Wei, Xiwen, et al.
Veröffentlicht: (2024)
Consistent Video Editing as Flow-Driven Image-to-Video Generation
von: Wang, Ge, et al.
Veröffentlicht: (2025)
von: Wang, Ge, et al.
Veröffentlicht: (2025)
Synthesizing Artifact Dataset for Pixel-level Detection
von: Menn, Dennis, et al.
Veröffentlicht: (2025)
von: Menn, Dennis, et al.
Veröffentlicht: (2025)
Jumping through Local Minima: Quantization in the Loss Landscape of Vision Transformers
von: Frumkin, Natalia, et al.
Veröffentlicht: (2023)
von: Frumkin, Natalia, et al.
Veröffentlicht: (2023)
AdaCluster: Adaptive Query-Key Clustering for Sparse Attention in Video Generation
von: Tan, Haoyue, et al.
Veröffentlicht: (2026)
von: Tan, Haoyue, et al.
Veröffentlicht: (2026)
STR-Match: Matching SpatioTemporal Relevance Score for Training-Free Video Editing
von: Lee, Junsung, et al.
Veröffentlicht: (2025)
von: Lee, Junsung, et al.
Veröffentlicht: (2025)
CausalVE: Face Video Privacy Encryption via Causal Video Prediction
von: Huang, Yubo, et al.
Veröffentlicht: (2024)
von: Huang, Yubo, et al.
Veröffentlicht: (2024)
DualReal: Adaptive Joint Training for Lossless Identity-Motion Fusion in Video Customization
von: Wang, Wenchuan, et al.
Veröffentlicht: (2025)
von: Wang, Wenchuan, et al.
Veröffentlicht: (2025)
EM-Vid: Training-Free Entity-Centric Memory for Efficient and Consistent Multi-Shot Video Generation
von: Vandersanden, Jente, et al.
Veröffentlicht: (2026)
von: Vandersanden, Jente, et al.
Veröffentlicht: (2026)
AdaCM$^2$: On Understanding Extremely Long-Term Video with Adaptive Cross-Modality Memory Reduction
von: Man, Yuanbin, et al.
Veröffentlicht: (2024)
von: Man, Yuanbin, et al.
Veröffentlicht: (2024)
SupMAE: Supervised Masked Autoencoders Are Efficient Vision Learners
von: Liang, Feng, et al.
Veröffentlicht: (2022)
von: Liang, Feng, et al.
Veröffentlicht: (2022)
LatentEdit: Adaptive Latent Control for Consistent Semantic Editing
von: Liu, Siyi, et al.
Veröffentlicht: (2025)
von: Liu, Siyi, et al.
Veröffentlicht: (2025)
RASA: Replace Anyone, Say Anything -- A Training-Free Framework for Audio-Driven and Universal Portrait Video Editing
von: Pan, Tianrui, et al.
Veröffentlicht: (2025)
von: Pan, Tianrui, et al.
Veröffentlicht: (2025)
Efficient Text-driven Motion Generation via Latent Consistency Training
von: Hu, Mengxian, et al.
Veröffentlicht: (2024)
von: Hu, Mengxian, et al.
Veröffentlicht: (2024)
AdaFocus: Adaptive Relevance-Diversity Sampling with Zero-Cache Look-back for Efficient Long Video Understanding
von: Yang, Xiao, et al.
Veröffentlicht: (2026)
von: Yang, Xiao, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
PipeFlow: Pipelined Processing and Motion-Aware Frame Selection for Long-Form Video Editing
von: Munir, Mustafa, et al.
Veröffentlicht: (2025) -
AdaptViG: Adaptive Vision GNN with Exponential Decay Gating
von: Munir, Mustafa, et al.
Veröffentlicht: (2025) -
RapidNet: Multi-Level Dilated Convolution Based Mobile Backbone
von: Munir, Mustafa, et al.
Veröffentlicht: (2024) -
VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation
von: Munir, Mustafa, et al.
Veröffentlicht: (2025) -
Multi-Scale High-Resolution Logarithmic Grapher Module for Efficient Vision GNNs
von: Munir, Mustafa, et al.
Veröffentlicht: (2025)