Temporally Consistent Object Editing in Videos using Extended Attention
Fuente:
arXiv
Salvato in:
| Autori principali: | Zamani, AmirHossein, Aghdam, Amir G., Popa, Tiberiu, Belilovsky, Eugene |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
End-to-End Fine-Tuning of 3D Texture Generation using Differentiable Rewards
di: Zamani, AmirHossein, et al.
Pubblicazione: (2025)
di: Zamani, AmirHossein, et al.
Pubblicazione: (2025)
Towards motion from video diffusion models
di: Janson, Paul, et al.
Pubblicazione: (2024)
di: Janson, Paul, et al.
Pubblicazione: (2024)
Unsupervised Representation Learning for 3D Mesh Parameterization with Semantic and Visibility Objectives
di: Zamani, AmirHossein, et al.
Pubblicazione: (2025)
di: Zamani, AmirHossein, et al.
Pubblicazione: (2025)
Sketch-guided Cage-based 3D Gaussian Splatting Deformation
di: Xie, Tianhao, et al.
Pubblicazione: (2024)
di: Xie, Tianhao, et al.
Pubblicazione: (2024)
A Scalable Attention-Based Approach for Image-to-3D Texture Mapping
di: Rampini, Arianna, et al.
Pubblicazione: (2025)
di: Rampini, Arianna, et al.
Pubblicazione: (2025)
Sound Sparks Motion: Audio and Text Tuning for Video Editing
di: Razlighi, AmirHossein Naghi, et al.
Pubblicazione: (2026)
di: Razlighi, AmirHossein Naghi, et al.
Pubblicazione: (2026)
Confident Splatting: Confidence-Based Compression of 3D Gaussian Splatting via Learnable Beta Distributions
di: Razlighi, AmirHossein Naghi, et al.
Pubblicazione: (2025)
di: Razlighi, AmirHossein Naghi, et al.
Pubblicazione: (2025)
Deep Nonlinear Hyperspectral Unmixing Using Multi-task Learning
di: Mehrdad, Saeid, et al.
Pubblicazione: (2024)
di: Mehrdad, Saeid, et al.
Pubblicazione: (2024)
Optimizing Data Augmentation for Real-Time Small UAV Detection: A Lightweight Context-Aware Approach
di: Zamani, Amir, et al.
Pubblicazione: (2026)
di: Zamani, Amir, et al.
Pubblicazione: (2026)
Enhancing Temporal Consistency in Video Editing by Reconstructing Videos with 3D Gaussian Splatting
di: Shin, Inkyu, et al.
Pubblicazione: (2024)
di: Shin, Inkyu, et al.
Pubblicazione: (2024)
Temporally Consistent Referring Video Object Segmentation with Hybrid Memory
di: Miao, Bo, et al.
Pubblicazione: (2024)
di: Miao, Bo, et al.
Pubblicazione: (2024)
Improving Weakly-supervised Video Instance Segmentation by Leveraging Spatio-temporal Consistency
di: Arefi, Farnoosh, et al.
Pubblicazione: (2024)
di: Arefi, Farnoosh, et al.
Pubblicazione: (2024)
RealCraft: Attention Control as A Tool for Zero-Shot Consistent Video Editing
di: Jin, Shutong, et al.
Pubblicazione: (2023)
di: Jin, Shutong, et al.
Pubblicazione: (2023)
Spatio-Temporal Attention for Consistent Video Semantic Segmentation in Automated Driving
di: Varghese, Serin, et al.
Pubblicazione: (2026)
di: Varghese, Serin, et al.
Pubblicazione: (2026)
MoViE: Mobile Diffusion for Video Editing
di: Karjauv, Adil, et al.
Pubblicazione: (2024)
di: Karjauv, Adil, et al.
Pubblicazione: (2024)
Efficient One-stage Video Object Detection by Exploiting Temporal Consistency
di: Sun, Guanxiong, et al.
Pubblicazione: (2024)
di: Sun, Guanxiong, et al.
Pubblicazione: (2024)
Latest Object Memory Management for Temporally Consistent Video Instance Segmentation
di: Lee, Seunghun, et al.
Pubblicazione: (2025)
di: Lee, Seunghun, et al.
Pubblicazione: (2025)
Multi-Context Temporal Consistent Modeling for Referring Video Object Segmentation
di: Choi, Sun-Hyuk, et al.
Pubblicazione: (2025)
di: Choi, Sun-Hyuk, et al.
Pubblicazione: (2025)
A Dataset for Mechanical Mechanisms
di: Ghezelbash, Farshid, et al.
Pubblicazione: (2024)
di: Ghezelbash, Farshid, et al.
Pubblicazione: (2024)
FluencyVE: Marrying Temporal-Aware Mamba with Bypass Attention for Video Editing
di: Cai, Mingshu, et al.
Pubblicazione: (2025)
di: Cai, Mingshu, et al.
Pubblicazione: (2025)
Echo-E$^3$Net: Efficient Endocardial Spatio-Temporal Network for Ejection Fraction Estimation
di: Heidari, Moein, et al.
Pubblicazione: (2025)
di: Heidari, Moein, et al.
Pubblicazione: (2025)
Probing Multimodal Fusion in the Brain: The Dominance of Audiovisual Streams in Naturalistic Encoding
di: Abdollahi, Hamid, et al.
Pubblicazione: (2025)
di: Abdollahi, Hamid, et al.
Pubblicazione: (2025)
Vectorized Video Representation with Easy Editing via Hierarchical Spatio-Temporally Consistent Proxy Embedding
di: Chen, Ye, et al.
Pubblicazione: (2025)
di: Chen, Ye, et al.
Pubblicazione: (2025)
Efficient Temporal Consistency in Diffusion-Based Video Editing with Adaptor Modules: A Theoretical Framework
di: Song, Xinyuan, et al.
Pubblicazione: (2025)
di: Song, Xinyuan, et al.
Pubblicazione: (2025)
Internalizing Temporal Consistency in Video Object-Centric Learning without Explicit Regularization
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
What Are We Really Measuring? Rethinking Dataset Bias in Web-Scale Natural Image Collections via Unsupervised Semantic Clustering
di: Saleknia, Amir Hossein, et al.
Pubblicazione: (2026)
di: Saleknia, Amir Hossein, et al.
Pubblicazione: (2026)
Nighttime Driver Behavior Prediction Using Taillight Signal Recognition via CNN-SVM Classifier
di: Barshooi, Amir Hossein, et al.
Pubblicazione: (2023)
di: Barshooi, Amir Hossein, et al.
Pubblicazione: (2023)
Instant3dit: Multiview Inpainting for Fast Editing of 3D Objects
di: Barda, Amir, et al.
Pubblicazione: (2024)
di: Barda, Amir, et al.
Pubblicazione: (2024)
TOC-Bench: A Temporal Object Consistency Benchmark for Video Large Language Models
di: Chen, Junzhe, et al.
Pubblicazione: (2026)
di: Chen, Junzhe, et al.
Pubblicazione: (2026)
ActAlign: Zero-Shot Fine-Grained Video Classification via Language-Guided Sequence Alignment
di: Aghdam, Amir, et al.
Pubblicazione: (2025)
di: Aghdam, Amir, et al.
Pubblicazione: (2025)
Neural 4D Evolution under Large Topological Changes from 2D Images
di: Razlighi, AmirHossein Naghi, et al.
Pubblicazione: (2024)
di: Razlighi, AmirHossein Naghi, et al.
Pubblicazione: (2024)
LTCA: Long-range Temporal Context Attention for Referring Video Object Segmentation
di: Yan, Cilin, et al.
Pubblicazione: (2025)
di: Yan, Cilin, et al.
Pubblicazione: (2025)
IMAGHarmony: Controllable Image Editing with Consistent Object Quantity and Layout
di: Shen, Fei, et al.
Pubblicazione: (2025)
di: Shen, Fei, et al.
Pubblicazione: (2025)
Deepfake Detection with Spatio-Temporal Consistency and Attention
di: Chen, Yunzhuo, et al.
Pubblicazione: (2025)
di: Chen, Yunzhuo, et al.
Pubblicazione: (2025)
SAM-PM: Enhancing Video Camouflaged Object Detection using Spatio-Temporal Attention
di: Meeran, Muhammad Nawfal, et al.
Pubblicazione: (2024)
di: Meeran, Muhammad Nawfal, et al.
Pubblicazione: (2024)
VideoCoF: Unified Video Editing with Temporal Reasoner
di: Yang, Xiangpeng, et al.
Pubblicazione: (2025)
di: Yang, Xiangpeng, et al.
Pubblicazione: (2025)
A Density-Guided Temporal Attention Transformer for Indiscernible Object Counting in Underwater Video
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2024)
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2024)
From Feature Visualization to Visual Circuits: Effect of Adversarial Model Manipulation
di: Nanfack, Geraldin, et al.
Pubblicazione: (2024)
di: Nanfack, Geraldin, et al.
Pubblicazione: (2024)
Diffusion-Based Attention Warping for Consistent 3D Scene Editing
di: Gomel, Eyal, et al.
Pubblicazione: (2024)
di: Gomel, Eyal, et al.
Pubblicazione: (2024)
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
End-to-End Fine-Tuning of 3D Texture Generation using Differentiable Rewards
di: Zamani, AmirHossein, et al.
Pubblicazione: (2025) -
Towards motion from video diffusion models
di: Janson, Paul, et al.
Pubblicazione: (2024) -
Unsupervised Representation Learning for 3D Mesh Parameterization with Semantic and Visibility Objectives
di: Zamani, AmirHossein, et al.
Pubblicazione: (2025) -
Sketch-guided Cage-based 3D Gaussian Splatting Deformation
di: Xie, Tianhao, et al.
Pubblicazione: (2024) -
A Scalable Attention-Based Approach for Image-to-3D Texture Mapping
di: Rampini, Arianna, et al.
Pubblicazione: (2025)