VONet: Unsupervised Video Object Learning With Parallel U-Net Attention and Object-wise Sequential VAE
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Haonan, Xu, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hierarchical Compact Clustering Attention (COCA) for Unsupervised Object-Centric Learning
par: Küçüksözen, Can, et autres
Publié: (2025)
par: Küçüksözen, Can, et autres
Publié: (2025)
RS-TinyNet: Stage-wise Feature Fusion Network for Detecting Tiny Objects in Remote Sensing Images
par: Jiang, Xiaozheng, et autres
Publié: (2025)
par: Jiang, Xiaozheng, et autres
Publié: (2025)
From Vicious to Virtuous Cycles: Synergistic Representation Learning for Unsupervised Video Object-Centric Learning
par: Seong, Hyun Seok, et autres
Publié: (2026)
par: Seong, Hyun Seok, et autres
Publié: (2026)
CMTM: Cross-Modal Token Modulation for Unsupervised Video Object Segmentation
par: Jeon, Inseok, et autres
Publié: (2026)
par: Jeon, Inseok, et autres
Publié: (2026)
DDLP: Unsupervised Object-Centric Video Prediction with Deep Dynamic Latent Particles
par: Daniel, Tal, et autres
Publié: (2023)
par: Daniel, Tal, et autres
Publié: (2023)
Saliency-Motion Guided Trunk-Collateral Network for Unsupervised Video Object Segmentation
par: Zheng, Xiangyu, et autres
Publié: (2025)
par: Zheng, Xiangyu, et autres
Publié: (2025)
Unsupervised Object-Centric Learning from Multiple Unspecified Viewpoints
par: Yuan, Jinyang, et autres
Publié: (2024)
par: Yuan, Jinyang, et autres
Publié: (2024)
Masked Multi-Query Slot Attention for Unsupervised Object Discovery
par: Pramanik, Rishav, et autres
Publié: (2024)
par: Pramanik, Rishav, et autres
Publié: (2024)
Conformal Object Detection by Sequential Risk Control
par: andéol, Léo, et autres
Publié: (2025)
par: andéol, Léo, et autres
Publié: (2025)
Unsupervised Machine Learning for Detecting and Locating Human-Made Objects in 3D Point Cloud
par: Zhao, Hong, et autres
Publié: (2024)
par: Zhao, Hong, et autres
Publié: (2024)
Divided Attention: Unsupervised Multi-Object Discovery with Contextually Separated Slots
par: Lao, Dong, et autres
Publié: (2023)
par: Lao, Dong, et autres
Publié: (2023)
Multiple Object Stitching for Unsupervised Representation Learning
par: Shen, Chengchao, et autres
Publié: (2025)
par: Shen, Chengchao, et autres
Publié: (2025)
DynaVol: Unsupervised Learning for Dynamic Scenes through Object-Centric Voxelization
par: Zhao, Yanpeng, et autres
Publié: (2023)
par: Zhao, Yanpeng, et autres
Publié: (2023)
Reconstruction-Guided Slot Curriculum: Addressing Object Over-Fragmentation in Video Object-Centric Learning
par: Moon, WonJun, et autres
Publié: (2026)
par: Moon, WonJun, et autres
Publié: (2026)
NOAH: Learning Pairwise Object Category Attentions for Image Classification
par: Li, Chao, et autres
Publié: (2024)
par: Li, Chao, et autres
Publié: (2024)
FORLA: Federated Object-centric Representation Learning with Slot Attention
par: Liao, Guiqiu, et autres
Publié: (2025)
par: Liao, Guiqiu, et autres
Publié: (2025)
Spatiotemporal Attention Learning Framework for Event-Driven Object Recognition
par: Xie, Tiantian, et autres
Publié: (2025)
par: Xie, Tiantian, et autres
Publié: (2025)
Edge Attention Module for Object Classification
par: Roy, Santanu, et autres
Publié: (2025)
par: Roy, Santanu, et autres
Publié: (2025)
VideoOrion: Tokenizing Object Dynamics in Videos
par: Feng, Yicheng, et autres
Publié: (2024)
par: Feng, Yicheng, et autres
Publié: (2024)
Incremental Object Keypoint Learning
par: Liang, Mingfu, et autres
Publié: (2025)
par: Liang, Mingfu, et autres
Publié: (2025)
CSA-Net: Channel-wise Spatially Autocorrelated Attention Networks
par: Nikzad, Nick, et autres
Publié: (2024)
par: Nikzad, Nick, et autres
Publié: (2024)
Lecture Video Visual Objects (LVVO) Dataset: A Benchmark for Visual Object Detection in Educational Videos
par: Biswas, Dipayan, et autres
Publié: (2025)
par: Biswas, Dipayan, et autres
Publié: (2025)
Closed-Loop Unsupervised Representation Disentanglement with $β$-VAE Distillation and Diffusion Probabilistic Feedback
par: Jin, Xin, et autres
Publié: (2024)
par: Jin, Xin, et autres
Publié: (2024)
AnomalousNet: A Hybrid Approach with Attention U-Nets and Change Point Detection for Accurate Characterization of Anomalous Diffusion in Video Data
par: Ahsini, Yusef, et autres
Publié: (2025)
par: Ahsini, Yusef, et autres
Publié: (2025)
Decoupling Amplitude and Phase Attention in Frequency Domain for RGB-Event based Visual Object Tracking
par: Wang, Shiao, et autres
Publié: (2026)
par: Wang, Shiao, et autres
Publié: (2026)
Object-Centric Diffusion for Efficient Video Editing
par: Kahatapitiya, Kumara, et autres
Publié: (2024)
par: Kahatapitiya, Kumara, et autres
Publié: (2024)
Moving Object Proposals with Deep Learned Optical Flow for Video Object Segmentation
par: Shi, Ge, et autres
Publié: (2024)
par: Shi, Ge, et autres
Publié: (2024)
Boosting Object Representation Learning via Motion and Object Continuity
par: Delfosse, Quentin, et autres
Publié: (2022)
par: Delfosse, Quentin, et autres
Publié: (2022)
COVTrack++: Learning Open-Vocabulary Multi-Object Tracking from Continuous Videos via a Synergistic Paradigm
par: Qian, Zekun, et autres
Publié: (2026)
par: Qian, Zekun, et autres
Publié: (2026)
Object-Centric Learning for Real-World Videos by Predicting Temporal Feature Similarities
par: Zadaianchuk, Andrii, et autres
Publié: (2023)
par: Zadaianchuk, Andrii, et autres
Publié: (2023)
DoughNet: A Visual Predictive Model for Topological Manipulation of Deformable Objects
par: Bauer, Dominik, et autres
Publié: (2024)
par: Bauer, Dominik, et autres
Publié: (2024)
Adaptive Slot Attention: Object Discovery with Dynamic Slot Number
par: Fan, Ke, et autres
Publié: (2024)
par: Fan, Ke, et autres
Publié: (2024)
Reasoning-Enhanced Object-Centric Learning for Videos
par: Li, Jian, et autres
Publié: (2024)
par: Li, Jian, et autres
Publié: (2024)
TrackNetV4: Enhancing Fast Sports Object Tracking with Motion Attention Maps
par: Raj, Arjun, et autres
Publié: (2024)
par: Raj, Arjun, et autres
Publié: (2024)
Unsupervised Representation Learning by Balanced Self Attention Matching
par: Shalam, Daniel, et autres
Publié: (2024)
par: Shalam, Daniel, et autres
Publié: (2024)
VidTwin: Video VAE with Decoupled Structure and Dynamics
par: Wang, Yuchi, et autres
Publié: (2024)
par: Wang, Yuchi, et autres
Publié: (2024)
Dual Prototype Attention for Unsupervised Video Object Segmentation
par: Cho, Suhwan, et autres
Publié: (2022)
par: Cho, Suhwan, et autres
Publié: (2022)
Guided Slot Attention for Unsupervised Video Object Segmentation
par: Lee, Minhyeok, et autres
Publié: (2023)
par: Lee, Minhyeok, et autres
Publié: (2023)
VQPy: An Object-Oriented Approach to Modern Video Analytics
par: Yu, Shan, et autres
Publié: (2023)
par: Yu, Shan, et autres
Publié: (2023)
GTA: Guided Transfer of Spatial Attention from Object-Centric Representations
par: Seo, SeokHyun, et autres
Publié: (2024)
par: Seo, SeokHyun, et autres
Publié: (2024)
Documents similaires
-
Hierarchical Compact Clustering Attention (COCA) for Unsupervised Object-Centric Learning
par: Küçüksözen, Can, et autres
Publié: (2025) -
RS-TinyNet: Stage-wise Feature Fusion Network for Detecting Tiny Objects in Remote Sensing Images
par: Jiang, Xiaozheng, et autres
Publié: (2025) -
From Vicious to Virtuous Cycles: Synergistic Representation Learning for Unsupervised Video Object-Centric Learning
par: Seong, Hyun Seok, et autres
Publié: (2026) -
CMTM: Cross-Modal Token Modulation for Unsupervised Video Object Segmentation
par: Jeon, Inseok, et autres
Publié: (2026) -
DDLP: Unsupervised Object-Centric Video Prediction with Deep Dynamic Latent Particles
par: Daniel, Tal, et autres
Publié: (2023)