Internalizing Temporal Consistency in Video Object-Centric Learning without Explicit Regularization
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Rongzhen, Li, Zhiyuan, Kannala, Juho, Pajarinen, Joni |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cycle Consistency in Video Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026)
Organized Grouped Discrete Representation for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Vector-Quantized Vision Foundation Models for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Grouped Discrete Representation for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Grouped Discrete Representation Guides Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Multi-Scale Fusion for Object Representation
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)
Predicting Video Slot Attention Queries from Random Slot-Feature Pairs
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Rethinking Temporal Consistency in Video Object-Centric Learning: From Prediction to Correspondence
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
Slot Attention with Re-Initialization and Self-Distillation
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
Smoothing Slot Attention Iterations and Recurrences
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025)
MetaSlot: Break Through the Fixed Number of Slots in Object-Centric Learning
di: Liu, Hongjia, et al.
Pubblicazione: (2025)
di: Liu, Hongjia, et al.
Pubblicazione: (2025)
Object-Centric Vision Token Pruning for Vision Language Models
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
Scene-Agnostic Object-Centric Representation Learning for 3D Gaussian Splatting
di: Hsu, Tsuheng, et al.
Pubblicazione: (2026)
di: Hsu, Tsuheng, et al.
Pubblicazione: (2026)
PAWS: Perception of Articulation in the Wild at Scale from Egocentric Videos
di: Wang, Yihao, et al.
Pubblicazione: (2026)
di: Wang, Yihao, et al.
Pubblicazione: (2026)
Compositional Video Synthesis by Temporal Object-Centric Learning
di: Akan, Adil Kaan, et al.
Pubblicazione: (2025)
di: Akan, Adil Kaan, et al.
Pubblicazione: (2025)
A2-GNN: Angle-Annular GNN for Visual Descriptor-free Camera Relocalization
di: Zhang, Yejun, et al.
Pubblicazione: (2025)
di: Zhang, Yejun, et al.
Pubblicazione: (2025)
DGC-GNN: Leveraging Geometry and Color Cues for Visual Descriptor-Free 2D-3D Matching
di: Wang, Shuzhe, et al.
Pubblicazione: (2023)
di: Wang, Shuzhe, et al.
Pubblicazione: (2023)
OP2GS: Object-Aware 3D Gaussian Splatting with Dual-Opacity Primitives
di: Liu, Guiyu, et al.
Pubblicazione: (2026)
di: Liu, Guiyu, et al.
Pubblicazione: (2026)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
Temporally Consistent Object-Centric Learning by Contrasting Slots
di: Manasyan, Anna, et al.
Pubblicazione: (2024)
di: Manasyan, Anna, et al.
Pubblicazione: (2024)
SlotVTG: Object-Centric Adapter for Generalizable Video Temporal Grounding
di: Han, Jiwook, et al.
Pubblicazione: (2026)
di: Han, Jiwook, et al.
Pubblicazione: (2026)
Efficient NeRF Optimization -- Not All Samples Remain Equally Hard
di: Korhonen, Juuso, et al.
Pubblicazione: (2024)
di: Korhonen, Juuso, et al.
Pubblicazione: (2024)
Object-Centric Temporal Consistency via Conditional Autoregressive Inductive Biases
di: Meo, Cristian, et al.
Pubblicazione: (2024)
di: Meo, Cristian, et al.
Pubblicazione: (2024)
Temporally Consistent Object Editing in Videos using Extended Attention
di: Zamani, AmirHossein, et al.
Pubblicazione: (2024)
di: Zamani, AmirHossein, et al.
Pubblicazione: (2024)
Temporally Consistent Referring Video Object Segmentation with Hybrid Memory
di: Miao, Bo, et al.
Pubblicazione: (2024)
di: Miao, Bo, et al.
Pubblicazione: (2024)
Explicitly Disentangled Representations in Object-Centric Learning
di: Majellaro, Riccardo, et al.
Pubblicazione: (2024)
di: Majellaro, Riccardo, et al.
Pubblicazione: (2024)
Object-Centric Learning for Real-World Videos by Predicting Temporal Feature Similarities
di: Zadaianchuk, Andrii, et al.
Pubblicazione: (2023)
di: Zadaianchuk, Andrii, et al.
Pubblicazione: (2023)
TOC-Bench: A Temporal Object Consistency Benchmark for Video Large Language Models
di: Chen, Junzhe, et al.
Pubblicazione: (2026)
di: Chen, Junzhe, et al.
Pubblicazione: (2026)
From Frames to Sequences: Temporally Consistent Human-Centric Dense Prediction
di: Miao, Xingyu, et al.
Pubblicazione: (2026)
di: Miao, Xingyu, et al.
Pubblicazione: (2026)
Object-Centric Framework for Video Moment Retrieval
di: Li, Zongyao, et al.
Pubblicazione: (2025)
di: Li, Zongyao, et al.
Pubblicazione: (2025)
Latest Object Memory Management for Temporally Consistent Video Instance Segmentation
di: Lee, Seunghun, et al.
Pubblicazione: (2025)
di: Lee, Seunghun, et al.
Pubblicazione: (2025)
Multi-Context Temporal Consistent Modeling for Referring Video Object Segmentation
di: Choi, Sun-Hyuk, et al.
Pubblicazione: (2025)
di: Choi, Sun-Hyuk, et al.
Pubblicazione: (2025)
Efficient One-stage Video Object Detection by Exploiting Temporal Consistency
di: Sun, Guanxiong, et al.
Pubblicazione: (2024)
di: Sun, Guanxiong, et al.
Pubblicazione: (2024)
Mask Consistency Regularization in Object Removal
di: Yuan, Hua, et al.
Pubblicazione: (2025)
di: Yuan, Hua, et al.
Pubblicazione: (2025)
Medical Image Segmentation with SAM-generated Annotations
di: Häkkinen, Iira, et al.
Pubblicazione: (2024)
di: Häkkinen, Iira, et al.
Pubblicazione: (2024)
Gaussian Splatting in Mirrors: Reflection-Aware Rendering via Virtual Camera Optimization
di: Wang, Zihan, et al.
Pubblicazione: (2024)
di: Wang, Zihan, et al.
Pubblicazione: (2024)
Differentiable Product Quantization for Memory Efficient Camera Relocalization
di: Laskar, Zakaria, et al.
Pubblicazione: (2024)
di: Laskar, Zakaria, et al.
Pubblicazione: (2024)
Sources of Uncertainty in 3D Scene Reconstruction
di: Klasson, Marcus, et al.
Pubblicazione: (2024)
di: Klasson, Marcus, et al.
Pubblicazione: (2024)
RGB-Th-Bench: A Dense benchmark for Visual-Thermal Understanding of Vision Language Models
di: Moshtaghi, Mehdi, et al.
Pubblicazione: (2025)
di: Moshtaghi, Mehdi, et al.
Pubblicazione: (2025)
FingerVeinSyn-5M: A Million-Scale Dataset and Benchmark for Finger Vein Recognition
di: Wang, Yinfan, et al.
Pubblicazione: (2025)
di: Wang, Yinfan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Cycle Consistency in Video Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2026) -
Organized Grouped Discrete Representation for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024) -
Vector-Quantized Vision Foundation Models for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2025) -
Grouped Discrete Representation for Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024) -
Grouped Discrete Representation Guides Object-Centric Learning
di: Zhao, Rongzhen, et al.
Pubblicazione: (2024)