Organized Grouped Discrete Representation for Object-Centric Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Rongzhen, Wang, Vivienne, Kannala, Juho, Pajarinen, Joni |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Grouped Discrete Representation for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024)
par: Zhao, Rongzhen, et autres
Publié: (2024)
Grouped Discrete Representation Guides Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024)
par: Zhao, Rongzhen, et autres
Publié: (2024)
Vector-Quantized Vision Foundation Models for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2025)
par: Zhao, Rongzhen, et autres
Publié: (2025)
Multi-Scale Fusion for Object Representation
par: Zhao, Rongzhen, et autres
Publié: (2024)
par: Zhao, Rongzhen, et autres
Publié: (2024)
Internalizing Temporal Consistency in Video Object-Centric Learning without Explicit Regularization
par: Zhao, Rongzhen, et autres
Publié: (2026)
par: Zhao, Rongzhen, et autres
Publié: (2026)
Cycle Consistency in Video Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2026)
par: Zhao, Rongzhen, et autres
Publié: (2026)
Slot Attention with Re-Initialization and Self-Distillation
par: Zhao, Rongzhen, et autres
Publié: (2025)
par: Zhao, Rongzhen, et autres
Publié: (2025)
Predicting Video Slot Attention Queries from Random Slot-Feature Pairs
par: Zhao, Rongzhen, et autres
Publié: (2025)
par: Zhao, Rongzhen, et autres
Publié: (2025)
Smoothing Slot Attention Iterations and Recurrences
par: Zhao, Rongzhen, et autres
Publié: (2025)
par: Zhao, Rongzhen, et autres
Publié: (2025)
MetaSlot: Break Through the Fixed Number of Slots in Object-Centric Learning
par: Liu, Hongjia, et autres
Publié: (2025)
par: Liu, Hongjia, et autres
Publié: (2025)
Object-Centric Vision Token Pruning for Vision Language Models
par: Li, Guangyuan, et autres
Publié: (2025)
par: Li, Guangyuan, et autres
Publié: (2025)
Rethinking Temporal Consistency in Video Object-Centric Learning: From Prediction to Correspondence
par: Li, Zhiyuan, et autres
Publié: (2026)
par: Li, Zhiyuan, et autres
Publié: (2026)
Scene-Agnostic Object-Centric Representation Learning for 3D Gaussian Splatting
par: Hsu, Tsuheng, et autres
Publié: (2026)
par: Hsu, Tsuheng, et autres
Publié: (2026)
PAWS: Perception of Articulation in the Wild at Scale from Egocentric Videos
par: Wang, Yihao, et autres
Publié: (2026)
par: Wang, Yihao, et autres
Publié: (2026)
A2-GNN: Angle-Annular GNN for Visual Descriptor-free Camera Relocalization
par: Zhang, Yejun, et autres
Publié: (2025)
par: Zhang, Yejun, et autres
Publié: (2025)
DGC-GNN: Leveraging Geometry and Color Cues for Visual Descriptor-Free 2D-3D Matching
par: Wang, Shuzhe, et autres
Publié: (2023)
par: Wang, Shuzhe, et autres
Publié: (2023)
OP2GS: Object-Aware 3D Gaussian Splatting with Dual-Opacity Primitives
par: Liu, Guiyu, et autres
Publié: (2026)
par: Liu, Guiyu, et autres
Publié: (2026)
Gaussian Splatting in Mirrors: Reflection-Aware Rendering via Virtual Camera Optimization
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
Differentiable Product Quantization for Memory Efficient Camera Relocalization
par: Laskar, Zakaria, et autres
Publié: (2024)
par: Laskar, Zakaria, et autres
Publié: (2024)
Efficient NeRF Optimization -- Not All Samples Remain Equally Hard
par: Korhonen, Juuso, et autres
Publié: (2024)
par: Korhonen, Juuso, et autres
Publié: (2024)
Top-Down Guidance for Learning Object-Centric Representations
par: Zou, Junhong, et autres
Publié: (2024)
par: Zou, Junhong, et autres
Publié: (2024)
Medical Image Segmentation with SAM-generated Annotations
par: Häkkinen, Iira, et autres
Publié: (2024)
par: Häkkinen, Iira, et autres
Publié: (2024)
NVSMask3D: Hard Visual Prompting with Camera Pose Interpolation for 3D Open Vocabulary Instance Segmentation
par: Fang, Junyuan, et autres
Publié: (2025)
par: Fang, Junyuan, et autres
Publié: (2025)
Sources of Uncertainty in 3D Scene Reconstruction
par: Klasson, Marcus, et autres
Publié: (2024)
par: Klasson, Marcus, et autres
Publié: (2024)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
par: Guan, Jiarui, et autres
Publié: (2026)
par: Guan, Jiarui, et autres
Publié: (2026)
RGB-Th-Bench: A Dense benchmark for Visual-Thermal Understanding of Vision Language Models
par: Moshtaghi, Mehdi, et autres
Publié: (2025)
par: Moshtaghi, Mehdi, et autres
Publié: (2025)
FingerVeinSyn-5M: A Million-Scale Dataset and Benchmark for Finger Vein Recognition
par: Wang, Yinfan, et autres
Publié: (2025)
par: Wang, Yinfan, et autres
Publié: (2025)
MuSHRoom: Multi-Sensor Hybrid Room Dataset for Joint 3D Reconstruction and Novel View Synthesis
par: Ren, Xuqian, et autres
Publié: (2023)
par: Ren, Xuqian, et autres
Publié: (2023)
Zero-Shot Object-Centric Representation Learning
par: Didolkar, Aniket, et autres
Publié: (2024)
par: Didolkar, Aniket, et autres
Publié: (2024)
Learning Global Object-Centric Representations via Disentangled Slot Attention
par: Chen, Tonglin, et autres
Publié: (2024)
par: Chen, Tonglin, et autres
Publié: (2024)
Context Matters: Learning Global Semantics via Object-Centric Representation
par: Zhong, Jike, et autres
Publié: (2025)
par: Zhong, Jike, et autres
Publié: (2025)
Learning Object-Centric Representations Based on Slots in Real World Scenarios
par: Akan, Adil Kaan
Publié: (2025)
par: Akan, Adil Kaan
Publié: (2025)
3D Gaussian Splatting with Fisheye Images: Field of View Analysis and Depth-Based Initialization
par: Gunes, Ulas, et autres
Publié: (2025)
par: Gunes, Ulas, et autres
Publié: (2025)
Learning Object-Centric Representations in SAR Images with Multi-Level Feature Fusion
par: Jang, Oh-Tae, et autres
Publié: (2025)
par: Jang, Oh-Tae, et autres
Publié: (2025)
DN-Splatter: Depth and Normal Priors for Gaussian Splatting and Meshing
par: Turkulainen, Matias, et autres
Publié: (2024)
par: Turkulainen, Matias, et autres
Publié: (2024)
FIORD: A Fisheye Indoor-Outdoor Dataset with LIDAR Ground Truth for 3D Scene Reconstruction and Benchmarking
par: Gunes, Ulas, et autres
Publié: (2025)
par: Gunes, Ulas, et autres
Publié: (2025)
HybVIO: Pushing the Limits of Real-time Visual-inertial Odometry
par: Seiskari, Otto, et autres
Publié: (2021)
par: Seiskari, Otto, et autres
Publié: (2021)
ORGAN: Object-Centric Representation Learning using Cycle Consistent Generative Adversarial Networks
par: Küchler, Joël, et autres
Publié: (2026)
par: Küchler, Joël, et autres
Publié: (2026)
Object-Centric Representation Learning for Enhanced 3D Semantic Scene Graph Prediction
par: Heo, KunHo, et autres
Publié: (2025)
par: Heo, KunHo, et autres
Publié: (2025)
Reloc3r: Large-Scale Training of Relative Camera Pose Regression for Generalizable, Fast, and Accurate Visual Localization
par: Dong, Siyan, et autres
Publié: (2024)
par: Dong, Siyan, et autres
Publié: (2024)
Documents similaires
-
Grouped Discrete Representation for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024) -
Grouped Discrete Representation Guides Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024) -
Vector-Quantized Vision Foundation Models for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2025) -
Multi-Scale Fusion for Object Representation
par: Zhao, Rongzhen, et autres
Publié: (2024) -
Internalizing Temporal Consistency in Video Object-Centric Learning without Explicit Regularization
par: Zhao, Rongzhen, et autres
Publié: (2026)