Gaussian Masked Autoencoders
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rajasegaran, Jathushan, Chen, Xinlei, Li, Rulilong, Feichtenhofer, Christoph, Malik, Jitendra, Ginosar, Shiry |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Poly-Autoregressive Prediction for Modeling Interactions
par: Thakkar, Neerja, et autres
Publié: (2025)
par: Thakkar, Neerja, et autres
Publié: (2025)
An Empirical Study of Autoregressive Pre-training from Videos
par: Rajasegaran, Jathushan, et autres
Publié: (2025)
par: Rajasegaran, Jathushan, et autres
Publié: (2025)
Scaling Properties of Diffusion Models for Perceptual Tasks
par: Ravishankar, Rahul, et autres
Publié: (2024)
par: Ravishankar, Rahul, et autres
Publié: (2024)
Synergy and Synchrony in Couple Dances
par: Maluleke, Vongani, et autres
Publié: (2024)
par: Maluleke, Vongani, et autres
Publié: (2024)
Synthesizing Moving People with 3D Control
par: Li, Boyi, et autres
Publié: (2024)
par: Li, Boyi, et autres
Publié: (2024)
Tracking by Predicting 3-D Gaussians Over Time
par: Baranwal, Tanish, et autres
Publié: (2025)
par: Baranwal, Tanish, et autres
Publié: (2025)
Diffusion Models as Data Mining Tools
par: Siglidis, Ioannis, et autres
Publié: (2024)
par: Siglidis, Ioannis, et autres
Publié: (2024)
Back into Plato's Cave: Examining Cross-modal Representational Convergence at Scale
par: Koepke, A. Sophia, et autres
Publié: (2026)
par: Koepke, A. Sophia, et autres
Publié: (2026)
Forecasting Motion in the Wild
par: Thakkar, Neerja, et autres
Publié: (2026)
par: Thakkar, Neerja, et autres
Publié: (2026)
FewShotNeRF: Meta-Learning-based Novel View Synthesis for Rapid Scene-Specific Adaptation
par: Sivakumar, Piraveen, et autres
Publié: (2024)
par: Sivakumar, Piraveen, et autres
Publié: (2024)
KiVA: Kid-inspired Visual Analogies for Testing Large Multimodal Models
par: Yiu, Eunice, et autres
Publié: (2024)
par: Yiu, Eunice, et autres
Publié: (2024)
Pseudo Labelling for Enhanced Masked Autoencoders
par: Nandam, Srinivasa Rao, et autres
Publié: (2024)
par: Nandam, Srinivasa Rao, et autres
Publié: (2024)
Domain-Guided Masked Autoencoders for Unique Player Identification
par: Balaji, Bavesh, et autres
Publié: (2024)
par: Balaji, Bavesh, et autres
Publié: (2024)
Disentangling Masked Autoencoders for Unsupervised Domain Generalization
par: Zhang, An, et autres
Publié: (2024)
par: Zhang, An, et autres
Publié: (2024)
Humanoid Locomotion as Next Token Prediction
par: Radosavovic, Ilija, et autres
Publié: (2024)
par: Radosavovic, Ilija, et autres
Publié: (2024)
Masked Autoencoders Are Effective Tokenizers for Diffusion Models
par: Chen, Hao, et autres
Publié: (2025)
par: Chen, Hao, et autres
Publié: (2025)
Self-Supervised Masked Autoencoders with Dense-Unet for Coronary Calcium Removal in limited CT Data
par: Chen, Mo
Publié: (2025)
par: Chen, Mo
Publié: (2025)
Frozen Forecasting: A Unified Evaluation
par: Walker, Jacob C, et autres
Publié: (2025)
par: Walker, Jacob C, et autres
Publié: (2025)
Self Pre-training with Topology- and Spatiality-aware Masked Autoencoders for 3D Medical Image Segmentation
par: Gu, Pengfei, et autres
Publié: (2024)
par: Gu, Pengfei, et autres
Publié: (2024)
MAESIL: Masked Autoencoder for Enhanced Self-supervised Medical Image Learning
par: Kim, Kyeonghun, et autres
Publié: (2026)
par: Kim, Kyeonghun, et autres
Publié: (2026)
Privacy Protection in MRI Scans Using 3D Masked Autoencoders
par: Van der Goten, Lennart Alexander, et autres
Publié: (2023)
par: Van der Goten, Lennart Alexander, et autres
Publié: (2023)
xT: Nested Tokenization for Larger Context in Large Images
par: Gupta, Ritwik, et autres
Publié: (2024)
par: Gupta, Ritwik, et autres
Publié: (2024)
SCE-MAE: Selective Correspondence Enhancement with Masked Autoencoder for Self-Supervised Landmark Estimation
par: Yin, Kejia, et autres
Publié: (2024)
par: Yin, Kejia, et autres
Publié: (2024)
CL-MAE: Curriculum-Learned Masked Autoencoders
par: Madan, Neelu, et autres
Publié: (2023)
par: Madan, Neelu, et autres
Publié: (2023)
MaeFuse: Transferring Omni Features with Pretrained Masked Autoencoders for Infrared and Visible Image Fusion via Guided Training
par: Li, Jiayang, et autres
Publié: (2024)
par: Li, Jiayang, et autres
Publié: (2024)
What Matters to You? Towards Visual Representation Alignment for Robot Learning
par: Tian, Ran, et autres
Publié: (2023)
par: Tian, Ran, et autres
Publié: (2023)
Masked Autoencoders for Microscopy are Scalable Learners of Cellular Biology
par: Kraus, Oren, et autres
Publié: (2024)
par: Kraus, Oren, et autres
Publié: (2024)
Balanced Token Pruning: Accelerating Vision Language Models Beyond Local Optimization
par: Li, Kaiyuan, et autres
Publié: (2025)
par: Li, Kaiyuan, et autres
Publié: (2025)
EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent
par: Li, Jiaao, et autres
Publié: (2025)
par: Li, Jiaao, et autres
Publié: (2025)
Multimodal Masked Autoencoder Pre-training for 3D MRI-Based Brain Tumor Analysis with Missing Modalities
par: Robinet, Lucas, et autres
Publié: (2025)
par: Robinet, Lucas, et autres
Publié: (2025)
Dr$^2$Net: Dynamic Reversible Dual-Residual Networks for Memory-Efficient Finetuning
par: Zhao, Chen, et autres
Publié: (2024)
par: Zhao, Chen, et autres
Publié: (2024)
VisionTS: Visual Masked Autoencoders Are Free-Lunch Zero-Shot Time Series Forecasters
par: Chen, Mouxiang, et autres
Publié: (2024)
par: Chen, Mouxiang, et autres
Publié: (2024)
Patch Progression Masked Autoencoder with Fusion CNN Network for Classifying Evolution Between Two Pairs of 2D OCT Slices
par: Zhang, Philippe, et autres
Publié: (2025)
par: Zhang, Philippe, et autres
Publié: (2025)
i-MAE: Are Latent Representations in Masked Autoencoders Linearly Separable?
par: Zhang, Kevin, et autres
Publié: (2022)
par: Zhang, Kevin, et autres
Publié: (2022)
VAN-AD: Visual Masked Autoencoder with Normalizing Flow For Time Series Anomaly Detection
par: Chen, PengYu, et autres
Publié: (2026)
par: Chen, PengYu, et autres
Publié: (2026)
Sense Less, Generate More: Pre-training LiDAR Perception with Masked Autoencoders for Ultra-Efficient 3D Sensing
par: Tayebati, Sina, et autres
Publié: (2024)
par: Tayebati, Sina, et autres
Publié: (2024)
3D Cloud reconstruction through geospatially-aware Masked Autoencoders
par: Girtsou, Stella, et autres
Publié: (2025)
par: Girtsou, Stella, et autres
Publié: (2025)
Pose Priors from Language Models
par: Subramanian, Sanjay, et autres
Publié: (2024)
par: Subramanian, Sanjay, et autres
Publié: (2024)
Estimating Body and Hand Motion in an Ego-sensed World
par: Yi, Brent, et autres
Publié: (2024)
par: Yi, Brent, et autres
Publié: (2024)
Multi-Scale Neighborhood Occupancy Masked Autoencoder for Self-Supervised Learning in LiDAR Point Clouds
par: Abdelsamad, Mohamed, et autres
Publié: (2025)
par: Abdelsamad, Mohamed, et autres
Publié: (2025)
Documents similaires
-
Poly-Autoregressive Prediction for Modeling Interactions
par: Thakkar, Neerja, et autres
Publié: (2025) -
An Empirical Study of Autoregressive Pre-training from Videos
par: Rajasegaran, Jathushan, et autres
Publié: (2025) -
Scaling Properties of Diffusion Models for Perceptual Tasks
par: Ravishankar, Rahul, et autres
Publié: (2024) -
Synergy and Synchrony in Couple Dances
par: Maluleke, Vongani, et autres
Publié: (2024) -
Synthesizing Moving People with 3D Control
par: Li, Boyi, et autres
Publié: (2024)