Midway Network: Learning Representations for Recognition and Motion from Latent Dynamics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hoang, Christopher, Ren, Mengye |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Seeking the Unfamiliar but Memorable: Conceptual Creativity as Meta-Learning
par: Ren, Mengye
Publié: (2026)
par: Ren, Mengye
Publié: (2026)
Memory Storyboard: Leveraging Temporal Segmentation for Streaming Self-Supervised Learning from Egocentric Videos
par: Yang, Yanlai, et autres
Publié: (2025)
par: Yang, Yanlai, et autres
Publié: (2025)
PooDLe: Pooled and dense self-supervised learning from naturalistic videos
par: Wang, Alex N., et autres
Publié: (2024)
par: Wang, Alex N., et autres
Publié: (2024)
Integrating Present and Past in Unsupervised Continual Learning
par: Zhang, Yipeng, et autres
Publié: (2024)
par: Zhang, Yipeng, et autres
Publié: (2024)
LifelongMemory: Leveraging LLMs for Answering Queries in Long-form Egocentric Videos
par: Wang, Ying, et autres
Publié: (2023)
par: Wang, Ying, et autres
Publié: (2023)
Opinion: Learning Intuitive Physics May Require More than Visual Data
par: Su, Ellen, et autres
Publié: (2025)
par: Su, Ellen, et autres
Publié: (2025)
Discrete JEPA: Learning Discrete Token Representations without Reconstruction
par: Baek, Junyeob, et autres
Publié: (2025)
par: Baek, Junyeob, et autres
Publié: (2025)
Latent Uncertainty Representations for Video-based Driver Action and Intention Recognition
par: Vellenga, Koen, et autres
Publié: (2025)
par: Vellenga, Koen, et autres
Publié: (2025)
Hypergraph Laplacian Eigenmaps and Face Recognition Problems
par: Tran, Loc Hoang
Publié: (2024)
par: Tran, Loc Hoang
Publié: (2024)
Neural Prior Estimation: Learning Class Priors from Latent Representations
par: Yavari, Masoud, et autres
Publié: (2026)
par: Yavari, Masoud, et autres
Publié: (2026)
Isometric Representation Learning for Disentangled Latent Space of Diffusion Models
par: Hahm, Jaehoon, et autres
Publié: (2024)
par: Hahm, Jaehoon, et autres
Publié: (2024)
VEDIT: Latent Prediction Architecture For Procedural Video Representation Learning
par: Lin, Han, et autres
Publié: (2024)
par: Lin, Han, et autres
Publié: (2024)
Boosting Object Representation Learning via Motion and Object Continuity
par: Delfosse, Quentin, et autres
Publié: (2022)
par: Delfosse, Quentin, et autres
Publié: (2022)
Learning Structure-from-Motion with Graph Attention Networks
par: Brynte, Lucas, et autres
Publié: (2023)
par: Brynte, Lucas, et autres
Publié: (2023)
An Approach Towards Learning K-means-friendly Deep Latent Representation
par: Roy, Debapriya
Publié: (2024)
par: Roy, Debapriya
Publié: (2024)
Evolving Skeletons: Motion Dynamics in Action Recognition
par: Qiu, Jushang, et autres
Publié: (2025)
par: Qiu, Jushang, et autres
Publié: (2025)
Boosting Open Set Recognition Performance through Modulated Representation Learning
par: Kundu, Amit Kumar, et autres
Publié: (2025)
par: Kundu, Amit Kumar, et autres
Publié: (2025)
Attention-Guided Dual-Stream Learning for Group Engagement Recognition: Fusing Transformer-Encoded Motion Dynamics with Scene Context via Adaptive Gating
par: Chowdhury, Saniah Kayenat, et autres
Publié: (2026)
par: Chowdhury, Saniah Kayenat, et autres
Publié: (2026)
Continual Learning of Conjugated Visual Representations through Higher-order Motion Flows
par: Marullo, Simone, et autres
Publié: (2024)
par: Marullo, Simone, et autres
Publié: (2024)
Canonical Latent Representations in Conditional Diffusion Models
par: Xu, Yitao, et autres
Publié: (2025)
par: Xu, Yitao, et autres
Publié: (2025)
An Optimal Transport-driven Approach for Cultivating Latent Space in Online Incremental Learning
par: Tran, Quyen, et autres
Publié: (2022)
par: Tran, Quyen, et autres
Publié: (2022)
Continuity-Preserving Convolutional Autoencoders for Learning Continuous Latent Dynamical Models from Images
par: Zhu, Aiqing, et autres
Publié: (2025)
par: Zhu, Aiqing, et autres
Publié: (2025)
Latent Equivariant Operators for Robust Object Recognition: Promises and Challenges
par: Dinh, Minh, et autres
Publié: (2026)
par: Dinh, Minh, et autres
Publié: (2026)
Latent Zoning Network: A Unified Principle for Generative Modeling, Representation Learning, and Classification
par: Lin, Zinan, et autres
Publié: (2025)
par: Lin, Zinan, et autres
Publié: (2025)
Enhancing Interpretability of Sparse Latent Representations with Class Information
par: Abiz, Farshad Sangari, et autres
Publié: (2025)
par: Abiz, Farshad Sangari, et autres
Publié: (2025)
MIND: Decoupling Model-Induced Label Noise via Latent Manifold Disentanglement
par: Ren, Dayong
Publié: (2026)
par: Ren, Dayong
Publié: (2026)
Balancing the Scales: Enhancing Fairness in Facial Expression Recognition with Latent Alignment
par: Rizvi, Syed Sameen Ahmad, et autres
Publié: (2024)
par: Rizvi, Syed Sameen Ahmad, et autres
Publié: (2024)
Efficient Video Diffusion Models via Content-Frame Motion-Latent Decomposition
par: Yu, Sihyun, et autres
Publié: (2024)
par: Yu, Sihyun, et autres
Publié: (2024)
Progressive Feature Learning for Realistic Cloth-Changing Gait Recognition
par: Ren, Xuqian, et autres
Publié: (2022)
par: Ren, Xuqian, et autres
Publié: (2022)
Stable-Drift: A Patient-Aware Latent Drift Replay Method for Stabilizing Representations in Continual Learning
par: Theofilou, Paraskevi-Antonia, et autres
Publié: (2025)
par: Theofilou, Paraskevi-Antonia, et autres
Publié: (2025)
LatentGAN Autoencoder: Learning Disentangled Latent Distribution
par: Kalwar, Sanket, et autres
Publié: (2022)
par: Kalwar, Sanket, et autres
Publié: (2022)
Latent Object Characteristics Recognition with Visual to Haptic-Audio Cross-modal Transfer Learning
par: Saito, Namiko, et autres
Publié: (2024)
par: Saito, Namiko, et autres
Publié: (2024)
Selective, Interpretable, and Motion Consistent Privacy Attribute Obfuscation for Action Recognition
par: Ilic, Filip, et autres
Publié: (2024)
par: Ilic, Filip, et autres
Publié: (2024)
When Invariant Representation Learning Meets Label Shift: Insufficiency and Theoretical Insights
par: Luo, You-Wei, et autres
Publié: (2024)
par: Luo, You-Wei, et autres
Publié: (2024)
LLVD: LSTM-based Explicit Motion Modeling in Latent Space for Blind Video Denoising
par: Rashid, Loay, et autres
Publié: (2025)
par: Rashid, Loay, et autres
Publié: (2025)
AsCAN: Asymmetric Convolution-Attention Networks for Efficient Recognition and Generation
par: Kag, Anil, et autres
Publié: (2024)
par: Kag, Anil, et autres
Publié: (2024)
COD: Learning Conditional Invariant Representation for Domain Adaptation Regression
par: Yang, Hao-Ran, et autres
Publié: (2024)
par: Yang, Hao-Ran, et autres
Publié: (2024)
A General Framework for Inference-time Scaling and Steering of Diffusion Models
par: Singhal, Raghav, et autres
Publié: (2025)
par: Singhal, Raghav, et autres
Publié: (2025)
Pre-trained Visual Dynamics Representations for Efficient Policy Learning
par: Luo, Hao, et autres
Publié: (2024)
par: Luo, Hao, et autres
Publié: (2024)
Riemannian Motion Generation: A Unified Framework for Human Motion Representation and Generation via Riemannian Flow Matching
par: Miao, Fangran, et autres
Publié: (2026)
par: Miao, Fangran, et autres
Publié: (2026)
Documents similaires
-
Seeking the Unfamiliar but Memorable: Conceptual Creativity as Meta-Learning
par: Ren, Mengye
Publié: (2026) -
Memory Storyboard: Leveraging Temporal Segmentation for Streaming Self-Supervised Learning from Egocentric Videos
par: Yang, Yanlai, et autres
Publié: (2025) -
PooDLe: Pooled and dense self-supervised learning from naturalistic videos
par: Wang, Alex N., et autres
Publié: (2024) -
Integrating Present and Past in Unsupervised Continual Learning
par: Zhang, Yipeng, et autres
Publié: (2024) -
LifelongMemory: Leveraging LLMs for Answering Queries in Long-form Egocentric Videos
par: Wang, Ying, et autres
Publié: (2023)