It's a Matter of Time: Three Lessons on Long-Term Motion for Perception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Davison, Willem, Hao, Xinyue, Sevilla-Lara, Laura |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Telling Stories for Common Sense Zero-Shot Action Recognition
par: Gowda, Shreyank N, et autres
Publié: (2023)
par: Gowda, Shreyank N, et autres
Publié: (2023)
Principles of Visual Tokens for Efficient Video Understanding
par: Hao, Xinyue, et autres
Publié: (2024)
par: Hao, Xinyue, et autres
Publié: (2024)
Watt For What: Rethinking Deep Learning's Energy-Performance Relationship
par: Gowda, Shreyank N, et autres
Publié: (2023)
par: Gowda, Shreyank N, et autres
Publié: (2023)
Continual Learning Improves Zero-Shot Action Recognition
par: Gowda, Shreyank N, et autres
Publié: (2024)
par: Gowda, Shreyank N, et autres
Publié: (2024)
Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency
par: Jiang, Jianwen, et autres
Publié: (2024)
par: Jiang, Jianwen, et autres
Publié: (2024)
Motion Mamba: Efficient and Long Sequence Motion Generation
par: Zhang, Zeyu, et autres
Publié: (2024)
par: Zhang, Zeyu, et autres
Publié: (2024)
Coarse or Fine? Recognising Action End States without Labels
par: Moltisanti, Davide, et autres
Publié: (2024)
par: Moltisanti, Davide, et autres
Publié: (2024)
Progressive Data Dropout: An Embarrassingly Simple Approach to Faster Training
par: Sathiyanarayanan, Shriram M, et autres
Publié: (2025)
par: Sathiyanarayanan, Shriram M, et autres
Publié: (2025)
Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model
par: Shen, Fei, et autres
Publié: (2025)
par: Shen, Fei, et autres
Publié: (2025)
When and Where to Reset Matters for Long-Term Test-Time Adaptation
par: Lim, Taejun, et autres
Publié: (2026)
par: Lim, Taejun, et autres
Publié: (2026)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
par: Agarwal, Madhav, et autres
Publié: (2025)
par: Agarwal, Madhav, et autres
Publié: (2025)
T2LM: Long-Term 3D Human Motion Generation from Multiple Sentences
par: Lee, Taeryung, et autres
Publié: (2024)
par: Lee, Taeryung, et autres
Publié: (2024)
MotionPCM: Real-Time Motion Synthesis with Phased Consistency Model
par: Jiang, Lei, et autres
Publié: (2025)
par: Jiang, Lei, et autres
Publié: (2025)
Predicting Implicit Arguments in Procedural Video Instructions
par: Batra, Anil, et autres
Publié: (2025)
par: Batra, Anil, et autres
Publié: (2025)
Mask2IV: Interaction-Centric Video Generation via Mask Trajectories
par: Li, Gen, et autres
Publié: (2025)
par: Li, Gen, et autres
Publié: (2025)
InfiniMotion: Mamba Boosts Memory in Transformer for Arbitrary Long Motion Generation
par: Zhang, Zeyu, et autres
Publié: (2024)
par: Zhang, Zeyu, et autres
Publié: (2024)
VMBench: A Benchmark for Perception-Aligned Video Motion Generation
par: Ling, Xinran, et autres
Publié: (2025)
par: Ling, Xinran, et autres
Publié: (2025)
Memorize-and-Generate: Towards Long-Term Consistency in Real-Time Video Generation
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
L-LBVC: Long-Term Motion Estimation and Prediction for Learned Bi-Directional Video Compression
par: Zhai, Yongqi, et autres
Publié: (2025)
par: Zhai, Yongqi, et autres
Publié: (2025)
Lagrangian Motion Fields for Long-term Motion Generation
par: Yang, Yifei, et autres
Publié: (2024)
par: Yang, Yifei, et autres
Publié: (2024)
What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?
par: Xu, Guangkai, et autres
Publié: (2024)
par: Xu, Guangkai, et autres
Publié: (2024)
MASt3R-SLAM: Real-Time Dense SLAM with 3D Reconstruction Priors
par: Murai, Riku, et autres
Publié: (2024)
par: Murai, Riku, et autres
Publié: (2024)
KV-Tracker: Real-Time Pose Tracking with Transformers
par: Taher, Marwan, et autres
Publié: (2025)
par: Taher, Marwan, et autres
Publié: (2025)
Motion Matters: Motion-guided Modulation Network for Skeleton-based Micro-Action Recognition
par: Gu, Jihao, et autres
Publié: (2025)
par: Gu, Jihao, et autres
Publié: (2025)
Rethinking Inductive Biases for Surface Normal Estimation
par: Bae, Gwangbin, et autres
Publié: (2024)
par: Bae, Gwangbin, et autres
Publié: (2024)
COMO: Compact Mapping and Odometry
par: Dexheimer, Eric, et autres
Publié: (2024)
par: Dexheimer, Eric, et autres
Publié: (2024)
Generative Perception of Shape and Material from Differential Motion
par: Han, Xinran Nicole, et autres
Publié: (2025)
par: Han, Xinran Nicole, et autres
Publié: (2025)
Eye Motion Matters for 3D Face Reconstruction
par: Wang, Xuan, et autres
Publié: (2024)
par: Wang, Xuan, et autres
Publié: (2024)
Context Matters: Query-aware Dynamic Long Sequence Modeling of Gigapixel Images
par: Guo, Zhengrui, et autres
Publié: (2025)
par: Guo, Zhengrui, et autres
Publié: (2025)
LongVideo-R1: Smart Navigation for Low-cost Long Video Understanding
par: Qiu, Jihao, et autres
Publié: (2026)
par: Qiu, Jihao, et autres
Publié: (2026)
Infinite Motion: Extended Motion Generation via Long Text Instructions
par: Li, Mengtian, et autres
Publié: (2024)
par: Li, Mengtian, et autres
Publié: (2024)
Unforgettable Lessons from Forgettable Images: Intra-Class Memorability Matters in Computer Vision
par: Jing, Jie, et autres
Publié: (2024)
par: Jing, Jie, et autres
Publié: (2024)
Floorplan-SLAM: A Real-Time, High-Accuracy, and Long-Term Multi-Session Point-Plane SLAM for Efficient Floorplan Reconstruction
par: Wang, Haolin, et autres
Publié: (2025)
par: Wang, Haolin, et autres
Publié: (2025)
SuperPrimitive: Scene Reconstruction at a Primitive Level
par: Mazur, Kirill, et autres
Publié: (2023)
par: Mazur, Kirill, et autres
Publié: (2023)
Towards Consistent Long-Term Pose Generation
par: Li, Yayuan, et autres
Publié: (2025)
par: Li, Yayuan, et autres
Publié: (2025)
OWL: A Novel Approach to Machine Perception During Motion
par: Raviv, Daniel, et autres
Publié: (2026)
par: Raviv, Daniel, et autres
Publié: (2026)
Superman: Unifying Skeleton and Vision for Human Motion Perception and Generation
par: Wang, Xinshun, et autres
Publié: (2026)
par: Wang, Xinshun, et autres
Publié: (2026)
Decoupling Static and Hierarchical Motion Perception for Referring Video Segmentation
par: He, Shuting, et autres
Publié: (2024)
par: He, Shuting, et autres
Publié: (2024)
AdvMT: Adversarial Motion Transformer for Long-term Human Motion Prediction
par: Idrees, Sarmad, et autres
Publié: (2024)
par: Idrees, Sarmad, et autres
Publié: (2024)
LongDWM: Cross-Granularity Distillation for Building a Long-Term Driving World Model
par: Wang, Xiaodong, et autres
Publié: (2025)
par: Wang, Xiaodong, et autres
Publié: (2025)
Documents similaires
-
Telling Stories for Common Sense Zero-Shot Action Recognition
par: Gowda, Shreyank N, et autres
Publié: (2023) -
Principles of Visual Tokens for Efficient Video Understanding
par: Hao, Xinyue, et autres
Publié: (2024) -
Watt For What: Rethinking Deep Learning's Energy-Performance Relationship
par: Gowda, Shreyank N, et autres
Publié: (2023) -
Continual Learning Improves Zero-Shot Action Recognition
par: Gowda, Shreyank N, et autres
Publié: (2024) -
Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency
par: Jiang, Jianwen, et autres
Publié: (2024)