MANTA: Diffusion Mamba for Efficient and Effective Stochastic Long-Term Dense Anticipation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zatsarynna, Olga, Bahrami, Emad, Farha, Yazan Abu, Francesca, Gianpiero, Gall, Juergen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gated Temporal Diffusion for Stochastic Long-Term Dense Anticipation
par: Zatsarynna, Olga, et autres
Publié: (2024)
par: Zatsarynna, Olga, et autres
Publié: (2024)
Looking into the Unknown: Exploring Action Discovery for Segmentation of Known and Unknown Actions
par: Spurio, Federico, et autres
Publié: (2025)
par: Spurio, Federico, et autres
Publié: (2025)
Towards Generalizing Temporal Action Segmentation to Unseen Views
par: Bahrami, Emad, et autres
Publié: (2025)
par: Bahrami, Emad, et autres
Publié: (2025)
MixANT: Observation-dependent Memory Propagation for Stochastic Dense Action Anticipation
par: Wasim, Syed Talal, et autres
Publié: (2025)
par: Wasim, Syed Talal, et autres
Publié: (2025)
Hierarchical Vector Quantization for Unsupervised Action Segmentation
par: Spurio, Federico, et autres
Publié: (2024)
par: Spurio, Federico, et autres
Publié: (2024)
STRIVE: Structured Spatiotemporal Exploration for Reinforcement Learning in Video Question Answering
par: Bahrami, Emad, et autres
Publié: (2026)
par: Bahrami, Emad, et autres
Publié: (2026)
Sequence-Adaptive Video Prediction in Continuous Streams using Diffusion Noise Optimization
par: Azar, Sina Mokhtarzadeh, et autres
Publié: (2025)
par: Azar, Sina Mokhtarzadeh, et autres
Publié: (2025)
Rethinking temporal self-similarity for repetitive action counting
par: Luo, Yanan, et autres
Publié: (2024)
par: Luo, Yanan, et autres
Publié: (2024)
SyncVP: Joint Diffusion for Synchronous Multi-Modal Video Prediction
par: Pallotta, Enrico, et autres
Publié: (2025)
par: Pallotta, Enrico, et autres
Publié: (2025)
Privacy-Preserving Semantic Segmentation from Ultra-Low-Resolution RGB Inputs
par: Huang, Xuying, et autres
Publié: (2025)
par: Huang, Xuying, et autres
Publié: (2025)
QueryMamba: A Mamba-Based Encoder-Decoder Architecture with a Statistical Verb-Noun Interaction Module for Video Action Forecasting @ Ego4D Long-Term Action Anticipation Challenge 2024
par: Zhong, Zeyun, et autres
Publié: (2024)
par: Zhong, Zeyun, et autres
Publié: (2024)
A Survey on Deep Learning Techniques for Action Anticipation
par: Zhong, Zeyun, et autres
Publié: (2023)
par: Zhong, Zeyun, et autres
Publié: (2023)
GroupMamba: Efficient Group-Based Visual State Space Model
par: Shaker, Abdelrahman, et autres
Publié: (2024)
par: Shaker, Abdelrahman, et autres
Publié: (2024)
StableMamba: Distillation-free Scaling of Large SSMs for Images and Videos
par: Suleman, Hamid, et autres
Publié: (2024)
par: Suleman, Hamid, et autres
Publié: (2024)
Video Panels for Long Video Understanding
par: Doorenbos, Lars, et autres
Publié: (2025)
par: Doorenbos, Lars, et autres
Publié: (2025)
FlowNar: Scalable Streaming Narration for Long-Form Videos
par: Zhong, Zeyun, et autres
Publié: (2026)
par: Zhong, Zeyun, et autres
Publié: (2026)
RiverMamba: A State Space Model for Global River Discharge and Flood Forecasting
par: Eddin, Mohamad Hakam Shams, et autres
Publié: (2025)
par: Eddin, Mohamad Hakam Shams, et autres
Publié: (2025)
FROST-STA: Frozen Dense Features for the Ego4D Short-Term Object Interaction Anticipation
par: Wang, Chaoyang, et autres
Publié: (2026)
par: Wang, Chaoyang, et autres
Publié: (2026)
Vision and Intention Boost Large Language Model in Long-Term Action Anticipation
par: Cao, Congqi, et autres
Publié: (2025)
par: Cao, Congqi, et autres
Publié: (2025)
LC-SLab -- An Object-based Deep Learning Framework for Large-scale Land Cover Classification from Satellite Imagery and Sparse In-situ Labels
par: Leonhardt, Johannes, et autres
Publié: (2025)
par: Leonhardt, Johannes, et autres
Publié: (2025)
Identifying Spatio-Temporal Drivers of Extreme Events
par: Eddin, Mohamad Hakam Shams, et autres
Publié: (2024)
par: Eddin, Mohamad Hakam Shams, et autres
Publié: (2024)
Self-Intersection-Aware 3D Human Motion Generation Using an Efficient Human Sphere Proxy
par: Herrmann, Pascal, et autres
Publié: (2026)
par: Herrmann, Pascal, et autres
Publié: (2026)
CamC2V: Context-aware Controllable Video Generation
par: Denninger, Luis, et autres
Publié: (2025)
par: Denninger, Luis, et autres
Publié: (2025)
Predict and Resist: Long-Term Accident Anticipation under Sensor Noise
par: Liu, Xingcheng, et autres
Publié: (2025)
par: Liu, Xingcheng, et autres
Publié: (2025)
Intention-Guided Cognitive Reasoning for Egocentric Long-Term Action Anticipation
par: Chu, Qiaohui, et autres
Publié: (2025)
par: Chu, Qiaohui, et autres
Publié: (2025)
Temporal Context Consistency Above All: Enhancing Long-Term Anticipation by Learning and Enforcing Temporal Constraints
par: Maté, Alberto, et autres
Publié: (2024)
par: Maté, Alberto, et autres
Publié: (2024)
Learning a Neural Association Network for Self-supervised Multi-Object Tracking
par: Li, Shuai, et autres
Publié: (2024)
par: Li, Shuai, et autres
Publié: (2024)
ADA-Track++: End-to-End Multi-Camera 3D Multi-Object Tracking with Alternating Detection and Association
par: Ding, Shuxiao, et autres
Publié: (2024)
par: Ding, Shuxiao, et autres
Publié: (2024)
Multimodal Large Models Are Effective Action Anticipators
par: Wang, Binglu, et autres
Publié: (2025)
par: Wang, Binglu, et autres
Publié: (2025)
Using Visual Anomaly Detection for Task Execution Monitoring
par: Thoduka, Santosh, et autres
Publié: (2021)
par: Thoduka, Santosh, et autres
Publié: (2021)
No Dense Tensors Needed: Fully Sparse Object Detection on Event-Camera Voxel Grids
par: Sadoun, Mohamad Yazan, et autres
Publié: (2026)
par: Sadoun, Mohamad Yazan, et autres
Publié: (2026)
MANTA: Physics-Informed Generalized Underwater Object Tracking
par: Srinath, Suhas, et autres
Publié: (2025)
par: Srinath, Suhas, et autres
Publié: (2025)
Skeleton Motion Words for Unsupervised Skeleton-Based Temporal Action Segmentation
par: Gökay, Uzay, et autres
Publié: (2025)
par: Gökay, Uzay, et autres
Publié: (2025)
Technical Report for Ego4D Long-Term Action Anticipation Challenge 2025
par: Chu, Qiaohui, et autres
Publié: (2025)
par: Chu, Qiaohui, et autres
Publié: (2025)
Motion Mamba: Efficient and Long Sequence Motion Generation
par: Zhang, Zeyu, et autres
Publié: (2024)
par: Zhang, Zeyu, et autres
Publié: (2024)
Integrating Affordances and Attention models for Short-Term Object Interaction Anticipation
par: Labadia, Lorenzo Mur, et autres
Publié: (2026)
par: Labadia, Lorenzo Mur, et autres
Publié: (2026)
MambaMIL+: Modeling Long-Term Contextual Patterns for Gigapixel Whole Slide Image
par: Zeng, Qian, et autres
Publié: (2025)
par: Zeng, Qian, et autres
Publié: (2025)
Anticipating Object State Changes in Long Procedural Videos
par: Manousaki, Victoria, et autres
Publié: (2024)
par: Manousaki, Victoria, et autres
Publié: (2024)
MV-Match: Multi-View Matching for Domain-Adaptive Identification of Plant Nutrient Deficiencies
par: Yi, Jinhui, et autres
Publié: (2024)
par: Yi, Jinhui, et autres
Publié: (2024)
AFF-ttention! Affordances and Attention models for Short-Term Object Interaction Anticipation
par: Mur-Labadia, Lorenzo, et autres
Publié: (2024)
par: Mur-Labadia, Lorenzo, et autres
Publié: (2024)
Documents similaires
-
Gated Temporal Diffusion for Stochastic Long-Term Dense Anticipation
par: Zatsarynna, Olga, et autres
Publié: (2024) -
Looking into the Unknown: Exploring Action Discovery for Segmentation of Known and Unknown Actions
par: Spurio, Federico, et autres
Publié: (2025) -
Towards Generalizing Temporal Action Segmentation to Unseen Views
par: Bahrami, Emad, et autres
Publié: (2025) -
MixANT: Observation-dependent Memory Propagation for Stochastic Dense Action Anticipation
par: Wasim, Syed Talal, et autres
Publié: (2025) -
Hierarchical Vector Quantization for Unsupervised Action Segmentation
par: Spurio, Federico, et autres
Publié: (2024)