SPAN: Continuous Modeling of Suspicion Progression for Temporal Intention Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Xinyi, Wang, Yuran, Zhang, Ruixu, Li, Yue, Liu, Wenxuan, Wang, Zheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond the Individual: Introducing Group Intention Forecasting with SHOT Dataset
di: Zhang, Ruixu, et al.
Pubblicazione: (2025)
di: Zhang, Ruixu, et al.
Pubblicazione: (2025)
Anomize: Better Open Vocabulary Video Anomaly Detection
di: Li, Fei, et al.
Pubblicazione: (2025)
di: Li, Fei, et al.
Pubblicazione: (2025)
Towards Dense and Accurate Radar Perception Via Efficient Cross-Modal Diffusion Model
di: Zhang, Ruibin, et al.
Pubblicazione: (2024)
di: Zhang, Ruibin, et al.
Pubblicazione: (2024)
Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection
di: Wang, Yifan, et al.
Pubblicazione: (2025)
di: Wang, Yifan, et al.
Pubblicazione: (2025)
Uncertainty-Aware Token Importance Estimation in Spiking Transformers
di: Liu, Wenxuan, et al.
Pubblicazione: (2026)
di: Liu, Wenxuan, et al.
Pubblicazione: (2026)
Devil is in Details: Locality-Aware 3D Abdominal CT Volume Generation for Self-Supervised Organ Segmentation
di: Wang, Yuran, et al.
Pubblicazione: (2024)
di: Wang, Yuran, et al.
Pubblicazione: (2024)
Bidirectional Progressive Transformer for Interaction Intention Anticipation
di: Zhang, Zichen, et al.
Pubblicazione: (2024)
di: Zhang, Zichen, et al.
Pubblicazione: (2024)
Weakly-Supervised Temporal Action Localization by Progressive Complementary Learning
di: Du, Jia-Run, et al.
Pubblicazione: (2022)
di: Du, Jia-Run, et al.
Pubblicazione: (2022)
SPAN: Learning Similarity between Scene Graphs and Images with Transformers
di: Cong, Yuren, et al.
Pubblicazione: (2023)
di: Cong, Yuren, et al.
Pubblicazione: (2023)
IFNet: Deep Imaging and Focusing for Handheld SAR with Millimeter-wave Signals
di: Li, Yadong, et al.
Pubblicazione: (2024)
di: Li, Yadong, et al.
Pubblicazione: (2024)
IntentVCNet: Bridging Spatio-Temporal Gaps for Intention-Oriented Controllable Video Captioning
di: Qiu, Tianheng, et al.
Pubblicazione: (2025)
di: Qiu, Tianheng, et al.
Pubblicazione: (2025)
RobuSTereo: Robust Zero-Shot Stereo Matching under Adverse Weather
di: Wang, Yuran, et al.
Pubblicazione: (2025)
di: Wang, Yuran, et al.
Pubblicazione: (2025)
Masked Diffusion Vision-Language Models for Temporal Action Localization
di: Wang, Fengshun, et al.
Pubblicazione: (2026)
di: Wang, Fengshun, et al.
Pubblicazione: (2026)
Towards Mitigating Modality Bias in Vision-Language Models for Temporal Action Localization
di: Li, Jiaqi, et al.
Pubblicazione: (2026)
di: Li, Jiaqi, et al.
Pubblicazione: (2026)
Localize, Understand, Collaborate: Semantic-Aware Dragging via Intention Reasoner
di: Cui, Xing, et al.
Pubblicazione: (2024)
di: Cui, Xing, et al.
Pubblicazione: (2024)
Temporal Action Detection Model Compression by Progressive Block Drop
di: Chen, Xiaoyong, et al.
Pubblicazione: (2025)
di: Chen, Xiaoyong, et al.
Pubblicazione: (2025)
Spatio-Temporal Progressive Attention Model for EEG Classification in Rapid Serial Visual Presentation Task
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
Scone: Bridging Composition and Distinction in Subject-Driven Image Generation via Unified Understanding-Generation Modeling
di: Wang, Yuran, et al.
Pubblicazione: (2025)
di: Wang, Yuran, et al.
Pubblicazione: (2025)
Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic Prompts
di: Cheng, Xinhua, et al.
Pubblicazione: (2023)
di: Cheng, Xinhua, et al.
Pubblicazione: (2023)
Boosting Zero-shot Stereo Matching using Large-scale Mixed Images Sources in the Real World
di: Wang, Yuran, et al.
Pubblicazione: (2025)
di: Wang, Yuran, et al.
Pubblicazione: (2025)
Beyond Single Models: Mitigating Multimodal Hallucinations via Adaptive Token Ensemble Decoding
di: Li, Jinlin, et al.
Pubblicazione: (2025)
di: Li, Jinlin, et al.
Pubblicazione: (2025)
DA-HFNet: Progressive Fine-Grained Forgery Image Detection and Localization Based on Dual Attention
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
TC-Light: Temporally Coherent Generative Rendering for Realistic World Transfer
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
UHD-GPGNet: UHD Video Denoising via Gaussian-Process-Guided Local Spatio-Temporal Modeling
di: He, Weiyuan, et al.
Pubblicazione: (2026)
di: He, Weiyuan, et al.
Pubblicazione: (2026)
Mono2Stereo: Monocular Knowledge Transfer for Enhanced Stereo Matching
di: Wang, Yuran, et al.
Pubblicazione: (2024)
di: Wang, Yuran, et al.
Pubblicazione: (2024)
Progressive Cross-Stream Cooperation in Spatial and Temporal Domain for Action Localization
di: Su, Rui, et al.
Pubblicazione: (2019)
di: Su, Rui, et al.
Pubblicazione: (2019)
PMT: Progressive Mean Teacher via Exploring Temporal Consistency for Semi-Supervised Medical Image Segmentation
di: Gao, Ning, et al.
Pubblicazione: (2024)
di: Gao, Ning, et al.
Pubblicazione: (2024)
Temporal Action Localization with Cross Layer Task Decoupling and Refinement
di: Li, Qiang, et al.
Pubblicazione: (2024)
di: Li, Qiang, et al.
Pubblicazione: (2024)
Video-Zero: Self-Evolution Video Understanding
di: Zhang, Ruixu, et al.
Pubblicazione: (2026)
di: Zhang, Ruixu, et al.
Pubblicazione: (2026)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
di: Wang, Liuyi, et al.
Pubblicazione: (2023)
di: Wang, Liuyi, et al.
Pubblicazione: (2023)
Word-Anchored Temporal Forgery Localization
di: Wang, Tianyi, et al.
Pubblicazione: (2026)
di: Wang, Tianyi, et al.
Pubblicazione: (2026)
Passive Non-Line-of-Sight Imaging with Light Transport Modulation
di: Zhang, Jiarui, et al.
Pubblicazione: (2023)
di: Zhang, Jiarui, et al.
Pubblicazione: (2023)
Probing Deep into Temporal Profile Makes the Infrared Small Target Detector Much Better
di: Li, Ruojing, et al.
Pubblicazione: (2025)
di: Li, Ruojing, et al.
Pubblicazione: (2025)
EgoLoc: A Generalizable Solution for Temporal Interaction Localization in Egocentric Videos
di: Ma, Junyi, et al.
Pubblicazione: (2025)
di: Ma, Junyi, et al.
Pubblicazione: (2025)
Interactive Multimodal Fusion with Temporal Modeling
di: Yu, Jun, et al.
Pubblicazione: (2025)
di: Yu, Jun, et al.
Pubblicazione: (2025)
Continuous Perception Matters: Diagnosing Temporal Integration Failures in Multimodal Models
di: Wang, Zeyu, et al.
Pubblicazione: (2024)
di: Wang, Zeyu, et al.
Pubblicazione: (2024)
Vision and Intention Boost Large Language Model in Long-Term Action Anticipation
di: Cao, Congqi, et al.
Pubblicazione: (2025)
di: Cao, Congqi, et al.
Pubblicazione: (2025)
MaIR: A Locality- and Continuity-Preserving Mamba for Image Restoration
di: Li, Boyun, et al.
Pubblicazione: (2024)
di: Li, Boyun, et al.
Pubblicazione: (2024)
EventMamba: Enhancing Spatio-Temporal Locality with State Space Models for Event-Based Video Reconstruction
di: Ge, Chengjie, et al.
Pubblicazione: (2025)
di: Ge, Chengjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond the Individual: Introducing Group Intention Forecasting with SHOT Dataset
di: Zhang, Ruixu, et al.
Pubblicazione: (2025) -
Anomize: Better Open Vocabulary Video Anomaly Detection
di: Li, Fei, et al.
Pubblicazione: (2025) -
Towards Dense and Accurate Radar Perception Via Efficient Cross-Modal Diffusion Model
di: Zhang, Ruibin, et al.
Pubblicazione: (2024) -
Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions
di: Wang, Wenxuan, et al.
Pubblicazione: (2024) -
SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection
di: Wang, Yifan, et al.
Pubblicazione: (2025)