Beyond the Individual: Introducing Group Intention Forecasting with SHOT Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Ruixu, Wang, Yuran, Hu, Xinyi, Mai, Chaoyu, Liu, Wenxuan, Xu, Danni, Zhong, Xian, Wang, Zheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SPAN: Continuous Modeling of Suspicion Progression for Temporal Intention Localization
par: Hu, Xinyi, et autres
Publié: (2025)
par: Hu, Xinyi, et autres
Publié: (2025)
Anomize: Better Open Vocabulary Video Anomaly Detection
par: Li, Fei, et autres
Publié: (2025)
par: Li, Fei, et autres
Publié: (2025)
Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions
par: Wang, Wenxuan, et autres
Publié: (2024)
par: Wang, Wenxuan, et autres
Publié: (2024)
Beyond Single Models: Mitigating Multimodal Hallucinations via Adaptive Token Ensemble Decoding
par: Li, Jinlin, et autres
Publié: (2025)
par: Li, Jinlin, et autres
Publié: (2025)
Uncertainty-Aware Token Importance Estimation in Spiking Transformers
par: Liu, Wenxuan, et autres
Publié: (2026)
par: Liu, Wenxuan, et autres
Publié: (2026)
Beyond the Horizon: Decoupling Multi-View UAV Action Recognition via Partial Order Transfer
par: Liu, Wenxuan, et autres
Publié: (2025)
par: Liu, Wenxuan, et autres
Publié: (2025)
Vision Transformer based Random Walk for Group Re-Identification
par: Zhang, Guoqing, et autres
Publié: (2024)
par: Zhang, Guoqing, et autres
Publié: (2024)
RobuSTereo: Robust Zero-Shot Stereo Matching under Adverse Weather
par: Wang, Yuran, et autres
Publié: (2025)
par: Wang, Yuran, et autres
Publié: (2025)
Towards Dense and Accurate Radar Perception Via Efficient Cross-Modal Diffusion Model
par: Zhang, Ruibin, et autres
Publié: (2024)
par: Zhang, Ruibin, et autres
Publié: (2024)
SpikeDerain: Unveiling Clear Videos from Rainy Sequences Using Color Spike Streams
par: Liang, Hanwen, et autres
Publié: (2025)
par: Liang, Hanwen, et autres
Publié: (2025)
360VFI: A Dataset and Benchmark for Omnidirectional Video Frame Interpolation
par: Lu, Wenxuan, et autres
Publié: (2024)
par: Lu, Wenxuan, et autres
Publié: (2024)
Towards Low-latency Event-based Visual Recognition with Hybrid Step-wise Distillation Spiking Neural Networks
par: Zhong, Xian, et autres
Publié: (2024)
par: Zhong, Xian, et autres
Publié: (2024)
ASM-UNet: Adaptive Scan Mamba Integrating Group Commonalities and Individual Variations for Fine-Grained Segmentation
par: Wang, Bo, et autres
Publié: (2025)
par: Wang, Bo, et autres
Publié: (2025)
ONE-SHOT: Compositional Human-Environment Video Synthesis via Spatial-Decoupled Motion Injection and Hybrid Context Integration
par: Yang, Fengyuan, et autres
Publié: (2026)
par: Yang, Fengyuan, et autres
Publié: (2026)
Boosting Zero-shot Stereo Matching using Large-scale Mixed Images Sources in the Real World
par: Wang, Yuran, et autres
Publié: (2025)
par: Wang, Yuran, et autres
Publié: (2025)
HAD: Hierarchical Asymmetric Distillation to Bridge Spatio-Temporal Gaps in Event-Based Object Tracking
par: Deng, Yao, et autres
Publié: (2025)
par: Deng, Yao, et autres
Publié: (2025)
Brain-Inspired Multimodal Spiking Neural Network for Image-Text Retrieval
par: Zong, Xintao, et autres
Publié: (2026)
par: Zong, Xintao, et autres
Publié: (2026)
SOTA: Spike-Navigated Optimal TrAnsport Saliency Region Detection in Composite-bias Videos
par: Liu, Wenxuan, et autres
Publié: (2025)
par: Liu, Wenxuan, et autres
Publié: (2025)
Intention-Conditioned Long-Term Human Egocentric Action Forecasting
par: Mascaro, Esteve Valls, et autres
Publié: (2022)
par: Mascaro, Esteve Valls, et autres
Publié: (2022)
Unveiling Parts Beyond Objects:Towards Finer-Granularity Referring Expression Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
Devil is in Details: Locality-Aware 3D Abdominal CT Volume Generation for Self-Supervised Organ Segmentation
par: Wang, Yuran, et autres
Publié: (2024)
par: Wang, Yuran, et autres
Publié: (2024)
OccludeNet: A Causal Journey into Mixed-View Actor-Centric Video Action Recognition under Occlusions
par: Zhou, Guanyu, et autres
Publié: (2024)
par: Zhou, Guanyu, et autres
Publié: (2024)
IFNet: Deep Imaging and Focusing for Handheld SAR with Millimeter-wave Signals
par: Li, Yadong, et autres
Publié: (2024)
par: Li, Yadong, et autres
Publié: (2024)
Towards Comprehensive Multimodal Perception: Introducing the Touch-Language-Vision Dataset
par: Cheng, Ning, et autres
Publié: (2024)
par: Cheng, Ning, et autres
Publié: (2024)
Introducing SDICE: An Index for Assessing Diversity of Synthetic Medical Datasets
par: Alam, Mohammed Talha, et autres
Publié: (2024)
par: Alam, Mohammed Talha, et autres
Publié: (2024)
Introducing HOT3D: An Egocentric Dataset for 3D Hand and Object Tracking
par: Banerjee, Prithviraj, et autres
Publié: (2024)
par: Banerjee, Prithviraj, et autres
Publié: (2024)
Mono2Stereo: Monocular Knowledge Transfer for Enhanced Stereo Matching
par: Wang, Yuran, et autres
Publié: (2024)
par: Wang, Yuran, et autres
Publié: (2024)
Can Video Diffusion Model Reconstruct 4D Geometry?
par: Mai, Jinjie, et autres
Publié: (2025)
par: Mai, Jinjie, et autres
Publié: (2025)
Video-Zero: Self-Evolution Video Understanding
par: Zhang, Ruixu, et autres
Publié: (2026)
par: Zhang, Ruixu, et autres
Publié: (2026)
Beyond Dataset Distillation: Lossless Dataset Concentration via Diffusion-Assisted Distribution Alignment
par: Liu, Tongfei, et autres
Publié: (2026)
par: Liu, Tongfei, et autres
Publié: (2026)
SU-YOLO: Spiking Neural Network for Efficient Underwater Object Detection
par: Li, Chenyang, et autres
Publié: (2025)
par: Li, Chenyang, et autres
Publié: (2025)
Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction
par: Qi, Mengshi, et autres
Publié: (2024)
par: Qi, Mengshi, et autres
Publié: (2024)
DeMo: Decoupling Motion Forecasting into Directional Intentions and Dynamic States
par: Zhang, Bozhou, et autres
Publié: (2024)
par: Zhang, Bozhou, et autres
Publié: (2024)
Wildfire Smoke Detection System: Model Architecture, Training Mechanism, and Dataset
par: Wang, Chong, et autres
Publié: (2023)
par: Wang, Chong, et autres
Publié: (2023)
Expanding Zero-Shot Object Counting with Rich Prompts
par: Zhu, Huilin, et autres
Publié: (2025)
par: Zhu, Huilin, et autres
Publié: (2025)
Beyond Average: Individualized Visual Scanpath Prediction
par: Chen, Xianyu, et autres
Publié: (2024)
par: Chen, Xianyu, et autres
Publié: (2024)
Does Semantic Noise Initialization Transfer from Images to Videos? A Paired Diagnostic Study
par: Jing, Yixiao, et autres
Publié: (2026)
par: Jing, Yixiao, et autres
Publié: (2026)
Scone: Bridging Composition and Distinction in Subject-Driven Image Generation via Unified Understanding-Generation Modeling
par: Wang, Yuran, et autres
Publié: (2025)
par: Wang, Yuran, et autres
Publié: (2025)
Passive Non-Line-of-Sight Imaging with Light Transport Modulation
par: Zhang, Jiarui, et autres
Publié: (2023)
par: Zhang, Jiarui, et autres
Publié: (2023)
Hyperspectral Image Dataset for Individual Penguin Identification
par: Noboru, Youta, et autres
Publié: (2024)
par: Noboru, Youta, et autres
Publié: (2024)
Documents similaires
-
SPAN: Continuous Modeling of Suspicion Progression for Temporal Intention Localization
par: Hu, Xinyi, et autres
Publié: (2025) -
Anomize: Better Open Vocabulary Video Anomaly Detection
par: Li, Fei, et autres
Publié: (2025) -
Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions
par: Wang, Wenxuan, et autres
Publié: (2024) -
Beyond Single Models: Mitigating Multimodal Hallucinations via Adaptive Token Ensemble Decoding
par: Li, Jinlin, et autres
Publié: (2025) -
Uncertainty-Aware Token Importance Estimation in Spiking Transformers
par: Liu, Wenxuan, et autres
Publié: (2026)