ESP: Extro-Spective Prediction for Long-term Behavior Reasoning in Emergency Scenarios
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Dingrui, Lai, Zheyuan, Li, Yuda, Wu, Yi, Ma, Yuexin, Betz, Johannes, Yang, Ruigang, Li, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DualAD: Dual-Layer Planning for Reasoning in Autonomous Driving
par: Wang, Dingrui, et autres
Publié: (2024)
par: Wang, Dingrui, et autres
Publié: (2024)
SocialMirror: Reconstructing 3D Human Interaction Behaviors from Monocular Videos with Semantic and Geometric Guidance
par: Xia, Qi, et autres
Publié: (2026)
par: Xia, Qi, et autres
Publié: (2026)
DRIP: Discriminative Rotation-Invariant Pole Landmark Descriptor for 3D LiDAR Localization
par: Li, Dingrui, et autres
Publié: (2024)
par: Li, Dingrui, et autres
Publié: (2024)
EgoDyn-Bench: Evaluating Ego-Motion Understanding in Vision-Centric Foundation Models for Autonomous Driving
par: Schäfer, Finn Rasmus, et autres
Publié: (2026)
par: Schäfer, Finn Rasmus, et autres
Publié: (2026)
State-space Decomposition Model for Video Prediction Considering Long-term Motion Trend
par: Cui, Fei, et autres
Publié: (2024)
par: Cui, Fei, et autres
Publié: (2024)
Fusion of Short-term and Long-term Attention for Video Mirror Detection
par: Xu, Mingchen, et autres
Publié: (2024)
par: Xu, Mingchen, et autres
Publié: (2024)
One Model, Two Minds: Task-Conditioned Reasoning for Unified Image Quality and Aesthetic Assessment
par: Yin, Wen, et autres
Publié: (2026)
par: Yin, Wen, et autres
Publié: (2026)
NPC: Neural Predictive Control for Fuel-Efficient Autonomous Trucks
par: Ren, Jiaping, et autres
Publié: (2024)
par: Ren, Jiaping, et autres
Publié: (2024)
Long-term Traffic Simulation with Interleaved Autoregressive Motion and Scenario Generation
par: Yang, Xiuyu, et autres
Publié: (2025)
par: Yang, Xiuyu, et autres
Publié: (2025)
GaussianFusionOcc: A Seamless Sensor Fusion Approach for 3D Occupancy Prediction Using 3D Gaussians
par: Pavković, Tomislav, et autres
Publié: (2025)
par: Pavković, Tomislav, et autres
Publié: (2025)
Beyond Flat Unknown Labels in Open-World Object Detection
par: Zhang, Yuchen, et autres
Publié: (2025)
par: Zhang, Yuchen, et autres
Publié: (2025)
Beyond Known Objects: A Novel Framework for Open-Set Object Detection using Negative-Aware Norm
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
Coherent Online Road Topology Estimation and Reasoning with Standard-Definition Maps
par: Pham, Khanh Son, et autres
Publié: (2025)
par: Pham, Khanh Son, et autres
Publié: (2025)
Learned Ranking Function: From Short-term Behavior Predictions to Long-term User Satisfaction
par: Wu, Yi, et autres
Publié: (2024)
par: Wu, Yi, et autres
Publié: (2024)
From Shadows to Safety: Occlusion Tracking and Risk Mitigation for Urban Autonomous Driving
par: Moller, Korbinian, et autres
Publié: (2025)
par: Moller, Korbinian, et autres
Publié: (2025)
LongTail Driving Scenarios with Reasoning Traces: The KITScenes LongTail Dataset
par: Wagner, Royden, et autres
Publié: (2026)
par: Wagner, Royden, et autres
Publié: (2026)
OccMamba: Semantic Occupancy Prediction with State Space Models
par: Li, Heng, et autres
Publié: (2024)
par: Li, Heng, et autres
Publié: (2024)
OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries
par: Lu, Yuhang, et autres
Publié: (2023)
par: Lu, Yuhang, et autres
Publié: (2023)
Long-RVOS: A Comprehensive Benchmark for Long-term Referring Video Object Segmentation
par: Liang, Tianming, et autres
Publié: (2025)
par: Liang, Tianming, et autres
Publié: (2025)
Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?
par: Wang, Dingrui, et autres
Publié: (2025)
par: Wang, Dingrui, et autres
Publié: (2025)
GM-DF: Generalized Multi-Scenario Deepfake Detection
par: Lai, Yingxin, et autres
Publié: (2024)
par: Lai, Yingxin, et autres
Publié: (2024)
Can VLMs Unlock Semantic Anomaly Detection? A Framework for Structured Reasoning
par: Brusnicki, Roberto, et autres
Publié: (2025)
par: Brusnicki, Roberto, et autres
Publié: (2025)
IS-Fusion: Instance-Scene Collaborative Fusion for Multimodal 3D Object Detection
par: Yin, Junbo, et autres
Publié: (2024)
par: Yin, Junbo, et autres
Publié: (2024)
OccLE: Label-Efficient 3D Semantic Occupancy Prediction
par: Fang, Naiyu, et autres
Publié: (2025)
par: Fang, Naiyu, et autres
Publié: (2025)
SceneTracker: Long-term Scene Flow Estimation Network
par: Wang, Bo, et autres
Publié: (2024)
par: Wang, Bo, et autres
Publié: (2024)
SALI: Short-term Alignment and Long-term Interaction Network for Colonoscopy Video Polyp Segmentation
par: Hu, Qiang, et autres
Publié: (2024)
par: Hu, Qiang, et autres
Publié: (2024)
How Well Do Vision-Language Models Understand Sequential Driving Scenes? A Sensitivity Study
par: Brusnicki, Roberto, et autres
Publié: (2026)
par: Brusnicki, Roberto, et autres
Publié: (2026)
Towards Practical Human Motion Prediction with LiDAR Point Clouds
par: Han, Xiao, et autres
Publié: (2024)
par: Han, Xiao, et autres
Publié: (2024)
VideoZoomer: Reinforcement-Learned Temporal Focusing for Long Video Reasoning
par: Ding, Yang, et autres
Publié: (2025)
par: Ding, Yang, et autres
Publié: (2025)
EXPLORE-Bench: Egocentric Scene Prediction with Long-Horizon Reasoning
par: Yu, Chengjun, et autres
Publié: (2026)
par: Yu, Chengjun, et autres
Publié: (2026)
SWAG: Long-term Surgical Workflow Prediction with Generative-based Anticipation
par: Boels, Maxence, et autres
Publié: (2024)
par: Boels, Maxence, et autres
Publié: (2024)
STAGE: A Stream-Centric Generative World Model for Long-Horizon Driving-Scene Simulation
par: Wang, Jiamin, et autres
Publié: (2025)
par: Wang, Jiamin, et autres
Publié: (2025)
BehaviorVLM: Unified Finetuning-Free Behavioral Understanding with Vision-Language Reasoning
par: Ke, Jingyang, et autres
Publié: (2026)
par: Ke, Jingyang, et autres
Publié: (2026)
AffordGrasp: Cross-Modal Diffusion for Affordance-Aware Grasp Synthesis
par: Wu, Xiaofei, et autres
Publié: (2026)
par: Wu, Xiaofei, et autres
Publié: (2026)
VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability
par: Cohendet, Romain, et autres
Publié: (2018)
par: Cohendet, Romain, et autres
Publié: (2018)
ReasoningTrack: Chain-of-Thought Reasoning for Long-term Vision-Language Tracking
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios
par: Wang, Daming, et autres
Publié: (2025)
par: Wang, Daming, et autres
Publié: (2025)
FastGrasp: Efficient Grasp Synthesis with Diffusion
par: Wu, Xiaofei, et autres
Publié: (2024)
par: Wu, Xiaofei, et autres
Publié: (2024)
Efficient Backdoor Attacks for Deep Neural Networks in Real-world Scenarios
par: Li, Ziqiang, et autres
Publié: (2023)
par: Li, Ziqiang, et autres
Publié: (2023)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
par: Lai, Yuxiang, et autres
Publié: (2025)
par: Lai, Yuxiang, et autres
Publié: (2025)
Documents similaires
-
DualAD: Dual-Layer Planning for Reasoning in Autonomous Driving
par: Wang, Dingrui, et autres
Publié: (2024) -
SocialMirror: Reconstructing 3D Human Interaction Behaviors from Monocular Videos with Semantic and Geometric Guidance
par: Xia, Qi, et autres
Publié: (2026) -
DRIP: Discriminative Rotation-Invariant Pole Landmark Descriptor for 3D LiDAR Localization
par: Li, Dingrui, et autres
Publié: (2024) -
EgoDyn-Bench: Evaluating Ego-Motion Understanding in Vision-Centric Foundation Models for Autonomous Driving
par: Schäfer, Finn Rasmus, et autres
Publié: (2026) -
State-space Decomposition Model for Video Prediction Considering Long-term Motion Trend
par: Cui, Fei, et autres
Publié: (2024)