Frozen LLMs as Map-Aware Spatio-Temporal Reasoners for Vehicle Trajectory Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yanjiao, Liu, Jiawei, Gong, Xun, Nie, Zifei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
V-STaR: Benchmarking Video-LLMs on Video Spatio-Temporal Reasoning
par: Cheng, Zixu, et autres
Publié: (2025)
par: Cheng, Zixu, et autres
Publié: (2025)
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
par: Zhou, Zewei, et autres
Publié: (2024)
par: Zhou, Zewei, et autres
Publié: (2024)
MapsTP: HD Map Images Based Multimodal Trajectory Prediction for Automated Vehicles
par: Sharma, Sushil, et autres
Publié: (2024)
par: Sharma, Sushil, et autres
Publié: (2024)
Multi-scale Temporal Fusion Transformer for Incomplete Vehicle Trajectory Prediction
par: Liu, Zhanwen, et autres
Publié: (2024)
par: Liu, Zhanwen, et autres
Publié: (2024)
LASAR: Towards Spatio-temporal Reasoning with Latent Cognitive Map
par: Tang, Jinzhou, et autres
Publié: (2026)
par: Tang, Jinzhou, et autres
Publié: (2026)
Map-Free Trajectory Prediction with Map Distillation and Hierarchical Encoding
par: Liu, Xiaodong, et autres
Publié: (2024)
par: Liu, Xiaodong, et autres
Publié: (2024)
STF: Spatial Temporal Fusion for Trajectory Prediction
par: Han, Pengqian, et autres
Publié: (2023)
par: Han, Pengqian, et autres
Publié: (2023)
Segmentation as A Plug-and-Play Capability for Frozen Multimodal LLMs
par: Liu, Jiazhen, et autres
Publié: (2025)
par: Liu, Jiazhen, et autres
Publié: (2025)
Unleashing the Potential of Multimodal LLMs for Zero-Shot Spatio-Temporal Video Grounding
par: Yang, Zaiquan, et autres
Publié: (2025)
par: Yang, Zaiquan, et autres
Publié: (2025)
Temporal Sampling Frequency Matters: A Capacity-Aware Study of End-to-End Driving Trajectory Prediction
par: Liu, Yumao, et autres
Publié: (2026)
par: Liu, Yumao, et autres
Publié: (2026)
Length Matters: Length-Aware Transformer for Temporal Sentence Grounding
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2023)
par: Wang, Liuyi, et autres
Publié: (2023)
Temporal Flow Matching for Learning Spatio-Temporal Trajectories in 4D Longitudinal Medical Imaging
par: Disch, Nico Albert, et autres
Publié: (2025)
par: Disch, Nico Albert, et autres
Publié: (2025)
PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning
par: Li, Guandong, et autres
Publié: (2026)
par: Li, Guandong, et autres
Publié: (2026)
PrevPredMap: Exploring Temporal Modeling with Previous Predictions for Online Vectorized HD Map Construction
par: Peng, Nan, et autres
Publié: (2024)
par: Peng, Nan, et autres
Publié: (2024)
Beyond Shortcuts: Mitigating Visual Illusions in Frozen VLMs via Qualitative Reasoning
par: Guo, Hao, et autres
Publié: (2026)
par: Guo, Hao, et autres
Publié: (2026)
R-AVST: Empowering Video-LLMs with Fine-Grained Spatio-Temporal Reasoning in Complex Audio-Visual Scenarios
par: Zhu, Lu, et autres
Publié: (2025)
par: Zhu, Lu, et autres
Publié: (2025)
Nonlinear Motion-Guided and Spatio-Temporal Aware Network for Unsupervised Event-Based Optical Flow
par: Liu, Zuntao, et autres
Publié: (2025)
par: Liu, Zuntao, et autres
Publié: (2025)
DVFace: Spatio-Temporal Dual-Prior Diffusion for Video Face Restoration
par: Chen, Zheng, et autres
Publié: (2026)
par: Chen, Zheng, et autres
Publié: (2026)
Delving into Mapping Uncertainty for Mapless Trajectory Prediction
par: Zhang, Zongzheng, et autres
Publié: (2025)
par: Zhang, Zongzheng, et autres
Publié: (2025)
VIRST: Video-Instructed Reasoning Assistant for SpatioTemporal Segmentation
par: Hong, Jihwan, et autres
Publié: (2026)
par: Hong, Jihwan, et autres
Publié: (2026)
EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT
par: Pei, Baoqi, et autres
Publié: (2025)
par: Pei, Baoqi, et autres
Publié: (2025)
Spatial-Temporal Conditional Random Field for Human Trajectory Prediction
par: Han, Pengqian, et autres
Publié: (2023)
par: Han, Pengqian, et autres
Publié: (2023)
Spatio-Temporal Distortion Aware Omnidirectional Video Super-Resolution
par: An, Hongyu, et autres
Publié: (2024)
par: An, Hongyu, et autres
Publié: (2024)
Bridging the Sampling Distribution Shift in Radio Map Estimation: A Trajectory-Aware Paradigm
par: Qiu, Feng, et autres
Publié: (2026)
par: Qiu, Feng, et autres
Publié: (2026)
V-CAST: Video Curvature-Aware Spatio-Temporal Pruning for Efficient Video Large Language Models
par: Lin, Xinying, et autres
Publié: (2026)
par: Lin, Xinying, et autres
Publié: (2026)
4D-VGGT: A General Foundation Model with SpatioTemporal Awareness for Dynamic Scene Geometry Estimation
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
Learning Normals of Noisy Points by Local Gradient-Aware Surface Filtering
par: Li, Qing, et autres
Publié: (2025)
par: Li, Qing, et autres
Publié: (2025)
Vulnerability-Aware Spatio-Temporal Learning for Generalizable Deepfake Video Detection
par: Nguyen, Dat, et autres
Publié: (2025)
par: Nguyen, Dat, et autres
Publié: (2025)
Spatio-Temporal Garment Reconstruction Using Diffusion Mapping via Pattern Coordinates
par: You, Yingxuan, et autres
Publié: (2026)
par: You, Yingxuan, et autres
Publié: (2026)
Patch Spatio-Temporal Relation Prediction for Video Anomaly Detection
par: Shen, Hao, et autres
Publié: (2024)
par: Shen, Hao, et autres
Publié: (2024)
STEP: Enhancing Video-LLMs' Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
par: Qiu, Haiyi, et autres
Publié: (2024)
par: Qiu, Haiyi, et autres
Publié: (2024)
Open-Ended Instruction Realization with LLM-Enabled Multi-Planner Scheduling in Autonomous Vehicles
par: Liu, Jiawei, et autres
Publié: (2026)
par: Liu, Jiawei, et autres
Publié: (2026)
Uncertainty-Aware Pedestrian Trajectory Prediction via Distributional Diffusion
par: Liu, Yao, et autres
Publié: (2023)
par: Liu, Yao, et autres
Publié: (2023)
Learning Trajectory-Aware Multimodal Large Language Models for Video Reasoning Segmentation
par: Luo, Jingnan, et autres
Publié: (2026)
par: Luo, Jingnan, et autres
Publié: (2026)
Reliability-Aware Weighted Multi-Scale Spatio-Temporal Maps for Heart Rate Monitoring
par: Bairagi, Arpan, et autres
Publié: (2026)
par: Bairagi, Arpan, et autres
Publié: (2026)
ST-GRIT: Spatio-Temporal Graph Transformer For Internal Ice Layer Thickness Prediction
par: Liu, Zesheng, et autres
Publié: (2025)
par: Liu, Zesheng, et autres
Publié: (2025)
Intention-Aware Diffusion Model for Pedestrian Trajectory Prediction
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
JSTR: Joint Spatio-Temporal Reasoning for Event-based Moving Object Detection
par: Zhou, Hanyu, et autres
Publié: (2024)
par: Zhou, Hanyu, et autres
Publié: (2024)
Know-Show: Benchmarking Video-Language Models on Spatio-Temporal Grounded Reasoning
par: Sugandhika, Chinthani, et autres
Publié: (2025)
par: Sugandhika, Chinthani, et autres
Publié: (2025)
Documents similaires
-
V-STaR: Benchmarking Video-LLMs on Video Spatio-Temporal Reasoning
par: Cheng, Zixu, et autres
Publié: (2025) -
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
par: Zhou, Zewei, et autres
Publié: (2024) -
MapsTP: HD Map Images Based Multimodal Trajectory Prediction for Automated Vehicles
par: Sharma, Sushil, et autres
Publié: (2024) -
Multi-scale Temporal Fusion Transformer for Incomplete Vehicle Trajectory Prediction
par: Liu, Zhanwen, et autres
Publié: (2024) -
LASAR: Towards Spatio-temporal Reasoning with Latent Cognitive Map
par: Tang, Jinzhou, et autres
Publié: (2026)