A Vision-and-Knowledge Enhanced Large Language Model for Generalizable Pedestrian Crossing Behavior Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Pu, Qingwen, Xie, Kun, Yang, Hong, Zhai, Guocong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Generating Realistic Safety-Critical Scenarios for Vehicle-Pedestrian Interactions
por: Pu, Qingwen, et al.
Publicado: (2026)
por: Pu, Qingwen, et al.
Publicado: (2026)
Modeling Vehicle-Type-Specific Pedestrian Crash Avoidance Behavior in Safety-Critical Interactions Using Smooth-Mamba Deep Reinforcement Learning
por: Pu, Qingwen, et al.
Publicado: (2026)
por: Pu, Qingwen, et al.
Publicado: (2026)
VLM-VPI: A Vision-Language Reasoning Framework for Improving Automated Vehicle-Pedestrian Interactions
por: Pu, Qingwen, et al.
Publicado: (2026)
por: Pu, Qingwen, et al.
Publicado: (2026)
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
por: Zhang, Minxing, et al.
Publicado: (2025)
por: Zhang, Minxing, et al.
Publicado: (2025)
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
por: Gao, Haoxiang, et al.
Publicado: (2025)
por: Gao, Haoxiang, et al.
Publicado: (2025)
Using Large Language Models to Assess Teachers' Pedagogical Content Knowledge
por: Yang, Yaxuan, et al.
Publicado: (2025)
por: Yang, Yaxuan, et al.
Publicado: (2025)
Enhancing the Capabilities of Large Language Models for API calls through Knowledge Graphs
por: Yang, Ye, et al.
Publicado: (2025)
por: Yang, Ye, et al.
Publicado: (2025)
Large Language Models for Pedestrian Safety: An Application to Predicting Driver Yielding Behavior at Unsignalized Intersections
por: Yang, Yicheng, et al.
Publicado: (2025)
por: Yang, Yicheng, et al.
Publicado: (2025)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
por: Wu, Yanru, et al.
Publicado: (2026)
por: Wu, Yanru, et al.
Publicado: (2026)
OmniPT: Unleashing the Potential of Large Vision Language Models for Pedestrian Tracking and Understanding
por: Fu, Teng, et al.
Publicado: (2025)
por: Fu, Teng, et al.
Publicado: (2025)
Video-to-Text Pedestrian Monitoring (VTPM): Leveraging Computer Vision and Large Language Models for Privacy-Preserve Pedestrian Activity Monitoring at Intersections
por: Abdelrahman, Ahmed S., et al.
Publicado: (2024)
por: Abdelrahman, Ahmed S., et al.
Publicado: (2024)
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
por: Zhang, Chengsheng, et al.
Publicado: (2026)
por: Zhang, Chengsheng, et al.
Publicado: (2026)
Vision Inference Former: Sustaining Visual Consistency in Multimodal Large Language Models
por: Dong, Xinpeng, et al.
Publicado: (2026)
por: Dong, Xinpeng, et al.
Publicado: (2026)
SlimGPT: Layer-wise Structured Pruning for Large Language Models
por: Ling, Gui, et al.
Publicado: (2024)
por: Ling, Gui, et al.
Publicado: (2024)
VLM-PAR: A Vision Language Model for Pedestrian Attribute Recognition
por: Sellam, Abdellah Zakaria, et al.
Publicado: (2025)
por: Sellam, Abdellah Zakaria, et al.
Publicado: (2025)
Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts
por: Xie, Jian, et al.
Publicado: (2023)
por: Xie, Jian, et al.
Publicado: (2023)
Enhancing Travel Choice Modeling with Large Language Models: A Prompt-Learning Approach
por: Zhai, Xuehao, et al.
Publicado: (2024)
por: Zhai, Xuehao, et al.
Publicado: (2024)
A Hierarchical Pedestrian Behavior Model to Generate Realistic Human Behavior in Traffic Simulation
por: Larter, Scott, et al.
Publicado: (2022)
por: Larter, Scott, et al.
Publicado: (2022)
Predicting and Analyzing Pedestrian Crossing Behavior at Unsignalized Crossings
por: Zhang, Chi, et al.
Publicado: (2024)
por: Zhang, Chi, et al.
Publicado: (2024)
Multi-view Phase-aware Pedestrian-Vehicle Incident Reasoning Framework with Vision-Language Models
por: Zhen, Hao, et al.
Publicado: (2025)
por: Zhen, Hao, et al.
Publicado: (2025)
PEDESTRIANQA: A Benchmark for Vision-Language Models on Pedestrian Intention and Trajectory Prediction
por: Mishra, Naman, et al.
Publicado: (2026)
por: Mishra, Naman, et al.
Publicado: (2026)
Cross-Lingual Knowledge Editing in Large Language Models
por: Wang, Jiaan, et al.
Publicado: (2023)
por: Wang, Jiaan, et al.
Publicado: (2023)
A Comprehensive Survey and Guide to Multimodal Large Language Models in Vision-Language Tasks
por: Liang, Chia Xin, et al.
Publicado: (2024)
por: Liang, Chia Xin, et al.
Publicado: (2024)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
por: Lei, Yuxuan, et al.
Publicado: (2024)
por: Lei, Yuxuan, et al.
Publicado: (2024)
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
por: Kim, Minsung, et al.
Publicado: (2025)
por: Kim, Minsung, et al.
Publicado: (2025)
Predicting Pedestrian Crossing Behavior in Germany and Japan: Insights into Model Transferability
por: Zhang, Chi, et al.
Publicado: (2024)
por: Zhang, Chi, et al.
Publicado: (2024)
LinguaSim: Interactive Multi-Vehicle Testing Scenario Generation via Natural Language Instruction Based on Large Language Models
por: Shi, Qingyuan, et al.
Publicado: (2025)
por: Shi, Qingyuan, et al.
Publicado: (2025)
Inference Performance Optimization for Large Language Models on CPUs
por: He, Pujiang, et al.
Publicado: (2024)
por: He, Pujiang, et al.
Publicado: (2024)
ENTRA: Entropy-Based Redundancy Avoidance in Large Language Model Reasoning
por: Cai, Ruichu, et al.
Publicado: (2026)
por: Cai, Ruichu, et al.
Publicado: (2026)
Debate with Images: Detecting Deceptive Behaviors in Multimodal Large Language Models
por: Fang, Sitong, et al.
Publicado: (2025)
por: Fang, Sitong, et al.
Publicado: (2025)
VGGT-DP: Generalizable Robot Control via Vision Foundation Models
por: Ge, Shijia, et al.
Publicado: (2025)
por: Ge, Shijia, et al.
Publicado: (2025)
Domain Generalizable Knowledge Tracing via Concept Aggregation and Relation-Based Attention
por: Xie, Yuquan, et al.
Publicado: (2024)
por: Xie, Yuquan, et al.
Publicado: (2024)
Cross-Modal Knowledge Distillation for Speech Large Language Models
por: Wang, Enzhi, et al.
Publicado: (2025)
por: Wang, Enzhi, et al.
Publicado: (2025)
Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance
por: Yang, Wei, et al.
Publicado: (2026)
por: Yang, Wei, et al.
Publicado: (2026)
Hierarchical Tree Search-based User Lifelong Behavior Modeling on Large Language Model
por: Xia, Yu, et al.
Publicado: (2025)
por: Xia, Yu, et al.
Publicado: (2025)
EAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration
por: Hong, Minjie, et al.
Publicado: (2025)
por: Hong, Minjie, et al.
Publicado: (2025)
Generalizable Speech Deepfake Detection via Information Bottleneck Enhanced Adversarial Alignment
por: Huang, Pu, et al.
Publicado: (2025)
por: Huang, Pu, et al.
Publicado: (2025)
Knowledge is Power: Harnessing Large Language Models for Enhanced Cognitive Diagnosis
por: Dong, Zhiang, et al.
Publicado: (2025)
por: Dong, Zhiang, et al.
Publicado: (2025)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
por: Zhou, Zhi, et al.
Publicado: (2024)
por: Zhou, Zhi, et al.
Publicado: (2024)
MCP-RADAR: A Multi-Dimensional Benchmark for Evaluating Tool Use Capabilities in Large Language Models
por: Gao, Xuanqi, et al.
Publicado: (2025)
por: Gao, Xuanqi, et al.
Publicado: (2025)
Ejemplares similares
-
Generating Realistic Safety-Critical Scenarios for Vehicle-Pedestrian Interactions
por: Pu, Qingwen, et al.
Publicado: (2026) -
Modeling Vehicle-Type-Specific Pedestrian Crash Avoidance Behavior in Safety-Critical Interactions Using Smooth-Mamba Deep Reinforcement Learning
por: Pu, Qingwen, et al.
Publicado: (2026) -
VLM-VPI: A Vision-Language Reasoning Framework for Improving Automated Vehicle-Pedestrian Interactions
por: Pu, Qingwen, et al.
Publicado: (2026) -
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
por: Zhang, Minxing, et al.
Publicado: (2025) -
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
por: Gao, Haoxiang, et al.
Publicado: (2025)