A Vision-and-Knowledge Enhanced Large Language Model for Generalizable Pedestrian Crossing Behavior Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Pu, Qingwen, Xie, Kun, Yang, Hong, Zhai, Guocong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generating Realistic Safety-Critical Scenarios for Vehicle-Pedestrian Interactions
di: Pu, Qingwen, et al.
Pubblicazione: (2026)
di: Pu, Qingwen, et al.
Pubblicazione: (2026)
Modeling Vehicle-Type-Specific Pedestrian Crash Avoidance Behavior in Safety-Critical Interactions Using Smooth-Mamba Deep Reinforcement Learning
di: Pu, Qingwen, et al.
Pubblicazione: (2026)
di: Pu, Qingwen, et al.
Pubblicazione: (2026)
VLM-VPI: A Vision-Language Reasoning Framework for Improving Automated Vehicle-Pedestrian Interactions
di: Pu, Qingwen, et al.
Pubblicazione: (2026)
di: Pu, Qingwen, et al.
Pubblicazione: (2026)
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
di: Zhang, Minxing, et al.
Pubblicazione: (2025)
di: Zhang, Minxing, et al.
Pubblicazione: (2025)
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
di: Gao, Haoxiang, et al.
Pubblicazione: (2025)
di: Gao, Haoxiang, et al.
Pubblicazione: (2025)
Using Large Language Models to Assess Teachers' Pedagogical Content Knowledge
di: Yang, Yaxuan, et al.
Pubblicazione: (2025)
di: Yang, Yaxuan, et al.
Pubblicazione: (2025)
Enhancing the Capabilities of Large Language Models for API calls through Knowledge Graphs
di: Yang, Ye, et al.
Pubblicazione: (2025)
di: Yang, Ye, et al.
Pubblicazione: (2025)
Large Language Models for Pedestrian Safety: An Application to Predicting Driver Yielding Behavior at Unsignalized Intersections
di: Yang, Yicheng, et al.
Pubblicazione: (2025)
di: Yang, Yicheng, et al.
Pubblicazione: (2025)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
di: Wu, Yanru, et al.
Pubblicazione: (2026)
di: Wu, Yanru, et al.
Pubblicazione: (2026)
OmniPT: Unleashing the Potential of Large Vision Language Models for Pedestrian Tracking and Understanding
di: Fu, Teng, et al.
Pubblicazione: (2025)
di: Fu, Teng, et al.
Pubblicazione: (2025)
Video-to-Text Pedestrian Monitoring (VTPM): Leveraging Computer Vision and Large Language Models for Privacy-Preserve Pedestrian Activity Monitoring at Intersections
di: Abdelrahman, Ahmed S., et al.
Pubblicazione: (2024)
di: Abdelrahman, Ahmed S., et al.
Pubblicazione: (2024)
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
di: Zhang, Chengsheng, et al.
Pubblicazione: (2026)
di: Zhang, Chengsheng, et al.
Pubblicazione: (2026)
Vision Inference Former: Sustaining Visual Consistency in Multimodal Large Language Models
di: Dong, Xinpeng, et al.
Pubblicazione: (2026)
di: Dong, Xinpeng, et al.
Pubblicazione: (2026)
SlimGPT: Layer-wise Structured Pruning for Large Language Models
di: Ling, Gui, et al.
Pubblicazione: (2024)
di: Ling, Gui, et al.
Pubblicazione: (2024)
VLM-PAR: A Vision Language Model for Pedestrian Attribute Recognition
di: Sellam, Abdellah Zakaria, et al.
Pubblicazione: (2025)
di: Sellam, Abdellah Zakaria, et al.
Pubblicazione: (2025)
Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts
di: Xie, Jian, et al.
Pubblicazione: (2023)
di: Xie, Jian, et al.
Pubblicazione: (2023)
Enhancing Travel Choice Modeling with Large Language Models: A Prompt-Learning Approach
di: Zhai, Xuehao, et al.
Pubblicazione: (2024)
di: Zhai, Xuehao, et al.
Pubblicazione: (2024)
A Hierarchical Pedestrian Behavior Model to Generate Realistic Human Behavior in Traffic Simulation
di: Larter, Scott, et al.
Pubblicazione: (2022)
di: Larter, Scott, et al.
Pubblicazione: (2022)
Predicting and Analyzing Pedestrian Crossing Behavior at Unsignalized Crossings
di: Zhang, Chi, et al.
Pubblicazione: (2024)
di: Zhang, Chi, et al.
Pubblicazione: (2024)
Multi-view Phase-aware Pedestrian-Vehicle Incident Reasoning Framework with Vision-Language Models
di: Zhen, Hao, et al.
Pubblicazione: (2025)
di: Zhen, Hao, et al.
Pubblicazione: (2025)
PEDESTRIANQA: A Benchmark for Vision-Language Models on Pedestrian Intention and Trajectory Prediction
di: Mishra, Naman, et al.
Pubblicazione: (2026)
di: Mishra, Naman, et al.
Pubblicazione: (2026)
Cross-Lingual Knowledge Editing in Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
A Comprehensive Survey and Guide to Multimodal Large Language Models in Vision-Language Tasks
di: Liang, Chia Xin, et al.
Pubblicazione: (2024)
di: Liang, Chia Xin, et al.
Pubblicazione: (2024)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
di: Lei, Yuxuan, et al.
Pubblicazione: (2024)
di: Lei, Yuxuan, et al.
Pubblicazione: (2024)
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
di: Kim, Minsung, et al.
Pubblicazione: (2025)
di: Kim, Minsung, et al.
Pubblicazione: (2025)
Predicting Pedestrian Crossing Behavior in Germany and Japan: Insights into Model Transferability
di: Zhang, Chi, et al.
Pubblicazione: (2024)
di: Zhang, Chi, et al.
Pubblicazione: (2024)
LinguaSim: Interactive Multi-Vehicle Testing Scenario Generation via Natural Language Instruction Based on Large Language Models
di: Shi, Qingyuan, et al.
Pubblicazione: (2025)
di: Shi, Qingyuan, et al.
Pubblicazione: (2025)
Inference Performance Optimization for Large Language Models on CPUs
di: He, Pujiang, et al.
Pubblicazione: (2024)
di: He, Pujiang, et al.
Pubblicazione: (2024)
ENTRA: Entropy-Based Redundancy Avoidance in Large Language Model Reasoning
di: Cai, Ruichu, et al.
Pubblicazione: (2026)
di: Cai, Ruichu, et al.
Pubblicazione: (2026)
Debate with Images: Detecting Deceptive Behaviors in Multimodal Large Language Models
di: Fang, Sitong, et al.
Pubblicazione: (2025)
di: Fang, Sitong, et al.
Pubblicazione: (2025)
VGGT-DP: Generalizable Robot Control via Vision Foundation Models
di: Ge, Shijia, et al.
Pubblicazione: (2025)
di: Ge, Shijia, et al.
Pubblicazione: (2025)
Domain Generalizable Knowledge Tracing via Concept Aggregation and Relation-Based Attention
di: Xie, Yuquan, et al.
Pubblicazione: (2024)
di: Xie, Yuquan, et al.
Pubblicazione: (2024)
Cross-Modal Knowledge Distillation for Speech Large Language Models
di: Wang, Enzhi, et al.
Pubblicazione: (2025)
di: Wang, Enzhi, et al.
Pubblicazione: (2025)
Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance
di: Yang, Wei, et al.
Pubblicazione: (2026)
di: Yang, Wei, et al.
Pubblicazione: (2026)
Hierarchical Tree Search-based User Lifelong Behavior Modeling on Large Language Model
di: Xia, Yu, et al.
Pubblicazione: (2025)
di: Xia, Yu, et al.
Pubblicazione: (2025)
EAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration
di: Hong, Minjie, et al.
Pubblicazione: (2025)
di: Hong, Minjie, et al.
Pubblicazione: (2025)
Generalizable Speech Deepfake Detection via Information Bottleneck Enhanced Adversarial Alignment
di: Huang, Pu, et al.
Pubblicazione: (2025)
di: Huang, Pu, et al.
Pubblicazione: (2025)
Knowledge is Power: Harnessing Large Language Models for Enhanced Cognitive Diagnosis
di: Dong, Zhiang, et al.
Pubblicazione: (2025)
di: Dong, Zhiang, et al.
Pubblicazione: (2025)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
di: Zhou, Zhi, et al.
Pubblicazione: (2024)
di: Zhou, Zhi, et al.
Pubblicazione: (2024)
MCP-RADAR: A Multi-Dimensional Benchmark for Evaluating Tool Use Capabilities in Large Language Models
di: Gao, Xuanqi, et al.
Pubblicazione: (2025)
di: Gao, Xuanqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generating Realistic Safety-Critical Scenarios for Vehicle-Pedestrian Interactions
di: Pu, Qingwen, et al.
Pubblicazione: (2026) -
Modeling Vehicle-Type-Specific Pedestrian Crash Avoidance Behavior in Safety-Critical Interactions Using Smooth-Mamba Deep Reinforcement Learning
di: Pu, Qingwen, et al.
Pubblicazione: (2026) -
VLM-VPI: A Vision-Language Reasoning Framework for Improving Automated Vehicle-Pedestrian Interactions
di: Pu, Qingwen, et al.
Pubblicazione: (2026) -
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
di: Zhang, Minxing, et al.
Pubblicazione: (2025) -
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
di: Gao, Haoxiang, et al.
Pubblicazione: (2025)