PDB-Eval: An Evaluation of Large Multimodal Models for Description and Explanation of Personalized Driving Behavior
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Junda, Echterhoff, Jessica, Han, Kyungtae, Abdelraouf, Amr, Gupta, Rohit, McAuley, Julian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PDB: Not All Drivers Are the Same -- A Personalized Dataset for Understanding Driving Behavior
par: Wei, Chuheng, et autres
Publié: (2025)
par: Wei, Chuheng, et autres
Publié: (2025)
Video Token Sparsification for Efficient Multimodal LLMs in Autonomous Driving
par: Ma, Yunsheng, et autres
Publié: (2024)
par: Ma, Yunsheng, et autres
Publié: (2024)
Investigating Personalized Driving Behaviors in Dilemma Zones: Analysis and Prediction of Stop-or-Go Decisions
par: Qin, Ziye, et autres
Publié: (2024)
par: Qin, Ziye, et autres
Publié: (2024)
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
par: Yoon, Se-eun, et autres
Publié: (2024)
par: Yoon, Se-eun, et autres
Publié: (2024)
Importance Sampling for Multi-Negative Multimodal Direct Preference Optimization
par: Li, Xintong, et autres
Publié: (2025)
par: Li, Xintong, et autres
Publié: (2025)
Imagery as Inquiry: Exploring A Multimodal Dataset for Conversational Recommendation
par: Yoon, Se-eun, et autres
Publié: (2024)
par: Yoon, Se-eun, et autres
Publié: (2024)
Cognitive Bias in Decision-Making with LLMs
par: Echterhoff, Jessica, et autres
Publié: (2024)
par: Echterhoff, Jessica, et autres
Publié: (2024)
Weakly-supervised VLM-guided Partial Contrastive Learning for Visual Language Navigation
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
KI-GAN: Knowledge-Informed Generative Adversarial Networks for Enhanced Multi-Vehicle Trajectory Forecasting at Signalized Intersections
par: Wei, Chuheng, et autres
Publié: (2024)
par: Wei, Chuheng, et autres
Publié: (2024)
Quantifying Cognitive Bias Induction in LLM-Generated Content
par: Alessa, Abeer, et autres
Publié: (2025)
par: Alessa, Abeer, et autres
Publié: (2025)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
par: Wang, Chuhan, et autres
Publié: (2026)
par: Wang, Chuhan, et autres
Publié: (2026)
NuPlanQA: A Large-Scale Dataset and Benchmark for Multi-View Driving Scene Understanding in Multi-Modal Large Language Models
par: Park, Sung-Yeon, et autres
Publié: (2025)
par: Park, Sung-Yeon, et autres
Publié: (2025)
Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction
par: Huang, Hongtao, et autres
Publié: (2025)
par: Huang, Hongtao, et autres
Publié: (2025)
LaViC: Adapting Large Vision-Language Models to Visually-Aware Conversational Recommendation
par: Jeon, Hyunsik, et autres
Publié: (2025)
par: Jeon, Hyunsik, et autres
Publié: (2025)
LVCHAT: Facilitating Long Video Comprehension
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
List Items One by One: A New Data Source and Learning Paradigm for Multimodal LLMs
par: Yan, An, et autres
Publié: (2024)
par: Yan, An, et autres
Publié: (2024)
Scene-Aware Conversational ADAS with Generative AI for Real-Time Driver Assistance
par: Han, Kyungtae, et autres
Publié: (2025)
par: Han, Kyungtae, et autres
Publié: (2025)
Evaluation on Entity Matching in Recommender Systems
par: Huang, Zihan, et autres
Publié: (2026)
par: Huang, Zihan, et autres
Publié: (2026)
Multi-Behavior Generative Recommendation
par: Liu, Zihan, et autres
Publié: (2024)
par: Liu, Zihan, et autres
Publié: (2024)
Visual Prompting in Multimodal Large Language Models: A Survey
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
par: Wang, Jianing, et autres
Publié: (2024)
par: Wang, Jianing, et autres
Publié: (2024)
Personalized Multimodal Large Language Models: A Survey
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
Self-Updatable Large Language Models by Integrating Context into Model Parameters
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Reddit2Deezer: A Scalable Dataset for Real-World Grounded Conversational Music Recommendation
par: Kim, Haven, et autres
Publié: (2026)
par: Kim, Haven, et autres
Publié: (2026)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025)
par: Hu, Yuanzhe, et autres
Publié: (2025)
When Benchmarks Age: Temporal Misalignment through Large Language Model Factuality Evaluation
par: Jiang, Xunyi, et autres
Publié: (2025)
par: Jiang, Xunyi, et autres
Publié: (2025)
Three central limit theorems for the unbounded excursion component of a Gaussian field
par: McAuley, Michael
Publié: (2024)
par: McAuley, Michael
Publié: (2024)
Children in Custody
par: McAuley, Mary
Publié: (2022)
par: McAuley, Mary
Publié: (2022)
Politics and the Soviet Union / Mary McAuley
par: McAuley, Mary
par: McAuley, Mary
Limit theorems for non-local functionals of smooth Gaussian fields via quasi-association
par: McAuley, Michael
Publié: (2026)
par: McAuley, Michael
Publié: (2026)
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
LaMPilot: An Open Benchmark Dataset for Autonomous Driving with Language Model Programs
par: Ma, Yunsheng, et autres
Publié: (2023)
par: Ma, Yunsheng, et autres
Publié: (2023)
GSPRec: Temporal-Aware Graph Spectral Filtering for Recommendation
par: Rabiah, Ahmad Bin, et autres
Publié: (2025)
par: Rabiah, Ahmad Bin, et autres
Publié: (2025)
Knowledge-Aware Query Expansion with Large Language Models for Textual and Relational Retrieval
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
SIMSplat: Predictive Driving Scene Editing with Language-aligned 4D Gaussian Splatting
par: Park, Sung-Yeon, et autres
Publié: (2025)
par: Park, Sung-Yeon, et autres
Publié: (2025)
CoRAL: Collaborative Retrieval-Augmented Large Language Models Improve Long-tail Recommendation
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
CoMMIT: Coordinated Multimodal Instruction Tuning
par: Li, Xintong, et autres
Publié: (2024)
par: Li, Xintong, et autres
Publié: (2024)
Investigating the Scaling Effect of Instruction Templates for Training Multimodal Language Model
par: Wang, Shijian, et autres
Publié: (2024)
par: Wang, Shijian, et autres
Publié: (2024)
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
par: Zhang, Kaichen, et autres
Publié: (2024)
par: Zhang, Kaichen, et autres
Publié: (2024)
Skill-CMIB: Multimodal Agent Skill for Consistent Action via Conditional Multimodal Information Bottleneck
par: Huang, Zihan, et autres
Publié: (2026)
par: Huang, Zihan, et autres
Publié: (2026)
Documents similaires
-
PDB: Not All Drivers Are the Same -- A Personalized Dataset for Understanding Driving Behavior
par: Wei, Chuheng, et autres
Publié: (2025) -
Video Token Sparsification for Efficient Multimodal LLMs in Autonomous Driving
par: Ma, Yunsheng, et autres
Publié: (2024) -
Investigating Personalized Driving Behaviors in Dilemma Zones: Analysis and Prediction of Stop-or-Go Decisions
par: Qin, Ziye, et autres
Publié: (2024) -
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
par: Yoon, Se-eun, et autres
Publié: (2024) -
Importance Sampling for Multi-Negative Multimodal Direct Preference Optimization
par: Li, Xintong, et autres
Publié: (2025)