Fine-Grained Evaluation of Large Vision-Language Models in Autonomous Driving
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yue, Tian, Meng, Lin, Zhenyu, Zhu, Jiangtong, Zhu, Dechang, Liu, Haiqiang, Wang, Zining, Zhang, Yueyi, Xiong, Zhiwei, Zhao, Xinhai |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Drive-R1: Bridging Reasoning and Planning in VLMs for Autonomous Driving with Reinforcement Learning
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
par: Li, Jiangtong, et autres
Publié: (2025)
par: Li, Jiangtong, et autres
Publié: (2025)
InspireDebate: Multi-Dimensional Subjective-Objective Evaluation-Guided Reasoning and Optimization for Debating
par: Wang, Fuyu, et autres
Publié: (2025)
par: Wang, Fuyu, et autres
Publié: (2025)
Prometheus-Vision: Vision-Language Model as a Judge for Fine-Grained Evaluation
par: Lee, Seongyun, et autres
Publié: (2024)
par: Lee, Seongyun, et autres
Publié: (2024)
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
par: Liu, Yan, et autres
Publié: (2024)
par: Liu, Yan, et autres
Publié: (2024)
Understanding Language Model Circuits through Knowledge Editing
par: Ge, Huaizhi, et autres
Publié: (2024)
par: Ge, Huaizhi, et autres
Publié: (2024)
Distribution Prompting: Understanding the Expressivity of Language Models Through the Next-Token Distributions They Can Produce
par: Wang, Haojin, et autres
Publié: (2025)
par: Wang, Haojin, et autres
Publié: (2025)
A Superalignment Framework in Autonomous Driving with Large Language Models
par: Kong, Xiangrui, et autres
Publié: (2024)
par: Kong, Xiangrui, et autres
Publié: (2024)
Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving
par: Li, Pengxiang, et autres
Publié: (2025)
par: Li, Pengxiang, et autres
Publié: (2025)
Scenarios and Approaches for Situated Natural Language Explanations
par: Qiu, Pengshuo, et autres
Publié: (2024)
par: Qiu, Pengshuo, et autres
Publié: (2024)
CFBenchmark: Chinese Financial Assistant Benchmark for Large Language Model
par: Lei, Yang, et autres
Publié: (2023)
par: Lei, Yang, et autres
Publié: (2023)
Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback
par: Xiao, Wenyi, et autres
Publié: (2024)
par: Xiao, Wenyi, et autres
Publié: (2024)
Analyzing Fine-Grained Alignment and Enhancing Vision Understanding in Multimodal Language Models
par: Jiang, Jiachen, et autres
Publié: (2025)
par: Jiang, Jiachen, et autres
Publié: (2025)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
par: Zhang, Jingfan, et autres
Publié: (2024)
par: Zhang, Jingfan, et autres
Publié: (2024)
X-Driver: Explainable Autonomous Driving with Vision-Language Models
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
Application of Multimodal Large Language Models in Autonomous Driving
par: Islam, Md Robiul
Publié: (2024)
par: Islam, Md Robiul
Publié: (2024)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
par: Liu, Zequan, et autres
Publié: (2024)
par: Liu, Zequan, et autres
Publié: (2024)
African or European Swallow? Benchmarking Large Vision-Language Models for Fine-Grained Object Classification
par: Geigle, Gregor, et autres
Publié: (2024)
par: Geigle, Gregor, et autres
Publié: (2024)
Finer: Investigating and Enhancing Fine-Grained Visual Concept Recognition in Large Vision Language Models
par: Kim, Jeonghwan, et autres
Publié: (2024)
par: Kim, Jeonghwan, et autres
Publié: (2024)
What Would You Ask When You First Saw $a^2+b^2=c^2$? Evaluating LLM on Curiosity-Driven Questioning
par: Javaji, Shashidhar Reddy, et autres
Publié: (2024)
par: Javaji, Shashidhar Reddy, et autres
Publié: (2024)
How Well Can Knowledge Edit Methods Edit Perplexing Knowledge?
par: Ge, Huaizhi, et autres
Publié: (2024)
par: Ge, Huaizhi, et autres
Publié: (2024)
IndiVec: An Exploration of Leveraging Large Language Models for Media Bias Detection with Fine-Grained Bias Indicators
par: Lin, Luyang, et autres
Publié: (2024)
par: Lin, Luyang, et autres
Publié: (2024)
Fine-Grained Alignment in Vision-and-Language Navigation through Bayesian Optimization
par: Song, Yuhang, et autres
Publié: (2024)
par: Song, Yuhang, et autres
Publié: (2024)
HFT: Half Fine-Tuning for Large Language Models
par: Hui, Tingfeng, et autres
Publié: (2024)
par: Hui, Tingfeng, et autres
Publié: (2024)
A Language Agent for Autonomous Driving
par: Mao, Jiageng, et autres
Publié: (2023)
par: Mao, Jiageng, et autres
Publié: (2023)
Knowledge Graph-Infused Fine-Tuning for Structured Reasoning in Large Language Models
par: Zhang, Wuyang, et autres
Publié: (2025)
par: Zhang, Wuyang, et autres
Publié: (2025)
Instructing Large Language Models to Identify and Ignore Irrelevant Conditions
par: Wu, Zhenyu, et autres
Publié: (2024)
par: Wu, Zhenyu, et autres
Publié: (2024)
CLEAN-EVAL: Clean Evaluation on Contaminated Large Language Models
par: Zhu, Wenhong, et autres
Publié: (2023)
par: Zhu, Wenhong, et autres
Publié: (2023)
The Fine-Grained Complexity of Gradient Computation for Training Large Language Models
par: Alman, Josh, et autres
Publié: (2024)
par: Alman, Josh, et autres
Publié: (2024)
E-Bench: Towards Evaluating the Ease-of-Use of Large Language Models
par: Zhang, Zhenyu, et autres
Publié: (2024)
par: Zhang, Zhenyu, et autres
Publié: (2024)
SAS-Bench: A Fine-Grained Benchmark for Evaluating Short Answer Scoring with Large Language Models
par: Lai, Peichao, et autres
Publié: (2025)
par: Lai, Peichao, et autres
Publié: (2025)
Learning to Refine with Fine-Grained Natural Language Feedback
par: Wadhwa, Manya, et autres
Publié: (2024)
par: Wadhwa, Manya, et autres
Publié: (2024)
Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuning
par: Tan, Zhaoxuan, et autres
Publié: (2024)
par: Tan, Zhaoxuan, et autres
Publié: (2024)
Revealing Fine-Grained Values and Opinions in Large Language Models
par: Wright, Dustin, et autres
Publié: (2024)
par: Wright, Dustin, et autres
Publié: (2024)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
par: Zhang, Jia-Chen, et autres
Publié: (2024)
par: Zhang, Jia-Chen, et autres
Publié: (2024)
Enhancing Fine-Grained Image Classifications via Cascaded Vision Language Models
par: Wei, Canshi
Publié: (2024)
par: Wei, Canshi
Publié: (2024)
An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
par: Luo, Yun, et autres
Publié: (2023)
par: Luo, Yun, et autres
Publié: (2023)
Beyond Query-Level Comparison: Fine-Grained Reinforcement Learning for Text-to-SQL with Automated Interpretable Critiques
par: Wang, Guifeng, et autres
Publié: (2025)
par: Wang, Guifeng, et autres
Publié: (2025)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
par: Bai, Ge, et autres
Publié: (2024)
par: Bai, Ge, et autres
Publié: (2024)
What does the Knowledge Neuron Thesis Have to do with Knowledge?
par: Niu, Jingcheng, et autres
Publié: (2024)
par: Niu, Jingcheng, et autres
Publié: (2024)
Documents similaires
-
Drive-R1: Bridging Reasoning and Planning in VLMs for Autonomous Driving with Reinforcement Learning
par: Li, Yue, et autres
Publié: (2025) -
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
par: Li, Jiangtong, et autres
Publié: (2025) -
InspireDebate: Multi-Dimensional Subjective-Objective Evaluation-Guided Reasoning and Optimization for Debating
par: Wang, Fuyu, et autres
Publié: (2025) -
Prometheus-Vision: Vision-Language Model as a Judge for Fine-Grained Evaluation
par: Lee, Seongyun, et autres
Publié: (2024) -
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
par: Liu, Yan, et autres
Publié: (2024)