AITP: Traffic Accident Responsibility Allocation via Multimodal Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Zijin, Zhang, Songan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
An Early Investigation into the Utility of Multimodal Large Language Models in Medical Imaging
by: Khan, Sulaiman, et al.
Published: (2024)
by: Khan, Sulaiman, et al.
Published: (2024)
LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
by: Le-Duc, Khai, et al.
Published: (2024)
by: Le-Duc, Khai, et al.
Published: (2024)
Imagining Alternatives: Towards High-Resolution 3D Counterfactual Medical Image Generation via Language Guidance
by: Mohamed, Mohamed, et al.
Published: (2025)
by: Mohamed, Mohamed, et al.
Published: (2025)
MedFLIP: Medical Vision-and-Language Self-supervised Fast Pre-Training with Masked Autoencoder
by: Li, Lei, et al.
Published: (2024)
by: Li, Lei, et al.
Published: (2024)
Read Like a Radiologist: Efficient Vision-Language Model for 3D Medical Imaging Interpretation
by: Lee, Changsun, et al.
Published: (2024)
by: Lee, Changsun, et al.
Published: (2024)
Utility of Multimodal Large Language Models in Analyzing Chest X-ray with Incomplete Contextual Information
by: Kim, Choonghan, et al.
Published: (2024)
by: Kim, Choonghan, et al.
Published: (2024)
How Does Diverse Interpretability of Textual Prompts Impact Medical Vision-Language Zero-Shot Tasks?
by: Wang, Sicheng, et al.
Published: (2024)
by: Wang, Sicheng, et al.
Published: (2024)
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
by: Liu, Che, et al.
Published: (2023)
by: Liu, Che, et al.
Published: (2023)
MSVD-Indonesian: A Benchmark for Multimodal Video-Text Tasks in Indonesian
by: Hendria, Willy Fitra
Published: (2023)
by: Hendria, Willy Fitra
Published: (2023)
EVTP-IVS: Effective Visual Token Pruning For Unifying Instruction Visual Segmentation In Multi-Modal Large Language Models
by: Zhu, Wenhui, et al.
Published: (2025)
by: Zhu, Wenhui, et al.
Published: (2025)
Spatiotemporal Tile-based Attention-guided LSTMs for Traffic Video Prediction
by: Nguyen, Tu
Published: (2019)
by: Nguyen, Tu
Published: (2019)
Unified Multimodal Brain Decoding via Cross-Subject Soft-ROI Fusion
by: Hu, Xuanyu
Published: (2025)
by: Hu, Xuanyu
Published: (2025)
CPLIP: Zero-Shot Learning for Histopathology with Comprehensive Vision-Language Alignment
by: Javed, Sajid, et al.
Published: (2024)
by: Javed, Sajid, et al.
Published: (2024)
Zero-Shot Distracted Driver Detection via Vision Language Models with Double Decoupling
by: Miyata, Takamichi, et al.
Published: (2026)
by: Miyata, Takamichi, et al.
Published: (2026)
LUQ: Layerwise Ultra-Low Bit Quantization for Multimodal Large Language Models
by: Bhatnagar, Shubhang, et al.
Published: (2025)
by: Bhatnagar, Shubhang, et al.
Published: (2025)
Exploring CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation
by: Yang, Zhiwei, et al.
Published: (2025)
by: Yang, Zhiwei, et al.
Published: (2025)
LOC: A General Language-Guided Framework for Open-Set 3D Occupancy Prediction
by: Gao, Yuhang, et al.
Published: (2025)
by: Gao, Yuhang, et al.
Published: (2025)
Multimodal MRI Report Findings Supervised Brain Lesion Segmentation with Substructures
by: Ge, Yubin, et al.
Published: (2026)
by: Ge, Yubin, et al.
Published: (2026)
Enhancing Radiographic Disease Detection with MetaCheX, a Context-Aware Multimodal Model
by: He, Nathan, et al.
Published: (2025)
by: He, Nathan, et al.
Published: (2025)
Automated Spinal MRI Labelling from Reports Using a Large Language Model
by: Park, Robin Y., et al.
Published: (2024)
by: Park, Robin Y., et al.
Published: (2024)
HyperFusion: A Hypernetwork Approach to Multimodal Integration of Tabular and Medical Imaging Data for Predictive Modeling
by: Duenias, Daniel, et al.
Published: (2024)
by: Duenias, Daniel, et al.
Published: (2024)
Normative Modeling for AD Diagnosis and Biomarker Identification
by: Zhao, Songlin, et al.
Published: (2024)
by: Zhao, Songlin, et al.
Published: (2024)
Towards A Generalizable Pathology Foundation Model via Unified Knowledge Distillation
by: Ma, Jiabo, et al.
Published: (2024)
by: Ma, Jiabo, et al.
Published: (2024)
Benchmarking Histopathology Foundation Models for Ovarian Cancer Bevacizumab Treatment Response Prediction from Whole Slide Images
by: Mallya, Mayur, et al.
Published: (2024)
by: Mallya, Mayur, et al.
Published: (2024)
Mutual Information Analysis in Multimodal Learning Systems
by: Hadizadeh, Hadi, et al.
Published: (2024)
by: Hadizadeh, Hadi, et al.
Published: (2024)
MTT-Bench: Predicting Social Dominance in Mice via Multimodal Large Language Models
by: Chen, Yunquan, et al.
Published: (2026)
by: Chen, Yunquan, et al.
Published: (2026)
MedVisionLlama: Leveraging Pre-Trained Large Language Model Layers to Enhance Medical Image Segmentation
by: Kumar, Gurucharan Marthi Krishna, et al.
Published: (2024)
by: Kumar, Gurucharan Marthi Krishna, et al.
Published: (2024)
A Multimodal Approach to The Detection and Classification of Skin Diseases
by: Yang, Allen, et al.
Published: (2024)
by: Yang, Allen, et al.
Published: (2024)
Is Dataset Quality Still a Concern in Diagnosis Using Large Foundation Model?
by: Lin, Ziqin, et al.
Published: (2024)
by: Lin, Ziqin, et al.
Published: (2024)
MSEG-VCUQ: Multimodal SEGmentation with Enhanced Vision Foundation Models, Convolutional Neural Networks, and Uncertainty Quantification for High-Speed Video Phase Detection Data
by: Maduabuchi, Chika, et al.
Published: (2024)
by: Maduabuchi, Chika, et al.
Published: (2024)
VIP: Visual Information Protection through Adversarial Attacks on Vision-Language Models
by: Meftah, Hanene F. Z. Brachemi, et al.
Published: (2025)
by: Meftah, Hanene F. Z. Brachemi, et al.
Published: (2025)
Vision-Language Generative Model for View-Specific Chest X-ray Generation
by: Lee, Hyungyung, et al.
Published: (2023)
by: Lee, Hyungyung, et al.
Published: (2023)
Enhancing Network Initialization for Medical AI Models Using Large-Scale, Unlabeled Natural Images
by: Arasteh, Soroosh Tayebi, et al.
Published: (2023)
by: Arasteh, Soroosh Tayebi, et al.
Published: (2023)
Mixture of Multicenter Experts in Multimodal AI for Debiased Radiotherapy Target Delineation
by: Oh, Yujin, et al.
Published: (2024)
by: Oh, Yujin, et al.
Published: (2024)
Multimodal AI on Wound Images and Clinical Notes for Home Patient Referral
by: Fard, Reza Saadati, et al.
Published: (2025)
by: Fard, Reza Saadati, et al.
Published: (2025)
Retinal IPA: Iterative KeyPoints Alignment for Multimodal Retinal Imaging
by: Wang, Jiacheng, et al.
Published: (2024)
by: Wang, Jiacheng, et al.
Published: (2024)
Evaluation of Geolocation Capabilities of Multimodal Large Language Models and Analysis of Associated Privacy Risks
by: Zhang, Xian, et al.
Published: (2025)
by: Zhang, Xian, et al.
Published: (2025)
MindVL: Towards Efficient and Effective Training of Multimodal Large Language Models on Ascend NPUs
by: Chen, Feilong, et al.
Published: (2025)
by: Chen, Feilong, et al.
Published: (2025)
Multimodal Diffusion to Mutually Enhance Polarized Light and Low Resolution EBSD Data
by: Dong, Harry, et al.
Published: (2026)
by: Dong, Harry, et al.
Published: (2026)
ROCOv2: Radiology Objects in COntext Version 2, an Updated Multimodal Image Dataset
by: Rückert, Johannes, et al.
Published: (2024)
by: Rückert, Johannes, et al.
Published: (2024)
Similar Items
-
An Early Investigation into the Utility of Multimodal Large Language Models in Medical Imaging
by: Khan, Sulaiman, et al.
Published: (2024) -
LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
by: Le-Duc, Khai, et al.
Published: (2024) -
Imagining Alternatives: Towards High-Resolution 3D Counterfactual Medical Image Generation via Language Guidance
by: Mohamed, Mohamed, et al.
Published: (2025) -
MedFLIP: Medical Vision-and-Language Self-supervised Fast Pre-Training with Masked Autoencoder
by: Li, Lei, et al.
Published: (2024) -
Read Like a Radiologist: Efficient Vision-Language Model for 3D Medical Imaging Interpretation
by: Lee, Changsun, et al.
Published: (2024)