Resource-Efficient Medical Report Generation using Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Abdullah, Hamza, Ameer, Kim, Seong Tae |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multimodal Retrieval-Augmented Generation with Large Language Models for Medical VQA
por: Karim, A H M Rezaul, et al.
Publicado: (2025)
por: Karim, A H M Rezaul, et al.
Publicado: (2025)
LLaVA Needs More Knowledge: Retrieval Augmented Natural Language Generation with Knowledge Graph for Explaining Thoracic Pathologies
por: Hamza, Ameer, et al.
Publicado: (2024)
por: Hamza, Ameer, et al.
Publicado: (2024)
Jailbreaking Multimodal Large Language Models using Multi-Clip Video
por: Kang, Choongwon, et al.
Publicado: (2026)
por: Kang, Choongwon, et al.
Publicado: (2026)
Transformers and Large Language Models for Efficient Intrusion Detection Systems: A Comprehensive Survey
por: Kheddar, Hamza
Publicado: (2024)
por: Kheddar, Hamza
Publicado: (2024)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
por: Ding, Meidan, et al.
Publicado: (2025)
por: Ding, Meidan, et al.
Publicado: (2025)
VLM-KG: Multimodal Radiology Knowledge Graph Generation
por: Abdullah, Abdullah, et al.
Publicado: (2025)
por: Abdullah, Abdullah, et al.
Publicado: (2025)
Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
por: Liu, Shaonan, et al.
Publicado: (2026)
por: Liu, Shaonan, et al.
Publicado: (2026)
Causal-SAM-LLM: Large Language Models as Causal Reasoners for Robust Medical Segmentation
por: Tang, Tao, et al.
Publicado: (2025)
por: Tang, Tao, et al.
Publicado: (2025)
VLind-Bench: Measuring Language Priors in Large Vision-Language Models
por: Lee, Kang-il, et al.
Publicado: (2024)
por: Lee, Kang-il, et al.
Publicado: (2024)
ERGO: Efficient High-Resolution Visual Understanding for Vision-Language Models
por: Lee, Jewon, et al.
Publicado: (2025)
por: Lee, Jewon, et al.
Publicado: (2025)
Contrastive Language Prompting to Ease False Positives in Medical Anomaly Detection
por: Park, YeongHyeon, et al.
Publicado: (2024)
por: Park, YeongHyeon, et al.
Publicado: (2024)
VLR-Bench: Multilingual Benchmark Dataset for Vision-Language Retrieval Augmented Generation
por: Lim, Hyeonseok, et al.
Publicado: (2024)
por: Lim, Hyeonseok, et al.
Publicado: (2024)
An Examination of the Compositionality of Large Generative Vision-Language Models
por: Ma, Teli, et al.
Publicado: (2023)
por: Ma, Teli, et al.
Publicado: (2023)
KOFFVQA: An Objectively Evaluated Free-form VQA Benchmark for Large Vision-Language Models in the Korean Language
por: Kim, Yoonshik, et al.
Publicado: (2025)
por: Kim, Yoonshik, et al.
Publicado: (2025)
DirecT2V: Large Language Models are Frame-Level Directors for Zero-Shot Text-to-Video Generation
por: Hong, Susung, et al.
Publicado: (2023)
por: Hong, Susung, et al.
Publicado: (2023)
CBVLM: Training-free Explainable Concept-based Large Vision Language Models for Medical Image Classification
por: Patrício, Cristiano, et al.
Publicado: (2025)
por: Patrício, Cristiano, et al.
Publicado: (2025)
MMRefine: Unveiling the Obstacles to Robust Refinement in Multimodal Large Language Models
por: Paik, Gio, et al.
Publicado: (2025)
por: Paik, Gio, et al.
Publicado: (2025)
Speed Always Wins: A Survey on Efficient Architectures for Large Language Models
por: Sun, Weigao, et al.
Publicado: (2025)
por: Sun, Weigao, et al.
Publicado: (2025)
ML-Mamba: Efficient Multi-Modal Large Language Model Utilizing Mamba-2
por: Huang, Wenjun, et al.
Publicado: (2024)
por: Huang, Wenjun, et al.
Publicado: (2024)
Decoding fMRI Data into Captions using Prefix Language Modeling
por: Shen, Vyacheslav, et al.
Publicado: (2025)
por: Shen, Vyacheslav, et al.
Publicado: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding
por: Min, Kyungmin, et al.
Publicado: (2024)
por: Min, Kyungmin, et al.
Publicado: (2024)
Chiron-o1: Igniting Multimodal Large Language Models towards Generalizable Medical Reasoning via Mentor-Intern Collaborative Search
por: Sun, Haoran, et al.
Publicado: (2025)
por: Sun, Haoran, et al.
Publicado: (2025)
Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation
por: Chen, Wenting, et al.
Publicado: (2023)
por: Chen, Wenting, et al.
Publicado: (2023)
Vision Token Reduction via Attention-Driven Self-Compression for Efficient Multimodal Large Language Models
por: Deniz, Omer Faruk, et al.
Publicado: (2026)
por: Deniz, Omer Faruk, et al.
Publicado: (2026)
MiniGPT-Med: Large Language Model as a General Interface for Radiology Diagnosis
por: Alkhaldi, Asma, et al.
Publicado: (2024)
por: Alkhaldi, Asma, et al.
Publicado: (2024)
Model Composition for Multimodal Large Language Models
por: Chen, Chi, et al.
Publicado: (2024)
por: Chen, Chi, et al.
Publicado: (2024)
ScImage: How Good Are Multimodal Large Language Models at Scientific Text-to-Image Generation?
por: Zhang, Leixin, et al.
Publicado: (2024)
por: Zhang, Leixin, et al.
Publicado: (2024)
TOOLCAD: Exploring Tool-Using Large Language Models in Text-to-CAD Generation with Reinforcement Learning
por: Gong, Yifei, et al.
Publicado: (2026)
por: Gong, Yifei, et al.
Publicado: (2026)
Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback
por: Zhou, Yucheng, et al.
Publicado: (2025)
por: Zhou, Yucheng, et al.
Publicado: (2025)
Mitigating Adversarial Attacks in LLMs through Defensive Suffix Generation
por: Kim, Minkyoung, et al.
Publicado: (2024)
por: Kim, Minkyoung, et al.
Publicado: (2024)
Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
por: Liu, Dingning, et al.
Publicado: (2024)
por: Liu, Dingning, et al.
Publicado: (2024)
Ex-Omni: Enabling 3D Facial Animation Generation for Omni-modal Large Language Models
por: Zhang, Haoyu, et al.
Publicado: (2026)
por: Zhang, Haoyu, et al.
Publicado: (2026)
Let's Think Outside the Box: Exploring Leap-of-Thought in Large Language Models with Creative Humor Generation
por: Zhong, Shanshan, et al.
Publicado: (2023)
por: Zhong, Shanshan, et al.
Publicado: (2023)
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
por: Zhu, Wenhui, et al.
Publicado: (2025)
por: Zhu, Wenhui, et al.
Publicado: (2025)
AC-Lite : A Lightweight Image Captioning Model for Low-Resource Assamese Language
por: Choudhury, Pankaj, et al.
Publicado: (2025)
por: Choudhury, Pankaj, et al.
Publicado: (2025)
POP: Prefill-Only Pruning for Efficient Large Model Inference
por: He, Junhui, et al.
Publicado: (2026)
por: He, Junhui, et al.
Publicado: (2026)
MedRepBench: A Comprehensive Benchmark for Medical Report Interpretation
por: Shang, Fangxin, et al.
Publicado: (2025)
por: Shang, Fangxin, et al.
Publicado: (2025)
Hallucination Benchmark in Medical Visual Question Answering
por: Wu, Jinge, et al.
Publicado: (2024)
por: Wu, Jinge, et al.
Publicado: (2024)
MedHallTune: An Instruction-Tuning Benchmark for Mitigating Medical Hallucination in Vision-Language Models
por: Yan, Qiao, et al.
Publicado: (2025)
por: Yan, Qiao, et al.
Publicado: (2025)
M4CXR: Exploring Multi-task Potentials of Multi-modal Large Language Models for Chest X-ray Interpretation
por: Park, Jonggwon, et al.
Publicado: (2024)
por: Park, Jonggwon, et al.
Publicado: (2024)
Ejemplares similares
-
Multimodal Retrieval-Augmented Generation with Large Language Models for Medical VQA
por: Karim, A H M Rezaul, et al.
Publicado: (2025) -
LLaVA Needs More Knowledge: Retrieval Augmented Natural Language Generation with Knowledge Graph for Explaining Thoracic Pathologies
por: Hamza, Ameer, et al.
Publicado: (2024) -
Jailbreaking Multimodal Large Language Models using Multi-Clip Video
por: Kang, Choongwon, et al.
Publicado: (2026) -
Transformers and Large Language Models for Efficient Intrusion Detection Systems: A Comprehensive Survey
por: Kheddar, Hamza
Publicado: (2024) -
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
por: Ding, Meidan, et al.
Publicado: (2025)