Compact Multimodal Language Models as Robust OCR Alternatives for Noisy Textual Clinical Reports
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Neveditsin, Nikita, Lingras, Pawan, Patil, Salil, Patil, Swarup, Mago, Vijay |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Structured Output Robustness of Small Language Models for Open Attribute-Value Extraction from Clinical Notes
par: Neveditsin, Nikita, et autres
Publié: (2025)
par: Neveditsin, Nikita, et autres
Publié: (2025)
Clinical Insights: A Comprehensive Review of Language Models in Medicine
par: Neveditsin, Nikita, et autres
Publié: (2024)
par: Neveditsin, Nikita, et autres
Publié: (2024)
From Annotation to Adaptation: Metrics, Synthetic Data, and Aspect Extraction for Aspect-Based Sentiment Analysis with Large Language Models
par: Neveditsin, Nikita, et autres
Publié: (2025)
par: Neveditsin, Nikita, et autres
Publié: (2025)
Scalable Parameter-Light Spectral Method for Clustering Short Text Embeddings with a Cohesion-Based Evaluation Metric
par: Neveditsin, Nikita, et autres
Publié: (2025)
par: Neveditsin, Nikita, et autres
Publié: (2025)
Multi-Stage Field Extraction of Financial Documents with OCR and Compact Vision-Language Models
par: Jin, Yichao, et autres
Publié: (2025)
par: Jin, Yichao, et autres
Publié: (2025)
Finder: A Multimodal AI-Powered Search Framework for Pharmaceutical Data Retrieval
par: Mishra, Suyash, et autres
Publié: (2026)
par: Mishra, Suyash, et autres
Publié: (2026)
A Comprehensive Survey of Evaluation Techniques for Recommendation Systems
par: Jadon, Aryan, et autres
Publié: (2023)
par: Jadon, Aryan, et autres
Publié: (2023)
Leveraging Large Language Models for Automated Scalable Development of Open Scientific Databases
par: Gautam, Nikita, et autres
Publié: (2026)
par: Gautam, Nikita, et autres
Publié: (2026)
On Evaluating the Adversarial Robustness of Foundation Models for Multimodal Entity Linking
par: Wang, Fang, et autres
Publié: (2025)
par: Wang, Fang, et autres
Publié: (2025)
Markup Language Modeling for Web Document Understanding
par: Liu, Su, et autres
Publié: (2025)
par: Liu, Su, et autres
Publié: (2025)
Knowledge-Aware Query Expansion with Large Language Models for Textual and Relational Retrieval
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
Enhancing Recommender Systems Using Textual Embeddings from Pre-trained Language Models
par: Le, Ngoc Luyen, et autres
Publié: (2025)
par: Le, Ngoc Luyen, et autres
Publié: (2025)
Optimizing Nepali PDF Extraction: A Comparative Study of Parser and OCR Technologies
par: Paudel, Prabin, et autres
Publié: (2024)
par: Paudel, Prabin, et autres
Publié: (2024)
SUMMA: A Multimodal Large Language Model for Advertisement Summarization
par: Jia, Weitao, et autres
Publié: (2025)
par: Jia, Weitao, et autres
Publié: (2025)
Fine-tuning Multimodal Large Language Models for Product Bundling
par: Liu, Xiaohao, et autres
Publié: (2024)
par: Liu, Xiaohao, et autres
Publié: (2024)
Augmenting Textual Generation via Topology Aware Retrieval
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Threat Behavior Textual Search by Attention Graph Isomorphism
par: Bae, Chanwoo, et autres
Publié: (2024)
par: Bae, Chanwoo, et autres
Publié: (2024)
Multimodal Large Language Models with Adaptive Preference Optimization for Sequential Recommendation
par: Wang, Yu, et autres
Publié: (2025)
par: Wang, Yu, et autres
Publié: (2025)
Enhancing Multimodal Recommendations with Vision-Language Models and Information-Aware Fusion
par: Kieu, Hai-Dang, et autres
Publié: (2025)
par: Kieu, Hai-Dang, et autres
Publié: (2025)
Structural and Disentangled Adaptation of Large Vision Language Models for Multimodal Recommendation
par: Rao, Zhongtao, et autres
Publié: (2025)
par: Rao, Zhongtao, et autres
Publié: (2025)
Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval
par: Hu, Ruofan, et autres
Publié: (2025)
par: Hu, Ruofan, et autres
Publié: (2025)
Proactive Detection and Calibration of Seasonal Advertisements with Multimodal Large Language Models
par: Eghbalzadeh, Hamid, et autres
Publié: (2024)
par: Eghbalzadeh, Hamid, et autres
Publié: (2024)
KAP: MLLM-assisted OCR Text Enhancement for Hybrid Retrieval in Chinese Non-Narrative Documents
par: Hsu, Hsin-Ling, et autres
Publié: (2025)
par: Hsu, Hsin-Ling, et autres
Publié: (2025)
Diagnosing LLM-based Rerankers in Cold-Start Recommender Systems: Coverage, Exposure and Practical Mitigations
par: Lemdiasova, Ekaterina, et autres
Publié: (2026)
par: Lemdiasova, Ekaterina, et autres
Publié: (2026)
Hybrid Semantic Search: Unveiling User Intent Beyond Keywords
par: Ahluwalia, Aman, et autres
Publié: (2024)
par: Ahluwalia, Aman, et autres
Publié: (2024)
Bridging Textual-Collaborative Gap through Semantic Codes for Sequential Recommendation
par: Liu, Enze, et autres
Publié: (2025)
par: Liu, Enze, et autres
Publié: (2025)
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
par: Zhuang, Shengyao, et autres
Publié: (2024)
par: Zhuang, Shengyao, et autres
Publié: (2024)
Harnessing Multimodal Large Language Models for Multimodal Sequential Recommendation
par: Ye, Yuyang, et autres
Publié: (2024)
par: Ye, Yuyang, et autres
Publié: (2024)
Bridging Personalization and Control in Scientific Personalized Search
par: Mysore, Sheshera, et autres
Publié: (2024)
par: Mysore, Sheshera, et autres
Publié: (2024)
Text-Guided Visual Representation Learning for Robust Multimodal E-Commerce Recommendation
par: Guo, Yufei, et autres
Publié: (2026)
par: Guo, Yufei, et autres
Publié: (2026)
MLLMRec-R1: Incentivizing Reasoning Capability in Large Language Models for Multimodal Sequential Recommendation
par: Wang, Yu, et autres
Publié: (2026)
par: Wang, Yu, et autres
Publié: (2026)
C2T-ID: Converting Semantic Codebooks to Textual Document Identifiers for Generative Search
par: Zhang, Yingchen, et autres
Publié: (2025)
par: Zhang, Yingchen, et autres
Publié: (2025)
FedUTR: Federated Recommendation with Augmented Universal Textual Representation for Sparse Interaction Scenarios
par: Fu, Kang, et autres
Publié: (2026)
par: Fu, Kang, et autres
Publié: (2026)
LoRec: Large Language Model for Robust Sequential Recommendation against Poisoning Attacks
par: Zhang, Kaike, et autres
Publié: (2024)
par: Zhang, Kaike, et autres
Publié: (2024)
Task-level Distributionally Robust Optimization for Large Language Model-based Dense Retrieval
par: Ma, Guangyuan, et autres
Publié: (2024)
par: Ma, Guangyuan, et autres
Publié: (2024)
Hard vs. Noise: Resolving Hard-Noisy Sample Confusion in Recommender Systems via Large Language Models
par: Song, Tianrui, et autres
Publié: (2025)
par: Song, Tianrui, et autres
Publié: (2025)
Ranking with Ties based on Noisy Performance Data
par: Sankaran, Aravind, et autres
Publié: (2024)
par: Sankaran, Aravind, et autres
Publié: (2024)
MDVT: Enhancing Multimodal Recommendation with Model-Agnostic Multimodal-Driven Virtual Triplets
par: Xu, Jinfeng, et autres
Publié: (2025)
par: Xu, Jinfeng, et autres
Publié: (2025)
End-to-end training of Multimodal Model and ranking Model
par: Deng, Xiuqi, et autres
Publié: (2024)
par: Deng, Xiuqi, et autres
Publié: (2024)
Robust Multimodal Recommendation via Graph Retrieval-Enhanced Modality Completion
par: Li, Yuan, et autres
Publié: (2026)
par: Li, Yuan, et autres
Publié: (2026)
Documents similaires
-
Evaluating Structured Output Robustness of Small Language Models for Open Attribute-Value Extraction from Clinical Notes
par: Neveditsin, Nikita, et autres
Publié: (2025) -
Clinical Insights: A Comprehensive Review of Language Models in Medicine
par: Neveditsin, Nikita, et autres
Publié: (2024) -
From Annotation to Adaptation: Metrics, Synthetic Data, and Aspect Extraction for Aspect-Based Sentiment Analysis with Large Language Models
par: Neveditsin, Nikita, et autres
Publié: (2025) -
Scalable Parameter-Light Spectral Method for Clustering Short Text Embeddings with a Cohesion-Based Evaluation Metric
par: Neveditsin, Nikita, et autres
Publié: (2025) -
Multi-Stage Field Extraction of Financial Documents with OCR and Compact Vision-Language Models
par: Jin, Yichao, et autres
Publié: (2025)