Compact Multimodal Language Models as Robust OCR Alternatives for Noisy Textual Clinical Reports
Fuente:
arXiv
Guardado en:
| Autores principales: | Neveditsin, Nikita, Lingras, Pawan, Patil, Salil, Patil, Swarup, Mago, Vijay |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evaluating Structured Output Robustness of Small Language Models for Open Attribute-Value Extraction from Clinical Notes
por: Neveditsin, Nikita, et al.
Publicado: (2025)
por: Neveditsin, Nikita, et al.
Publicado: (2025)
Clinical Insights: A Comprehensive Review of Language Models in Medicine
por: Neveditsin, Nikita, et al.
Publicado: (2024)
por: Neveditsin, Nikita, et al.
Publicado: (2024)
From Annotation to Adaptation: Metrics, Synthetic Data, and Aspect Extraction for Aspect-Based Sentiment Analysis with Large Language Models
por: Neveditsin, Nikita, et al.
Publicado: (2025)
por: Neveditsin, Nikita, et al.
Publicado: (2025)
Scalable Parameter-Light Spectral Method for Clustering Short Text Embeddings with a Cohesion-Based Evaluation Metric
por: Neveditsin, Nikita, et al.
Publicado: (2025)
por: Neveditsin, Nikita, et al.
Publicado: (2025)
Multi-Stage Field Extraction of Financial Documents with OCR and Compact Vision-Language Models
por: Jin, Yichao, et al.
Publicado: (2025)
por: Jin, Yichao, et al.
Publicado: (2025)
Finder: A Multimodal AI-Powered Search Framework for Pharmaceutical Data Retrieval
por: Mishra, Suyash, et al.
Publicado: (2026)
por: Mishra, Suyash, et al.
Publicado: (2026)
A Comprehensive Survey of Evaluation Techniques for Recommendation Systems
por: Jadon, Aryan, et al.
Publicado: (2023)
por: Jadon, Aryan, et al.
Publicado: (2023)
Leveraging Large Language Models for Automated Scalable Development of Open Scientific Databases
por: Gautam, Nikita, et al.
Publicado: (2026)
por: Gautam, Nikita, et al.
Publicado: (2026)
On Evaluating the Adversarial Robustness of Foundation Models for Multimodal Entity Linking
por: Wang, Fang, et al.
Publicado: (2025)
por: Wang, Fang, et al.
Publicado: (2025)
Markup Language Modeling for Web Document Understanding
por: Liu, Su, et al.
Publicado: (2025)
por: Liu, Su, et al.
Publicado: (2025)
Knowledge-Aware Query Expansion with Large Language Models for Textual and Relational Retrieval
por: Xia, Yu, et al.
Publicado: (2024)
por: Xia, Yu, et al.
Publicado: (2024)
Enhancing Recommender Systems Using Textual Embeddings from Pre-trained Language Models
por: Le, Ngoc Luyen, et al.
Publicado: (2025)
por: Le, Ngoc Luyen, et al.
Publicado: (2025)
Optimizing Nepali PDF Extraction: A Comparative Study of Parser and OCR Technologies
por: Paudel, Prabin, et al.
Publicado: (2024)
por: Paudel, Prabin, et al.
Publicado: (2024)
SUMMA: A Multimodal Large Language Model for Advertisement Summarization
por: Jia, Weitao, et al.
Publicado: (2025)
por: Jia, Weitao, et al.
Publicado: (2025)
Fine-tuning Multimodal Large Language Models for Product Bundling
por: Liu, Xiaohao, et al.
Publicado: (2024)
por: Liu, Xiaohao, et al.
Publicado: (2024)
Augmenting Textual Generation via Topology Aware Retrieval
por: Wang, Yu, et al.
Publicado: (2024)
por: Wang, Yu, et al.
Publicado: (2024)
Threat Behavior Textual Search by Attention Graph Isomorphism
por: Bae, Chanwoo, et al.
Publicado: (2024)
por: Bae, Chanwoo, et al.
Publicado: (2024)
Multimodal Large Language Models with Adaptive Preference Optimization for Sequential Recommendation
por: Wang, Yu, et al.
Publicado: (2025)
por: Wang, Yu, et al.
Publicado: (2025)
Enhancing Multimodal Recommendations with Vision-Language Models and Information-Aware Fusion
por: Kieu, Hai-Dang, et al.
Publicado: (2025)
por: Kieu, Hai-Dang, et al.
Publicado: (2025)
Structural and Disentangled Adaptation of Large Vision Language Models for Multimodal Recommendation
por: Rao, Zhongtao, et al.
Publicado: (2025)
por: Rao, Zhongtao, et al.
Publicado: (2025)
Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval
por: Hu, Ruofan, et al.
Publicado: (2025)
por: Hu, Ruofan, et al.
Publicado: (2025)
Proactive Detection and Calibration of Seasonal Advertisements with Multimodal Large Language Models
por: Eghbalzadeh, Hamid, et al.
Publicado: (2024)
por: Eghbalzadeh, Hamid, et al.
Publicado: (2024)
KAP: MLLM-assisted OCR Text Enhancement for Hybrid Retrieval in Chinese Non-Narrative Documents
por: Hsu, Hsin-Ling, et al.
Publicado: (2025)
por: Hsu, Hsin-Ling, et al.
Publicado: (2025)
Diagnosing LLM-based Rerankers in Cold-Start Recommender Systems: Coverage, Exposure and Practical Mitigations
por: Lemdiasova, Ekaterina, et al.
Publicado: (2026)
por: Lemdiasova, Ekaterina, et al.
Publicado: (2026)
Hybrid Semantic Search: Unveiling User Intent Beyond Keywords
por: Ahluwalia, Aman, et al.
Publicado: (2024)
por: Ahluwalia, Aman, et al.
Publicado: (2024)
Bridging Textual-Collaborative Gap through Semantic Codes for Sequential Recommendation
por: Liu, Enze, et al.
Publicado: (2025)
por: Liu, Enze, et al.
Publicado: (2025)
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
por: Zhuang, Shengyao, et al.
Publicado: (2024)
por: Zhuang, Shengyao, et al.
Publicado: (2024)
Harnessing Multimodal Large Language Models for Multimodal Sequential Recommendation
por: Ye, Yuyang, et al.
Publicado: (2024)
por: Ye, Yuyang, et al.
Publicado: (2024)
Bridging Personalization and Control in Scientific Personalized Search
por: Mysore, Sheshera, et al.
Publicado: (2024)
por: Mysore, Sheshera, et al.
Publicado: (2024)
Text-Guided Visual Representation Learning for Robust Multimodal E-Commerce Recommendation
por: Guo, Yufei, et al.
Publicado: (2026)
por: Guo, Yufei, et al.
Publicado: (2026)
MLLMRec-R1: Incentivizing Reasoning Capability in Large Language Models for Multimodal Sequential Recommendation
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
C2T-ID: Converting Semantic Codebooks to Textual Document Identifiers for Generative Search
por: Zhang, Yingchen, et al.
Publicado: (2025)
por: Zhang, Yingchen, et al.
Publicado: (2025)
FedUTR: Federated Recommendation with Augmented Universal Textual Representation for Sparse Interaction Scenarios
por: Fu, Kang, et al.
Publicado: (2026)
por: Fu, Kang, et al.
Publicado: (2026)
LoRec: Large Language Model for Robust Sequential Recommendation against Poisoning Attacks
por: Zhang, Kaike, et al.
Publicado: (2024)
por: Zhang, Kaike, et al.
Publicado: (2024)
Task-level Distributionally Robust Optimization for Large Language Model-based Dense Retrieval
por: Ma, Guangyuan, et al.
Publicado: (2024)
por: Ma, Guangyuan, et al.
Publicado: (2024)
Hard vs. Noise: Resolving Hard-Noisy Sample Confusion in Recommender Systems via Large Language Models
por: Song, Tianrui, et al.
Publicado: (2025)
por: Song, Tianrui, et al.
Publicado: (2025)
Ranking with Ties based on Noisy Performance Data
por: Sankaran, Aravind, et al.
Publicado: (2024)
por: Sankaran, Aravind, et al.
Publicado: (2024)
MDVT: Enhancing Multimodal Recommendation with Model-Agnostic Multimodal-Driven Virtual Triplets
por: Xu, Jinfeng, et al.
Publicado: (2025)
por: Xu, Jinfeng, et al.
Publicado: (2025)
End-to-end training of Multimodal Model and ranking Model
por: Deng, Xiuqi, et al.
Publicado: (2024)
por: Deng, Xiuqi, et al.
Publicado: (2024)
Robust Multimodal Recommendation via Graph Retrieval-Enhanced Modality Completion
por: Li, Yuan, et al.
Publicado: (2026)
por: Li, Yuan, et al.
Publicado: (2026)
Ejemplares similares
-
Evaluating Structured Output Robustness of Small Language Models for Open Attribute-Value Extraction from Clinical Notes
por: Neveditsin, Nikita, et al.
Publicado: (2025) -
Clinical Insights: A Comprehensive Review of Language Models in Medicine
por: Neveditsin, Nikita, et al.
Publicado: (2024) -
From Annotation to Adaptation: Metrics, Synthetic Data, and Aspect Extraction for Aspect-Based Sentiment Analysis with Large Language Models
por: Neveditsin, Nikita, et al.
Publicado: (2025) -
Scalable Parameter-Light Spectral Method for Clustering Short Text Embeddings with a Cohesion-Based Evaluation Metric
por: Neveditsin, Nikita, et al.
Publicado: (2025) -
Multi-Stage Field Extraction of Financial Documents with OCR and Compact Vision-Language Models
por: Jin, Yichao, et al.
Publicado: (2025)