Clinical QA 2.0: Multi-Task Learning for Answer Extraction and Categorization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pattnayak, Priyaranjan, Patel, Hitesh Laxmichand, Agarwal, Amit, Kumar, Bhargava, Panda, Srikant, Kumar, Tejaswini |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Document AI Data Generation Through Graph-Based Synthetic Layouts
par: Agarwal, Amit, et autres
Publié: (2024)
par: Agarwal, Amit, et autres
Publié: (2024)
Survey of Large Multimodal Model Datasets, Application Categories and Taxonomy
par: Pattnayak, Priyaranjan, et autres
Publié: (2024)
par: Pattnayak, Priyaranjan, et autres
Publié: (2024)
Tokenization Matters: Improving Zero-Shot NER for Indic Languages
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
LLM for Barcodes: Generating Diverse Synthetic Data for Identity Documents
par: Patel, Hitesh Laxmichand, et autres
Publié: (2024)
par: Patel, Hitesh Laxmichand, et autres
Publié: (2024)
Hybrid AI for Responsive Multi-Turn Online Conversations with Novel Dynamic Routing and Feedback Adaptation
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
Hard Negative Mining for Domain-Specific Retrieval in Enterprise Systems
par: Meghwani, Hansa, et autres
Publié: (2025)
par: Meghwani, Hansa, et autres
Publié: (2025)
SweEval: Do LLMs Really Swear? A Safety Benchmark for Testing Limits for Enterprise Use
par: Patel, Hitesh Laxmichand, et autres
Publié: (2025)
par: Patel, Hitesh Laxmichand, et autres
Publié: (2025)
AccessEval: Benchmarking Disability Bias in Large Language Models
par: Panda, Srikant, et autres
Publié: (2025)
par: Panda, Srikant, et autres
Publié: (2025)
LLM-Guided Lifecycle-Aware Clustering of Multi-Turn Customer Support Conversations
par: Pattnayak, Priyaranjan, et autres
Publié: (2026)
par: Pattnayak, Priyaranjan, et autres
Publié: (2026)
Who's Asking? Investigating Bias Through the Lens of Disability Framed Queries in LLMs
par: Hari, Vishnu, et autres
Publié: (2025)
par: Hari, Vishnu, et autres
Publié: (2025)
DAIQ: Auditing Demographic Attribute Inference from Question in LLMs
par: Panda, Srikant, et autres
Publié: (2025)
par: Panda, Srikant, et autres
Publié: (2025)
IndicJR: A Judge-Free Benchmark of Jailbreak Robustness in South Asian Languages
par: Pattnayak, Priyaranjan, et autres
Publié: (2026)
par: Pattnayak, Priyaranjan, et autres
Publié: (2026)
IndicSafe: A Benchmark for Evaluating Multilingual LLM Safety in South Asia
par: Pattnayak, Priyaranjan, et autres
Publié: (2026)
par: Pattnayak, Priyaranjan, et autres
Publié: (2026)
SN-WER: Script-Normalized WER for Multi-Script Indic ASR Evaluation
par: Pattnayak, Priyaranjan
Publié: (2026)
par: Pattnayak, Priyaranjan
Publié: (2026)
MVTamperBench: Evaluating Robustness of Vision-Language Models
par: Agarwal, Amit, et autres
Publié: (2024)
par: Agarwal, Amit, et autres
Publié: (2024)
Say It Differently: Linguistic Styles as Jailbreak Vectors
par: Panda, Srikant, et autres
Publié: (2025)
par: Panda, Srikant, et autres
Publié: (2025)
PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications
par: Patel, Hitesh Laxmichand, et autres
Publié: (2025)
par: Patel, Hitesh Laxmichand, et autres
Publié: (2025)
FS-DAG: Few Shot Domain Adapting Graph Networks for Visually Rich Document Understanding
par: Agarwal, Amit, et autres
Publié: (2025)
par: Agarwal, Amit, et autres
Publié: (2025)
SPENCE: A Syntactic Probe for Detecting Contamination in NL2SQL Benchmarks
par: Safarzadeh, Mohammadtaher, et autres
Publié: (2026)
par: Safarzadeh, Mohammadtaher, et autres
Publié: (2026)
RCI: A Score for Evaluating Global and Local Reasoning in Multimodal Benchmarks
par: Agarwal, Amit, et autres
Publié: (2025)
par: Agarwal, Amit, et autres
Publié: (2025)
Aligning LLMs for Multilingual Consistency in Enterprise Applications
par: Agarwal, Amit, et autres
Publié: (2025)
par: Agarwal, Amit, et autres
Publié: (2025)
Think Twice Before You Write -- an Entropy-based Decoding Strategy to Enhance LLM Reasoning
par: He, Jiashu, et autres
Publié: (2026)
par: He, Jiashu, et autres
Publié: (2026)
SpeechWeave: Diverse Multilingual Synthetic Text & Audio Data Generation Pipeline for Training Text to Speech Models
par: Dua, Karan, et autres
Publié: (2025)
par: Dua, Karan, et autres
Publié: (2025)
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
par: Kim, Eunsu, et autres
Publié: (2025)
par: Kim, Eunsu, et autres
Publié: (2025)
GSM-SEM: Benchmark and Framework for Generating Semantically Variant Augmentations
par: Singh, Jyotika, et autres
Publié: (2026)
par: Singh, Jyotika, et autres
Publié: (2026)
ExpertQA: Expert-Curated Questions and Attributed Answers
par: Malaviya, Chaitanya, et autres
Publié: (2023)
par: Malaviya, Chaitanya, et autres
Publié: (2023)
FlexDoc: Parameterized Sampling for Diverse Multilingual Synthetic Documents for Training Document Understanding Models
par: Dua, Karan, et autres
Publié: (2025)
par: Dua, Karan, et autres
Publié: (2025)
NLP at UC Santa Cruz at SemEval-2024 Task 5: Legal Answer Validation using Few-Shot Multi-Choice QA
par: Pahilajani, Anish, et autres
Publié: (2024)
par: Pahilajani, Anish, et autres
Publié: (2024)
Code-Based English Models Surprising Performance on Chinese QA Pair Extraction Task
par: Zheng, Linghan, et autres
Publié: (2024)
par: Zheng, Linghan, et autres
Publié: (2024)
DEEPAMBIGQA: Ambiguous Multi-hop Questions for Benchmarking LLM Answer Completeness
par: Ji, Jiabao, et autres
Publié: (2025)
par: Ji, Jiabao, et autres
Publié: (2025)
Multi-LLM QA with Embodied Exploration
par: Patel, Bhrij, et autres
Publié: (2024)
par: Patel, Bhrij, et autres
Publié: (2024)
FairytaleQA Translated: Enabling Educational Question and Answer Generation in Less-Resourced Languages
par: Leite, Bernardo, et autres
Publié: (2024)
par: Leite, Bernardo, et autres
Publié: (2024)
Directed Graph-alignment Approach for Identification of Gaps in Short Answers
par: Sahu, Archana, et autres
Publié: (2025)
par: Sahu, Archana, et autres
Publié: (2025)
Composable NLP Workflows for BERT-based Ranking and QA System
par: Kumar, Gaurav, et autres
Publié: (2025)
par: Kumar, Gaurav, et autres
Publié: (2025)
Schema on the Inside: A Two-Phase Fine-Tuning Method for High-Efficiency Text-to-SQL at Scale
par: Soni, Chinmay, et autres
Publié: (2026)
par: Soni, Chinmay, et autres
Publié: (2026)
A Pluggable Multi-Task Learning Framework for Sentiment-Aware Financial Relation Extraction
par: Luo, Jinming, et autres
Publié: (2025)
par: Luo, Jinming, et autres
Publié: (2025)
CQA-Eval: Designing Reliable Evaluations of Multi-paragraph Clinical QA under Resource Constraints
par: Bologna, Federica, et autres
Publié: (2025)
par: Bologna, Federica, et autres
Publié: (2025)
SuRe: Summarizing Retrievals using Answer Candidates for Open-domain QA of LLMs
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
Event Extraction for Portuguese: A QA-driven Approach using ACE-2005
par: Cunha, Luís Filipe, et autres
Publié: (2024)
par: Cunha, Luís Filipe, et autres
Publié: (2024)
A Multi-Task, Multi-Modal Approach for Predicting Categorical and Dimensional Emotions
par: Ispas, Alex-Răzvan, et autres
Publié: (2023)
par: Ispas, Alex-Răzvan, et autres
Publié: (2023)
Documents similaires
-
Enhancing Document AI Data Generation Through Graph-Based Synthetic Layouts
par: Agarwal, Amit, et autres
Publié: (2024) -
Survey of Large Multimodal Model Datasets, Application Categories and Taxonomy
par: Pattnayak, Priyaranjan, et autres
Publié: (2024) -
Tokenization Matters: Improving Zero-Shot NER for Indic Languages
par: Pattnayak, Priyaranjan, et autres
Publié: (2025) -
LLM for Barcodes: Generating Diverse Synthetic Data for Identity Documents
par: Patel, Hitesh Laxmichand, et autres
Publié: (2024) -
Hybrid AI for Responsive Multi-Turn Online Conversations with Novel Dynamic Routing and Feedback Adaptation
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)