Clinical QA 2.0: Multi-Task Learning for Answer Extraction and Categorization
Fuente:
arXiv
Guardado en:
| Autores principales: | Pattnayak, Priyaranjan, Patel, Hitesh Laxmichand, Agarwal, Amit, Kumar, Bhargava, Panda, Srikant, Kumar, Tejaswini |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Enhancing Document AI Data Generation Through Graph-Based Synthetic Layouts
por: Agarwal, Amit, et al.
Publicado: (2024)
por: Agarwal, Amit, et al.
Publicado: (2024)
Survey of Large Multimodal Model Datasets, Application Categories and Taxonomy
por: Pattnayak, Priyaranjan, et al.
Publicado: (2024)
por: Pattnayak, Priyaranjan, et al.
Publicado: (2024)
Tokenization Matters: Improving Zero-Shot NER for Indic Languages
por: Pattnayak, Priyaranjan, et al.
Publicado: (2025)
por: Pattnayak, Priyaranjan, et al.
Publicado: (2025)
LLM for Barcodes: Generating Diverse Synthetic Data for Identity Documents
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2024)
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2024)
Hybrid AI for Responsive Multi-Turn Online Conversations with Novel Dynamic Routing and Feedback Adaptation
por: Pattnayak, Priyaranjan, et al.
Publicado: (2025)
por: Pattnayak, Priyaranjan, et al.
Publicado: (2025)
Hard Negative Mining for Domain-Specific Retrieval in Enterprise Systems
por: Meghwani, Hansa, et al.
Publicado: (2025)
por: Meghwani, Hansa, et al.
Publicado: (2025)
SweEval: Do LLMs Really Swear? A Safety Benchmark for Testing Limits for Enterprise Use
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2025)
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2025)
AccessEval: Benchmarking Disability Bias in Large Language Models
por: Panda, Srikant, et al.
Publicado: (2025)
por: Panda, Srikant, et al.
Publicado: (2025)
LLM-Guided Lifecycle-Aware Clustering of Multi-Turn Customer Support Conversations
por: Pattnayak, Priyaranjan, et al.
Publicado: (2026)
por: Pattnayak, Priyaranjan, et al.
Publicado: (2026)
Who's Asking? Investigating Bias Through the Lens of Disability Framed Queries in LLMs
por: Hari, Vishnu, et al.
Publicado: (2025)
por: Hari, Vishnu, et al.
Publicado: (2025)
DAIQ: Auditing Demographic Attribute Inference from Question in LLMs
por: Panda, Srikant, et al.
Publicado: (2025)
por: Panda, Srikant, et al.
Publicado: (2025)
IndicJR: A Judge-Free Benchmark of Jailbreak Robustness in South Asian Languages
por: Pattnayak, Priyaranjan, et al.
Publicado: (2026)
por: Pattnayak, Priyaranjan, et al.
Publicado: (2026)
IndicSafe: A Benchmark for Evaluating Multilingual LLM Safety in South Asia
por: Pattnayak, Priyaranjan, et al.
Publicado: (2026)
por: Pattnayak, Priyaranjan, et al.
Publicado: (2026)
SN-WER: Script-Normalized WER for Multi-Script Indic ASR Evaluation
por: Pattnayak, Priyaranjan
Publicado: (2026)
por: Pattnayak, Priyaranjan
Publicado: (2026)
MVTamperBench: Evaluating Robustness of Vision-Language Models
por: Agarwal, Amit, et al.
Publicado: (2024)
por: Agarwal, Amit, et al.
Publicado: (2024)
Say It Differently: Linguistic Styles as Jailbreak Vectors
por: Panda, Srikant, et al.
Publicado: (2025)
por: Panda, Srikant, et al.
Publicado: (2025)
PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2025)
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2025)
FS-DAG: Few Shot Domain Adapting Graph Networks for Visually Rich Document Understanding
por: Agarwal, Amit, et al.
Publicado: (2025)
por: Agarwal, Amit, et al.
Publicado: (2025)
SPENCE: A Syntactic Probe for Detecting Contamination in NL2SQL Benchmarks
por: Safarzadeh, Mohammadtaher, et al.
Publicado: (2026)
por: Safarzadeh, Mohammadtaher, et al.
Publicado: (2026)
RCI: A Score for Evaluating Global and Local Reasoning in Multimodal Benchmarks
por: Agarwal, Amit, et al.
Publicado: (2025)
por: Agarwal, Amit, et al.
Publicado: (2025)
Aligning LLMs for Multilingual Consistency in Enterprise Applications
por: Agarwal, Amit, et al.
Publicado: (2025)
por: Agarwal, Amit, et al.
Publicado: (2025)
Think Twice Before You Write -- an Entropy-based Decoding Strategy to Enhance LLM Reasoning
por: He, Jiashu, et al.
Publicado: (2026)
por: He, Jiashu, et al.
Publicado: (2026)
SpeechWeave: Diverse Multilingual Synthetic Text & Audio Data Generation Pipeline for Training Text to Speech Models
por: Dua, Karan, et al.
Publicado: (2025)
por: Dua, Karan, et al.
Publicado: (2025)
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
por: Kim, Eunsu, et al.
Publicado: (2025)
por: Kim, Eunsu, et al.
Publicado: (2025)
GSM-SEM: Benchmark and Framework for Generating Semantically Variant Augmentations
por: Singh, Jyotika, et al.
Publicado: (2026)
por: Singh, Jyotika, et al.
Publicado: (2026)
ExpertQA: Expert-Curated Questions and Attributed Answers
por: Malaviya, Chaitanya, et al.
Publicado: (2023)
por: Malaviya, Chaitanya, et al.
Publicado: (2023)
FlexDoc: Parameterized Sampling for Diverse Multilingual Synthetic Documents for Training Document Understanding Models
por: Dua, Karan, et al.
Publicado: (2025)
por: Dua, Karan, et al.
Publicado: (2025)
NLP at UC Santa Cruz at SemEval-2024 Task 5: Legal Answer Validation using Few-Shot Multi-Choice QA
por: Pahilajani, Anish, et al.
Publicado: (2024)
por: Pahilajani, Anish, et al.
Publicado: (2024)
Code-Based English Models Surprising Performance on Chinese QA Pair Extraction Task
por: Zheng, Linghan, et al.
Publicado: (2024)
por: Zheng, Linghan, et al.
Publicado: (2024)
DEEPAMBIGQA: Ambiguous Multi-hop Questions for Benchmarking LLM Answer Completeness
por: Ji, Jiabao, et al.
Publicado: (2025)
por: Ji, Jiabao, et al.
Publicado: (2025)
Multi-LLM QA with Embodied Exploration
por: Patel, Bhrij, et al.
Publicado: (2024)
por: Patel, Bhrij, et al.
Publicado: (2024)
FairytaleQA Translated: Enabling Educational Question and Answer Generation in Less-Resourced Languages
por: Leite, Bernardo, et al.
Publicado: (2024)
por: Leite, Bernardo, et al.
Publicado: (2024)
Directed Graph-alignment Approach for Identification of Gaps in Short Answers
por: Sahu, Archana, et al.
Publicado: (2025)
por: Sahu, Archana, et al.
Publicado: (2025)
Composable NLP Workflows for BERT-based Ranking and QA System
por: Kumar, Gaurav, et al.
Publicado: (2025)
por: Kumar, Gaurav, et al.
Publicado: (2025)
Schema on the Inside: A Two-Phase Fine-Tuning Method for High-Efficiency Text-to-SQL at Scale
por: Soni, Chinmay, et al.
Publicado: (2026)
por: Soni, Chinmay, et al.
Publicado: (2026)
A Pluggable Multi-Task Learning Framework for Sentiment-Aware Financial Relation Extraction
por: Luo, Jinming, et al.
Publicado: (2025)
por: Luo, Jinming, et al.
Publicado: (2025)
CQA-Eval: Designing Reliable Evaluations of Multi-paragraph Clinical QA under Resource Constraints
por: Bologna, Federica, et al.
Publicado: (2025)
por: Bologna, Federica, et al.
Publicado: (2025)
SuRe: Summarizing Retrievals using Answer Candidates for Open-domain QA of LLMs
por: Kim, Jaehyung, et al.
Publicado: (2024)
por: Kim, Jaehyung, et al.
Publicado: (2024)
Event Extraction for Portuguese: A QA-driven Approach using ACE-2005
por: Cunha, Luís Filipe, et al.
Publicado: (2024)
por: Cunha, Luís Filipe, et al.
Publicado: (2024)
A Multi-Task, Multi-Modal Approach for Predicting Categorical and Dimensional Emotions
por: Ispas, Alex-Răzvan, et al.
Publicado: (2023)
por: Ispas, Alex-Răzvan, et al.
Publicado: (2023)
Ejemplares similares
-
Enhancing Document AI Data Generation Through Graph-Based Synthetic Layouts
por: Agarwal, Amit, et al.
Publicado: (2024) -
Survey of Large Multimodal Model Datasets, Application Categories and Taxonomy
por: Pattnayak, Priyaranjan, et al.
Publicado: (2024) -
Tokenization Matters: Improving Zero-Shot NER for Indic Languages
por: Pattnayak, Priyaranjan, et al.
Publicado: (2025) -
LLM for Barcodes: Generating Diverse Synthetic Data for Identity Documents
por: Patel, Hitesh Laxmichand, et al.
Publicado: (2024) -
Hybrid AI for Responsive Multi-Turn Online Conversations with Novel Dynamic Routing and Feedback Adaptation
por: Pattnayak, Priyaranjan, et al.
Publicado: (2025)