Continually Self-Improving Language Models for Bariatric Surgery Question--Answering
Fuente:
arXiv
Guardado en:
| Autores principales: | Atri, Yash Kumar, Shin, Thomas H, Hartvigsen, Thomas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Model Editing with Graph-Based External Memory
por: Atri, Yash Kumar, et al.
Publicado: (2025)
por: Atri, Yash Kumar, et al.
Publicado: (2025)
Evaluating Temporal Consistency in Multi-Turn Language Models
por: Atri, Yash Kumar, et al.
Publicado: (2026)
por: Atri, Yash Kumar, et al.
Publicado: (2026)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
por: Chen, Hanjie, et al.
Publicado: (2024)
por: Chen, Hanjie, et al.
Publicado: (2024)
TAXI: Evaluating Categorical Knowledge Editing for Language Models
por: Powell, Derek, et al.
Publicado: (2024)
por: Powell, Derek, et al.
Publicado: (2024)
Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?
por: Seah, Natalie, et al.
Publicado: (2026)
por: Seah, Natalie, et al.
Publicado: (2026)
Fusion of Domain-Adapted Vision and Language Models for Medical Visual Question Answering
por: Ha, Cuong Nhat, et al.
Publicado: (2024)
por: Ha, Cuong Nhat, et al.
Publicado: (2024)
PolygloToxicityPrompts: Multilingual Evaluation of Neural Toxic Degeneration in Large Language Models
por: Jain, Devansh, et al.
Publicado: (2024)
por: Jain, Devansh, et al.
Publicado: (2024)
Fine-tuning Large Language Models for Improving Factuality in Legal Question Answering
por: Hu, Yinghao, et al.
Publicado: (2025)
por: Hu, Yinghao, et al.
Publicado: (2025)
QA-prompting: Improving Summarization with Large Language Models using Question-Answering
por: Sinha, Neelabh
Publicado: (2025)
por: Sinha, Neelabh
Publicado: (2025)
Pretraining Vision-Language Model for Difference Visual Question Answering in Longitudinal Chest X-rays
por: Cho, Yeongjae, et al.
Publicado: (2024)
por: Cho, Yeongjae, et al.
Publicado: (2024)
Generalizing Visual Question Answering from Synthetic to Human-Written Questions via a Chain of QA with a Large Language Model
por: Kim, Taehee, et al.
Publicado: (2024)
por: Kim, Taehee, et al.
Publicado: (2024)
CALM: Unleashing the Cross-Lingual Self-Aligning Ability of Language Model Question Answering
por: Wang, Yumeng, et al.
Publicado: (2025)
por: Wang, Yumeng, et al.
Publicado: (2025)
Empowering Large Language Model for Continual Video Question Answering with Collaborative Prompting
por: Cai, Chen, et al.
Publicado: (2024)
por: Cai, Chen, et al.
Publicado: (2024)
Can Large Language Models Self-Correct in Medical Question Answering? An Exploratory Study
por: Zhan, Zaifu, et al.
Publicado: (2026)
por: Zhan, Zaifu, et al.
Publicado: (2026)
Declarative Knowledge Distillation from Large Language Models for Visual Question Answering Datasets
por: Eiter, Thomas, et al.
Publicado: (2024)
por: Eiter, Thomas, et al.
Publicado: (2024)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
por: Yao, Jui-Ming, et al.
Publicado: (2025)
por: Yao, Jui-Ming, et al.
Publicado: (2025)
Continual Learning for Temporal-Sensitive Question Answering
por: Yang, Wanqi, et al.
Publicado: (2024)
por: Yang, Wanqi, et al.
Publicado: (2024)
Improving TCM Question Answering through Tree-Organized Self-Reflective Retrieval with LLMs
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
Wait, but Tylenol is Acetaminophen... Investigating and Improving Language Models' Ability to Resist Requests for Misinformation
por: Chen, Shan, et al.
Publicado: (2024)
por: Chen, Shan, et al.
Publicado: (2024)
Math Neurosurgery: Isolating Language Models' Math Reasoning Abilities Using Only Forward Passes
por: Christ, Bryan R., et al.
Publicado: (2024)
por: Christ, Bryan R., et al.
Publicado: (2024)
Bridging Language Gaps with Adaptive RAG: Improving Indonesian Language Question Answering
por: Christian, William, et al.
Publicado: (2025)
por: Christian, William, et al.
Publicado: (2025)
Zero-Shot Multi-Hop Question Answering via Monte-Carlo Tree Search with Large Language Models
por: Lee, Seongmin, et al.
Publicado: (2024)
por: Lee, Seongmin, et al.
Publicado: (2024)
Identifying Implicit Social Biases in Vision-Language Models
por: Hamidieh, Kimia, et al.
Publicado: (2024)
por: Hamidieh, Kimia, et al.
Publicado: (2024)
Question: How do Large Language Models perform on the Question Answering tasks? Answer:
por: Fischer, Kevin, et al.
Publicado: (2024)
por: Fischer, Kevin, et al.
Publicado: (2024)
p2-TQA: A Process-based Preference Learning Framework for Self-Improving Table Question Answering Models
por: Zhou, Wei, et al.
Publicado: (2025)
por: Zhou, Wei, et al.
Publicado: (2025)
MATHWELL: Generating Educational Math Word Problems Using Teacher Annotations
por: Christ, Bryan R, et al.
Publicado: (2024)
por: Christ, Bryan R, et al.
Publicado: (2024)
PolyGuard: A Multilingual Safety Moderation Tool for 17 Languages
por: Kumar, Priyanshu, et al.
Publicado: (2025)
por: Kumar, Priyanshu, et al.
Publicado: (2025)
Evaluating Open-Source Large Language Models for Technical Telecom Question Answering
por: Caraus, Arina, et al.
Publicado: (2025)
por: Caraus, Arina, et al.
Publicado: (2025)
Context Convergence Improves Answering Inferential Questions
por: Mozafari, Jamshid, et al.
Publicado: (2026)
por: Mozafari, Jamshid, et al.
Publicado: (2026)
BQA: Body Language Question Answering Dataset for Video Large Language Models
por: Ozaki, Shintaro, et al.
Publicado: (2024)
por: Ozaki, Shintaro, et al.
Publicado: (2024)
Calibrated Large Language Models for Binary Question Answering
por: Giovannotti, Patrizio, et al.
Publicado: (2024)
por: Giovannotti, Patrizio, et al.
Publicado: (2024)
Evaluating Large Language Models for Evidence-Based Clinical Question Answering
por: Wang, Can, et al.
Publicado: (2025)
por: Wang, Can, et al.
Publicado: (2025)
Performance of Large Language Models in Answering Critical Care Medicine Questions
por: Alwakeel, Mahmoud, et al.
Publicado: (2025)
por: Alwakeel, Mahmoud, et al.
Publicado: (2025)
Peering into the Mind of Language Models: An Approach for Attribution in Contextual Question Answering
por: Phukan, Anirudh, et al.
Publicado: (2024)
por: Phukan, Anirudh, et al.
Publicado: (2024)
HalluScore: Large Language Model Hallucination Question Answering Benchmark
por: Alansari, Aisha, et al.
Publicado: (2026)
por: Alansari, Aisha, et al.
Publicado: (2026)
PAT-Questions: A Self-Updating Benchmark for Present-Anchored Temporal Question-Answering
por: Meem, Jannat Ara, et al.
Publicado: (2024)
por: Meem, Jannat Ara, et al.
Publicado: (2024)
Compute Where it Counts: Self Optimizing Language Models
por: Akhauri, Yash, et al.
Publicado: (2026)
por: Akhauri, Yash, et al.
Publicado: (2026)
Self-Improvement Programming for Temporal Knowledge Graph Question Answering
por: Chen, Zhuo, et al.
Publicado: (2024)
por: Chen, Zhuo, et al.
Publicado: (2024)
Question Calibration and Multi-Hop Modeling for Temporal Question Answering
por: Xue, Chao, et al.
Publicado: (2024)
por: Xue, Chao, et al.
Publicado: (2024)
UTSA-NLP at ArchEHR-QA 2025: Improving EHR Question Answering via Self-Consistency Prompting
por: Shields-Menard, Sara, et al.
Publicado: (2025)
por: Shields-Menard, Sara, et al.
Publicado: (2025)
Ejemplares similares
-
Model Editing with Graph-Based External Memory
por: Atri, Yash Kumar, et al.
Publicado: (2025) -
Evaluating Temporal Consistency in Multi-Turn Language Models
por: Atri, Yash Kumar, et al.
Publicado: (2026) -
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
por: Chen, Hanjie, et al.
Publicado: (2024) -
TAXI: Evaluating Categorical Knowledge Editing for Language Models
por: Powell, Derek, et al.
Publicado: (2024) -
Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?
por: Seah, Natalie, et al.
Publicado: (2026)