When Models Decide and When They Bind: A Two-Stage Computation for Multiple-Choice Question-Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wong, Hugh Mee, Nouwen, Rick, Gatt, Albert |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VAQUUM: Are Vague Quantifiers Grounded in Visual Data?
par: Wong, Hugh Mee, et autres
Publié: (2025)
par: Wong, Hugh Mee, et autres
Publié: (2025)
Disentangling the Roles of Representation and Selection in Data Pruning
par: Du, Yupei, et autres
Publié: (2025)
par: Du, Yupei, et autres
Publié: (2025)
Can LLMs Detect Ambiguous Plural Reference? An Analysis of Split-Antecedent and Mereological Reference
par: Anh, Dang, et autres
Publié: (2025)
par: Anh, Dang, et autres
Publié: (2025)
Differentiating Choices via Commonality for Multiple-Choice Question Answering
par: Deng, Wenqing, et autres
Publié: (2024)
par: Deng, Wenqing, et autres
Publié: (2024)
LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering
par: Sutanto, Patrick, et autres
Publié: (2024)
par: Sutanto, Patrick, et autres
Publié: (2024)
Biomedical Entity Linking as Multiple Choice Question Answering
par: Lin, Zhenxi, et autres
Publié: (2024)
par: Lin, Zhenxi, et autres
Publié: (2024)
When Choices Become Risks: Safety Failures of Large Language Models under Multiple-Choice Constraints
par: Chen, Yuheng, et autres
Publié: (2026)
par: Chen, Yuheng, et autres
Publié: (2026)
A Study on Large Language Models' Limitations in Multiple-Choice Question Answering
par: Khatun, Aisha, et autres
Publié: (2024)
par: Khatun, Aisha, et autres
Publié: (2024)
Mind the Gap: A Closer Look at Tokenization for Multiple-Choice Question Answering with LLMs
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
Multiple Choice Questions: Reasoning Makes Large Language Models (LLMs) More Self-Confident, Especially When They are Wrong
par: Fu, Tairan, et autres
Publié: (2025)
par: Fu, Tairan, et autres
Publié: (2025)
Applying Relation Extraction and Graph Matching to Answering Multiple Choice Questions
par: Shimoda, Naoki, et autres
Publié: (2025)
par: Shimoda, Naoki, et autres
Publié: (2025)
Evaluating the Symbol Binding Ability of Large Language Models for Multiple-Choice Questions in Vietnamese General Education
par: Nguyen, Duc-Vu, et autres
Publié: (2023)
par: Nguyen, Duc-Vu, et autres
Publié: (2023)
Addressing Blind Guessing: Calibration of Selection Bias in Multiple-Choice Question Answering by Video Language Models
par: Loginova, Olga, et autres
Publié: (2024)
par: Loginova, Olga, et autres
Publié: (2024)
More Bias, Less Bias: BiasPrompting for Enhanced Multiple-Choice Question Answering
par: Vu, Duc Anh, et autres
Publié: (2025)
par: Vu, Duc Anh, et autres
Publié: (2025)
Invoke Interfaces Only When Needed: Adaptive Invocation for Large Language Models in Question Answering
par: Zhao, Jihao, et autres
Publié: (2025)
par: Zhao, Jihao, et autres
Publié: (2025)
Hierarchical Vision-Language Reasoning for Multimodal Multiple-Choice Question Answering
par: Zhou, Ao, et autres
Publié: (2025)
par: Zhou, Ao, et autres
Publié: (2025)
Right Answer, Wrong Score: Uncovering the Inconsistencies of LLM Evaluation in Multiple-Choice Question Answering
par: Molfese, Francesco Maria, et autres
Publié: (2025)
par: Molfese, Francesco Maria, et autres
Publié: (2025)
Improving LLM First-Token Predictions in Multiple-Choice Question Answering via Output Prefilling
par: Cappelletti, Silvia, et autres
Publié: (2025)
par: Cappelletti, Silvia, et autres
Publié: (2025)
When Evidence Conflicts: Uncertainty and Order Effects in Retrieval-Augmented Biomedical Question Answering
par: Han, Yikun, et autres
Publié: (2026)
par: Han, Yikun, et autres
Publié: (2026)
When Cases Get Rare: A Retrieval Benchmark for Off-Guideline Clinical Question Answering
par: Lee, Doeun, et autres
Publié: (2026)
par: Lee, Doeun, et autres
Publié: (2026)
Tell Me Who Your Students Are: GPT Can Generate Valid Multiple-Choice Questions When Students' (Mis)Understanding Is Hinted
par: Shimmei, Machi, et autres
Publié: (2025)
par: Shimmei, Machi, et autres
Publié: (2025)
Synthetic Eggs in Many Baskets: The Impact of Synthetic Data Diversity on LLM Fine-Tuning
par: Schaffelder, Max, et autres
Publié: (2025)
par: Schaffelder, Max, et autres
Publié: (2025)
Can Confidence Estimates Decide When Chain-of-Thought Is Necessary for LLMs?
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
A Systematic Analysis of Large Language Models as Soft Reasoners: The Case of Syllogistic Inferences
par: Bertolazzi, Leonardo, et autres
Publié: (2024)
par: Bertolazzi, Leonardo, et autres
Publié: (2024)
Conformal P-Value in Multiple-Choice Question Answering Tasks with Provable Risk Control
par: Ye, Yuanchang
Publié: (2025)
par: Ye, Yuanchang
Publié: (2025)
Retrieval Augmented Question Answering: When Should LLMs Admit Ignorance?
par: Wang, Dingmin, et autres
Publié: (2025)
par: Wang, Dingmin, et autres
Publié: (2025)
Correctness Coverage Evaluation for Medical Multiple-Choice Question Answering Based on the Enhanced Conformal Prediction Framework
par: Ke, Yusong, et autres
Publié: (2025)
par: Ke, Yusong, et autres
Publié: (2025)
Probing Omissions and Distortions in Transformer-based RDF-to-Text Models
par: Faille, Juliette, et autres
Publié: (2024)
par: Faille, Juliette, et autres
Publié: (2024)
Small Models, Big Insights: Leveraging Slim Proxy Models To Decide When and What to Retrieve for LLMs
par: Tan, Jiejun, et autres
Publié: (2024)
par: Tan, Jiejun, et autres
Publié: (2024)
Self-DC: When to Reason and When to Act? Self Divide-and-Conquer for Compositional Unknown Questions
par: Wang, Hongru, et autres
Publié: (2024)
par: Wang, Hongru, et autres
Publié: (2024)
When Language Shapes Thought: Cross-Lingual Transfer of Factual Knowledge in Question Answering
par: Kang, Eojin, et autres
Publié: (2025)
par: Kang, Eojin, et autres
Publié: (2025)
The Role of the Availability Heuristic in Multiple-Choice Answering Behaviour
par: Zotos, Leonidas, et autres
Publié: (2026)
par: Zotos, Leonidas, et autres
Publié: (2026)
Morphological Analysis for the Maltese Language: The Challenges of a Hybrid System
par: Borg, Claudia, et autres
Publié: (2017)
par: Borg, Claudia, et autres
Publié: (2017)
Conformal Sets in Multiple-Choice Question Answering under Black-Box Settings with Provable Coverage Guarantees
par: Yang, Guang, et autres
Publié: (2025)
par: Yang, Guang, et autres
Publié: (2025)
(WhyPHI) Fine-Tuning PHI-3 for Multiple-Choice Question Answering: Methodology, Results, and Challenges
par: Abdellatif, Mohamed Hisham
Publié: (2025)
par: Abdellatif, Mohamed Hisham
Publié: (2025)
Strengthened Symbol Binding Makes Large Language Models Reliable Multiple-Choice Selectors
par: Xue, Mengge, et autres
Publié: (2024)
par: Xue, Mengge, et autres
Publié: (2024)
UBench: Benchmarking Uncertainty in Large Language Models with Multiple Choice Questions
par: Wang, Xunzhi, et autres
Publié: (2024)
par: Wang, Xunzhi, et autres
Publié: (2024)
Multiple-Choice Questions are Efficient and Robust LLM Evaluators
par: Zhang, Ziyin, et autres
Publié: (2024)
par: Zhang, Ziyin, et autres
Publié: (2024)
CV-Probes: Studying the interplay of lexical and world knowledge in visually grounded verb understanding
par: Beňová, Ivana, et autres
Publié: (2024)
par: Beňová, Ivana, et autres
Publié: (2024)
A Two-Stage Multitask Vision-Language Framework for Explainable Crop Disease Visual Question Answering
par: Hossain, Md. Zahid, et autres
Publié: (2026)
par: Hossain, Md. Zahid, et autres
Publié: (2026)
Documents similaires
-
VAQUUM: Are Vague Quantifiers Grounded in Visual Data?
par: Wong, Hugh Mee, et autres
Publié: (2025) -
Disentangling the Roles of Representation and Selection in Data Pruning
par: Du, Yupei, et autres
Publié: (2025) -
Can LLMs Detect Ambiguous Plural Reference? An Analysis of Split-Antecedent and Mereological Reference
par: Anh, Dang, et autres
Publié: (2025) -
Differentiating Choices via Commonality for Multiple-Choice Question Answering
par: Deng, Wenqing, et autres
Publié: (2024) -
LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering
par: Sutanto, Patrick, et autres
Publié: (2024)