Leveraging Large Language Models in Code Question Answering: Baselines and Issues
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Andryushchenko, Georgy, Ivanov, Vladimir, Makharev, Vladimir, Tukhtina, Elizaveta, Valeev, Aidar |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Code Summarization Beyond Function Level
von: Makharev, Vladimir, et al.
Veröffentlicht: (2025)
von: Makharev, Vladimir, et al.
Veröffentlicht: (2025)
YABLoCo: Yet Another Benchmark for Long Context Code Generation
von: Valeev, Aidar, et al.
Veröffentlicht: (2025)
von: Valeev, Aidar, et al.
Veröffentlicht: (2025)
SWE-MERA: A Dynamic Benchmark for Agenticly Evaluating Large Language Models on Software Engineering Tasks
von: Adamenko, Pavel, et al.
Veröffentlicht: (2025)
von: Adamenko, Pavel, et al.
Veröffentlicht: (2025)
RuCCoD: Towards Automated ICD Coding in Russian
von: Nesterov, Aleksandr, et al.
Veröffentlicht: (2025)
von: Nesterov, Aleksandr, et al.
Veröffentlicht: (2025)
Uncertainty Estimation of Large Language Models in Medical Question Answering
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
Multilingual Medical Reasoning for Question Answering with Large Language Models
von: Ferrazzi, Pietro, et al.
Veröffentlicht: (2025)
von: Ferrazzi, Pietro, et al.
Veröffentlicht: (2025)
Cost-efficient Knowledge-based Question Answering with Large Language Models
von: Dong, Junnan, et al.
Veröffentlicht: (2024)
von: Dong, Junnan, et al.
Veröffentlicht: (2024)
Collaboration among Multiple Large Language Models for Medical Question Answering
von: Shang, Kexin, et al.
Veröffentlicht: (2025)
von: Shang, Kexin, et al.
Veröffentlicht: (2025)
On the Temporal Question-Answering Capabilities of Large Language Models Over Anonymized Data
von: Ruiz, Alfredo Garrachón, et al.
Veröffentlicht: (2025)
von: Ruiz, Alfredo Garrachón, et al.
Veröffentlicht: (2025)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
von: Yao, Jui-Ming, et al.
Veröffentlicht: (2025)
von: Yao, Jui-Ming, et al.
Veröffentlicht: (2025)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
von: Wei, Mingyang, et al.
Veröffentlicht: (2026)
von: Wei, Mingyang, et al.
Veröffentlicht: (2026)
Evaluating the Meta- and Object-Level Reasoning of Large Language Models for Question Answering
von: Ferguson, Nick, et al.
Veröffentlicht: (2025)
von: Ferguson, Nick, et al.
Veröffentlicht: (2025)
A Survey of Large Language Model Agents for Question Answering
von: Yue, Murong
Veröffentlicht: (2025)
von: Yue, Murong
Veröffentlicht: (2025)
Can Language Models Analyze Data? Evaluating Large Language Models for Question Answering over Datasets
von: Xenofontos, Andreas, et al.
Veröffentlicht: (2026)
von: Xenofontos, Andreas, et al.
Veröffentlicht: (2026)
MERA Code: A Unified Framework for Evaluating Code Generation Across Tasks
von: Chervyakov, Artem, et al.
Veröffentlicht: (2025)
von: Chervyakov, Artem, et al.
Veröffentlicht: (2025)
Declarative Knowledge Distillation from Large Language Models for Visual Question Answering Datasets
von: Eiter, Thomas, et al.
Veröffentlicht: (2024)
von: Eiter, Thomas, et al.
Veröffentlicht: (2024)
Multi-Agents Based on Large Language Models for Knowledge-based Visual Question Answering
von: Hu, Zhongjian, et al.
Veröffentlicht: (2024)
von: Hu, Zhongjian, et al.
Veröffentlicht: (2024)
Enhancing Healthcare through Large Language Models: A Study on Medical Question Answering
von: Yu, Haoran, et al.
Veröffentlicht: (2024)
von: Yu, Haoran, et al.
Veröffentlicht: (2024)
Reliable Academic Conference Question Answering: A Study Based on Large Language Model
von: Huang, Zhiwei, et al.
Veröffentlicht: (2023)
von: Huang, Zhiwei, et al.
Veröffentlicht: (2023)
Bactrainus: Optimizing Large Language Models for Multi-hop Complex Question Answering Tasks
von: Barati, Iman, et al.
Veröffentlicht: (2025)
von: Barati, Iman, et al.
Veröffentlicht: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
von: Ding, Jing, et al.
Veröffentlicht: (2025)
von: Ding, Jing, et al.
Veröffentlicht: (2025)
Towards Building a Robust Knowledge Intensive Question Answering Model with Large Language Models
von: Hong, Xingyun, et al.
Veröffentlicht: (2024)
von: Hong, Xingyun, et al.
Veröffentlicht: (2024)
PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
von: Jamali, Naghmeh, et al.
Veröffentlicht: (2025)
von: Jamali, Naghmeh, et al.
Veröffentlicht: (2025)
A Perspective on Large Language Models, Intelligent Machines, and Knowledge Acquisition
von: Cherkassky, Vladimir, et al.
Veröffentlicht: (2024)
von: Cherkassky, Vladimir, et al.
Veröffentlicht: (2024)
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering
von: Sui, Yuan, et al.
Veröffentlicht: (2024)
von: Sui, Yuan, et al.
Veröffentlicht: (2024)
Scholarly Question Answering using Large Language Models in the NFDI4DataScience Gateway
von: Giglou, Hamed Babaei, et al.
Veröffentlicht: (2024)
von: Giglou, Hamed Babaei, et al.
Veröffentlicht: (2024)
Enhancing Large Language Models with Pseudo- and Multisource- Knowledge Graphs for Open-ended Question Answering
von: Liu, Jiaxiang, et al.
Veröffentlicht: (2024)
von: Liu, Jiaxiang, et al.
Veröffentlicht: (2024)
UniOQA: A Unified Framework for Knowledge Graph Question Answering with Large Language Models
von: Li, Zhuoyang, et al.
Veröffentlicht: (2024)
von: Li, Zhuoyang, et al.
Veröffentlicht: (2024)
Perception of Knowledge Boundary for Large Language Models through Semi-open-ended Question Answering
von: Wen, Zhihua, et al.
Veröffentlicht: (2024)
von: Wen, Zhihua, et al.
Veröffentlicht: (2024)
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
von: Chen, Zixin, et al.
Veröffentlicht: (2025)
von: Chen, Zixin, et al.
Veröffentlicht: (2025)
RTQA : Recursive Thinking for Complex Temporal Knowledge Graph Question Answering with Large Language Models
von: Gong, Zhaoyan, et al.
Veröffentlicht: (2025)
von: Gong, Zhaoyan, et al.
Veröffentlicht: (2025)
Enhancing Large Language Models with Reward-guided Tree Search for Knowledge Graph Question and Answering
von: Long, Xiao, et al.
Veröffentlicht: (2025)
von: Long, Xiao, et al.
Veröffentlicht: (2025)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
von: Mastrokostas, Charalampos, et al.
Veröffentlicht: (2026)
von: Mastrokostas, Charalampos, et al.
Veröffentlicht: (2026)
THELMA: Task Based Holistic Evaluation of Large Language Model Applications-RAG Question Answering
von: Patel, Udita, et al.
Veröffentlicht: (2025)
von: Patel, Udita, et al.
Veröffentlicht: (2025)
Dynamic Strategy Planning for Efficient Question Answering with Large Language Models
von: Parekh, Tanmay, et al.
Veröffentlicht: (2024)
von: Parekh, Tanmay, et al.
Veröffentlicht: (2024)
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
von: Cabello, Laura, et al.
Veröffentlicht: (2024)
von: Cabello, Laura, et al.
Veröffentlicht: (2024)
Evaluating Multimodal Large Language Models on Educational Textbook Question Answering
von: Alawwad, Hessa A., et al.
Veröffentlicht: (2025)
von: Alawwad, Hessa A., et al.
Veröffentlicht: (2025)
Mitigating Knowledge Conflicts in Language Model-Driven Question Answering
von: Cao, Han, et al.
Veröffentlicht: (2024)
von: Cao, Han, et al.
Veröffentlicht: (2024)
Code-Style In-Context Learning for Knowledge-Based Question Answering
von: Nie, Zhijie, et al.
Veröffentlicht: (2023)
von: Nie, Zhijie, et al.
Veröffentlicht: (2023)
Extracting and Encoding: Leveraging Large Language Models and Medical Knowledge to Enhance Radiological Text Representation
von: Messina, Pablo, et al.
Veröffentlicht: (2024)
von: Messina, Pablo, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Code Summarization Beyond Function Level
von: Makharev, Vladimir, et al.
Veröffentlicht: (2025) -
YABLoCo: Yet Another Benchmark for Long Context Code Generation
von: Valeev, Aidar, et al.
Veröffentlicht: (2025) -
SWE-MERA: A Dynamic Benchmark for Agenticly Evaluating Large Language Models on Software Engineering Tasks
von: Adamenko, Pavel, et al.
Veröffentlicht: (2025) -
RuCCoD: Towards Automated ICD Coding in Russian
von: Nesterov, Aleksandr, et al.
Veröffentlicht: (2025) -
Uncertainty Estimation of Large Language Models in Medical Question Answering
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)