Leveraging Large Language Models in Code Question Answering: Baselines and Issues
Fuente:
arXiv
Guardado en:
| Autores principales: | Andryushchenko, Georgy, Ivanov, Vladimir, Makharev, Vladimir, Tukhtina, Elizaveta, Valeev, Aidar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Code Summarization Beyond Function Level
por: Makharev, Vladimir, et al.
Publicado: (2025)
por: Makharev, Vladimir, et al.
Publicado: (2025)
YABLoCo: Yet Another Benchmark for Long Context Code Generation
por: Valeev, Aidar, et al.
Publicado: (2025)
por: Valeev, Aidar, et al.
Publicado: (2025)
SWE-MERA: A Dynamic Benchmark for Agenticly Evaluating Large Language Models on Software Engineering Tasks
por: Adamenko, Pavel, et al.
Publicado: (2025)
por: Adamenko, Pavel, et al.
Publicado: (2025)
RuCCoD: Towards Automated ICD Coding in Russian
por: Nesterov, Aleksandr, et al.
Publicado: (2025)
por: Nesterov, Aleksandr, et al.
Publicado: (2025)
Uncertainty Estimation of Large Language Models in Medical Question Answering
por: Wu, Jiaxin, et al.
Publicado: (2024)
por: Wu, Jiaxin, et al.
Publicado: (2024)
Multilingual Medical Reasoning for Question Answering with Large Language Models
por: Ferrazzi, Pietro, et al.
Publicado: (2025)
por: Ferrazzi, Pietro, et al.
Publicado: (2025)
Cost-efficient Knowledge-based Question Answering with Large Language Models
por: Dong, Junnan, et al.
Publicado: (2024)
por: Dong, Junnan, et al.
Publicado: (2024)
Collaboration among Multiple Large Language Models for Medical Question Answering
por: Shang, Kexin, et al.
Publicado: (2025)
por: Shang, Kexin, et al.
Publicado: (2025)
On the Temporal Question-Answering Capabilities of Large Language Models Over Anonymized Data
por: Ruiz, Alfredo Garrachón, et al.
Publicado: (2025)
por: Ruiz, Alfredo Garrachón, et al.
Publicado: (2025)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
por: Yao, Jui-Ming, et al.
Publicado: (2025)
por: Yao, Jui-Ming, et al.
Publicado: (2025)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
por: Wei, Mingyang, et al.
Publicado: (2026)
por: Wei, Mingyang, et al.
Publicado: (2026)
Evaluating the Meta- and Object-Level Reasoning of Large Language Models for Question Answering
por: Ferguson, Nick, et al.
Publicado: (2025)
por: Ferguson, Nick, et al.
Publicado: (2025)
A Survey of Large Language Model Agents for Question Answering
por: Yue, Murong
Publicado: (2025)
por: Yue, Murong
Publicado: (2025)
Can Language Models Analyze Data? Evaluating Large Language Models for Question Answering over Datasets
por: Xenofontos, Andreas, et al.
Publicado: (2026)
por: Xenofontos, Andreas, et al.
Publicado: (2026)
MERA Code: A Unified Framework for Evaluating Code Generation Across Tasks
por: Chervyakov, Artem, et al.
Publicado: (2025)
por: Chervyakov, Artem, et al.
Publicado: (2025)
Declarative Knowledge Distillation from Large Language Models for Visual Question Answering Datasets
por: Eiter, Thomas, et al.
Publicado: (2024)
por: Eiter, Thomas, et al.
Publicado: (2024)
Multi-Agents Based on Large Language Models for Knowledge-based Visual Question Answering
por: Hu, Zhongjian, et al.
Publicado: (2024)
por: Hu, Zhongjian, et al.
Publicado: (2024)
Enhancing Healthcare through Large Language Models: A Study on Medical Question Answering
por: Yu, Haoran, et al.
Publicado: (2024)
por: Yu, Haoran, et al.
Publicado: (2024)
Reliable Academic Conference Question Answering: A Study Based on Large Language Model
por: Huang, Zhiwei, et al.
Publicado: (2023)
por: Huang, Zhiwei, et al.
Publicado: (2023)
Bactrainus: Optimizing Large Language Models for Multi-hop Complex Question Answering Tasks
por: Barati, Iman, et al.
Publicado: (2025)
por: Barati, Iman, et al.
Publicado: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
por: Ding, Jing, et al.
Publicado: (2025)
por: Ding, Jing, et al.
Publicado: (2025)
Towards Building a Robust Knowledge Intensive Question Answering Model with Large Language Models
por: Hong, Xingyun, et al.
Publicado: (2024)
por: Hong, Xingyun, et al.
Publicado: (2024)
PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
por: Jamali, Naghmeh, et al.
Publicado: (2025)
por: Jamali, Naghmeh, et al.
Publicado: (2025)
A Perspective on Large Language Models, Intelligent Machines, and Knowledge Acquisition
por: Cherkassky, Vladimir, et al.
Publicado: (2024)
por: Cherkassky, Vladimir, et al.
Publicado: (2024)
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering
por: Sui, Yuan, et al.
Publicado: (2024)
por: Sui, Yuan, et al.
Publicado: (2024)
Scholarly Question Answering using Large Language Models in the NFDI4DataScience Gateway
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
Enhancing Large Language Models with Pseudo- and Multisource- Knowledge Graphs for Open-ended Question Answering
por: Liu, Jiaxiang, et al.
Publicado: (2024)
por: Liu, Jiaxiang, et al.
Publicado: (2024)
UniOQA: A Unified Framework for Knowledge Graph Question Answering with Large Language Models
por: Li, Zhuoyang, et al.
Publicado: (2024)
por: Li, Zhuoyang, et al.
Publicado: (2024)
Perception of Knowledge Boundary for Large Language Models through Semi-open-ended Question Answering
por: Wen, Zhihua, et al.
Publicado: (2024)
por: Wen, Zhihua, et al.
Publicado: (2024)
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
por: Chen, Zixin, et al.
Publicado: (2025)
por: Chen, Zixin, et al.
Publicado: (2025)
RTQA : Recursive Thinking for Complex Temporal Knowledge Graph Question Answering with Large Language Models
por: Gong, Zhaoyan, et al.
Publicado: (2025)
por: Gong, Zhaoyan, et al.
Publicado: (2025)
Enhancing Large Language Models with Reward-guided Tree Search for Knowledge Graph Question and Answering
por: Long, Xiao, et al.
Publicado: (2025)
por: Long, Xiao, et al.
Publicado: (2025)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
por: Mastrokostas, Charalampos, et al.
Publicado: (2026)
por: Mastrokostas, Charalampos, et al.
Publicado: (2026)
THELMA: Task Based Holistic Evaluation of Large Language Model Applications-RAG Question Answering
por: Patel, Udita, et al.
Publicado: (2025)
por: Patel, Udita, et al.
Publicado: (2025)
Dynamic Strategy Planning for Efficient Question Answering with Large Language Models
por: Parekh, Tanmay, et al.
Publicado: (2024)
por: Parekh, Tanmay, et al.
Publicado: (2024)
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
por: Cabello, Laura, et al.
Publicado: (2024)
por: Cabello, Laura, et al.
Publicado: (2024)
Evaluating Multimodal Large Language Models on Educational Textbook Question Answering
por: Alawwad, Hessa A., et al.
Publicado: (2025)
por: Alawwad, Hessa A., et al.
Publicado: (2025)
Mitigating Knowledge Conflicts in Language Model-Driven Question Answering
por: Cao, Han, et al.
Publicado: (2024)
por: Cao, Han, et al.
Publicado: (2024)
Code-Style In-Context Learning for Knowledge-Based Question Answering
por: Nie, Zhijie, et al.
Publicado: (2023)
por: Nie, Zhijie, et al.
Publicado: (2023)
Extracting and Encoding: Leveraging Large Language Models and Medical Knowledge to Enhance Radiological Text Representation
por: Messina, Pablo, et al.
Publicado: (2024)
por: Messina, Pablo, et al.
Publicado: (2024)
Ejemplares similares
-
Code Summarization Beyond Function Level
por: Makharev, Vladimir, et al.
Publicado: (2025) -
YABLoCo: Yet Another Benchmark for Long Context Code Generation
por: Valeev, Aidar, et al.
Publicado: (2025) -
SWE-MERA: A Dynamic Benchmark for Agenticly Evaluating Large Language Models on Software Engineering Tasks
por: Adamenko, Pavel, et al.
Publicado: (2025) -
RuCCoD: Towards Automated ICD Coding in Russian
por: Nesterov, Aleksandr, et al.
Publicado: (2025) -
Uncertainty Estimation of Large Language Models in Medical Question Answering
por: Wu, Jiaxin, et al.
Publicado: (2024)