CoPA: Benchmarking Personalized Question Answering with Data-Informed Cognitive Factors
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Su, Hang, Liu, Zequn, Hu, Chen, Lu, Xuesong, Xia, Yingce, Liu, Zhen |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering
par: Zhu, Rongzhi, et autres
Publié: (2025)
par: Zhu, Rongzhi, et autres
Publié: (2025)
Agentic Retrieval-Augmented Generation for Financial Document Question Answering
par: Shu, Yang, et autres
Publié: (2026)
par: Shu, Yang, et autres
Publié: (2026)
CoPA: Hierarchical Concept Prompting and Aggregating Network for Explainable Diagnosis
par: Dong, Yiheng, et autres
Publié: (2025)
par: Dong, Yiheng, et autres
Publié: (2025)
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
par: Gu, Tiancheng, et autres
Publié: (2024)
par: Gu, Tiancheng, et autres
Publié: (2024)
Answering the Unanswerable Is to Err Knowingly: Analyzing and Mitigating Abstention Failures in Large Reasoning Models
par: Liu, Yi, et autres
Publié: (2025)
par: Liu, Yi, et autres
Publié: (2025)
IPQA: A Benchmark for Core Intent Identification in Personalized Question Answering
par: Kim, Jieyong, et autres
Publié: (2025)
par: Kim, Jieyong, et autres
Publié: (2025)
STAGE: A Full-Screenplay Benchmark for Reasoning over Evolving Storie
par: Tian, Qiuyu, et autres
Publié: (2026)
par: Tian, Qiuyu, et autres
Publié: (2026)
Recursive Question Understanding for Complex Question Answering over Heterogeneous Personal Data
par: Christmann, Philipp, et autres
Publié: (2025)
par: Christmann, Philipp, et autres
Publié: (2025)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
par: Wu, Shiwei, et autres
Publié: (2024)
par: Wu, Shiwei, et autres
Publié: (2024)
IMB: An Italian Medical Benchmark for Question Answering
par: Romano, Antonio, et autres
Publié: (2025)
par: Romano, Antonio, et autres
Publié: (2025)
What Factors Affect LLMs and RLLMs in Financial Question Answering?
par: Wang, Peng, et autres
Publié: (2025)
par: Wang, Peng, et autres
Publié: (2025)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
par: Chen, Zhitong, et autres
Publié: (2026)
par: Chen, Zhitong, et autres
Publié: (2026)
Chain-of-thought Reviewing and Correction for Time Series Question Answering
par: Su, Chen, et autres
Publié: (2025)
par: Su, Chen, et autres
Publié: (2025)
LaMP-QA: A Benchmark for Personalized Long-form Question Answering
par: Salemi, Alireza, et autres
Publié: (2025)
par: Salemi, Alireza, et autres
Publié: (2025)
MINTQA: A Multi-Hop Question Answering Benchmark for Evaluating LLMs on New and Tail Knowledge
par: He, Jie, et autres
Publié: (2024)
par: He, Jie, et autres
Publié: (2024)
OCC-RAG: Optimal Cognitive Core for Faithful Question Answering
par: Savkin, Maksim, et autres
Publié: (2026)
par: Savkin, Maksim, et autres
Publié: (2026)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
par: Wu, Xianjie, et autres
Publié: (2024)
par: Wu, Xianjie, et autres
Publié: (2024)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
par: Chen, Hanjie, et autres
Publié: (2024)
par: Chen, Hanjie, et autres
Publié: (2024)
Argument-Based Comparative Question Answering Evaluation Benchmark
par: Nikishina, Irina, et autres
Publié: (2025)
par: Nikishina, Irina, et autres
Publié: (2025)
MULTITAT: Benchmarking Multilingual Table-and-Text Question Answering
par: Zhang, Xuanliang, et autres
Publié: (2025)
par: Zhang, Xuanliang, et autres
Publié: (2025)
A Knowledge-Injected Curriculum Pretraining Framework for Question Answering
par: Lin, Xin, et autres
Publié: (2024)
par: Lin, Xin, et autres
Publié: (2024)
Let LLMs Take on the Latest Challenges! A Chinese Dynamic Question Answering Benchmark
par: Xu, Zhikun, et autres
Publié: (2024)
par: Xu, Zhikun, et autres
Publié: (2024)
Social Bias in Popular Question-Answering Benchmarks
par: Kraft, Angelie, et autres
Publié: (2025)
par: Kraft, Angelie, et autres
Publié: (2025)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
par: Wei, Mingyang, et autres
Publié: (2026)
par: Wei, Mingyang, et autres
Publié: (2026)
Benchmarking Retrieval-Augmented Multimodal Generation for Document Question Answering
par: Dong, Kuicai, et autres
Publié: (2025)
par: Dong, Kuicai, et autres
Publié: (2025)
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
CoTKR: Chain-of-Thought Enhanced Knowledge Rewriting for Complex Knowledge Graph Question Answering
par: Wu, Yike, et autres
Publié: (2024)
par: Wu, Yike, et autres
Publié: (2024)
EconLogicQA: A Question-Answering Benchmark for Evaluating Large Language Models in Economic Sequential Reasoning
par: Quan, Yinzhu, et autres
Publié: (2024)
par: Quan, Yinzhu, et autres
Publié: (2024)
Efficient Multimodal Planning Agent for Visual Question-Answering
par: Chen, Zhuo, et autres
Publié: (2026)
par: Chen, Zhuo, et autres
Publié: (2026)
NovelQA: Benchmarking Question Answering on Documents Exceeding 200K Tokens
par: Wang, Cunxiang, et autres
Publié: (2024)
par: Wang, Cunxiang, et autres
Publié: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
PAT-Questions: A Self-Updating Benchmark for Present-Anchored Temporal Question-Answering
par: Meem, Jannat Ara, et autres
Publié: (2024)
par: Meem, Jannat Ara, et autres
Publié: (2024)
Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan
par: Yao, Jui-Ming, et autres
Publié: (2025)
par: Yao, Jui-Ming, et autres
Publié: (2025)
ReCoQA: A Benchmark for Tool-Augmented and Multi-Step Reasoning in Real Estate Question and Answering
par: Zhang, Yindong, et autres
Publié: (2026)
par: Zhang, Yindong, et autres
Publié: (2026)
KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues
par: Chen, Junhao, et autres
Publié: (2025)
par: Chen, Junhao, et autres
Publié: (2025)
Knowledge Editing with Dynamic Knowledge Graphs for Multi-Hop Question Answering
par: Lu, Yifan, et autres
Publié: (2024)
par: Lu, Yifan, et autres
Publié: (2024)
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts
par: Chen, Xiangnan, et autres
Publié: (2025)
par: Chen, Xiangnan, et autres
Publié: (2025)
SensorQA: A Question Answering Benchmark for Daily-Life Monitoring
par: Reichman, Benjamin, et autres
Publié: (2025)
par: Reichman, Benjamin, et autres
Publié: (2025)
Rationale-guided Prompting for Knowledge-based Visual Question Answering
par: Hu, Zhongjian, et autres
Publié: (2024)
par: Hu, Zhongjian, et autres
Publié: (2024)
MEBench: Benchmarking Large Language Models for Cross-Document Multi-Entity Question Answering
par: Lin, Teng, et autres
Publié: (2025)
par: Lin, Teng, et autres
Publié: (2025)
Documents similaires
-
Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering
par: Zhu, Rongzhi, et autres
Publié: (2025) -
Agentic Retrieval-Augmented Generation for Financial Document Question Answering
par: Shu, Yang, et autres
Publié: (2026) -
CoPA: Hierarchical Concept Prompting and Aggregating Network for Explainable Diagnosis
par: Dong, Yiheng, et autres
Publié: (2025) -
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
par: Gu, Tiancheng, et autres
Publié: (2024) -
Answering the Unanswerable Is to Err Knowingly: Analyzing and Mitigating Abstention Failures in Large Reasoning Models
par: Liu, Yi, et autres
Publié: (2025)