CoPA: Benchmarking Personalized Question Answering with Data-Informed Cognitive Factors
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Su, Hang, Liu, Zequn, Hu, Chen, Lu, Xuesong, Xia, Yingce, Liu, Zhen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering
von: Zhu, Rongzhi, et al.
Veröffentlicht: (2025)
von: Zhu, Rongzhi, et al.
Veröffentlicht: (2025)
Agentic Retrieval-Augmented Generation for Financial Document Question Answering
von: Shu, Yang, et al.
Veröffentlicht: (2026)
von: Shu, Yang, et al.
Veröffentlicht: (2026)
CoPA: Hierarchical Concept Prompting and Aggregating Network for Explainable Diagnosis
von: Dong, Yiheng, et al.
Veröffentlicht: (2025)
von: Dong, Yiheng, et al.
Veröffentlicht: (2025)
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
von: Gu, Tiancheng, et al.
Veröffentlicht: (2024)
von: Gu, Tiancheng, et al.
Veröffentlicht: (2024)
Answering the Unanswerable Is to Err Knowingly: Analyzing and Mitigating Abstention Failures in Large Reasoning Models
von: Liu, Yi, et al.
Veröffentlicht: (2025)
von: Liu, Yi, et al.
Veröffentlicht: (2025)
IPQA: A Benchmark for Core Intent Identification in Personalized Question Answering
von: Kim, Jieyong, et al.
Veröffentlicht: (2025)
von: Kim, Jieyong, et al.
Veröffentlicht: (2025)
STAGE: A Full-Screenplay Benchmark for Reasoning over Evolving Storie
von: Tian, Qiuyu, et al.
Veröffentlicht: (2026)
von: Tian, Qiuyu, et al.
Veröffentlicht: (2026)
Recursive Question Understanding for Complex Question Answering over Heterogeneous Personal Data
von: Christmann, Philipp, et al.
Veröffentlicht: (2025)
von: Christmann, Philipp, et al.
Veröffentlicht: (2025)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
von: Wu, Shiwei, et al.
Veröffentlicht: (2024)
von: Wu, Shiwei, et al.
Veröffentlicht: (2024)
IMB: An Italian Medical Benchmark for Question Answering
von: Romano, Antonio, et al.
Veröffentlicht: (2025)
von: Romano, Antonio, et al.
Veröffentlicht: (2025)
What Factors Affect LLMs and RLLMs in Financial Question Answering?
von: Wang, Peng, et al.
Veröffentlicht: (2025)
von: Wang, Peng, et al.
Veröffentlicht: (2025)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
von: Chen, Zhitong, et al.
Veröffentlicht: (2026)
von: Chen, Zhitong, et al.
Veröffentlicht: (2026)
Chain-of-thought Reviewing and Correction for Time Series Question Answering
von: Su, Chen, et al.
Veröffentlicht: (2025)
von: Su, Chen, et al.
Veröffentlicht: (2025)
LaMP-QA: A Benchmark for Personalized Long-form Question Answering
von: Salemi, Alireza, et al.
Veröffentlicht: (2025)
von: Salemi, Alireza, et al.
Veröffentlicht: (2025)
MINTQA: A Multi-Hop Question Answering Benchmark for Evaluating LLMs on New and Tail Knowledge
von: He, Jie, et al.
Veröffentlicht: (2024)
von: He, Jie, et al.
Veröffentlicht: (2024)
OCC-RAG: Optimal Cognitive Core for Faithful Question Answering
von: Savkin, Maksim, et al.
Veröffentlicht: (2026)
von: Savkin, Maksim, et al.
Veröffentlicht: (2026)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
von: Wu, Xianjie, et al.
Veröffentlicht: (2024)
von: Wu, Xianjie, et al.
Veröffentlicht: (2024)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
von: Chen, Hanjie, et al.
Veröffentlicht: (2024)
von: Chen, Hanjie, et al.
Veröffentlicht: (2024)
Argument-Based Comparative Question Answering Evaluation Benchmark
von: Nikishina, Irina, et al.
Veröffentlicht: (2025)
von: Nikishina, Irina, et al.
Veröffentlicht: (2025)
MULTITAT: Benchmarking Multilingual Table-and-Text Question Answering
von: Zhang, Xuanliang, et al.
Veröffentlicht: (2025)
von: Zhang, Xuanliang, et al.
Veröffentlicht: (2025)
A Knowledge-Injected Curriculum Pretraining Framework for Question Answering
von: Lin, Xin, et al.
Veröffentlicht: (2024)
von: Lin, Xin, et al.
Veröffentlicht: (2024)
Let LLMs Take on the Latest Challenges! A Chinese Dynamic Question Answering Benchmark
von: Xu, Zhikun, et al.
Veröffentlicht: (2024)
von: Xu, Zhikun, et al.
Veröffentlicht: (2024)
Social Bias in Popular Question-Answering Benchmarks
von: Kraft, Angelie, et al.
Veröffentlicht: (2025)
von: Kraft, Angelie, et al.
Veröffentlicht: (2025)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
von: Wei, Mingyang, et al.
Veröffentlicht: (2026)
von: Wei, Mingyang, et al.
Veröffentlicht: (2026)
Benchmarking Retrieval-Augmented Multimodal Generation for Document Question Answering
von: Dong, Kuicai, et al.
Veröffentlicht: (2025)
von: Dong, Kuicai, et al.
Veröffentlicht: (2025)
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
von: Ji, Yuelyu, et al.
Veröffentlicht: (2025)
von: Ji, Yuelyu, et al.
Veröffentlicht: (2025)
CoTKR: Chain-of-Thought Enhanced Knowledge Rewriting for Complex Knowledge Graph Question Answering
von: Wu, Yike, et al.
Veröffentlicht: (2024)
von: Wu, Yike, et al.
Veröffentlicht: (2024)
EconLogicQA: A Question-Answering Benchmark for Evaluating Large Language Models in Economic Sequential Reasoning
von: Quan, Yinzhu, et al.
Veröffentlicht: (2024)
von: Quan, Yinzhu, et al.
Veröffentlicht: (2024)
Efficient Multimodal Planning Agent for Visual Question-Answering
von: Chen, Zhuo, et al.
Veröffentlicht: (2026)
von: Chen, Zhuo, et al.
Veröffentlicht: (2026)
NovelQA: Benchmarking Question Answering on Documents Exceeding 200K Tokens
von: Wang, Cunxiang, et al.
Veröffentlicht: (2024)
von: Wang, Cunxiang, et al.
Veröffentlicht: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
von: Wei, Jianhui, et al.
Veröffentlicht: (2025)
von: Wei, Jianhui, et al.
Veröffentlicht: (2025)
PAT-Questions: A Self-Updating Benchmark for Present-Anchored Temporal Question-Answering
von: Meem, Jannat Ara, et al.
Veröffentlicht: (2024)
von: Meem, Jannat Ara, et al.
Veröffentlicht: (2024)
Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan
von: Yao, Jui-Ming, et al.
Veröffentlicht: (2025)
von: Yao, Jui-Ming, et al.
Veröffentlicht: (2025)
ReCoQA: A Benchmark for Tool-Augmented and Multi-Step Reasoning in Real Estate Question and Answering
von: Zhang, Yindong, et al.
Veröffentlicht: (2026)
von: Zhang, Yindong, et al.
Veröffentlicht: (2026)
KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues
von: Chen, Junhao, et al.
Veröffentlicht: (2025)
von: Chen, Junhao, et al.
Veröffentlicht: (2025)
Knowledge Editing with Dynamic Knowledge Graphs for Multi-Hop Question Answering
von: Lu, Yifan, et al.
Veröffentlicht: (2024)
von: Lu, Yifan, et al.
Veröffentlicht: (2024)
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts
von: Chen, Xiangnan, et al.
Veröffentlicht: (2025)
von: Chen, Xiangnan, et al.
Veröffentlicht: (2025)
SensorQA: A Question Answering Benchmark for Daily-Life Monitoring
von: Reichman, Benjamin, et al.
Veröffentlicht: (2025)
von: Reichman, Benjamin, et al.
Veröffentlicht: (2025)
Rationale-guided Prompting for Knowledge-based Visual Question Answering
von: Hu, Zhongjian, et al.
Veröffentlicht: (2024)
von: Hu, Zhongjian, et al.
Veröffentlicht: (2024)
MEBench: Benchmarking Large Language Models for Cross-Document Multi-Entity Question Answering
von: Lin, Teng, et al.
Veröffentlicht: (2025)
von: Lin, Teng, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering
von: Zhu, Rongzhi, et al.
Veröffentlicht: (2025) -
Agentic Retrieval-Augmented Generation for Financial Document Question Answering
von: Shu, Yang, et al.
Veröffentlicht: (2026) -
CoPA: Hierarchical Concept Prompting and Aggregating Network for Explainable Diagnosis
von: Dong, Yiheng, et al.
Veröffentlicht: (2025) -
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
von: Gu, Tiancheng, et al.
Veröffentlicht: (2024) -
Answering the Unanswerable Is to Err Knowingly: Analyzing and Mitigating Abstention Failures in Large Reasoning Models
von: Liu, Yi, et al.
Veröffentlicht: (2025)