Leave No Document Behind: Benchmarking Long-Context LLMs with Extended Multi-Doc QA
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Minzheng, Chen, Longze, Fu, Cheng, Liao, Shengyi, Zhang, Xinghua, Wu, Bingli, Yu, Haiyang, Xu, Nan, Zhang, Lei, Luo, Run, Li, Yunshui, Yang, Min, Huang, Fei, Li, Yongbin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Imperative of Conversation Analysis in the Era of LLMs: A Survey of Tasks, Techniques, and Trends
di: Zhang, Xinghua, et al.
Pubblicazione: (2024)
di: Zhang, Xinghua, et al.
Pubblicazione: (2024)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025)
di: Zou, Tao, et al.
Pubblicazione: (2025)
Adaptive Social Learning via Mode Policy Optimization for Language Agents
di: Wang, Minzheng, et al.
Pubblicazione: (2025)
di: Wang, Minzheng, et al.
Pubblicazione: (2025)
Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs
di: Zhang, Lei, et al.
Pubblicazione: (2024)
di: Zhang, Lei, et al.
Pubblicazione: (2024)
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
di: Chen, Longze, et al.
Pubblicazione: (2024)
di: Chen, Longze, et al.
Pubblicazione: (2024)
IOPO: Empowering LLMs with Complex Instruction Following via Input-Output Preference Optimization
di: Zhang, Xinghua, et al.
Pubblicazione: (2024)
di: Zhang, Xinghua, et al.
Pubblicazione: (2024)
DEMO: Reframing Dialogue Interaction with Fine-grained Element Modeling
di: Wang, Minzheng, et al.
Pubblicazione: (2024)
di: Wang, Minzheng, et al.
Pubblicazione: (2024)
Marathon: A Race Through the Realm of Long Context with Large Language Models
di: Zhang, Lei, et al.
Pubblicazione: (2023)
di: Zhang, Lei, et al.
Pubblicazione: (2023)
IP-MOT: Instance Prompt Learning for Cross-Domain Multi-Object Tracking
di: Luo, Run, et al.
Pubblicazione: (2024)
di: Luo, Run, et al.
Pubblicazione: (2024)
ExpSeek: Self-Triggered Experience Seeking for Web Agents
di: Zhang, Wenyuan, et al.
Pubblicazione: (2026)
di: Zhang, Wenyuan, et al.
Pubblicazione: (2026)
MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct
di: Luo, Run, et al.
Pubblicazione: (2024)
di: Luo, Run, et al.
Pubblicazione: (2024)
Ruler: A Model-Agnostic Method to Control Generated Length for Large Language Models
di: Li, Jiaming, et al.
Pubblicazione: (2024)
di: Li, Jiaming, et al.
Pubblicazione: (2024)
How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
DocFinQA: A Long-Context Financial Reasoning Dataset
di: Reddy, Varshini, et al.
Pubblicazione: (2024)
di: Reddy, Varshini, et al.
Pubblicazione: (2024)
EvoRoute: Experience-Driven Self-Routing LLM Agent Systems
di: Zhang, Guibin, et al.
Pubblicazione: (2026)
di: Zhang, Guibin, et al.
Pubblicazione: (2026)
Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
QwenLong-CPRS: Towards $\infty$-LLMs with Dynamic Context Optimization
di: Shen, Weizhou, et al.
Pubblicazione: (2025)
di: Shen, Weizhou, et al.
Pubblicazione: (2025)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
di: Sun, Huashan, et al.
Pubblicazione: (2025)
di: Sun, Huashan, et al.
Pubblicazione: (2025)
MemPO: Self-Memory Policy Optimization for Long-Horizon Agents
di: Li, Ruoran, et al.
Pubblicazione: (2026)
di: Li, Ruoran, et al.
Pubblicazione: (2026)
DeQA-Doc: Adapting DeQA-Score to Document Image Quality Assessment
di: Gao, Junjie, et al.
Pubblicazione: (2025)
di: Gao, Junjie, et al.
Pubblicazione: (2025)
DocTabQA: Answering Questions from Long Documents Using Tables
di: Wang, Haochen, et al.
Pubblicazione: (2024)
di: Wang, Haochen, et al.
Pubblicazione: (2024)
Extending Token Computation for LLM Reasoning
di: Liao, Bingli, et al.
Pubblicazione: (2024)
di: Liao, Bingli, et al.
Pubblicazione: (2024)
MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations
di: Ma, Yubo, et al.
Pubblicazione: (2024)
di: Ma, Yubo, et al.
Pubblicazione: (2024)
DocMath-Eval: Evaluating Math Reasoning Capabilities of LLMs in Understanding Long and Specialized Documents
di: Zhao, Yilun, et al.
Pubblicazione: (2023)
di: Zhao, Yilun, et al.
Pubblicazione: (2023)
Extend Model Merging from Fine-Tuned to Pre-Trained Large Language Models via Weight Disentanglement
di: Yu, Le, et al.
Pubblicazione: (2024)
di: Yu, Le, et al.
Pubblicazione: (2024)
DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding
di: Feng, Xiang, et al.
Pubblicazione: (2026)
di: Feng, Xiang, et al.
Pubblicazione: (2026)
Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention
di: Munkhdalai, Tsendsuren, et al.
Pubblicazione: (2024)
di: Munkhdalai, Tsendsuren, et al.
Pubblicazione: (2024)
Beyond KV Caching: Shared Attention for Efficient LLMs
di: Liao, Bingli, et al.
Pubblicazione: (2024)
di: Liao, Bingli, et al.
Pubblicazione: (2024)
LongDocURL: a Comprehensive Multimodal Long Document Benchmark Integrating Understanding, Reasoning, and Locating
di: Deng, Chao, et al.
Pubblicazione: (2024)
di: Deng, Chao, et al.
Pubblicazione: (2024)
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
di: Wan, Fanqi, et al.
Pubblicazione: (2025)
di: Wan, Fanqi, et al.
Pubblicazione: (2025)
mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding
di: Hu, Anwen, et al.
Pubblicazione: (2024)
di: Hu, Anwen, et al.
Pubblicazione: (2024)
DocPuzzle: A Process-Aware Benchmark for Evaluating Realistic Long-Context Reasoning Capabilities
di: Zhuang, Tianyi, et al.
Pubblicazione: (2025)
di: Zhuang, Tianyi, et al.
Pubblicazione: (2025)
Leaving No One Behind, Leaving No One Unaccountable
di: Glušac, Luka
Pubblicazione: (2023)
di: Glušac, Luka
Pubblicazione: (2023)
DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding
di: Yan, Hao, et al.
Pubblicazione: (2026)
di: Yan, Hao, et al.
Pubblicazione: (2026)
The First Place Solution of WSDM Cup 2024: Leveraging Large Language Models for Conversational Multi-Doc QA
di: Li, Yiming, et al.
Pubblicazione: (2024)
di: Li, Yiming, et al.
Pubblicazione: (2024)
Long-Document QA with Chain-of-Structured-Thought and Fine-Tuned SLMs
di: Liang, Zhuowen, et al.
Pubblicazione: (2026)
di: Liang, Zhuowen, et al.
Pubblicazione: (2026)
Extending LLMs' Context Window with 100 Samples
di: Zhang, Yikai, et al.
Pubblicazione: (2024)
di: Zhang, Yikai, et al.
Pubblicazione: (2024)
What People Leave Behind
Pubblicazione: (2022)
Pubblicazione: (2022)
Leave No Library Collection Behind!
di: Yoke, Beth
Pubblicazione: (2004)
di: Yoke, Beth
Pubblicazione: (2004)
On the Role of Attention Heads in Large Language Model Safety
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
The Imperative of Conversation Analysis in the Era of LLMs: A Survey of Tasks, Techniques, and Trends
di: Zhang, Xinghua, et al.
Pubblicazione: (2024) -
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025) -
Adaptive Social Learning via Mode Policy Optimization for Language Agents
di: Wang, Minzheng, et al.
Pubblicazione: (2025) -
Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs
di: Zhang, Lei, et al.
Pubblicazione: (2024) -
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
di: Chen, Longze, et al.
Pubblicazione: (2024)