Enabling and Analyzing How to Efficiently Extract Information from Hybrid Long Documents with LLMs
Fuente:
arXiv
Saved in:
| Main Authors: | Yue, Chongjian, Xu, Xinrun, Ma, Xiaojun, Du, Lun, Liu, Hengyu, Ding, Zhiming, Jiang, Yanbing, Han, Shi, Zhang, Dongmei |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Extract Information from Hybrid Long Documents Leveraging LLMs: A Framework and Dataset
by: Yue, Chongjian, et al.
Published: (2024)
by: Yue, Chongjian, et al.
Published: (2024)
MindRef: Mimicking Human Memory for Hierarchical Reference Retrieval with Fine-Grained Location Awareness
by: Wang, Ye, et al.
Published: (2024)
by: Wang, Ye, et al.
Published: (2024)
Tackling Long Code Search with Splitting, Encoding, and Aggregating
by: Hu, Fan, et al.
Published: (2022)
by: Hu, Fan, et al.
Published: (2022)
How good are LLMs at Retrieving Documents in a Specific Domain?
by: Islam, Nafis Tanveer, et al.
Published: (2025)
by: Islam, Nafis Tanveer, et al.
Published: (2025)
A Clustering Method with Graph Maximum Decoding Information
by: Xu, Xinrun, et al.
Published: (2024)
by: Xu, Xinrun, et al.
Published: (2024)
Catastrophic Forgetting Mitigation via Discrepancy-Weighted Experience Replay
by: Xu, Xinrun, et al.
Published: (2025)
by: Xu, Xinrun, et al.
Published: (2025)
SECRET: Towards Scalable and Efficient Code Retrieval via Segmented Deep Hashing
by: Gu, Wenchao, et al.
Published: (2024)
by: Gu, Wenchao, et al.
Published: (2024)
A Survey on Game Playing Agents and Large Models: Methods, Applications, and Challenges
by: Xu, Xinrun, et al.
Published: (2024)
by: Xu, Xinrun, et al.
Published: (2024)
Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning
by: Liu, Hanbing, et al.
Published: (2025)
by: Liu, Hanbing, et al.
Published: (2025)
High-Quality Pseudo-Label Generation Based on Visual Prompt Assisted Cloud Model Update
by: Xu, Xinrun, et al.
Published: (2025)
by: Xu, Xinrun, et al.
Published: (2025)
A Multi-constraint and Multi-objective Allocation Model for Emergency Rescue in IoT Environment
by: Xu, Xinrun, et al.
Published: (2024)
by: Xu, Xinrun, et al.
Published: (2024)
SheetDesigner: MLLM-Powered Spreadsheet Layout Generation with Rule-Based and Vision-Based Reflection
by: Chen, Qin, et al.
Published: (2025)
by: Chen, Qin, et al.
Published: (2025)
How Reliable are LLMs for Reasoning on the Re-ranking task?
by: Islam, Nafis Tanveer, et al.
Published: (2025)
by: Islam, Nafis Tanveer, et al.
Published: (2025)
Beyond Token Eviction: Mixed-Dimension Budget Allocation for Efficient KV Cache Compression
by: Miao, Ruijie, et al.
Published: (2026)
by: Miao, Ruijie, et al.
Published: (2026)
Revisiting Code Search in a Two-Stage Paradigm
by: Hu, Fan, et al.
Published: (2022)
by: Hu, Fan, et al.
Published: (2022)
TAP4LLM: Table Provider on Sampling, Augmenting, and Packing Semi-structured Data for Large Language Model Reasoning
by: Sui, Yuan, et al.
Published: (2023)
by: Sui, Yuan, et al.
Published: (2023)
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
by: Chen, Yuyan, et al.
Published: (2024)
by: Chen, Yuyan, et al.
Published: (2024)
SinkLoRA: Enhanced Efficiency and Chat Capabilities for Long-Context Large Language Models
by: Zhang, Hengyu
Published: (2024)
by: Zhang, Hengyu
Published: (2024)
Automated Formalization via Conceptual Retrieval-Augmented LLMs
by: Lu, Wangyue, et al.
Published: (2025)
by: Lu, Wangyue, et al.
Published: (2025)
Efficient Solutions For An Intriguing Failure of LLMs: Long Context Window Does Not Mean LLMs Can Analyze Long Sequences Flawlessly
by: Hosseini, Peyman, et al.
Published: (2024)
by: Hosseini, Peyman, et al.
Published: (2024)
Resolving Latency and Inventory Risk in Market Making with Reinforcement Learning
by: Jiang, Junzhe, et al.
Published: (2025)
by: Jiang, Junzhe, et al.
Published: (2025)
Interfacial Orbital Hybridization in Multiphase Mn‐V Oxide Enabling Long‐Life and High‐Power Aqueous Zinc‐Ion Batteries
by: Xiudong Chen, et al.
Published: (2026)
by: Xiudong Chen, et al.
Published: (2026)
URaG: Unified Retrieval and Generation in Multimodal LLMs for Efficient Long Document Understanding
by: Shi, Yongxin, et al.
Published: (2025)
by: Shi, Yongxin, et al.
Published: (2025)
LongVLM: Efficient Long Video Understanding via Large Language Models
by: Weng, Yuetian, et al.
Published: (2024)
by: Weng, Yuetian, et al.
Published: (2024)
A Synergistically Enhanced Triboelectric‐Electromagnetic Hybrid Generator Enabled by Multifunctional Amorphous Alloy for Highly Efficient Self‐Powered System
by: Shaokun Gong, et al.
Published: (2024)
by: Shaokun Gong, et al.
Published: (2024)
Tailor‐Made Host–Guest Organic–Inorganic Hybrid Antimony Halide Enables Efficient Light‐Emitting Diodes
by: Weihong Chu, et al.
Published: (2025)
by: Weihong Chu, et al.
Published: (2025)
ChuLo: Chunk-Level Key Information Representation for Long Document Understanding
by: Li, Yan, et al.
Published: (2024)
by: Li, Yan, et al.
Published: (2024)
Optimus-1: Hybrid Multimodal Memory Empowered Agents Excel in Long-Horizon Tasks
by: Li, Zaijing, et al.
Published: (2024)
by: Li, Zaijing, et al.
Published: (2024)
Large Language Models for Predictive Analysis: How Far Are They?
by: Chen, Qin, et al.
Published: (2025)
by: Chen, Qin, et al.
Published: (2025)
LLMs for Relational Reasoning: How Far are We?
by: Li, Zhiming, et al.
Published: (2024)
by: Li, Zhiming, et al.
Published: (2024)
Local newspaper closures and bank loan contracts
by: Zhiming Ma, et al.
Published: (2025)
by: Zhiming Ma, et al.
Published: (2025)
StructMem: Structured Memory for Long-Horizon Behavior in LLMs
by: Xu, Buqiang, et al.
Published: (2026)
by: Xu, Buqiang, et al.
Published: (2026)
Analyzing the Inherent Response Tendency of LLMs: Real-World Instructions-Driven Jailbreak
by: Du, Yanrui, et al.
Published: (2023)
by: Du, Yanrui, et al.
Published: (2023)
SynDoc: A Hybrid Discriminative-Generative Framework for Enhancing Synthetic Domain-Adaptive Document Key Information Extraction
by: Ding, Yihao, et al.
Published: (2025)
by: Ding, Yihao, et al.
Published: (2025)
S3-CoT: Self-Sampled Succinct Reasoning Enables Efficient Chain-of-Thought LLMs
by: Du, Yanrui, et al.
Published: (2026)
by: Du, Yanrui, et al.
Published: (2026)
From Task to Tutorial: An Automated GUI Framework for Excel Tutorial Document and Video Creation
by: Xie, Yuhang, et al.
Published: (2025)
by: Xie, Yuhang, et al.
Published: (2025)
Quarkonium Polarization Kinetic Equation from Open Quantum Systems and Effective Field Theories
by: Yang, Di-Lun, et al.
Published: (2025)
by: Yang, Di-Lun, et al.
Published: (2025)
Quarkonium Polarization in Medium from Open Quantum Systems and Chromomagnetic Correlators
by: Yang, Di-Lun, et al.
Published: (2024)
by: Yang, Di-Lun, et al.
Published: (2024)
LongRAG: Enhancing Retrieval-Augmented Generation with Long-context LLMs
by: Jiang, Ziyan, et al.
Published: (2024)
by: Jiang, Ziyan, et al.
Published: (2024)
Boswellia Extract Promotes Healing and Resolving Inflammation in Oral Ulcers of Rat
by: Wei Zhao, et al.
Published: (2025)
by: Wei Zhao, et al.
Published: (2025)
Similar Items
-
Extract Information from Hybrid Long Documents Leveraging LLMs: A Framework and Dataset
by: Yue, Chongjian, et al.
Published: (2024) -
MindRef: Mimicking Human Memory for Hierarchical Reference Retrieval with Fine-Grained Location Awareness
by: Wang, Ye, et al.
Published: (2024) -
Tackling Long Code Search with Splitting, Encoding, and Aggregating
by: Hu, Fan, et al.
Published: (2022) -
How good are LLMs at Retrieving Documents in a Specific Domain?
by: Islam, Nafis Tanveer, et al.
Published: (2025) -
A Clustering Method with Graph Maximum Decoding Information
by: Xu, Xinrun, et al.
Published: (2024)