Efficient Document Parsing via Parallel Token Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Lei, Zhao, Ze, Li, Meng, Lun, Zhongwang, Yuan, Yi, Lu, Xingjing, Wei, Zheng, Bian, Jiang, Li, Zang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reasoning Bias of Next Token Prediction Training
di: Lin, Pengxiao, et al.
Pubblicazione: (2025)
di: Lin, Pengxiao, et al.
Pubblicazione: (2025)
Semantic Parsing for Question Answering over Knowledge Graphs
di: Wei, Sijia, et al.
Pubblicazione: (2023)
di: Wei, Sijia, et al.
Pubblicazione: (2023)
MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing
di: Niu, Junbo, et al.
Pubblicazione: (2025)
di: Niu, Junbo, et al.
Pubblicazione: (2025)
LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model
di: Shao, Wei, et al.
Pubblicazione: (2025)
di: Shao, Wei, et al.
Pubblicazione: (2025)
FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
di: Tang, Zihan, et al.
Pubblicazione: (2026)
di: Tang, Zihan, et al.
Pubblicazione: (2026)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
di: Wang, Baode, et al.
Pubblicazione: (2025)
di: Wang, Baode, et al.
Pubblicazione: (2025)
Bilingual Rhetorical Structure Parsing with Large Parallel Annotations
di: Chistova, Elena
Pubblicazione: (2024)
di: Chistova, Elena
Pubblicazione: (2024)
Parallel Token Prediction for Language Models
di: Draxler, Felix, et al.
Pubblicazione: (2025)
di: Draxler, Felix, et al.
Pubblicazione: (2025)
TokAlign: Efficient Vocabulary Adaptation via Token Alignment
di: Li, Chong, et al.
Pubblicazione: (2025)
di: Li, Chong, et al.
Pubblicazione: (2025)
FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing
di: Li, Zekai, et al.
Pubblicazione: (2024)
di: Li, Zekai, et al.
Pubblicazione: (2024)
AdaParse: An Adaptive Parallel PDF Parsing and Resource Scaling Engine
di: Siebenschuh, Carlo, et al.
Pubblicazione: (2025)
di: Siebenschuh, Carlo, et al.
Pubblicazione: (2025)
MinerU2.5-Pro: Pushing the Limits of Data-Centric Document Parsing at Scale
di: Wang, Bin, et al.
Pubblicazione: (2026)
di: Wang, Bin, et al.
Pubblicazione: (2026)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
di: Wang, Baode, et al.
Pubblicazione: (2025)
di: Wang, Baode, et al.
Pubblicazione: (2025)
Character-Level Chinese Dependency Parsing via Modeling Latent Intra-Word Structure
di: Hou, Yang, et al.
Pubblicazione: (2024)
di: Hou, Yang, et al.
Pubblicazione: (2024)
Doc-Researcher: A Unified System for Multimodal Document Parsing and Deep Research
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding
di: Zhong, Shuzhang, et al.
Pubblicazione: (2024)
di: Zhong, Shuzhang, et al.
Pubblicazione: (2024)
Progressive Document-level Text Simplification via Large Language Models
di: Fang, Dengzhao, et al.
Pubblicazione: (2025)
di: Fang, Dengzhao, et al.
Pubblicazione: (2025)
SCORE: A Semantic Evaluation Framework for Generative Document Parsing
di: Li, Renyu, et al.
Pubblicazione: (2025)
di: Li, Renyu, et al.
Pubblicazione: (2025)
Hierarchical Document Parsing via Large Margin Feature Matching and Heuristics
di: Kiet, Duong Anh
Pubblicazione: (2025)
di: Kiet, Duong Anh
Pubblicazione: (2025)
Unsupervised Mutual Learning of Discourse Parsing and Topic Segmentation in Dialogue
di: Xu, Jiahui, et al.
Pubblicazione: (2024)
di: Xu, Jiahui, et al.
Pubblicazione: (2024)
QoSBERT: An Uncertainty-Aware Approach based on Pre-trained Language Models for Service Quality Prediction
di: Wang, Ziliang, et al.
Pubblicazione: (2025)
di: Wang, Ziliang, et al.
Pubblicazione: (2025)
Zero Token-Driven Deep Thinking in LLMs: Unlocking the Full Potential of Existing Parameters via Cyclic Refinement
di: Li, Guanghao, et al.
Pubblicazione: (2025)
di: Li, Guanghao, et al.
Pubblicazione: (2025)
Parallel-Probe: Towards Efficient Parallel Thinking via 2D Probing
di: Zheng, Tong, et al.
Pubblicazione: (2026)
di: Zheng, Tong, et al.
Pubblicazione: (2026)
Textless Dependency Parsing by Labeled Sequence Prediction
di: Kando, Shunsuke, et al.
Pubblicazione: (2024)
di: Kando, Shunsuke, et al.
Pubblicazione: (2024)
Dependency Parsing is More Parameter-Efficient with Normalization
di: Gajo, Paolo, et al.
Pubblicazione: (2025)
di: Gajo, Paolo, et al.
Pubblicazione: (2025)
Speech Vecalign: an Embedding-based Method for Aligning Parallel Speech Documents
di: Meng, Chutong, et al.
Pubblicazione: (2025)
di: Meng, Chutong, et al.
Pubblicazione: (2025)
CTkvr: KV Cache Retrieval for Long-Context LLMs via Centroid then Token Indexing
di: Lu, Kuan, et al.
Pubblicazione: (2025)
di: Lu, Kuan, et al.
Pubblicazione: (2025)
Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model
di: Yuan, Chenhan, et al.
Pubblicazione: (2024)
di: Yuan, Chenhan, et al.
Pubblicazione: (2024)
Beyond the Next Token: Towards Prompt-Robust Zero-Shot Classification via Efficient Multi-Token Prediction
di: Qian, Junlang, et al.
Pubblicazione: (2025)
di: Qian, Junlang, et al.
Pubblicazione: (2025)
Mind the Gap No More: Achieving Zero-Gap Multimodal Integration via One Tokenizer
di: Li, Yanan, et al.
Pubblicazione: (2026)
di: Li, Yanan, et al.
Pubblicazione: (2026)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
di: Li, Xue, et al.
Pubblicazione: (2025)
di: Li, Xue, et al.
Pubblicazione: (2025)
Text-to-Distribution Prediction with Quantile Tokens and Neighbor Context
di: Zhu, Yilun, et al.
Pubblicazione: (2026)
di: Zhu, Yilun, et al.
Pubblicazione: (2026)
Conditional Unigram Tokenization with Parallel Data
di: Vico, Gianluca, et al.
Pubblicazione: (2025)
di: Vico, Gianluca, et al.
Pubblicazione: (2025)
Semi-Parametric Retrieval via Binary Bag-of-Tokens Index
di: Zhou, Jiawei, et al.
Pubblicazione: (2024)
di: Zhou, Jiawei, et al.
Pubblicazione: (2024)
High-order Joint Constituency and Dependency Parsing
di: Gu, Yanggan, et al.
Pubblicazione: (2023)
di: Gu, Yanggan, et al.
Pubblicazione: (2023)
ECLIPSE: Semantic Entropy-LCS for Cross-Lingual Industrial Log Parsing
di: Zhang, Wei, et al.
Pubblicazione: (2024)
di: Zhang, Wei, et al.
Pubblicazione: (2024)
Efficient Training-Free Multi-Token Prediction via Embedding-Space Probing
di: Goel, Raghavv, et al.
Pubblicazione: (2026)
di: Goel, Raghavv, et al.
Pubblicazione: (2026)
Efficient Sparse Attention needs Adaptive Token Release
di: Zhang, Chaoran, et al.
Pubblicazione: (2024)
di: Zhang, Chaoran, et al.
Pubblicazione: (2024)
Empirical Analysis for Unsupervised Universal Dependency Parse Tree Aggregation
di: Kulkarni, Adithya, et al.
Pubblicazione: (2024)
di: Kulkarni, Adithya, et al.
Pubblicazione: (2024)
DocFusion: A Unified Framework for Document Parsing Tasks
di: Chai, Mingxu, et al.
Pubblicazione: (2024)
di: Chai, Mingxu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Reasoning Bias of Next Token Prediction Training
di: Lin, Pengxiao, et al.
Pubblicazione: (2025) -
Semantic Parsing for Question Answering over Knowledge Graphs
di: Wei, Sijia, et al.
Pubblicazione: (2023) -
MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing
di: Niu, Junbo, et al.
Pubblicazione: (2025) -
LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model
di: Shao, Wei, et al.
Pubblicazione: (2025) -
FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
di: Tang, Zihan, et al.
Pubblicazione: (2026)