DocMamba: Efficient Document Pre-training with State Space Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Pengfei, Zhang, Zhenrong, Ma, Jiefeng, Liu, Shuhang, Du, Jun, Zhang, Jianshu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SRFUND: A Multi-Granularity Hierarchical Structure Reconstruction Benchmark in Form Understanding
di: Ma, Jiefeng, et al.
Pubblicazione: (2024)
di: Ma, Jiefeng, et al.
Pubblicazione: (2024)
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
di: Pan, Yicheng, et al.
Pubblicazione: (2025)
di: Pan, Yicheng, et al.
Pubblicazione: (2025)
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
di: Chang, Qikai, et al.
Pubblicazione: (2025)
di: Chang, Qikai, et al.
Pubblicazione: (2025)
See then Tell: Enhancing Key Information Extraction with Vision Grounding
di: Liu, Shuhang, et al.
Pubblicazione: (2024)
di: Liu, Shuhang, et al.
Pubblicazione: (2024)
UniTabNet: Bridging Vision and Language Models for Enhanced Table Structure Recognition
di: Zhang, Zhenrong, et al.
Pubblicazione: (2024)
di: Zhang, Zhenrong, et al.
Pubblicazione: (2024)
Bidirectional Trained Tree-Structured Decoder for Handwritten Mathematical Expression Recognition
di: Cheng, Hanbo, et al.
Pubblicazione: (2023)
di: Cheng, Hanbo, et al.
Pubblicazione: (2023)
DocMEdit: Towards Document-Level Model Editing
di: Zeng, Li, et al.
Pubblicazione: (2025)
di: Zeng, Li, et al.
Pubblicazione: (2025)
Bi-Mamba: Towards Accurate 1-Bit State Space Models
di: Tang, Shengkun, et al.
Pubblicazione: (2024)
di: Tang, Shengkun, et al.
Pubblicazione: (2024)
RepCali: High Efficient Fine-tuning Via Representation Calibration in Latent Space for Pre-trained Language Models
di: Zhang, Fujun, et al.
Pubblicazione: (2025)
di: Zhang, Fujun, et al.
Pubblicazione: (2025)
Pre-training Distillation for Large Language Models: A Design Space Exploration
di: Peng, Hao, et al.
Pubblicazione: (2024)
di: Peng, Hao, et al.
Pubblicazione: (2024)
Efficient Language Adaptive Pre-training: Extending State-of-the-Art Large Language Models for Polish
di: Ruciński, Szymon
Pubblicazione: (2024)
di: Ruciński, Szymon
Pubblicazione: (2024)
MoE-Mamba: Efficient Selective State Space Models with Mixture of Experts
di: Pióro, Maciej, et al.
Pubblicazione: (2024)
di: Pióro, Maciej, et al.
Pubblicazione: (2024)
DocReLM: Mastering Document Retrieval with Language Model
di: Wei, Gengchen, et al.
Pubblicazione: (2024)
di: Wei, Gengchen, et al.
Pubblicazione: (2024)
Doc-Guided Sent2Sent++: A Sent2Sent++ Agent with Doc-Guided memory for Document-level Machine Translation
di: Guo, Jiaxin, et al.
Pubblicazione: (2025)
di: Guo, Jiaxin, et al.
Pubblicazione: (2025)
SoftDedup: an Efficient Data Reweighting Method for Speeding Up Language Model Pre-training
di: He, Nan, et al.
Pubblicazione: (2024)
di: He, Nan, et al.
Pubblicazione: (2024)
DocTER: Evaluating Document-based Knowledge Editing
di: Wu, Suhang, et al.
Pubblicazione: (2023)
di: Wu, Suhang, et al.
Pubblicazione: (2023)
Leave No Document Behind: Benchmarking Long-Context LLMs with Extended Multi-Doc QA
di: Wang, Minzheng, et al.
Pubblicazione: (2024)
di: Wang, Minzheng, et al.
Pubblicazione: (2024)
Spike No More: Stabilizing the Pre-training of Large Language Models
di: Takase, Sho, et al.
Pubblicazione: (2023)
di: Takase, Sho, et al.
Pubblicazione: (2023)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
di: Song, Weixi, et al.
Pubblicazione: (2023)
di: Song, Weixi, et al.
Pubblicazione: (2023)
Multi-domain Knowledge Graph Collaborative Pre-training and Prompt Tuning for Diverse Downstream Tasks
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
Synthesize-on-Graph: Knowledgeable Synthetic Data Generation for Continue Pre-training of Large Language Models
di: Ma, Shengjie, et al.
Pubblicazione: (2025)
di: Ma, Shengjie, et al.
Pubblicazione: (2025)
Probing Language Models for Pre-training Data Detection
di: Liu, Zhenhua, et al.
Pubblicazione: (2024)
di: Liu, Zhenhua, et al.
Pubblicazione: (2024)
PP-DocBee2: Improved Baselines with Efficient Data for Multimodal Document Understanding
di: Huang, Kui, et al.
Pubblicazione: (2025)
di: Huang, Kui, et al.
Pubblicazione: (2025)
LongDocURL: a Comprehensive Multimodal Long Document Benchmark Integrating Understanding, Reasoning, and Locating
di: Deng, Chao, et al.
Pubblicazione: (2024)
di: Deng, Chao, et al.
Pubblicazione: (2024)
MemMamba: Rethinking Memory Patterns in State Space Model
di: Wang, Youjin, et al.
Pubblicazione: (2025)
di: Wang, Youjin, et al.
Pubblicazione: (2025)
DocReward: A Document Reward Model for Structuring and Stylizing
di: Liu, Junpeng, et al.
Pubblicazione: (2025)
di: Liu, Junpeng, et al.
Pubblicazione: (2025)
Automated Detection of Pre-training Text in Black-box LLMs
di: Hu, Ruihan, et al.
Pubblicazione: (2025)
di: Hu, Ruihan, et al.
Pubblicazione: (2025)
UOR: Universal Backdoor Attacks on Pre-trained Language Models
di: Du, Wei, et al.
Pubblicazione: (2023)
di: Du, Wei, et al.
Pubblicazione: (2023)
Data Darwinism Part I: Unlocking the Value of Scientific Data for Pre-training
di: Qin, Yiwei, et al.
Pubblicazione: (2026)
di: Qin, Yiwei, et al.
Pubblicazione: (2026)
Efficient Data Learning for Open Information Extraction with Pre-trained Language Models
di: Fan, Zhiyuan, et al.
Pubblicazione: (2023)
di: Fan, Zhiyuan, et al.
Pubblicazione: (2023)
Stuffed Mamba: Oversized States Lead to the Inability to Forget
di: Chen, Yingfa, et al.
Pubblicazione: (2024)
di: Chen, Yingfa, et al.
Pubblicazione: (2024)
Boosting Explainability through Selective Rationalization in Pre-trained Language Models
di: Yuan, Libing, et al.
Pubblicazione: (2025)
di: Yuan, Libing, et al.
Pubblicazione: (2025)
Towards Tracing Trustworthiness Dynamics: Revisiting Pre-training Period of Large Language Models
di: Qian, Chen, et al.
Pubblicazione: (2024)
di: Qian, Chen, et al.
Pubblicazione: (2024)
PatientVLM Meets DocVLM: Pre-Consultation Dialogue Between Vision-Language Models for Efficient Diagnosis
di: Lokesh, K, et al.
Pubblicazione: (2026)
di: Lokesh, K, et al.
Pubblicazione: (2026)
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
di: Tan, Yuqiao, et al.
Pubblicazione: (2026)
di: Tan, Yuqiao, et al.
Pubblicazione: (2026)
Docs2KG: Unified Knowledge Graph Construction from Heterogeneous Documents Assisted by Large Language Models
di: Sun, Qiang, et al.
Pubblicazione: (2024)
di: Sun, Qiang, et al.
Pubblicazione: (2024)
Exploring the Benefit of Activation Sparsity in Pre-training
di: Zhang, Zhengyan, et al.
Pubblicazione: (2024)
di: Zhang, Zhengyan, et al.
Pubblicazione: (2024)
B-cos LM: Efficiently Transforming Pre-trained Language Models for Improved Explainability
di: Wang, Yifan, et al.
Pubblicazione: (2025)
di: Wang, Yifan, et al.
Pubblicazione: (2025)
Demonstrating ViviDoc: Generating Interactive Documents through Human-Agent Collaboration
di: Tang, Yinghao, et al.
Pubblicazione: (2026)
di: Tang, Yinghao, et al.
Pubblicazione: (2026)
BoundingDocs: a Unified Dataset for Document Question Answering with Spatial Annotations
di: Giovannini, Simone, et al.
Pubblicazione: (2025)
di: Giovannini, Simone, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SRFUND: A Multi-Granularity Hierarchical Structure Reconstruction Benchmark in Form Understanding
di: Ma, Jiefeng, et al.
Pubblicazione: (2024) -
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
di: Pan, Yicheng, et al.
Pubblicazione: (2025) -
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
di: Chang, Qikai, et al.
Pubblicazione: (2025) -
See then Tell: Enhancing Key Information Extraction with Vision Grounding
di: Liu, Shuhang, et al.
Pubblicazione: (2024) -
UniTabNet: Bridging Vision and Language Models for Enhanced Table Structure Recognition
di: Zhang, Zhenrong, et al.
Pubblicazione: (2024)