TopoChunker: Topology-Aware Agentic Document Chunking Framework
Fuente:
arXiv
Guardado en:
| Autor principal: | Liu, Xiaoyu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FreeChunker: A Cross-Granularity Chunking Framework
por: Zhang, Wenxuan, et al.
Publicado: (2025)
por: Zhang, Wenxuan, et al.
Publicado: (2025)
LumberChunker: Long-Form Narrative Document Segmentation
por: Duarte, André V., et al.
Publicado: (2024)
por: Duarte, André V., et al.
Publicado: (2024)
SmartChunk Retrieval: Query-Aware Chunk Compression with Planning for Efficient Document RAG
por: Zhang, Xuechen, et al.
Publicado: (2025)
por: Zhang, Xuechen, et al.
Publicado: (2025)
TopoAlign: A Framework for Aligning Code to Math via Topological Decomposition
por: Li, Yupei, et al.
Publicado: (2025)
por: Li, Yupei, et al.
Publicado: (2025)
Context-Aware Dynamic Chunking for Streaming Tibetan Speech Recognition
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
Visual Late Chunking: An Empirical Study of Contextual Chunking for Efficient Visual Document Retrieval
por: Yan, Yibo, et al.
Publicado: (2026)
por: Yan, Yibo, et al.
Publicado: (2026)
TopoBench: Benchmarking LLMs on Hard Topological Reasoning
por: Maniparambil, Mayug, et al.
Publicado: (2026)
por: Maniparambil, Mayug, et al.
Publicado: (2026)
Toward General Semantic Chunking: A Discriminative Framework for Ultra-Long Documents
por: Wu, Kaifeng, et al.
Publicado: (2025)
por: Wu, Kaifeng, et al.
Publicado: (2025)
TopoCurate:Modeling Interaction Topology for Tool-Use Agent Training
por: Yang, Jinluan, et al.
Publicado: (2026)
por: Yang, Jinluan, et al.
Publicado: (2026)
Beyond Chunking: Discourse-Aware Hierarchical Retrieval for Long Document Question Answering
por: Chen, Huiyao, et al.
Publicado: (2025)
por: Chen, Huiyao, et al.
Publicado: (2025)
Efficient RAG with Intent-Aware Retrieval and Semantics-Preserving Chunking
por: Puspitasari, Fachrina Dewi, et al.
Publicado: (2026)
por: Puspitasari, Fachrina Dewi, et al.
Publicado: (2026)
Skip-Thinking: Chunk-wise Chain-of-Thought Distillation Enable Smaller Language Models to Reason Better and Faster
por: Chen, Xiao, et al.
Publicado: (2025)
por: Chen, Xiao, et al.
Publicado: (2025)
SASST: Leveraging Syntax-Aware Chunking and LLMs for Simultaneous Speech Translation
por: Yang, Zeyu, et al.
Publicado: (2025)
por: Yang, Zeyu, et al.
Publicado: (2025)
QChunker: Learning Question-Aware Text Chunking for Domain RAG via Multi-Agent Debate
por: Zhao, Jihao, et al.
Publicado: (2026)
por: Zhao, Jihao, et al.
Publicado: (2026)
ChunkRAG: Novel LLM-Chunk Filtering Method for RAG Systems
por: Singh, Ishneet Sukhvinder, et al.
Publicado: (2024)
por: Singh, Ishneet Sukhvinder, et al.
Publicado: (2024)
ChuLo: Chunk-Level Key Information Representation for Long Document Understanding
por: Li, Yan, et al.
Publicado: (2024)
por: Li, Yan, et al.
Publicado: (2024)
A Systematic Investigation of Document Chunking Strategies and Embedding Sensitivity
por: Shaukat, Muhammad Arslan, et al.
Publicado: (2026)
por: Shaukat, Muhammad Arslan, et al.
Publicado: (2026)
Structure-Aware Chunking for Tabular Data in Retrieval-Augmented Generation
por: Guttal, Pooja, et al.
Publicado: (2026)
por: Guttal, Pooja, et al.
Publicado: (2026)
Beyond Chunk-Local Extraction: Cross-Chunk Graph Augmentation for GraphRAG
por: Zhang, Jiaming, et al.
Publicado: (2026)
por: Zhang, Jiaming, et al.
Publicado: (2026)
LangTopo: Aligning Language Descriptions of Graphs with Tokenized Topological Modeling
por: Guan, Zhong, et al.
Publicado: (2024)
por: Guan, Zhong, et al.
Publicado: (2024)
S2 Chunking: A Hybrid Framework for Document Segmentation Through Integrated Spatial and Semantic Analysis
por: Verma, Prashant
Publicado: (2025)
por: Verma, Prashant
Publicado: (2025)
TopoLedgerBERT: Topological Learning of Ledger Description Embeddings using Siamese BERT-Networks
por: Noels, Sander, et al.
Publicado: (2024)
por: Noels, Sander, et al.
Publicado: (2024)
HiChunk: Evaluating and Enhancing Retrieval-Augmented Generation with Hierarchical Chunking
por: Lu, Wensheng, et al.
Publicado: (2025)
por: Lu, Wensheng, et al.
Publicado: (2025)
Agent-R1: A Unified and Modular Framework for Agentic Reinforcement Learning
por: Cheng, Mingyue, et al.
Publicado: (2025)
por: Cheng, Mingyue, et al.
Publicado: (2025)
Cross-Document Topic-Aligned Chunking for Retrieval-Augmented Generation
por: Stankovic, Mile
Publicado: (2025)
por: Stankovic, Mile
Publicado: (2025)
SlideAgent: Hierarchical Agentic Framework for Multi-Page Visual Document Understanding
por: Jin, Yiqiao, et al.
Publicado: (2025)
por: Jin, Yiqiao, et al.
Publicado: (2025)
Adaptive Chunking: Optimizing Chunking-Method Selection for RAG
por: Júnior, Paulo Roberto de Moura, et al.
Publicado: (2026)
por: Júnior, Paulo Roberto de Moura, et al.
Publicado: (2026)
Dynamic Chunking for Diffusion Language Models
por: Zhu, Yichen, et al.
Publicado: (2026)
por: Zhu, Yichen, et al.
Publicado: (2026)
The Emergence of Chunking Structures with Hierarchical RNN
por: Wu, Zijun, et al.
Publicado: (2023)
por: Wu, Zijun, et al.
Publicado: (2023)
FAMA: Failure-Aware Meta-Agentic Framework for Open-Source LLMs in Interactive Tool Use Environments
por: Saeidi, Amir, et al.
Publicado: (2026)
por: Saeidi, Amir, et al.
Publicado: (2026)
ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference
por: Ouyang, Haojie, et al.
Publicado: (2025)
por: Ouyang, Haojie, et al.
Publicado: (2025)
Geo-Encoder: A Chunk-Argument Bi-Encoder Framework for Chinese Geographic Re-Ranking
por: Cao, Yong, et al.
Publicado: (2023)
por: Cao, Yong, et al.
Publicado: (2023)
LycheeCluster: Efficient Long-Context Inference with Structure-Aware Chunking and Hierarchical KV Indexing
por: Li, Dongfang, et al.
Publicado: (2026)
por: Li, Dongfang, et al.
Publicado: (2026)
TopoDIM: One-shot Topology Generation of Diverse Interaction Modes for Multi-Agent Systems
por: Sun, Rui, et al.
Publicado: (2026)
por: Sun, Rui, et al.
Publicado: (2026)
Chunking German Legal Code
por: Prior, Max, et al.
Publicado: (2026)
por: Prior, Max, et al.
Publicado: (2026)
Chunk-Distilled Language Modeling
por: Li, Yanhong, et al.
Publicado: (2024)
por: Li, Yanhong, et al.
Publicado: (2024)
SSCFormer: Push the Limit of Chunk-wise Conformer for Streaming ASR Using Sequentially Sampled Chunks and Chunked Causal Convolution
por: Wang, Fangyuan, et al.
Publicado: (2022)
por: Wang, Fangyuan, et al.
Publicado: (2022)
MultiDocFusion: Hierarchical and Multimodal Chunking Pipeline for Enhanced RAG on Long Industrial Documents
por: Shin, Joongmin, et al.
Publicado: (2026)
por: Shin, Joongmin, et al.
Publicado: (2026)
ChunkAttention: Efficient Self-Attention with Prefix-Aware KV Cache and Two-Phase Partition
por: Ye, Lu, et al.
Publicado: (2024)
por: Ye, Lu, et al.
Publicado: (2024)
DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search
por: Li, Zhanli, et al.
Publicado: (2026)
por: Li, Zhanli, et al.
Publicado: (2026)
Ejemplares similares
-
FreeChunker: A Cross-Granularity Chunking Framework
por: Zhang, Wenxuan, et al.
Publicado: (2025) -
LumberChunker: Long-Form Narrative Document Segmentation
por: Duarte, André V., et al.
Publicado: (2024) -
SmartChunk Retrieval: Query-Aware Chunk Compression with Planning for Efficient Document RAG
por: Zhang, Xuechen, et al.
Publicado: (2025) -
TopoAlign: A Framework for Aligning Code to Math via Topological Decomposition
por: Li, Yupei, et al.
Publicado: (2025) -
Context-Aware Dynamic Chunking for Streaming Tibetan Speech Recognition
por: Wang, Chao, et al.
Publicado: (2025)