HiPS: Hierarchical PDF Segmentation of Textbooks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wehnert, Sabine, Changaramkulath, Harikrishnan, De Luca, Ernesto William |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AI-Friendly LaTeX: Using LaTeX Code as a Knowledge Source for Retrieval-Augmented Generation
par: Verhoeff, Tom
Publié: (2026)
par: Verhoeff, Tom
Publié: (2026)
Document Understanding for Healthcare Referrals
par: Mistry, Jimit, et autres
Publié: (2023)
par: Mistry, Jimit, et autres
Publié: (2023)
"The Data Says Otherwise"-Towards Automated Fact-checking and Communication of Data Claims
par: Fu, Yu, et autres
Publié: (2024)
par: Fu, Yu, et autres
Publié: (2024)
A Semantic Approach to Negation Detection and Word Disambiguation with Natural Language Processing
par: Okpala, Izunna, et autres
Publié: (2023)
par: Okpala, Izunna, et autres
Publié: (2023)
S2Doc -- Spatial-Semantic Document Format
par: Kempf, Sebastian, et autres
Publié: (2025)
par: Kempf, Sebastian, et autres
Publié: (2025)
Leveraging Large Language Models for Semantic Query Processing in a Scholarly Knowledge Graph
par: Jia, Runsong, et autres
Publié: (2024)
par: Jia, Runsong, et autres
Publié: (2024)
Graphemic Normalization of the Perso-Arabic Script
par: Doctor, Raiomond, et autres
Publié: (2022)
par: Doctor, Raiomond, et autres
Publié: (2022)
Beyond Arabic: Software for Perso-Arabic Script Manipulation
par: Gutkin, Alexander, et autres
Publié: (2023)
par: Gutkin, Alexander, et autres
Publié: (2023)
Co-Writing with AI, on Human Terms: Aligning Research with User Demands Across the Writing Process
par: Reza, Mohi, et autres
Publié: (2025)
par: Reza, Mohi, et autres
Publié: (2025)
HySemRAG: A Hybrid Semantic Retrieval-Augmented Generation Framework for Automated Literature Synthesis and Methodological Gap Analysis
par: Godinez, Alejandro
Publié: (2025)
par: Godinez, Alejandro
Publié: (2025)
FATHOMS-RAG: A Framework for the Assessment of Thinking and Observation in Multimodal Systems that use Retrieval Augmented Generation
par: Hildebrand, Samuel, et autres
Publié: (2025)
par: Hildebrand, Samuel, et autres
Publié: (2025)
Hydra: Unifying Document Retrieval and Generation in a Single Vision-Language Model
par: Georgiou, Athos
Publié: (2026)
par: Georgiou, Athos
Publié: (2026)
BabelDOC: Better Layout-Preserving PDF Translation via Intermediate Representation
par: Yang, Qi, et autres
Publié: (2026)
par: Yang, Qi, et autres
Publié: (2026)
Detection of Personal Data in Structured Datasets Using a Large Language Model
par: Ntwali, Albert Agisha, et autres
Publié: (2025)
par: Ntwali, Albert Agisha, et autres
Publié: (2025)
Deep Learning based Key Information Extraction from Business Documents: Systematic Literature Review
par: Rombach, Alexander Michael, et autres
Publié: (2024)
par: Rombach, Alexander Michael, et autres
Publié: (2024)
LLM-supported document separation for printed reviews from zbMATH Open
par: Pluzhnikov, Ivan, et autres
Publié: (2026)
par: Pluzhnikov, Ivan, et autres
Publié: (2026)
Qwerty AI: Explainable Automated Age Rating and Content Safety Assessment for Russian-Language Screenplays
par: Zmanovskii, Nikita
Publié: (2025)
par: Zmanovskii, Nikita
Publié: (2025)
Large Language Models for Simultaneous Named Entity Extraction and Spelling Correction
par: Whittaker, Edward, et autres
Publié: (2024)
par: Whittaker, Edward, et autres
Publié: (2024)
HalalBench: A Multilingual OCR Benchmark for Food Packaging Ingredient Extraction
par: Arief, Hasan
Publié: (2026)
par: Arief, Hasan
Publié: (2026)
TMT: A Simple Way to Translate Topic Models Using Dictionaries
par: Engl, Felix, et autres
Publié: (2025)
par: Engl, Felix, et autres
Publié: (2025)
Enhancing Scientific Literature Chatbots with Retrieval-Augmented Generation: A Performance Evaluation of Vector and Graph-Based Systems
par: Ghanadian, Hamideh, et autres
Publié: (2026)
par: Ghanadian, Hamideh, et autres
Publié: (2026)
Smart ETL and LLM-based contents classification: the European Smart Tourism Tools Observatory experience
par: Cosme, Diogo, et autres
Publié: (2024)
par: Cosme, Diogo, et autres
Publié: (2024)
DEUCE: Dual-diversity Enhancement and Uncertainty-awareness for Cold-start Active Learning
par: Guo, Jiaxin, et autres
Publié: (2025)
par: Guo, Jiaxin, et autres
Publié: (2025)
SoccerRAG: Multimodal Soccer Information Retrieval via Natural Queries
par: Strand, Aleksander Theo, et autres
Publié: (2024)
par: Strand, Aleksander Theo, et autres
Publié: (2024)
Demo: Soccer Information Retrieval via Natural Queries using SoccerRAG
par: Strand, Aleksander Theo, et autres
Publié: (2024)
par: Strand, Aleksander Theo, et autres
Publié: (2024)
VOGUE: A Multimodal Dataset for Conversational Recommendation in Fashion
par: Guo, David, et autres
Publié: (2025)
par: Guo, David, et autres
Publié: (2025)
TriAlignGR: Triangular Multitask Alignment with Multimodal Deep Interest Mining for Generative Recommendation
par: Zeng, Yangchen, et autres
Publié: (2026)
par: Zeng, Yangchen, et autres
Publié: (2026)
Adapting PromptORE for Modern History: Information Extraction from Hispanic Monarchy Documents of the XVIth Century
par: Hidalgo, Hèctor Loopez, et autres
Publié: (2024)
par: Hidalgo, Hèctor Loopez, et autres
Publié: (2024)
SampoNLP: A Self-Referential Toolkit for Morphological Analysis of Subword Tokenizers
par: Chelombitko, Iaroslav, et autres
Publié: (2026)
par: Chelombitko, Iaroslav, et autres
Publié: (2026)
Intent-Driven Dynamic Chunking: Segmenting Documents to Reflect Predicted Information Needs
par: Koutsiaris, Christos
Publié: (2026)
par: Koutsiaris, Christos
Publié: (2026)
A Multimodal Pipeline for Clinical Data Extraction: Applying Vision-Language Models to Scans of Transfusion Reaction Reports
par: Schäfer, Henning, et autres
Publié: (2025)
par: Schäfer, Henning, et autres
Publié: (2025)
A Survey of Text and Speech Resources for Hausa and Fongbe: Availability, Quality, and Gaps for NLP Development
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026)
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026)
LLMs as Architects and Critics for Multi-Source Opinion Summarization
par: Attri, Anuj, et autres
Publié: (2025)
par: Attri, Anuj, et autres
Publié: (2025)
Why We Feel What We Feel: Joint Detection of Emotions and Their Opinion Triggers in E-commerce
par: Attri, Arnav, et autres
Publié: (2025)
par: Attri, Arnav, et autres
Publié: (2025)
Mitigating Response Delays in Free-Form Conversations with LLM-powered Intelligent Virtual Agents
par: Maslych, Mykola, et autres
Publié: (2025)
par: Maslych, Mykola, et autres
Publié: (2025)
Detection of ChatGPT Fake Science with the xFakeSci Learning Algorithm
par: Hamed, Ahmed Abdeen, et autres
Publié: (2023)
par: Hamed, Ahmed Abdeen, et autres
Publié: (2023)
What Matters in LLM-Based Feature Extractor for Recommender? A Systematic Analysis of Prompts, Models, and Adaptation
par: Shi, Kainan, et autres
Publié: (2025)
par: Shi, Kainan, et autres
Publié: (2025)
Reading Between the Waves: Robust Topic Segmentation Using Inter-Sentence Audio Features
par: Freisinger, Steffen, et autres
Publié: (2026)
par: Freisinger, Steffen, et autres
Publié: (2026)
Cognitive Linguistic Identity Fusion Score (CLIFS): A Scalable Cognition-Informed Approach to Quantifying Identity Fusion from Text
par: Wright, Devin R., et autres
Publié: (2025)
par: Wright, Devin R., et autres
Publié: (2025)
"This Suits You the Best": Query Focused Comparative Explainable Summarization
par: Attri, Arnav, et autres
Publié: (2025)
par: Attri, Arnav, et autres
Publié: (2025)
Documents similaires
-
AI-Friendly LaTeX: Using LaTeX Code as a Knowledge Source for Retrieval-Augmented Generation
par: Verhoeff, Tom
Publié: (2026) -
Document Understanding for Healthcare Referrals
par: Mistry, Jimit, et autres
Publié: (2023) -
"The Data Says Otherwise"-Towards Automated Fact-checking and Communication of Data Claims
par: Fu, Yu, et autres
Publié: (2024) -
A Semantic Approach to Negation Detection and Word Disambiguation with Natural Language Processing
par: Okpala, Izunna, et autres
Publié: (2023) -
S2Doc -- Spatial-Semantic Document Format
par: Kempf, Sebastian, et autres
Publié: (2025)