Long document summarization using page specific target text alignment and distilling page importance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Devi, Pushpa, Agrawal, Ayush, Dubey, Ashutosh, Chowdary, C. Ravindranath |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SlideSpawn: An Automatic Slides Generation System for Research Publications
par: Kumar, Keshav, et autres
Publié: (2024)
par: Kumar, Keshav, et autres
Publié: (2024)
Loops On Retrieval Augmented Generation (LoRAG)
par: Thakur, Ayush, et autres
Publié: (2024)
par: Thakur, Ayush, et autres
Publié: (2024)
Abstractive summarization from Audio Transcription
par: Derkach, Ilia
Publié: (2024)
par: Derkach, Ilia
Publié: (2024)
Is text normalization relevant for classifying medieval charters?
par: Atzenhofer-Baumgartner, Florian, et autres
Publié: (2024)
par: Atzenhofer-Baumgartner, Florian, et autres
Publié: (2024)
Benchmarking pre-trained text embedding models in aligning built asset information
par: Shahinmoghadam, Mehrzad, et autres
Publié: (2024)
par: Shahinmoghadam, Mehrzad, et autres
Publié: (2024)
$\text{R}^2\text{R}$: A Route-to-Rerank Post-Training Framework for Multi-Domain Decoder-Only Rerankers
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
Facilitating phenotyping from clinical texts: the medkit library
par: Neuraz, Antoine, et autres
Publié: (2024)
par: Neuraz, Antoine, et autres
Publié: (2024)
How important is Recall for Measuring Retrieval Quality?
par: Schwartz, Shelly, et autres
Publié: (2025)
par: Schwartz, Shelly, et autres
Publié: (2025)
Is Architectural Complexity Overrated? Competitive and Interpretable Knowledge Graph Completion with RelatE
par: Chakraborty, Abhijit, et autres
Publié: (2025)
par: Chakraborty, Abhijit, et autres
Publié: (2025)
Evaluation of the phi-3-mini SLM for identification of texts related to medicine, health, and sports injuries
par: Brogly, Chris, et autres
Publié: (2025)
par: Brogly, Chris, et autres
Publié: (2025)
Retrieving Contextual Information for Long-Form Question Answering using Weak Supervision
par: Christmann, Philipp, et autres
Publié: (2024)
par: Christmann, Philipp, et autres
Publié: (2024)
Causality extraction from medical text using Large Language Models (LLMs)
par: Gopalakrishnan, Seethalakshmi, et autres
Publié: (2024)
par: Gopalakrishnan, Seethalakshmi, et autres
Publié: (2024)
Introducing Super RAGs in Mistral 8x7B-v1
par: Thakur, Ayush, et autres
Publié: (2024)
par: Thakur, Ayush, et autres
Publié: (2024)
MRGSEM-Sum: An Unsupervised Multi-document Summarization Framework based on Multi-Relational Graphs and Structural Entropy Minimization
par: Zhang, Yongbing, et autres
Publié: (2025)
par: Zhang, Yongbing, et autres
Publié: (2025)
Deep Learning Based Named Entity Recognition Models for Recipes
par: Goel, Mansi, et autres
Publié: (2024)
par: Goel, Mansi, et autres
Publié: (2024)
REARANK: Reasoning Re-ranking Agent via Reinforcement Learning
par: Zhang, Le, et autres
Publié: (2025)
par: Zhang, Le, et autres
Publié: (2025)
OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Framework
par: Chen, Ben, et autres
Publié: (2026)
par: Chen, Ben, et autres
Publié: (2026)
EIoU-EMC: A Novel Loss for Domain-specific Nested Entity Recognition
par: Zhang, Jian, et autres
Publié: (2025)
par: Zhang, Jian, et autres
Publié: (2025)
DREditor: An Time-efficient Approach for Building a Domain-specific Dense Retrieval Model
par: Huang, Chen, et autres
Publié: (2024)
par: Huang, Chen, et autres
Publié: (2024)
Passage-specific Prompt Tuning for Passage Reranking in Question Answering with Large Language Models
par: Wu, Xuyang, et autres
Publié: (2024)
par: Wu, Xuyang, et autres
Publié: (2024)
DomainRAG: A Chinese Benchmark for Evaluating Domain-specific Retrieval-Augmented Generation
par: Wang, Shuting, et autres
Publié: (2024)
par: Wang, Shuting, et autres
Publié: (2024)
FsPONER: Few-shot Prompt Optimization for Named Entity Recognition in Domain-specific Scenarios
par: Tang, Yongjian, et autres
Publié: (2024)
par: Tang, Yongjian, et autres
Publié: (2024)
OkraLong: A Flexible Retrieval-Augmented Framework for Long-Text Query Processing
par: Hui, Yulong, et autres
Publié: (2025)
par: Hui, Yulong, et autres
Publié: (2025)
SciNets: Graph-Constrained Multi-Hop Reasoning for Scientific Literature Synthesis
par: Dubey, Sauhard
Publié: (2025)
par: Dubey, Sauhard
Publié: (2025)
Long Dialog Summarization: An Analysis
par: Mullick, Ankan, et autres
Publié: (2024)
par: Mullick, Ankan, et autres
Publié: (2024)
Can't Remember Details in Long Documents? You Need Some R&R
par: Agrawal, Devanshu, et autres
Publié: (2024)
par: Agrawal, Devanshu, et autres
Publié: (2024)
Adaptive Data-Resilient Multi-Modal Hierarchical Multi-Label Book Genre Identification
par: Nareti, Utsav Kumar, et autres
Publié: (2025)
par: Nareti, Utsav Kumar, et autres
Publié: (2025)
Aug2Search: Enhancing Facebook Marketplace Search with LLM-Generated Synthetic Data Augmentation
par: Xi, Ruijie, et autres
Publié: (2025)
par: Xi, Ruijie, et autres
Publié: (2025)
NEAR$^2$: A Nested Embedding Approach to Efficient Product Retrieval and Ranking
par: Qian, Shenbin, et autres
Publié: (2025)
par: Qian, Shenbin, et autres
Publié: (2025)
Recall Them All: Retrieval-Augmented Language Models for Long Object List Extraction from Long Documents
par: Singhania, Sneha, et autres
Publié: (2024)
par: Singhania, Sneha, et autres
Publié: (2024)
Noise reduction in BERT NER models for clinical entity extraction
par: Jiwani, Kuldeep, et autres
Publié: (2026)
par: Jiwani, Kuldeep, et autres
Publié: (2026)
Leveraging Hierarchical Organization for Medical Multi-document Summarization
par: Hsu, Yi-Li, et autres
Publié: (2025)
par: Hsu, Yi-Li, et autres
Publié: (2025)
Multi-Relation Extraction in Entity Pairs using Global Context
par: Nilesh, et autres
Publié: (2025)
par: Nilesh, et autres
Publié: (2025)
Who's important? -- SUnSET: Synergistic Understanding of Stakeholder, Events and Time for Timeline Generation
par: Sim, Tiviatis, et autres
Publié: (2025)
par: Sim, Tiviatis, et autres
Publié: (2025)
Unstructured Evidence Attribution for Long Context Query Focused Summarization
par: Wright, Dustin, et autres
Publié: (2025)
par: Wright, Dustin, et autres
Publié: (2025)
Graph-Based Retriever Captures the Long Tail of Biomedical Knowledge
par: Delile, Julien, et autres
Publié: (2024)
par: Delile, Julien, et autres
Publié: (2024)
Writing in the Margins: Better Inference Pattern for Long Context Retrieval
par: Russak, Melisa, et autres
Publié: (2024)
par: Russak, Melisa, et autres
Publié: (2024)
Positional Bias in Long-Document Ranking: Impact, Assessment, and Mitigation
par: Boytsov, Leonid, et autres
Publié: (2022)
par: Boytsov, Leonid, et autres
Publié: (2022)
Millions of $\text{GeAR}$-s: Extending GraphRAG to Millions of Documents
par: Shen, Zhili, et autres
Publié: (2025)
par: Shen, Zhili, et autres
Publié: (2025)
Exploring Selective Retrieval-Augmentation for Long-Tail Legal Text Classification
par: Mao, Boheng
Publié: (2025)
par: Mao, Boheng
Publié: (2025)
Documents similaires
-
SlideSpawn: An Automatic Slides Generation System for Research Publications
par: Kumar, Keshav, et autres
Publié: (2024) -
Loops On Retrieval Augmented Generation (LoRAG)
par: Thakur, Ayush, et autres
Publié: (2024) -
Abstractive summarization from Audio Transcription
par: Derkach, Ilia
Publié: (2024) -
Is text normalization relevant for classifying medieval charters?
par: Atzenhofer-Baumgartner, Florian, et autres
Publié: (2024) -
Benchmarking pre-trained text embedding models in aligning built asset information
par: Shahinmoghadam, Mehrzad, et autres
Publié: (2024)