QAPyramid: Fine-grained Evaluation of Content Selection for Text Summarization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Shiyue, Wan, David, Cattan, Arie, Klein, Ayal, Dagan, Ido, Bansal, Mohit |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GenerationPrograms: Fine-grained Attribution with Executable Programs
par: Wan, David, et autres
Publié: (2025)
par: Wan, David, et autres
Publié: (2025)
Localizing Factual Inconsistencies in Attributable Text Generation
par: Cattan, Arie, et autres
Publié: (2024)
par: Cattan, Arie, et autres
Publié: (2024)
PrefixNLI: Detecting Factual Inconsistencies as Soon as They Arise
par: Harary, Sapir, et autres
Publié: (2025)
par: Harary, Sapir, et autres
Publié: (2025)
Consensus or Conflict? Fine-Grained Evaluation of Conflicting Answers in Question-Answering
par: Nachshoni, Eviatar, et autres
Publié: (2025)
par: Nachshoni, Eviatar, et autres
Publié: (2025)
Explicating the Implicit: Argument Detection Beyond Sentence Boundaries
par: Roit, Paul, et autres
Publié: (2024)
par: Roit, Paul, et autres
Publié: (2024)
Attribute First, then Generate: Locally-attributable Grounded Text Generation
par: Slobodkin, Aviv, et autres
Publié: (2024)
par: Slobodkin, Aviv, et autres
Publié: (2024)
CLATTER: Comprehensive Entailment Reasoning for Hallucination Detection
par: Eliav, Ron, et autres
Publié: (2025)
par: Eliav, Ron, et autres
Publié: (2025)
FineSurE: Fine-grained Summarization Evaluation using LLMs
par: Song, Hwanjun, et autres
Publié: (2024)
par: Song, Hwanjun, et autres
Publié: (2024)
Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation
par: Cho, Jaemin, et autres
Publié: (2023)
par: Cho, Jaemin, et autres
Publié: (2023)
LAQuer: Localized Attribution Queries in Content-grounded Generation
par: Hirsch, Eran, et autres
Publié: (2025)
par: Hirsch, Eran, et autres
Publié: (2025)
MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-Entropies
par: Zhang, Shiyue, et autres
Publié: (2023)
par: Zhang, Shiyue, et autres
Publié: (2023)
QA-Noun: Representing Nominal Semantics via Natural Language Question-Answer Pairs
par: Tseytlin, Maria, et autres
Publié: (2025)
par: Tseytlin, Maria, et autres
Publié: (2025)
Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM
par: Yuan, Dong, et autres
Publié: (2024)
par: Yuan, Dong, et autres
Publié: (2024)
MAMM-Refine: A Recipe for Improving Faithfulness in Generation with Multi-Agent Collaboration
par: Wan, David, et autres
Publié: (2025)
par: Wan, David, et autres
Publié: (2025)
UPCORE: Utility-Preserving Coreset Selection for Balanced Unlearning
par: Patil, Vaidehi, et autres
Publié: (2025)
par: Patil, Vaidehi, et autres
Publié: (2025)
Effective QA-driven Annotation of Predicate-Argument Relations Across Languages
par: Davidov, Jonathan, et autres
Publié: (2026)
par: Davidov, Jonathan, et autres
Publié: (2026)
A Comparative Study of Quality Evaluation Methods for Text Summarization
par: Nguyen, Huyen, et autres
Publié: (2024)
par: Nguyen, Huyen, et autres
Publié: (2024)
Is It Really Long Context if All You Need Is Retrieval? Towards Genuinely Difficult Long Context NLP
par: Goldman, Omer, et autres
Publié: (2024)
par: Goldman, Omer, et autres
Publié: (2024)
Identifying User Goals from UI Trajectories
par: Berkovitch, Omri, et autres
Publié: (2024)
par: Berkovitch, Omri, et autres
Publié: (2024)
Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement
par: Lee, Daeun, et autres
Publié: (2024)
par: Lee, Daeun, et autres
Publié: (2024)
SciQAG: A Framework for Auto-Generated Science Question Answering Dataset with Fine-grained Evaluation
par: Wan, Yuwei, et autres
Publié: (2024)
par: Wan, Yuwei, et autres
Publié: (2024)
Dont Add, dont Miss: Effective Content Preserving Generation from Pre-Selected Text Spans
par: Slobodkin, Aviv, et autres
Publié: (2023)
par: Slobodkin, Aviv, et autres
Publié: (2023)
Parameter-Efficient Fine-Tuning for Medical Text Summarization: A Comparative Study of Lora, Prompt Tuning, and Full Fine-Tuning
par: Shernazarov, Ulugbek, et autres
Publié: (2026)
par: Shernazarov, Ulugbek, et autres
Publié: (2026)
LACIE: Listener-Aware Finetuning for Confidence Calibration in Large Language Models
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
Teaching Models to Balance Resisting and Accepting Persuasion
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
Language Models Identify Ambiguities and Exploit Loopholes
par: Choi, Jio, et autres
Publié: (2025)
par: Choi, Jio, et autres
Publié: (2025)
ECoFLaP: Efficient Coarse-to-Fine Layer-Wise Pruning for Vision-Language Models
par: Sung, Yi-Lin, et autres
Publié: (2023)
par: Sung, Yi-Lin, et autres
Publié: (2023)
LMUnit: Fine-grained Evaluation with Natural Language Unit Tests
par: Saad-Falcon, Jon, et autres
Publié: (2024)
par: Saad-Falcon, Jon, et autres
Publié: (2024)
Fennec: Fine-grained Language Model Evaluation and Correction Extended through Branching and Bridging
par: Liang, Xiaobo, et autres
Publié: (2024)
par: Liang, Xiaobo, et autres
Publié: (2024)
Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training
par: Wan, David, et autres
Publié: (2024)
par: Wan, David, et autres
Publié: (2024)
Efficient Data Generation for Source-grounded Information-seeking Dialogs: A Use Case for Meeting Transcripts
par: Golany, Lotem, et autres
Publié: (2024)
par: Golany, Lotem, et autres
Publié: (2024)
ChallengeMe: An Adversarial Learning-enabled Text Summarization Framework
par: Deng, Xiaoyu, et autres
Publié: (2025)
par: Deng, Xiaoyu, et autres
Publié: (2025)
DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation
par: Wang, Zun, et autres
Publié: (2024)
par: Wang, Zun, et autres
Publié: (2024)
RAG LLMs are Not Safer: A Safety Analysis of Retrieval-Augmented Generation for Large Language Models
par: An, Bang, et autres
Publié: (2025)
par: An, Bang, et autres
Publié: (2025)
UniSumEval: Towards Unified, Fine-Grained, Multi-Dimensional Summarization Evaluation for LLMs
par: Lee, Yuho, et autres
Publié: (2024)
par: Lee, Yuho, et autres
Publié: (2024)
An Evaluation of Large Language Models on Text Summarization Tasks Using Prompt Engineering Techniques
par: Aly, Walid Mohamed, et autres
Publié: (2025)
par: Aly, Walid Mohamed, et autres
Publié: (2025)
When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation
par: Goren, Shani, et autres
Publié: (2026)
par: Goren, Shani, et autres
Publié: (2026)
Evaluating the Retrieval Robustness of Large Language Models
par: Cao, Shuyang, et autres
Publié: (2025)
par: Cao, Shuyang, et autres
Publié: (2025)
CNsum:Automatic Summarization for Chinese News Text
par: Zhao, Yu, et autres
Publié: (2025)
par: Zhao, Yu, et autres
Publié: (2025)
A Unifying Scheme for Extractive Content Selection Tasks
par: Amar, Shmuel, et autres
Publié: (2025)
par: Amar, Shmuel, et autres
Publié: (2025)
Documents similaires
-
GenerationPrograms: Fine-grained Attribution with Executable Programs
par: Wan, David, et autres
Publié: (2025) -
Localizing Factual Inconsistencies in Attributable Text Generation
par: Cattan, Arie, et autres
Publié: (2024) -
PrefixNLI: Detecting Factual Inconsistencies as Soon as They Arise
par: Harary, Sapir, et autres
Publié: (2025) -
Consensus or Conflict? Fine-Grained Evaluation of Conflicting Answers in Question-Answering
par: Nachshoni, Eviatar, et autres
Publié: (2025) -
Explicating the Implicit: Argument Detection Beyond Sentence Boundaries
par: Roit, Paul, et autres
Publié: (2024)