CASPR: Automated Evaluation Metric for Contrastive Summarization
Fuente:
arXiv
Guardado en:
| Autores principales: | Ananthamurugan, Nirupan, Duong, Dat, George, Philip, Gupta, Ankita, Tata, Sandeep, Gunel, Beliz |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SUMIE: A Synthetic Benchmark for Incremental Entity Summarization
por: Hwang, Eunjeong, et al.
Publicado: (2024)
por: Hwang, Eunjeong, et al.
Publicado: (2024)
STRUM-LLM: Attributed and Structured Contrastive Summarization
por: Gunel, Beliz, et al.
Publicado: (2024)
por: Gunel, Beliz, et al.
Publicado: (2024)
Enhancing Incremental Summarization with Structured Representations
por: Hwang, EunJeong, et al.
Publicado: (2024)
por: Hwang, EunJeong, et al.
Publicado: (2024)
PRISM: Efficient Long-Range Reasoning With Short-Context LLMs
por: Jayalath, Dulhan, et al.
Publicado: (2024)
por: Jayalath, Dulhan, et al.
Publicado: (2024)
An Automated Length-Aware Quality Metric for Summarization
por: Foland, Andrew D.
Publicado: (2025)
por: Foland, Andrew D.
Publicado: (2025)
APPLS: Evaluating Evaluation Metrics for Plain Language Summarization
por: Guo, Yue, et al.
Publicado: (2023)
por: Guo, Yue, et al.
Publicado: (2023)
Calibrating Model-Based Evaluation Metrics for Summarization
por: Liu, Hongye, et al.
Publicado: (2026)
por: Liu, Hongye, et al.
Publicado: (2026)
Predicting Task Performance with Context-aware Scaling Laws
por: Montgomery, Kyle, et al.
Publicado: (2025)
por: Montgomery, Kyle, et al.
Publicado: (2025)
Q-STRUM Debate: Query-Driven Contrastive Summarization for Recommendation Comparison
por: Saad, George-Kirollos, et al.
Publicado: (2025)
por: Saad, George-Kirollos, et al.
Publicado: (2025)
What's under the hood: Investigating Automatic Metrics on Meeting Summarization
por: Kirstein, Frederic, et al.
Publicado: (2024)
por: Kirstein, Frederic, et al.
Publicado: (2024)
Rethinking Scientific Summarization Evaluation: Grounding Explainable Metrics on Facet-aware Benchmark
por: Chen, Xiuying, et al.
Publicado: (2024)
por: Chen, Xiuying, et al.
Publicado: (2024)
Beyond N-Grams: Rethinking Evaluation Metrics and Strategies for Multilingual Abstractive Summarization
por: Mondshine, Itai, et al.
Publicado: (2025)
por: Mondshine, Itai, et al.
Publicado: (2025)
MLAN: Language-Based Instruction Tuning Preserves and Transfers Knowledge in Multimodal Language Models
por: Tu, Jianhong, et al.
Publicado: (2024)
por: Tu, Jianhong, et al.
Publicado: (2024)
Revisiting Metric Reliability for Fine-grained Evaluation of Machine Translation and Summarization in Indian Languages
por: Yari, Amir Hossein, et al.
Publicado: (2025)
por: Yari, Amir Hossein, et al.
Publicado: (2025)
DeepScholar-Bench: A Live Benchmark and Automated Evaluation for Generative Research Synthesis
por: Patel, Liana, et al.
Publicado: (2025)
por: Patel, Liana, et al.
Publicado: (2025)
ContrastScore: Towards Higher Quality, Less Biased, More Efficient Evaluation Metrics with Contrastive Evaluation
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
PlainQAFact: Retrieval-augmented Factual Consistency Evaluation Metric for Biomedical Plain Language Summarization
por: You, Zhiwen, et al.
Publicado: (2025)
por: You, Zhiwen, et al.
Publicado: (2025)
Faithful Model Evaluation for Model-Based Metrics
por: Goyal, Palash, et al.
Publicado: (2023)
por: Goyal, Palash, et al.
Publicado: (2023)
Discrete Diffusion Language Model for Efficient Text Summarization
por: Dat, Do Huu, et al.
Publicado: (2024)
por: Dat, Do Huu, et al.
Publicado: (2024)
Enhancing Argument Summarization: Prioritizing Exhaustiveness in Key Point Generation and Introducing an Automatic Coverage Evaluation Metric
por: Khosravani, Mohammad, et al.
Publicado: (2024)
por: Khosravani, Mohammad, et al.
Publicado: (2024)
Evaluating Metrics for Bias in Word Embeddings
por: Schröder, Sarah, et al.
Publicado: (2021)
por: Schröder, Sarah, et al.
Publicado: (2021)
Mitigating the Impact of Reference Quality on Evaluation of Summarization Systems with Reference-Free Metrics
por: Gigant, Théo, et al.
Publicado: (2024)
por: Gigant, Théo, et al.
Publicado: (2024)
Medical Question Summarization with Entity-driven Contrastive Learning
por: Lu, Wenpeng, et al.
Publicado: (2023)
por: Lu, Wenpeng, et al.
Publicado: (2023)
NovAScore: A New Automated Metric for Evaluating Document Level Novelty
por: Ai, Lin, et al.
Publicado: (2024)
por: Ai, Lin, et al.
Publicado: (2024)
Iterative Augmentation with Summarization Refinement (IASR) Evaluation for Unstructured Survey data Modeling and Analysis
por: Bhattad, Payal, et al.
Publicado: (2025)
por: Bhattad, Payal, et al.
Publicado: (2025)
An Analysis on Automated Metrics for Evaluating Japanese-English Chat Translation
por: Rusli, Andre, et al.
Publicado: (2024)
por: Rusli, Andre, et al.
Publicado: (2024)
SteerEval: Inference-time Interventions Strengthen Multilingual Generalization in Neural Summarization Metrics
por: Casola, Silvia, et al.
Publicado: (2026)
por: Casola, Silvia, et al.
Publicado: (2026)
Legal Document Summarization: Enhancing Judicial Efficiency through Automation Detection
por: Li, Yongjie, et al.
Publicado: (2025)
por: Li, Yongjie, et al.
Publicado: (2025)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
por: Feng, Huawen, et al.
Publicado: (2023)
por: Feng, Huawen, et al.
Publicado: (2023)
BioACE: An Automated Framework for Biomedical Answer and Citation Evaluations
por: Gupta, Deepak, et al.
Publicado: (2026)
por: Gupta, Deepak, et al.
Publicado: (2026)
A Dataset and Benchmark for Consumer Healthcare Question Summarization
por: Basu, Abhishek, et al.
Publicado: (2025)
por: Basu, Abhishek, et al.
Publicado: (2025)
Medalyze: Lightweight Medical Report Summarization Application Using FLAN-T5-Large
por: Nguyen, Van-Tinh, et al.
Publicado: (2025)
por: Nguyen, Van-Tinh, et al.
Publicado: (2025)
Moneyball with LLMs: Analyzing Tabular Summarization in Sports Narratives
por: Upadhyay, Ritam, et al.
Publicado: (2025)
por: Upadhyay, Ritam, et al.
Publicado: (2025)
What do the metrics mean? A critical analysis of the use of Automated Evaluation Metrics in Interpreting
por: Downie, Jonathan, et al.
Publicado: (2026)
por: Downie, Jonathan, et al.
Publicado: (2026)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
On the Role of Summary Content Units in Text Summarization Evaluation
por: Nawrath, Marcel, et al.
Publicado: (2024)
por: Nawrath, Marcel, et al.
Publicado: (2024)
Fine-grained and Explainable Factuality Evaluation for Multimodal Summarization
por: Zhang, Yue, et al.
Publicado: (2024)
por: Zhang, Yue, et al.
Publicado: (2024)
PSentScore: Evaluating Sentiment Polarity in Dialogue Summarization
por: Zhou, Yongxin, et al.
Publicado: (2023)
por: Zhou, Yongxin, et al.
Publicado: (2023)
Multi-Dimensional Evaluation of Text Summarization with In-Context Learning
por: Jain, Sameer, et al.
Publicado: (2023)
por: Jain, Sameer, et al.
Publicado: (2023)
mFACE: Multilingual Summarization with Factual Consistency Evaluation
por: Aharoni, Roee, et al.
Publicado: (2022)
por: Aharoni, Roee, et al.
Publicado: (2022)
Ejemplares similares
-
SUMIE: A Synthetic Benchmark for Incremental Entity Summarization
por: Hwang, Eunjeong, et al.
Publicado: (2024) -
STRUM-LLM: Attributed and Structured Contrastive Summarization
por: Gunel, Beliz, et al.
Publicado: (2024) -
Enhancing Incremental Summarization with Structured Representations
por: Hwang, EunJeong, et al.
Publicado: (2024) -
PRISM: Efficient Long-Range Reasoning With Short-Context LLMs
por: Jayalath, Dulhan, et al.
Publicado: (2024) -
An Automated Length-Aware Quality Metric for Summarization
por: Foland, Andrew D.
Publicado: (2025)