Event-based evaluation of abstractive news summarization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | You, Huiling, Touileb, Samia, Velldal, Erik, Øvrelid, Lilja |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Benchmarking Abstractive Summarisation: A Dataset of Human-authored Summaries of Norwegian News Articles
par: Touileb, Samia, et autres
Publié: (2025)
par: Touileb, Samia, et autres
Publié: (2025)
Entity-Level Sentiment: More than the Sum of Its Parts
par: Rønningstad, Egil, et autres
Publié: (2024)
par: Rønningstad, Egil, et autres
Publié: (2024)
Fluent Alignment with Disfluent Judges: Post-training for Lower-resource Languages
par: Samuel, David, et autres
Publié: (2025)
par: Samuel, David, et autres
Publié: (2025)
Mixed Feelings: Cross-Domain Sentiment Classification of Patient Feedback
par: Rønningstad, Egil, et autres
Publié: (2025)
par: Rønningstad, Egil, et autres
Publié: (2025)
A Collection of Question Answering Datasets for Norwegian
par: Mikhailov, Vladislav, et autres
Publié: (2025)
par: Mikhailov, Vladislav, et autres
Publié: (2025)
It's Difficult to be Neutral -- Human and LLM-based Sentiment Annotation of Patient Comments
par: Mæhlum, Petter, et autres
Publié: (2024)
par: Mæhlum, Petter, et autres
Publié: (2024)
Compositional Generalization with Grounded Language Models
par: Wold, Sondre, et autres
Publié: (2024)
par: Wold, Sondre, et autres
Publié: (2024)
NorEval: A Norwegian Language Understanding and Generation Evaluation Benchmark
par: Mikhailov, Vladislav, et autres
Publié: (2025)
par: Mikhailov, Vladislav, et autres
Publié: (2025)
Small Languages, Big Models: A Study of Continual Training on Languages of Norway
par: Samuel, David, et autres
Publié: (2024)
par: Samuel, David, et autres
Publié: (2024)
A Systematic Survey of Semantic Role Labeling in the Era of Pretrained Language Models
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
Factual consistency evaluation of summarization in the Era of large language models
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
Improving ROUGE‐1 by 6%: A novel multilingual transformer for abstractive news summarization
par: Sandeep Kumar, et autres
Publié: (2024)
par: Sandeep Kumar, et autres
Publié: (2024)
Optimizing the role of human evaluation in LLM-based spoken document summarization systems
par: Kroll, Margaret, et autres
Publié: (2024)
par: Kroll, Margaret, et autres
Publié: (2024)
Leveraging language models for summarizing mental state examinations: A comprehensive evaluation and dataset release
par: Sahu, Nilesh Kumar, et autres
Publié: (2024)
par: Sahu, Nilesh Kumar, et autres
Publié: (2024)
FENICE: Factuality Evaluation of summarization based on Natural language Inference and Claim Extraction
par: Scirè, Alessandro, et autres
Publié: (2024)
par: Scirè, Alessandro, et autres
Publié: (2024)
An empirical evaluation of using ChatGPT to summarize disputes for recommending similar labor and employment cases in Chinese
par: Wu, Po-Hsien, et autres
Publié: (2024)
par: Wu, Po-Hsien, et autres
Publié: (2024)
Can summarization approximate simplification? A gold standard comparison
par: Magnifico, Giacomo, et autres
Publié: (2025)
par: Magnifico, Giacomo, et autres
Publié: (2025)
Text summarization via global structure awareness
par: Zhang, Jiaquan, et autres
Publié: (2026)
par: Zhang, Jiaquan, et autres
Publié: (2026)
The current status of large language models in summarizing radiology report impressions
par: Hu, Danqing, et autres
Publié: (2024)
par: Hu, Danqing, et autres
Publié: (2024)
FABLES: Evaluating faithfulness and content selection in book-length summarization
par: Kim, Yekyung, et autres
Publié: (2024)
par: Kim, Yekyung, et autres
Publié: (2024)
Abstractive summarization from Audio Transcription
par: Derkach, Ilia
Publié: (2024)
par: Derkach, Ilia
Publié: (2024)
Toward expanding the scope of radiology report summarization to multiple anatomies and modalities
par: Chen, Zhihong, et autres
Publié: (2022)
par: Chen, Zhihong, et autres
Publié: (2022)
Panacea: A foundation model for clinical trial search, summarization, design, and recruitment
par: Lin, Jiacheng, et autres
Publié: (2024)
par: Lin, Jiacheng, et autres
Publié: (2024)
Increasing faithfulness in human-human dialog summarization with Spoken Language Understanding tasks
par: Akani, Eunice, et autres
Publié: (2024)
par: Akani, Eunice, et autres
Publié: (2024)
QFS-Composer: Query-focused summarization pipeline for less resourced languages
par: Đuranović, Vuk, et autres
Publié: (2026)
par: Đuranović, Vuk, et autres
Publié: (2026)
Question‐driven text summarization using an extractive‐abstractive framework
par: Mahsa Abazari Kia, et autres
Publié: (2024)
par: Mahsa Abazari Kia, et autres
Publié: (2024)
The Impact of Copyrighted Material on Large Language Models: A Norwegian Perspective
par: de la Rosa, Javier, et autres
Publié: (2024)
par: de la Rosa, Javier, et autres
Publié: (2024)
Finding frames with BERT: A transformer-based approach to generic news frame detection
par: Jumle, Vihang, et autres
Publié: (2024)
par: Jumle, Vihang, et autres
Publié: (2024)
Clash of the models: Comparing performance of BERT-based variants for generic news frame detection
par: Jumle, Vihang
Publié: (2026)
par: Jumle, Vihang
Publié: (2026)
Long document summarization using page specific target text alignment and distilling page importance
par: Devi, Pushpa, et autres
Publié: (2025)
par: Devi, Pushpa, et autres
Publié: (2025)
Closing the gap between open-source and commercial large language models for medical evidence summarization
par: Zhang, Gongbo, et autres
Publié: (2024)
par: Zhang, Gongbo, et autres
Publié: (2024)
BooookScore: A systematic exploration of book-length summarization in the era of LLMs
par: Chang, Yapei, et autres
Publié: (2023)
par: Chang, Yapei, et autres
Publié: (2023)
A dataset and benchmark for hospital course summarization with adapted large language models
par: Aali, Asad, et autres
Publié: (2024)
par: Aali, Asad, et autres
Publié: (2024)
AugSumm: towards generalizable speech summarization using synthetic labels from large language model
par: Jung, Jee-weon, et autres
Publié: (2024)
par: Jung, Jee-weon, et autres
Publié: (2024)
Computational frame analysis revisited: On LLMs for studying news coverage
par: Kunjar, Sharaj, et autres
Publié: (2025)
par: Kunjar, Sharaj, et autres
Publié: (2025)
DS$^2$-Instruct: Domain-Specific Data Synthesis for Large Language Models Instruction Tuning
par: Xu, Ruiyao, et autres
Publié: (2026)
par: Xu, Ruiyao, et autres
Publié: (2026)
Can large audio language models understand child stuttering speech? speech summarization, and source separation
par: Okocha, Chibuzor, et autres
Publié: (2025)
par: Okocha, Chibuzor, et autres
Publié: (2025)
Binary classification for perceived quality of headlines and links on worldwide news websites, 2018-2024
par: McCutcheon, Austin, et autres
Publié: (2025)
par: McCutcheon, Austin, et autres
Publié: (2025)
When retrieval outperforms generation: Dense evidence retrieval for scalable fake news detection
par: Qazi, Alamgir Munir, et autres
Publié: (2025)
par: Qazi, Alamgir Munir, et autres
Publié: (2025)
Fact-checking AI-generated news reports: Can LLMs catch their own lies?
par: Yao, Jiayi, et autres
Publié: (2025)
par: Yao, Jiayi, et autres
Publié: (2025)
Documents similaires
-
Benchmarking Abstractive Summarisation: A Dataset of Human-authored Summaries of Norwegian News Articles
par: Touileb, Samia, et autres
Publié: (2025) -
Entity-Level Sentiment: More than the Sum of Its Parts
par: Rønningstad, Egil, et autres
Publié: (2024) -
Fluent Alignment with Disfluent Judges: Post-training for Lower-resource Languages
par: Samuel, David, et autres
Publié: (2025) -
Mixed Feelings: Cross-Domain Sentiment Classification of Patient Feedback
par: Rønningstad, Egil, et autres
Publié: (2025) -
A Collection of Question Answering Datasets for Norwegian
par: Mikhailov, Vladislav, et autres
Publié: (2025)