An Empirical Comparison of Text Summarization: A Multi-Dimensional Evaluation of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Janakiraman, Anantharaman, Ghoraani, Behnaz |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Aligning Language Models for Icelandic Legal Text Summarization
por: Harðarson, Þórir Hrafn, et al.
Publicado: (2025)
por: Harðarson, Þórir Hrafn, et al.
Publicado: (2025)
Low-Rank Adaptation for Multilingual Summarization: An Empirical Study
por: Whitehouse, Chenxi, et al.
Publicado: (2023)
por: Whitehouse, Chenxi, et al.
Publicado: (2023)
Trustworthy Summarization via Uncertainty Quantification and Risk Awareness in Large Language Models
por: Pan, Shuaidong, et al.
Publicado: (2025)
por: Pan, Shuaidong, et al.
Publicado: (2025)
REFLEX: Reference-Free Evaluation of Log Summarization via Large Language Model Judgment
por: Mudgal, Priyanka
Publicado: (2025)
por: Mudgal, Priyanka
Publicado: (2025)
Evaluating Text Summaries Generated by Large Language Models Using OpenAI's GPT
por: Shakil, Hassan, et al.
Publicado: (2024)
por: Shakil, Hassan, et al.
Publicado: (2024)
DACP: Domain-Adaptive Continual Pre-Training of Large Language Models for Phone Conversation Summarization
por: Fu, Xue-Yong, et al.
Publicado: (2025)
por: Fu, Xue-Yong, et al.
Publicado: (2025)
Large Language Models Are Overparameterized Text Encoders
por: K, Thennal D, et al.
Publicado: (2024)
por: K, Thennal D, et al.
Publicado: (2024)
Hallucination Diversity-Aware Active Learning for Text Summarization
por: Xia, Yu, et al.
Publicado: (2024)
por: Xia, Yu, et al.
Publicado: (2024)
Abstractive Text Summarization: State of the Art, Challenges, and Improvements
por: Shakil, Hassan, et al.
Publicado: (2024)
por: Shakil, Hassan, et al.
Publicado: (2024)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
Utilizing GPT to Enhance Text Summarization: A Strategy to Minimize Hallucinations
por: Shakil, Hassan, et al.
Publicado: (2024)
por: Shakil, Hassan, et al.
Publicado: (2024)
Policies and Evaluation for Online Meeting Summarization
por: Schneider, Felix, et al.
Publicado: (2025)
por: Schneider, Felix, et al.
Publicado: (2025)
Evaluating Large Language Models for Health-Related Text Classification Tasks with Public Social Media Data
por: Guo, Yuting, et al.
Publicado: (2024)
por: Guo, Yuting, et al.
Publicado: (2024)
Large Language Models for Detection of Life-Threatening Texts
por: Nguyen, Thanh Thi, et al.
Publicado: (2025)
por: Nguyen, Thanh Thi, et al.
Publicado: (2025)
A Multi-Faceted Evaluation Framework for Assessing Synthetic Data Generated by Large Language Models
por: Yuan, Yefeng, et al.
Publicado: (2024)
por: Yuan, Yefeng, et al.
Publicado: (2024)
Omanic: Towards Step-wise Evaluation of Multi-hop Reasoning in Large Language Models
por: Gu, Xiaojie, et al.
Publicado: (2026)
por: Gu, Xiaojie, et al.
Publicado: (2026)
Ensemble Learning for Large Language Models in Text and Code Generation: A Survey
por: Ashiga, Mari, et al.
Publicado: (2025)
por: Ashiga, Mari, et al.
Publicado: (2025)
ChatGPT vs Human-authored Text: Insights into Controllable Text Summarization and Sentence Style Transfer
por: Liu, Dongqi, et al.
Publicado: (2023)
por: Liu, Dongqi, et al.
Publicado: (2023)
Multi-Dimensional Behavioral Evaluation of Agentic Stock Prediction Systems Using Large Language Model Judges with Closed-Loop Reinforcement Learning Feedback
por: Ridhawi, Mohammad Al, et al.
Publicado: (2026)
por: Ridhawi, Mohammad Al, et al.
Publicado: (2026)
Evaluating the Goal-Directedness of Large Language Models
por: Everitt, Tom, et al.
Publicado: (2025)
por: Everitt, Tom, et al.
Publicado: (2025)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
por: Yang, Xinqi, et al.
Publicado: (2024)
por: Yang, Xinqi, et al.
Publicado: (2024)
Do Large Language Models Truly Grasp Mathematics? An Empirical Exploration From Cognitive Psychology
por: Xie, Wei, et al.
Publicado: (2024)
por: Xie, Wei, et al.
Publicado: (2024)
Large Language Models in the Task of Automatic Validation of Text Classifier Predictions
por: Tsymbalov, Aleksandr, et al.
Publicado: (2025)
por: Tsymbalov, Aleksandr, et al.
Publicado: (2025)
Large Language Models as Topological Structure Enhancers for Text-Attributed Graphs
por: Sun, Shengyin, et al.
Publicado: (2023)
por: Sun, Shengyin, et al.
Publicado: (2023)
Multi-Objective Large Language Model Unlearning
por: Pan, Zibin, et al.
Publicado: (2024)
por: Pan, Zibin, et al.
Publicado: (2024)
Evaluating the Factuality of Zero-shot Summarizers Across Varied Domains
por: Ramprasad, Sanjana, et al.
Publicado: (2024)
por: Ramprasad, Sanjana, et al.
Publicado: (2024)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
por: Feng, Zhili, et al.
Publicado: (2025)
por: Feng, Zhili, et al.
Publicado: (2025)
Generative Evaluation of Complex Reasoning in Large Language Models
por: Lin, Haowei, et al.
Publicado: (2025)
por: Lin, Haowei, et al.
Publicado: (2025)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
por: de Wynter, Adrian, et al.
Publicado: (2023)
por: de Wynter, Adrian, et al.
Publicado: (2023)
Evaluating the Robustness of Analogical Reasoning in Large Language Models
por: Lewis, Martha, et al.
Publicado: (2024)
por: Lewis, Martha, et al.
Publicado: (2024)
Evaluating the Performance of Large Language Models via Debates
por: Moniri, Behrad, et al.
Publicado: (2024)
por: Moniri, Behrad, et al.
Publicado: (2024)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
por: Jiao, Difan, et al.
Publicado: (2023)
por: Jiao, Difan, et al.
Publicado: (2023)
UserSumBench: A Benchmark Framework for Evaluating User Summarization Approaches
por: Wang, Chao, et al.
Publicado: (2024)
por: Wang, Chao, et al.
Publicado: (2024)
PromptBench: A Unified Library for Evaluation of Large Language Models
por: Zhu, Kaijie, et al.
Publicado: (2023)
por: Zhu, Kaijie, et al.
Publicado: (2023)
A Critical Evaluation of AI Feedback for Aligning Large Language Models
por: Sharma, Archit, et al.
Publicado: (2024)
por: Sharma, Archit, et al.
Publicado: (2024)
BioPars: A Pretrained Biomedical Large Language Model for Persian Biomedical Text Mining
por: Merzah, Baqer M., et al.
Publicado: (2025)
por: Merzah, Baqer M., et al.
Publicado: (2025)
Large Language Models Meet Text-Attributed Graphs: A Survey of Integration Frameworks and Applications
por: Su, Guangxin, et al.
Publicado: (2025)
por: Su, Guangxin, et al.
Publicado: (2025)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
por: Rogoz, Ana-Cristina, et al.
Publicado: (2025)
por: Rogoz, Ana-Cristina, et al.
Publicado: (2025)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
por: Liu, Xiaoze, et al.
Publicado: (2024)
por: Liu, Xiaoze, et al.
Publicado: (2024)
Can Large Language Models Infer Causal Relationships from Real-World Text?
por: Saklad, Ryan, et al.
Publicado: (2025)
por: Saklad, Ryan, et al.
Publicado: (2025)
Ejemplares similares
-
Aligning Language Models for Icelandic Legal Text Summarization
por: Harðarson, Þórir Hrafn, et al.
Publicado: (2025) -
Low-Rank Adaptation for Multilingual Summarization: An Empirical Study
por: Whitehouse, Chenxi, et al.
Publicado: (2023) -
Trustworthy Summarization via Uncertainty Quantification and Risk Awareness in Large Language Models
por: Pan, Shuaidong, et al.
Publicado: (2025) -
REFLEX: Reference-Free Evaluation of Log Summarization via Large Language Model Judgment
por: Mudgal, Priyanka
Publicado: (2025) -
Evaluating Text Summaries Generated by Large Language Models Using OpenAI's GPT
por: Shakil, Hassan, et al.
Publicado: (2024)