On the Benefits of Fine-Grained Loss Truncation: A Case Study on Factuality in Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Flores, Lorenzo Jaime Yu, Cohan, Arman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
di: Bae, Suyoung, et al.
Pubblicazione: (2026)
di: Bae, Suyoung, et al.
Pubblicazione: (2026)
Fine-Grained Self-Endorsement Improves Factuality and Reasoning
di: Wang, Ante, et al.
Pubblicazione: (2024)
di: Wang, Ante, et al.
Pubblicazione: (2024)
Entity-level Factual Adaptiveness of Fine-tuning based Abstractive Summarization Models
di: Song, Jongyoon, et al.
Pubblicazione: (2024)
di: Song, Jongyoon, et al.
Pubblicazione: (2024)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
di: Feng, Huawen, et al.
Pubblicazione: (2023)
di: Feng, Huawen, et al.
Pubblicazione: (2023)
SYNFAC-EDIT: Synthetic Imitation Edit Feedback for Factual Alignment in Clinical Summarization
di: Mishra, Prakamya, et al.
Pubblicazione: (2024)
di: Mishra, Prakamya, et al.
Pubblicazione: (2024)
Investigating Text Shortening Strategy in BERT: Truncation vs Summarization
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024)
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024)
Bayesian Calibration of Win Rate Estimation with LLM Evaluators
di: Gao, Yicheng, et al.
Pubblicazione: (2024)
di: Gao, Yicheng, et al.
Pubblicazione: (2024)
SUCEA: Reasoning-Intensive Retrieval for Adversarial Fact-checking through Claim Decomposition and Editing
di: Liu, Hongjun, et al.
Pubblicazione: (2025)
di: Liu, Hongjun, et al.
Pubblicazione: (2025)
On Evaluating LLM Alignment by Evaluating LLMs as Judges
di: Liu, Yixin, et al.
Pubblicazione: (2025)
di: Liu, Yixin, et al.
Pubblicazione: (2025)
Discourse-Driven Evaluation: Unveiling Factual Inconsistency in Long Document Summarization
di: Zhong, Yang, et al.
Pubblicazione: (2025)
di: Zhong, Yang, et al.
Pubblicazione: (2025)
Evaluating Legal Reasoning Traces with Legal Issue Tree Rubrics
di: Lee, Jinu, et al.
Pubblicazione: (2025)
di: Lee, Jinu, et al.
Pubblicazione: (2025)
Investigating Data Contamination in Modern Benchmarks for Large Language Models
di: Deng, Chunyuan, et al.
Pubblicazione: (2023)
di: Deng, Chunyuan, et al.
Pubblicazione: (2023)
UniSumEval: Towards Unified, Fine-Grained, Multi-Dimensional Summarization Evaluation for LLMs
di: Lee, Yuho, et al.
Pubblicazione: (2024)
di: Lee, Yuho, et al.
Pubblicazione: (2024)
Evaluating the Factuality of Zero-shot Summarizers Across Varied Domains
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
di: Mujahid, Zain Muhammad, et al.
Pubblicazione: (2025)
di: Mujahid, Zain Muhammad, et al.
Pubblicazione: (2025)
IRIS: Interactive Research Ideation System for Accelerating Scientific Discovery
di: Garikaparthi, Aniketh, et al.
Pubblicazione: (2025)
di: Garikaparthi, Aniketh, et al.
Pubblicazione: (2025)
M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models
di: Li, Chuhan, et al.
Pubblicazione: (2024)
di: Li, Chuhan, et al.
Pubblicazione: (2024)
AbGen: Evaluating Large Language Models in Ablation Study Design and Evaluation for Scientific Research
di: Zhao, Yilun, et al.
Pubblicazione: (2025)
di: Zhao, Yilun, et al.
Pubblicazione: (2025)
FineSurE: Fine-grained Summarization Evaluation using LLMs
di: Song, Hwanjun, et al.
Pubblicazione: (2024)
di: Song, Hwanjun, et al.
Pubblicazione: (2024)
Parameter-Efficient Fine-Tuning for Medical Text Summarization: A Comparative Study of Lora, Prompt Tuning, and Full Fine-Tuning
di: Shernazarov, Ulugbek, et al.
Pubblicazione: (2026)
di: Shernazarov, Ulugbek, et al.
Pubblicazione: (2026)
Advantages of Domain Knowledge Injection for Legal Document Summarization: A Case Study on Summarizing Indian Court Judgments in English and Hindi
di: Datta, Debtanu, et al.
Pubblicazione: (2026)
di: Datta, Debtanu, et al.
Pubblicazione: (2026)
Factuality on Demand: Controlling the Factuality-Informativeness Trade-off in Text Generation
di: Gong, Ziwei, et al.
Pubblicazione: (2026)
di: Gong, Ziwei, et al.
Pubblicazione: (2026)
MIR: Methodology Inspiration Retrieval for Scientific Research Problems
di: Garikaparthi, Aniketh, et al.
Pubblicazione: (2025)
di: Garikaparthi, Aniketh, et al.
Pubblicazione: (2025)
Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM
di: Yuan, Dong, et al.
Pubblicazione: (2024)
di: Yuan, Dong, et al.
Pubblicazione: (2024)
Calibrating Long-form Generations from Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2024)
di: Huang, Yukun, et al.
Pubblicazione: (2024)
FG-RAG: Enhancing Query-Focused Summarization with Context-Aware Fine-Grained Graph RAG
di: Hong, Yubin, et al.
Pubblicazione: (2025)
di: Hong, Yubin, et al.
Pubblicazione: (2025)
Do Automatic Factuality Metrics Measure Factuality? A Critical Evaluation
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
di: Ramprasad, Sanjana, et al.
Pubblicazione: (2024)
When do Generative Query and Document Expansions Fail? A Comprehensive Study Across Methods, Retrievers, and Datasets
di: Weller, Orion, et al.
Pubblicazione: (2023)
di: Weller, Orion, et al.
Pubblicazione: (2023)
RbtAct: Rebuttal as Supervision for Actionable Review Feedback Generation
di: Wu, Sihong, et al.
Pubblicazione: (2026)
di: Wu, Sihong, et al.
Pubblicazione: (2026)
QAPyramid: Fine-grained Evaluation of Content Selection for Text Summarization
di: Zhang, Shiyue, et al.
Pubblicazione: (2024)
di: Zhang, Shiyue, et al.
Pubblicazione: (2024)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
di: Wang, Jun, et al.
Pubblicazione: (2025)
di: Wang, Jun, et al.
Pubblicazione: (2025)
MIMIR: A Streamlined Platform for Personalized Agent Tuning in Domain Expertise
di: Deng, Chunyuan, et al.
Pubblicazione: (2024)
di: Deng, Chunyuan, et al.
Pubblicazione: (2024)
Can AI Be a Good Peer Reviewer? A Survey of Peer Review Process, Evaluation, and the Future
di: Wu, Sihong, et al.
Pubblicazione: (2026)
di: Wu, Sihong, et al.
Pubblicazione: (2026)
From Scores to Steps: Diagnosing and Improving LLM Performance in Evidence-Based Medical Calculations
di: Wang, Benlu, et al.
Pubblicazione: (2025)
di: Wang, Benlu, et al.
Pubblicazione: (2025)
Improving the Calibration of Confidence Scores in Text Generation Using the Output Distribution's Characteristics
di: Flores, Lorenzo Jaime Yu, et al.
Pubblicazione: (2025)
di: Flores, Lorenzo Jaime Yu, et al.
Pubblicazione: (2025)
MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning
di: Tang, Xiangru, et al.
Pubblicazione: (2023)
di: Tang, Xiangru, et al.
Pubblicazione: (2023)
Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
COMAL: A Convergent Meta-Algorithm for Aligning LLMs with General Preferences
di: Liu, Yixin, et al.
Pubblicazione: (2024)
di: Liu, Yixin, et al.
Pubblicazione: (2024)
The Curious Case of Factual (Mis)Alignment between LLMs' Short- and Long-Form Answers
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
Characterizing Multimodal Long-form Summarization: A Case Study on Financial Reports
di: Cao, Tianyu, et al.
Pubblicazione: (2024)
di: Cao, Tianyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
di: Bae, Suyoung, et al.
Pubblicazione: (2026) -
Fine-Grained Self-Endorsement Improves Factuality and Reasoning
di: Wang, Ante, et al.
Pubblicazione: (2024) -
Entity-level Factual Adaptiveness of Fine-tuning based Abstractive Summarization Models
di: Song, Jongyoon, et al.
Pubblicazione: (2024) -
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
di: Feng, Huawen, et al.
Pubblicazione: (2023) -
SYNFAC-EDIT: Synthetic Imitation Edit Feedback for Factual Alignment in Clinical Summarization
di: Mishra, Prakamya, et al.
Pubblicazione: (2024)