Learning to Summarize from LLM-generated Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Hwanjun, Yun, Taewon, Lee, Yuho, Oh, Jihwan, Lee, Gihun, Cai, Jason, Su, Hang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReFeed: Multi-dimensional Summarization Refinement with Reflective Reasoning on Feedback
par: Yun, Taewon, et autres
Publié: (2025)
par: Yun, Taewon, et autres
Publié: (2025)
UniSumEval: Towards Unified, Fine-Grained, Multi-Dimensional Summarization Evaluation for LLMs
par: Lee, Yuho, et autres
Publié: (2024)
par: Lee, Yuho, et autres
Publié: (2024)
Towards Multi-dimensional Evaluation of LLM Summarization across Domains and Languages
par: Min, Hyangsuk, et autres
Publié: (2025)
par: Min, Hyangsuk, et autres
Publié: (2025)
Learning to Verify Summary Facts with Fine-Grained LLM Feedback
par: Oh, Jihwan, et autres
Publié: (2024)
par: Oh, Jihwan, et autres
Publié: (2024)
FineSurE: Fine-grained Summarization Evaluation using LLMs
par: Song, Hwanjun, et autres
Publié: (2024)
par: Song, Hwanjun, et autres
Publié: (2024)
Semi-Supervised Dialogue Abstractive Summarization via High-Quality Pseudolabel Selection
par: He, Jianfeng, et autres
Publié: (2024)
par: He, Jianfeng, et autres
Publié: (2024)
Towards a Holistic and Automated Evaluation Framework for Multi-Level Comprehension of LLMs in Book-Length Contexts
par: Deng, Jiaqi, et autres
Publié: (2025)
par: Deng, Jiaqi, et autres
Publié: (2025)
What Makes a Sale? Rethinking End-to-End Seller--Buyer Retail Dynamics with LLM Agents
par: Choi, Jeonghwan, et autres
Publié: (2026)
par: Choi, Jeonghwan, et autres
Publié: (2026)
Alignment Tuning for Large Language Models: A Data-Centric Lens on Alignment Data Pipelines
par: Song, Hwanjun
Publié: (2026)
par: Song, Hwanjun
Publié: (2026)
TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue Summarization
par: Tang, Liyan, et autres
Publié: (2024)
par: Tang, Liyan, et autres
Publié: (2024)
BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalization
par: Lee, Gihun, et autres
Publié: (2024)
par: Lee, Gihun, et autres
Publié: (2024)
Aligning Extraction and Generation for Robust Retrieval-Augmented Generation
par: Song, Hwanjun, et autres
Publié: (2025)
par: Song, Hwanjun, et autres
Publié: (2025)
RLPF: Reinforcement Learning from Prediction Feedback for User Summarization with LLMs
par: Wu, Jiaxing, et autres
Publié: (2024)
par: Wu, Jiaxing, et autres
Publié: (2024)
PerMix-RLVR: Preserving Persona Expressivity under Verifiable-Reward Alignment
par: Oh, Jihwan, et autres
Publié: (2026)
par: Oh, Jihwan, et autres
Publié: (2026)
Learning-free L2-Accented Speech Generation using Phonological Rules
par: Lertpetchpun, Thanathai, et autres
Publié: (2026)
par: Lertpetchpun, Thanathai, et autres
Publié: (2026)
Key-Element-Informed sLLM Tuning for Document Summarization
par: Ryu, Sangwon, et autres
Publié: (2024)
par: Ryu, Sangwon, et autres
Publié: (2024)
ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
par: Bae, Suyoung, et autres
Publié: (2026)
par: Bae, Suyoung, et autres
Publié: (2026)
Model-based Preference Optimization in Abstractive Summarization without Human Feedback
par: Choi, Jaepill, et autres
Publié: (2024)
par: Choi, Jaepill, et autres
Publié: (2024)
LLM-C3MOD: A Human-LLM Collaborative System for Cross-Cultural Hate Speech Moderation
par: Park, Junyeong, et autres
Publié: (2025)
par: Park, Junyeong, et autres
Publié: (2025)
Understanding LLM Behavior in Multi-Target Cross-Lingual Summarization
par: Ryu, Sangwon, et autres
Publié: (2026)
par: Ryu, Sangwon, et autres
Publié: (2026)
$C^2$: Scalable Auto-Feedback for LLM-based Chart Generation
par: Koh, Woosung, et autres
Publié: (2024)
par: Koh, Woosung, et autres
Publié: (2024)
VorTEX: Various overlap ratio for Target speech EXtraction
par: Oh, Ro-hoon, et autres
Publié: (2026)
par: Oh, Ro-hoon, et autres
Publié: (2026)
FedSOL: Stabilized Orthogonal Learning with Proximal Restrictions in Federated Learning
par: Lee, Gihun, et autres
Publié: (2023)
par: Lee, Gihun, et autres
Publié: (2023)
Multi-Dimensional Optimization for Text Summarization via Reinforcement Learning
par: Ryu, Sangwon, et autres
Publié: (2024)
par: Ryu, Sangwon, et autres
Publié: (2024)
Beyond speculation: Measuring the growing presence of LLM-generated texts in multilingual disinformation
par: Macko, Dominik, et autres
Publié: (2025)
par: Macko, Dominik, et autres
Publié: (2025)
Gender Bias in LLM-generated Interview Responses
par: Kong, Haein, et autres
Publié: (2024)
par: Kong, Haein, et autres
Publié: (2024)
MEDSAGE: Enhancing Robustness of Medical Dialogue Summarization to ASR Errors with LLM-generated Synthetic Dialogues
par: Binici, Kuluhan, et autres
Publié: (2024)
par: Binici, Kuluhan, et autres
Publié: (2024)
Completing Missing Annotation: Multi-Agent Debate for Accurate and Scalable Relevant Assessment for IR Benchmarks
par: Ban, Minjeong, et autres
Publié: (2026)
par: Ban, Minjeong, et autres
Publié: (2026)
ChallengeMe: An Adversarial Learning-enabled Text Summarization Framework
par: Deng, Xiaoyu, et autres
Publié: (2025)
par: Deng, Xiaoyu, et autres
Publié: (2025)
Prompt-based Learning for Text Readability Assessment
par: Lee, Bruce W., et autres
Publié: (2023)
par: Lee, Bruce W., et autres
Publié: (2023)
Unsupervised Extractive Dialogue Summarization in Hyperdimensional Space
par: Park, Seongmin, et autres
Publié: (2024)
par: Park, Seongmin, et autres
Publié: (2024)
Distilling Long-CoT Reasoning through Collaborative Step-wise Multi-Teacher Decoding
par: Yun, Taewon, et autres
Publié: (2026)
par: Yun, Taewon, et autres
Publié: (2026)
Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection
par: Lee, Kyungjae, et autres
Publié: (2024)
par: Lee, Kyungjae, et autres
Publié: (2024)
Chain-of-Rank: Enhancing Large Language Models for Domain-Specific RAG in Edge Device
par: Lee, Juntae, et autres
Publié: (2025)
par: Lee, Juntae, et autres
Publié: (2025)
DIAMOND: An LLM-Driven Agent for Context-Aware Baseball Highlight Summarization
par: Kang, Jeonghun, et autres
Publié: (2025)
par: Kang, Jeonghun, et autres
Publié: (2025)
MDSEval: A Meta-Evaluation Benchmark for Multimodal Dialogue Summarization
par: Liu, Yinhong, et autres
Publié: (2025)
par: Liu, Yinhong, et autres
Publié: (2025)
Incremental Summarization for Customer Support via Progressive Note-Taking and Agent Feedback
par: Wu, Yisha, et autres
Publié: (2025)
par: Wu, Yisha, et autres
Publié: (2025)
SYNFAC-EDIT: Synthetic Imitation Edit Feedback for Factual Alignment in Clinical Summarization
par: Mishra, Prakamya, et autres
Publié: (2024)
par: Mishra, Prakamya, et autres
Publié: (2024)
SALAD: Improving Robustness and Generalization through Contrastive Learning with Structure-Aware and LLM-Driven Augmented Data
par: Bae, Suyoung, et autres
Publié: (2025)
par: Bae, Suyoung, et autres
Publié: (2025)
Reward Collapse in Aligning Large Language Models
par: Song, Ziang, et autres
Publié: (2023)
par: Song, Ziang, et autres
Publié: (2023)
Documents similaires
-
ReFeed: Multi-dimensional Summarization Refinement with Reflective Reasoning on Feedback
par: Yun, Taewon, et autres
Publié: (2025) -
UniSumEval: Towards Unified, Fine-Grained, Multi-Dimensional Summarization Evaluation for LLMs
par: Lee, Yuho, et autres
Publié: (2024) -
Towards Multi-dimensional Evaluation of LLM Summarization across Domains and Languages
par: Min, Hyangsuk, et autres
Publié: (2025) -
Learning to Verify Summary Facts with Fine-Grained LLM Feedback
par: Oh, Jihwan, et autres
Publié: (2024) -
FineSurE: Fine-grained Summarization Evaluation using LLMs
par: Song, Hwanjun, et autres
Publié: (2024)