CCSBench: Evaluating Compositional Controllability in LLMs for Scientific Document Summarization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ding, Yixi, Wu, Jiaying, Zhu, Tongyao, Qin, Yanxia, Liu, Qian, Kan, Min-Yen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ISQA: Informative Factuality Feedback for Scientific Summarization
par: Li, Zekai, et autres
Publié: (2024)
par: Li, Zekai, et autres
Publié: (2024)
Beyond Memorization: The Challenge of Random Memory Access in Language Models
par: Zhu, Tongyao, et autres
Publié: (2024)
par: Zhu, Tongyao, et autres
Publié: (2024)
SkyLadder: Better and Faster Pretraining via Context Window Scheduling
par: Zhu, Tongyao, et autres
Publié: (2025)
par: Zhu, Tongyao, et autres
Publié: (2025)
Adapter-based Selective Knowledge Distillation for Federated Multi-domain Meeting Summarization
par: Feng, Xiachong, et autres
Publié: (2023)
par: Feng, Xiachong, et autres
Publié: (2023)
A Probability--Quality Trade-off in Aligned Language Models and its Relation to Sampling Adaptors
par: Tan, Naaman, et autres
Publié: (2024)
par: Tan, Naaman, et autres
Publié: (2024)
Seeing Through Deception: Uncovering Misleading Creator Intent in Multimodal News with Vision-Language Models
par: Wu, Jiaying, et autres
Publié: (2025)
par: Wu, Jiaying, et autres
Publié: (2025)
The Facade of Truth: Uncovering and Mitigating LLM Susceptibility to Deceptive Evidence
par: Wan, Herun, et autres
Publié: (2026)
par: Wan, Herun, et autres
Publié: (2026)
Rethinking Scientific Summarization Evaluation: Grounding Explainable Metrics on Facet-aware Benchmark
par: Chen, Xiuying, et autres
Publié: (2024)
par: Chen, Xiuying, et autres
Publié: (2024)
Hierarchical Attention Graph for Scientific Document Summarization in Global and Local Level
par: Zhao, Chenlong, et autres
Publié: (2024)
par: Zhao, Chenlong, et autres
Publié: (2024)
SKT5SciSumm -- Revisiting Extractive-Generative Approach for Multi-Document Scientific Summarization
par: To, Huy Quoc, et autres
Publié: (2024)
par: To, Huy Quoc, et autres
Publié: (2024)
LLMs Are Biased Towards Output Formats! Systematically Evaluating and Mitigating Output Format Bias of LLMs
par: Long, Do Xuan, et autres
Publié: (2024)
par: Long, Do Xuan, et autres
Publié: (2024)
Ask, Retrieve, Summarize: A Modular Pipeline for Scientific Literature Summarization
par: Achkar, Pierre, et autres
Publié: (2025)
par: Achkar, Pierre, et autres
Publié: (2025)
Scientific Opinion Summarization: Paper Meta-review Generation Dataset, Methods, and Evaluation
par: Zeng, Qi, et autres
Publié: (2023)
par: Zeng, Qi, et autres
Publié: (2023)
From Single to Multi: How LLMs Hallucinate in Multi-Document Summarization
par: Belem, Catarina G., et autres
Publié: (2024)
par: Belem, Catarina G., et autres
Publié: (2024)
Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization
par: Li, Chuyuan, et autres
Publié: (2025)
par: Li, Chuyuan, et autres
Publié: (2025)
Learning to Summarize by Learning to Quiz: Adversarial Agentic Collaboration for Long Document Summarization
par: Wang, Weixuan, et autres
Publié: (2025)
par: Wang, Weixuan, et autres
Publié: (2025)
Discursive Circuits: How Do Language Models Understand Discourse Relations?
par: Miao, Yisong, et autres
Publié: (2025)
par: Miao, Yisong, et autres
Publié: (2025)
Accelerating Scientific Discovery with Multi-Document Summarization of Impact-Ranked Papers
par: Koloveas, Paris, et autres
Publié: (2025)
par: Koloveas, Paris, et autres
Publié: (2025)
StrucSum: Graph-Structured Reasoning for Long Document Extractive Summarization with LLMs
par: Yuan, Haohan, et autres
Publié: (2025)
par: Yuan, Haohan, et autres
Publié: (2025)
Beyond the Crowd: LLM-Augmented Community Notes for Governing Health Misinformation
par: Wu, Jiaying, et autres
Publié: (2025)
par: Wu, Jiaying, et autres
Publié: (2025)
GLIMMER: Incorporating Graph and Lexical Features in Unsupervised Multi-Document Summarization
par: Liu, Ran, et autres
Publié: (2024)
par: Liu, Ran, et autres
Publié: (2024)
When Precision Meets Position: BFloat16 Breaks Down RoPE in Long-Context Training
par: Wang, Haonan, et autres
Publié: (2024)
par: Wang, Haonan, et autres
Publié: (2024)
GitSearch: Enhancing Community Notes Generation with Gap-Informed Targeted Search
par: Singh, Sahajpreet, et autres
Publié: (2026)
par: Singh, Sahajpreet, et autres
Publié: (2026)
Manager: Aggregating Insights from Unimodal Experts in Two-Tower VLMs and MLLMs
par: Xu, Xiao, et autres
Publié: (2025)
par: Xu, Xiao, et autres
Publié: (2025)
EROS: Entity-Driven Controlled Policy Document Summarization
par: Singh, Joykirat, et autres
Publié: (2024)
par: Singh, Joykirat, et autres
Publié: (2024)
DnA-Eval: Enhancing Large Language Model Evaluation through Decomposition and Aggregation
par: Li, Minzhi, et autres
Publié: (2024)
par: Li, Minzhi, et autres
Publié: (2024)
Gavel: Agent Meets Checklist for Evaluating LLMs on Long-Context Legal Summarization
par: Dou, Yao, et autres
Publié: (2026)
par: Dou, Yao, et autres
Publié: (2026)
Evaluating LLMs and Pre-trained Models for Text Summarization Across Diverse Datasets
par: Rehman, Tohida, et autres
Publié: (2025)
par: Rehman, Tohida, et autres
Publié: (2025)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
Reasoning or Not? A Comprehensive Evaluation of Reasoning LLMs for Dialogue Summarization
par: Jin, Keyan, et autres
Publié: (2025)
par: Jin, Keyan, et autres
Publié: (2025)
Russian-Language Multimodal Dataset for Automatic Summarization of Scientific Papers
par: Tsanda, Alena, et autres
Publié: (2024)
par: Tsanda, Alena, et autres
Publié: (2024)
Topic-Controllable Summarization: Topic-Aware Evaluation and Transformer Methods
par: Passali, Tatiana, et autres
Publié: (2022)
par: Passali, Tatiana, et autres
Publié: (2022)
Are Knowledge and Reference in Multilingual Language Models Cross-Lingually Consistent?
par: Ai, Xi, et autres
Publié: (2025)
par: Ai, Xi, et autres
Publié: (2025)
Better with Experience: Self-Evolving LLM Agents for Evidence-Grounded Health Community Notes
par: Fu, Zihang, et autres
Publié: (2026)
par: Fu, Zihang, et autres
Publié: (2026)
Cross-Document Event-Keyed Summarization
par: Walden, William, et autres
Publié: (2024)
par: Walden, William, et autres
Publié: (2024)
Less is More for Long Document Summary Evaluation by LLMs
par: Wu, Yunshu, et autres
Publié: (2023)
par: Wu, Yunshu, et autres
Publié: (2023)
Evaluation of LLMs in Medical Text Summarization: The Role of Vocabulary Adaptation in High OOV Settings
par: Balde, Gunjan, et autres
Publié: (2025)
par: Balde, Gunjan, et autres
Publié: (2025)
From Harm to Help: Turning Reasoning In-Context Demos into Assets for Reasoning LMs
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
One Arrow, Many Targets: Probing LLMs for Multi-Attribute Controllable Text Summarization
par: Roy, Tathagato, et autres
Publié: (2024)
par: Roy, Tathagato, et autres
Publié: (2024)
Calibrating Model-Based Evaluation Metrics for Summarization
par: Liu, Hongye, et autres
Publié: (2026)
par: Liu, Hongye, et autres
Publié: (2026)
Documents similaires
-
ISQA: Informative Factuality Feedback for Scientific Summarization
par: Li, Zekai, et autres
Publié: (2024) -
Beyond Memorization: The Challenge of Random Memory Access in Language Models
par: Zhu, Tongyao, et autres
Publié: (2024) -
SkyLadder: Better and Faster Pretraining via Context Window Scheduling
par: Zhu, Tongyao, et autres
Publié: (2025) -
Adapter-based Selective Knowledge Distillation for Federated Multi-domain Meeting Summarization
par: Feng, Xiachong, et autres
Publié: (2023) -
A Probability--Quality Trade-off in Aligned Language Models and its Relation to Sampling Adaptors
par: Tan, Naaman, et autres
Publié: (2024)