IFDID: Information Filter upon Diversity-Improved Decoding for Diversity-Faithfulness Tradeoff in NLG
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Meng, Han, He, Xiaosong, Chen, Zexing, Zhou, Feng |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AmbigNLG: Addressing Task Ambiguity in Instruction for NLG
par: Niwa, Ayana, et autres
Publié: (2024)
par: Niwa, Ayana, et autres
Publié: (2024)
Improving Romanian LLM Pretraining Data using Diversity and Quality Filtering
par: Negoita, Vlad, et autres
Publié: (2025)
par: Negoita, Vlad, et autres
Publié: (2025)
Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
par: Tang, Tianyi, et autres
Publié: (2023)
par: Tang, Tianyi, et autres
Publié: (2023)
Semantic-guided Diverse Decoding for Large Language Model
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
Is Reference Necessary in the Evaluation of NLG Systems? When and Where?
par: Sheng, Shuqian, et autres
Publié: (2024)
par: Sheng, Shuqian, et autres
Publié: (2024)
Integration of LLM Quality Assurance into an NLG System
par: Chen, Ching-Yi, et autres
Publié: (2025)
par: Chen, Ching-Yi, et autres
Publié: (2025)
NLG Evaluation: Past, Present, Future
par: Reiter, Ehud
Publié: (2026)
par: Reiter, Ehud
Publié: (2026)
FaithBench: A Diverse Hallucination Benchmark for Summarization by Modern LLMs
par: Bao, Forrest Sheng, et autres
Publié: (2024)
par: Bao, Forrest Sheng, et autres
Publié: (2024)
Are LLM-based Evaluators Confusing NLG Quality Criteria?
par: Hu, Xinyu, et autres
Publié: (2024)
par: Hu, Xinyu, et autres
Publié: (2024)
Fine-Grained Natural Language Inference Based Faithfulness Evaluation for Diverse Summarisation Tasks
par: Zhang, Huajian, et autres
Publié: (2024)
par: Zhang, Huajian, et autres
Publié: (2024)
VOLTA: Improving Generative Diversity by Variational Mutual Information Maximizing Autoencoder
par: Ma, Yueen, et autres
Publié: (2023)
par: Ma, Yueen, et autres
Publié: (2023)
Leveraging Large Language Models for NLG Evaluation: Advances and Challenges
par: Li, Zhen, et autres
Publié: (2024)
par: Li, Zhen, et autres
Publié: (2024)
MagicDec: Breaking the Latency-Throughput Tradeoff for Long Context Generation with Speculative Decoding
par: Sadhukhan, Ranajoy, et autres
Publié: (2024)
par: Sadhukhan, Ranajoy, et autres
Publié: (2024)
The Hidden Strength of Disagreement: Unraveling the Consensus-Diversity Tradeoff in Adaptive Multi-Agent Systems
par: Wu, Zengqing, et autres
Publié: (2025)
par: Wu, Zengqing, et autres
Publié: (2025)
Verbosity Tradeoffs and the Impact of Scale on the Faithfulness of LLM Self-Explanations
par: Siegel, Noah Y., et autres
Publié: (2025)
par: Siegel, Noah Y., et autres
Publié: (2025)
From Critique to Clarity: A Pathway to Faithful and Personalized Code Explanations with Large Language Models
par: Xu, Zexing, et autres
Publié: (2024)
par: Xu, Zexing, et autres
Publié: (2024)
Mind the Gap: Conformative Decoding to Improve Output Diversity of Instruction-Tuned Large Language Models
par: Peeperkorn, Max, et autres
Publié: (2025)
par: Peeperkorn, Max, et autres
Publié: (2025)
Large Language Models Are Active Critics in NLG Evaluation
par: Xu, Shuying, et autres
Publié: (2024)
par: Xu, Shuying, et autres
Publié: (2024)
LLM-based NLG Evaluation: Current Status and Challenges
par: Gao, Mingqi, et autres
Publié: (2024)
par: Gao, Mingqi, et autres
Publié: (2024)
The statistical advantage of automatic NLG metrics at the system level
par: Wei, Johnny Tian-Zheng, et autres
Publié: (2021)
par: Wei, Johnny Tian-Zheng, et autres
Publié: (2021)
Analyzing and Evaluating Correlation Measures in NLG Meta-Evaluation
par: Gao, Mingqi, et autres
Publié: (2024)
par: Gao, Mingqi, et autres
Publié: (2024)
Adapting Decoder-Based Language Models for Diverse Encoder Downstream Tasks
par: Suganthan, Paul, et autres
Publié: (2025)
par: Suganthan, Paul, et autres
Publié: (2025)
Ruby Teaming: Improving Quality Diversity Search with Memory for Automated Red Teaming
par: Han, Vernon Toh Yan, et autres
Publié: (2024)
par: Han, Vernon Toh Yan, et autres
Publié: (2024)
SPD-Faith Bench: Diagnosing and Improving Faithfulness in Chain-of-Thought for Multimodal Large Language Models
par: Lv, Weijiang, et autres
Publié: (2026)
par: Lv, Weijiang, et autres
Publié: (2026)
Avoidance Decoding for Diverse Multi-Branch Story Generation
par: Park, Kyeongman, et autres
Publié: (2025)
par: Park, Kyeongman, et autres
Publié: (2025)
SED-SFT: Selectively Encouraging Diversity in Supervised Fine-Tuning
par: Chen, Yijie, et autres
Publié: (2026)
par: Chen, Yijie, et autres
Publié: (2026)
Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains
par: Li, Kun, et autres
Publié: (2024)
par: Li, Kun, et autres
Publié: (2024)
DHP Benchmark: Are LLMs Good NLG Evaluators?
par: Wang, Yicheng, et autres
Publié: (2024)
par: Wang, Yicheng, et autres
Publié: (2024)
Multilingual Prompting for Improving LLM Generation Diversity
par: Wang, Qihan, et autres
Publié: (2025)
par: Wang, Qihan, et autres
Publié: (2025)
Exploring the Multilingual NLG Evaluation Abilities of LLM-Based Evaluators
par: Chang, Jiayi, et autres
Publié: (2025)
par: Chang, Jiayi, et autres
Publié: (2025)
How to Select Datapoints for Efficient Human Evaluation of NLG Models?
par: Zouhar, Vilém, et autres
Publié: (2025)
par: Zouhar, Vilém, et autres
Publié: (2025)
Diverse, not Short: A Length-Controlled Data Selection Strategy for Improving Response Diversity of Language Models
par: Deshpande, Vijeta, et autres
Publié: (2025)
par: Deshpande, Vijeta, et autres
Publié: (2025)
A Factuality and Diversity Reconciled Decoding Method for Knowledge-Grounded Dialogue Generation
par: Yang, Chenxu, et autres
Publié: (2024)
par: Yang, Chenxu, et autres
Publié: (2024)
OpeNLGauge: An Explainable Metric for NLG Evaluation with Open-Weights LLMs
par: Kartáč, Ivan, et autres
Publié: (2025)
par: Kartáč, Ivan, et autres
Publié: (2025)
From Instruction to Output: The Role of Prompting in Modern NLG
par: Zaib, Munazza, et autres
Publié: (2026)
par: Zaib, Munazza, et autres
Publié: (2026)
PPM: Automated Generation of Diverse Programming Problems for Benchmarking Code Generation Models
par: Chen, Simin, et autres
Publié: (2024)
par: Chen, Simin, et autres
Publié: (2024)
DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
par: Guo, YiQiu, et autres
Publié: (2025)
par: Guo, YiQiu, et autres
Publié: (2025)
NLP needs Diversity outside of 'Diversity'
par: Tint, Joshua
Publié: (2026)
par: Tint, Joshua
Publié: (2026)
Faithfulness Evaluation for Decoder-only LLM Attributions with Controlled Retained Information
par: Huang, Xin, et autres
Publié: (2026)
par: Huang, Xin, et autres
Publié: (2026)
Bridging Information Gaps with Comprehensive Answers: Improving the Diversity and Informativeness of Follow-Up Questions
par: Liu, Zhe, et autres
Publié: (2025)
par: Liu, Zhe, et autres
Publié: (2025)
Documents similaires
-
AmbigNLG: Addressing Task Ambiguity in Instruction for NLG
par: Niwa, Ayana, et autres
Publié: (2024) -
Improving Romanian LLM Pretraining Data using Diversity and Quality Filtering
par: Negoita, Vlad, et autres
Publié: (2025) -
Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
par: Tang, Tianyi, et autres
Publié: (2023) -
Semantic-guided Diverse Decoding for Large Language Model
par: Shi, Weijie, et autres
Publié: (2025) -
Is Reference Necessary in the Evaluation of NLG Systems? When and Where?
par: Sheng, Shuqian, et autres
Publié: (2024)