Dancing in Chains: Reconciling Instruction Following and Faithfulness in Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Zhengxuan, Zhang, Yuhao, Qi, Peng, Xu, Yumo, Han, Rujun, Zhang, Yian, Chen, Jifan, Min, Bonan, Huang, Zhiheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RAG-QA Arena: Evaluating Domain Robustness for Long-form Retrieval Augmented Question Answering
di: Han, Rujun, et al.
Pubblicazione: (2024)
di: Han, Rujun, et al.
Pubblicazione: (2024)
CiteEval: Principle-Driven Citation Evaluation for Source Attribution
di: Xu, Yumo, et al.
Pubblicazione: (2025)
di: Xu, Yumo, et al.
Pubblicazione: (2025)
Fine-Grained Natural Language Inference Based Faithfulness Evaluation for Diverse Summarisation Tasks
di: Zhang, Huajian, et al.
Pubblicazione: (2024)
di: Zhang, Huajian, et al.
Pubblicazione: (2024)
Evaluating Correctness and Faithfulness of Instruction-Following Models for Question Answering
di: Adlakha, Vaibhav, et al.
Pubblicazione: (2023)
di: Adlakha, Vaibhav, et al.
Pubblicazione: (2023)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
di: Zhang, Yuansen, et al.
Pubblicazione: (2024)
di: Zhang, Yuansen, et al.
Pubblicazione: (2024)
GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought
di: Lv, Weijiang, et al.
Pubblicazione: (2026)
di: Lv, Weijiang, et al.
Pubblicazione: (2026)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
Revisiting the Reliability of Language Models in Instruction-Following
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
Constraint Back-translation Improves Complex Instruction Following of Large Language Models
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
di: Sun, Yuchong, et al.
Pubblicazione: (2023)
di: Sun, Yuchong, et al.
Pubblicazione: (2023)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025)
di: Zou, Tao, et al.
Pubblicazione: (2025)
InsTALL: Context-aware Instructional Task Assistance with Multi-modal Large Language Models
di: Nguyen, Pha, et al.
Pubblicazione: (2025)
di: Nguyen, Pha, et al.
Pubblicazione: (2025)
On the Hardness of Faithful Chain-of-Thought Reasoning in Large Language Models
di: Tanneru, Sree Harsha, et al.
Pubblicazione: (2024)
di: Tanneru, Sree Harsha, et al.
Pubblicazione: (2024)
IHEval: Evaluating Language Models on Following the Instruction Hierarchy
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data
di: Xia, Han, et al.
Pubblicazione: (2024)
di: Xia, Han, et al.
Pubblicazione: (2024)
Beyond Relevant Documents: A Knowledge-Intensive Approach for Query-Focused Summarization using Large Language Models
di: Zhang, Weijia, et al.
Pubblicazione: (2024)
di: Zhang, Weijia, et al.
Pubblicazione: (2024)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
Stress-Testing Model Specs Reveals Character Differences among Language Models
di: Zhang, Jifan, et al.
Pubblicazione: (2025)
di: Zhang, Jifan, et al.
Pubblicazione: (2025)
Countering Catastrophic Forgetting of Large Language Models for Better Instruction Following via Weight-Space Model Merging
di: Lyu, Mengxian, et al.
Pubblicazione: (2026)
di: Lyu, Mengxian, et al.
Pubblicazione: (2026)
MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
Large Language Model Instruction Following: A Survey of Progresses and Challenges
di: Lou, Renze, et al.
Pubblicazione: (2023)
di: Lou, Renze, et al.
Pubblicazione: (2023)
Loki's Dance of Illusions: A Comprehensive Survey of Hallucination in Large Language Models
di: Li, Chaozhuo, et al.
Pubblicazione: (2025)
di: Li, Chaozhuo, et al.
Pubblicazione: (2025)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
RAVEL: Evaluating Interpretability Methods on Disentangling Language Model Representations
di: Huang, Jing, et al.
Pubblicazione: (2024)
di: Huang, Jing, et al.
Pubblicazione: (2024)
Effectively Steer LLM To Follow Preference via Building Confident Directions
di: Song, Bingqing, et al.
Pubblicazione: (2025)
di: Song, Bingqing, et al.
Pubblicazione: (2025)
Context-DPO: Aligning Language Models for Context-Faithfulness
di: Bi, Baolong, et al.
Pubblicazione: (2024)
di: Bi, Baolong, et al.
Pubblicazione: (2024)
Faithfulness-QA: A Counterfactual Entity Substitution Dataset for Training Context-Faithful RAG Models
di: Ju, Li, et al.
Pubblicazione: (2026)
di: Ju, Li, et al.
Pubblicazione: (2026)
VerIF: Verification Engineering for Reinforcement Learning in Instruction Following
di: Peng, Hao, et al.
Pubblicazione: (2025)
di: Peng, Hao, et al.
Pubblicazione: (2025)
CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
Instruction-Following Pruning for Large Language Models
di: Hou, Bairu, et al.
Pubblicazione: (2025)
di: Hou, Bairu, et al.
Pubblicazione: (2025)
RefuteBench: Evaluating Refuting Instruction-Following for Large Language Models
di: Yan, Jianhao, et al.
Pubblicazione: (2024)
di: Yan, Jianhao, et al.
Pubblicazione: (2024)
Learning Instruction-Following Policies through Open-Ended Instruction Relabeling with Large Language Models
di: Zhang, Zhicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2025)
On the Paradoxical Interference between Instruction-Following and Task Solving
di: Qi, Yunjia, et al.
Pubblicazione: (2026)
di: Qi, Yunjia, et al.
Pubblicazione: (2026)
Chain-of-Instructions: Compositional Instruction Tuning on Large Language Models
di: Hayati, Shirley Anugrah, et al.
Pubblicazione: (2024)
di: Hayati, Shirley Anugrah, et al.
Pubblicazione: (2024)
From Instructions to Constraints: Language Model Alignment with Automatic Constraint Verification
di: Wang, Fei, et al.
Pubblicazione: (2024)
di: Wang, Fei, et al.
Pubblicazione: (2024)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
SPD-Faith Bench: Diagnosing and Improving Faithfulness in Chain-of-Thought for Multimodal Large Language Models
di: Lv, Weijiang, et al.
Pubblicazione: (2026)
di: Lv, Weijiang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RAG-QA Arena: Evaluating Domain Robustness for Long-form Retrieval Augmented Question Answering
di: Han, Rujun, et al.
Pubblicazione: (2024) -
CiteEval: Principle-Driven Citation Evaluation for Source Attribution
di: Xu, Yumo, et al.
Pubblicazione: (2025) -
Fine-Grained Natural Language Inference Based Faithfulness Evaluation for Diverse Summarisation Tasks
di: Zhang, Huajian, et al.
Pubblicazione: (2024) -
Evaluating Correctness and Faithfulness of Instruction-Following Models for Question Answering
di: Adlakha, Vaibhav, et al.
Pubblicazione: (2023) -
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
di: Zhang, Yuansen, et al.
Pubblicazione: (2024)