LLMCRIT: Teaching Large Language Models to Use Criteria
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Weizhe, Liu, Pengfei, Gallé, Matthias |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Trade-off between Redundancy and Local Coherence in Summarization
par: Cardenas, Ronald, et autres
Publié: (2022)
par: Cardenas, Ronald, et autres
Publié: (2022)
Teaching Large Language Models an Unseen Language on the Fly
par: Zhang, Chen, et autres
Publié: (2024)
par: Zhang, Chen, et autres
Publié: (2024)
System-Level Natural Language Feedback
par: Yuan, Weizhe, et autres
Publié: (2023)
par: Yuan, Weizhe, et autres
Publié: (2023)
The Critique of Critique
par: Sun, Shichao, et autres
Publié: (2024)
par: Sun, Shichao, et autres
Publié: (2024)
Bigger But Not Better: Small Neural Language Models Outperform Large Language Models in Detection of Thought Disorder
par: Li, Changye, et autres
Publié: (2025)
par: Li, Changye, et autres
Publié: (2025)
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
par: Chen, Weizhe, et autres
Publié: (2024)
par: Chen, Weizhe, et autres
Publié: (2024)
HD-Eval: Aligning Large Language Model Evaluators Through Hierarchical Criteria Decomposition
par: Liu, Yuxuan, et autres
Publié: (2024)
par: Liu, Yuxuan, et autres
Publié: (2024)
`Keep it Together': Enforcing Cohesion in Extractive Summaries by Simulating Human Memory
par: Cardenas, Ronald, et autres
Publié: (2024)
par: Cardenas, Ronald, et autres
Publié: (2024)
TALEC: Teach Your LLM to Evaluate in Specific Domain with In-house Criteria by Criteria Division and Zero-shot Plus Few-shot
par: Zhang, Kaiqi, et autres
Publié: (2024)
par: Zhang, Kaiqi, et autres
Publié: (2024)
Why Solving Multi-agent Path Finding with Large Language Model has not Succeeded Yet
par: Chen, Weizhe, et autres
Publié: (2024)
par: Chen, Weizhe, et autres
Publié: (2024)
Logic-of-Thought: Injecting Logic into Contexts for Full Reasoning in Large Language Models
par: Liu, Tongxuan, et autres
Publié: (2024)
par: Liu, Tongxuan, et autres
Publié: (2024)
Retrieval-Augmented Defense: Adaptive and Controllable Jailbreak Prevention for Large Language Models
par: Yang, Guangyu, et autres
Publié: (2025)
par: Yang, Guangyu, et autres
Publié: (2025)
ConInstruct: Evaluating Large Language Models on Conflict Detection and Resolution in Instructions
par: He, Xingwei, et autres
Publié: (2025)
par: He, Xingwei, et autres
Publié: (2025)
Generating and Evaluating Sustainable Procurement Criteria for the Swiss Public Sector using In-Context Prompting with Large Language Models
par: Gao, Yingqiang, et autres
Publié: (2026)
par: Gao, Yingqiang, et autres
Publié: (2026)
TIM: Teaching Large Language Models to Translate with Comparison
par: Zeng, Jiali, et autres
Publié: (2023)
par: Zeng, Jiali, et autres
Publié: (2023)
Improving Reward Models with Synthetic Critiques
par: Ye, Zihuiwen, et autres
Publié: (2024)
par: Ye, Zihuiwen, et autres
Publié: (2024)
Towards Atoms of Large Language Models
par: Hu, Chenhui, et autres
Publié: (2025)
par: Hu, Chenhui, et autres
Publié: (2025)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
par: Yue, Liang, et autres
Publié: (2025)
par: Yue, Liang, et autres
Publié: (2025)
PATS: Personality-Aware Teaching Strategies with Large Language Model Tutors
par: Rooein, Donya, et autres
Publié: (2026)
par: Rooein, Donya, et autres
Publié: (2026)
On Learning to Summarize with Large Language Models as References
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
FRoG: Evaluating Fuzzy Reasoning of Generalized Quantifiers in Large Language Models
par: Li, Yiyuan, et autres
Publié: (2024)
par: Li, Yiyuan, et autres
Publié: (2024)
Agentic Tool Use in Large Language Models
par: Hu, Jinchao, et autres
Publié: (2026)
par: Hu, Jinchao, et autres
Publié: (2026)
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
par: Yuan, Hongbang, et autres
Publié: (2024)
par: Yuan, Hongbang, et autres
Publié: (2024)
BeHonest: Benchmarking Honesty in Large Language Models
par: Chern, Steffi, et autres
Publié: (2024)
par: Chern, Steffi, et autres
Publié: (2024)
Large Language Models for Sentiment Analysis to Detect Social Challenges: A Use Case with South African Languages
par: Mabokela, Koena Ronny, et autres
Publié: (2025)
par: Mabokela, Koena Ronny, et autres
Publié: (2025)
Knowledge in Superposition: Unveiling the Failures of Lifelong Knowledge Editing for Large Language Models
par: Hu, Chenhui, et autres
Publié: (2024)
par: Hu, Chenhui, et autres
Publié: (2024)
MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use
par: Huang, Yue, et autres
Publié: (2023)
par: Huang, Yue, et autres
Publié: (2023)
An Overview of Large Language Models for Statisticians
par: Ji, Wenlong, et autres
Publié: (2025)
par: Ji, Wenlong, et autres
Publié: (2025)
Know-MRI: A Knowledge Mechanisms Revealer&Interpreter for Large Language Models
par: Liu, Jiaxiang, et autres
Publié: (2025)
par: Liu, Jiaxiang, et autres
Publié: (2025)
Self-Rewarding Language Models
par: Yuan, Weizhe, et autres
Publié: (2024)
par: Yuan, Weizhe, et autres
Publié: (2024)
Boosting Large Language Models with Socratic Method for Conversational Mathematics Teaching
par: Ding, Yuyang, et autres
Publié: (2024)
par: Ding, Yuyang, et autres
Publié: (2024)
Whispers that Shake Foundations: Analyzing and Mitigating False Premise Hallucinations in Large Language Models
par: Yuan, Hongbang, et autres
Publié: (2024)
par: Yuan, Hongbang, et autres
Publié: (2024)
DiscussLLM: Teaching Large Language Models When to Speak
par: Patel, Deep Anil, et autres
Publié: (2025)
par: Patel, Deep Anil, et autres
Publié: (2025)
Can Language Model Understand Word Semantics as A Chatbot? An Empirical Study of Language Model Internal External Mismatch
par: Zhao, Jinman, et autres
Publié: (2024)
par: Zhao, Jinman, et autres
Publié: (2024)
One Mind, Many Tongues: A Deep Dive into Language-Agnostic Knowledge Neurons in Large Language Models
par: Cao, Pengfei, et autres
Publié: (2024)
par: Cao, Pengfei, et autres
Publié: (2024)
Agents Explore but Agents Ignore: LLMs Lack Environmental Curiosity
par: Engländer, Leon, et autres
Publié: (2026)
par: Engländer, Leon, et autres
Publié: (2026)
EvalLM: Interactive Evaluation of Large Language Model Prompts on User-Defined Criteria
par: Kim, Tae Soo, et autres
Publié: (2023)
par: Kim, Tae Soo, et autres
Publié: (2023)
Benchmarking Benchmark Leakage in Large Language Models
par: Xu, Ruijie, et autres
Publié: (2024)
par: Xu, Ruijie, et autres
Publié: (2024)
Unlocking the Future: Exploring Look-Ahead Planning Mechanistic Interpretability in Large Language Models
par: Men, Tianyi, et autres
Publié: (2024)
par: Men, Tianyi, et autres
Publié: (2024)
If You Can't Use Them, Recycle Them: Optimizing Merging at Scale Mitigates Performance Tradeoffs
par: Khalifa, Muhammad, et autres
Publié: (2024)
par: Khalifa, Muhammad, et autres
Publié: (2024)
Documents similaires
-
On the Trade-off between Redundancy and Local Coherence in Summarization
par: Cardenas, Ronald, et autres
Publié: (2022) -
Teaching Large Language Models an Unseen Language on the Fly
par: Zhang, Chen, et autres
Publié: (2024) -
System-Level Natural Language Feedback
par: Yuan, Weizhe, et autres
Publié: (2023) -
The Critique of Critique
par: Sun, Shichao, et autres
Publié: (2024) -
Bigger But Not Better: Small Neural Language Models Outperform Large Language Models in Detection of Thought Disorder
par: Li, Changye, et autres
Publié: (2025)