Enhancing LLM Robustness to Perturbed Instructions: An Empirical Study
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Agrawal, Aryan, Alazraki, Lisa, Honarvar, Shahin, Rei, Marek |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Meta-Reasoning Improves Tool Use in Large Language Models
par: Alazraki, Lisa, et autres
Publié: (2024)
par: Alazraki, Lisa, et autres
Publié: (2024)
AgentCoMa: A Compositional Benchmark Mixing Commonsense and Mathematical Reasoning in Real-World Scenarios
par: Alazraki, Lisa, et autres
Publié: (2025)
par: Alazraki, Lisa, et autres
Publié: (2025)
Improving the OOD Performance of Closed-Source LLMs on NLI Through Strategic Data Selection
par: Stacey, Joe, et autres
Publié: (2025)
par: Stacey, Joe, et autres
Publié: (2025)
Reverse Engineering Human Preferences with Reinforcement Learning
par: Alazraki, Lisa, et autres
Publié: (2025)
par: Alazraki, Lisa, et autres
Publié: (2025)
No Need for Explanations: LLMs can implicitly learn from mistakes in-context
par: Alazraki, Lisa, et autres
Publié: (2025)
par: Alazraki, Lisa, et autres
Publié: (2025)
StateAct: Enhancing LLM Base Agents via Self-prompting and State-tracking
par: Rozanov, Nikolai, et autres
Publié: (2024)
par: Rozanov, Nikolai, et autres
Publié: (2024)
Culturally Grounded Physical Commonsense Reasoning in Italian and English: A Submission to the MRL 2025 Shared Task
par: De Santis, Marco, et autres
Publié: (2025)
par: De Santis, Marco, et autres
Publié: (2025)
Distilling Robustness into Natural Language Inference Models with Domain-Targeted Augmentation
par: Stacey, Joe, et autres
Publié: (2023)
par: Stacey, Joe, et autres
Publié: (2023)
Fine-tuning with RAG for Improving LLM Learning of New Skills
par: Ibrahim, Humaid, et autres
Publié: (2025)
par: Ibrahim, Humaid, et autres
Publié: (2025)
Illuminate: A novel approach for depression detection with explainable analysis and proactive therapy using prompt engineering
par: Agrawal, Aryan
Publié: (2024)
par: Agrawal, Aryan
Publié: (2024)
DiffuseDef: Improved Robustness to Adversarial Attacks via Iterative Denoising
par: Li, Zhenhao, et autres
Publié: (2024)
par: Li, Zhenhao, et autres
Publié: (2024)
Is Preference Alignment Always the Best Option to Enhance LLM-Based Translation? An Empirical Analysis
par: Gisserot-Boukhlef, Hippolyte, et autres
Publié: (2024)
par: Gisserot-Boukhlef, Hippolyte, et autres
Publié: (2024)
Scaling Small Agents Through Strategy Auctions
par: Alazraki, Lisa, et autres
Publié: (2026)
par: Alazraki, Lisa, et autres
Publié: (2026)
Improving LLM Unlearning Robustness via Random Perturbations
par: Huu-Tien, Dang, et autres
Publié: (2025)
par: Huu-Tien, Dang, et autres
Publié: (2025)
More Than a Quick Glance: Overcoming the Greedy Bias in KV-Cache Compression
par: Sood, Aryan, et autres
Publié: (2026)
par: Sood, Aryan, et autres
Publié: (2026)
An Empirical Study of Conformal Prediction in LLM with ASP Scaffolds for Robust Reasoning
par: Kaur, Navdeep, et autres
Publié: (2025)
par: Kaur, Navdeep, et autres
Publié: (2025)
An Empathetic AI Coach for Self-Attachment Therapy
par: Alazraki, Lisa, et autres
Publié: (2022)
par: Alazraki, Lisa, et autres
Publié: (2022)
Can Automatic Metrics Assess High-Quality Translations?
par: Agrawal, Sweta, et autres
Publié: (2024)
par: Agrawal, Sweta, et autres
Publié: (2024)
Resource-Aware Arabic LLM Creation: Model Adaptation, Integration, and Multi-Domain Testing
par: Aryan, Prakash
Publié: (2024)
par: Aryan, Prakash
Publié: (2024)
Teach Me Sign: Stepwise Prompting LLM for Sign Language Production
par: An, Zhaoyi, et autres
Publié: (2025)
par: An, Zhaoyi, et autres
Publié: (2025)
DFKI-NLP at SemEval-2024 Task 2: Towards Robust LLMs Using Data Perturbations and MinMax Training
par: Verma, Bhuvanesh, et autres
Publié: (2024)
par: Verma, Bhuvanesh, et autres
Publié: (2024)
Towards Understanding the Robustness of LLM-based Evaluations under Perturbations
par: Chaudhary, Manav, et autres
Publié: (2024)
par: Chaudhary, Manav, et autres
Publié: (2024)
Parameter Efficient Instruction Tuning: An Empirical Study
par: He, Pengfei
Publié: (2024)
par: He, Pengfei
Publié: (2024)
Is Context Helpful for Chat Translation Evaluation?
par: Agrawal, Sweta, et autres
Publié: (2024)
par: Agrawal, Sweta, et autres
Publié: (2024)
EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction
par: Yuan, Siyu, et autres
Publié: (2024)
par: Yuan, Siyu, et autres
Publié: (2024)
Can LLM-Generated Textual Explanations Enhance Model Classification Performance? An Empirical Study
par: Dhaini, Mahdi, et autres
Publié: (2025)
par: Dhaini, Mahdi, et autres
Publié: (2025)
An Empirical Study on the Robustness of Massively Multilingual Neural Machine Translation
par: Supryadi, et autres
Publié: (2024)
par: Supryadi, et autres
Publié: (2024)
Structure First, Reason Next: Enhancing a Large Language Model using Knowledge Graph for Numerical Reasoning in Financial Documents
par: Mishra, Aryan, et autres
Publié: (2026)
par: Mishra, Aryan, et autres
Publié: (2026)
Enhancing LLM Reasoning with Iterative DPO: A Comprehensive Empirical Investigation
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
LLMSR@XLLM25: An Empirical Study of LLM for Structural Reasoning
par: Li, Xinye, et autres
Publié: (2025)
par: Li, Xinye, et autres
Publié: (2025)
LLMRank: Understanding LLM Strengths for Model Routing
par: Agrawal, Shubham, et autres
Publié: (2025)
par: Agrawal, Shubham, et autres
Publié: (2025)
Robust Biomedical Publication Type and Study Design Classification with Knowledge-Guided Perturbations
par: Ming, Shufan, et autres
Publié: (2026)
par: Ming, Shufan, et autres
Publié: (2026)
xTower: A Multilingual LLM for Explaining and Correcting Translation Errors
par: Treviso, Marcos, et autres
Publié: (2024)
par: Treviso, Marcos, et autres
Publié: (2024)
Effective Context Selection in LLM-based Leaderboard Generation: An Empirical Study
par: Kabongo, Salomon, et autres
Publié: (2024)
par: Kabongo, Salomon, et autres
Publié: (2024)
Instructional Segment Embedding: Improving LLM Safety with Instruction Hierarchy
par: Wu, Tong, et autres
Publié: (2024)
par: Wu, Tong, et autres
Publié: (2024)
Evaluating Robustness of Large Audio Language Models to Audio Injection: An Empirical Study
par: Hou, Guanyu, et autres
Publié: (2025)
par: Hou, Guanyu, et autres
Publié: (2025)
Instruction Finetuning for Leaderboard Generation from Empirical AI Research
par: Kabongo, Salomon, et autres
Publié: (2024)
par: Kabongo, Salomon, et autres
Publié: (2024)
Self-Review Framework for Enhancing Instruction Following Capability of LLM
par: Park, Sihyun
Publié: (2025)
par: Park, Sihyun
Publié: (2025)
Assessing Adversarial Robustness of Large Language Models: An Empirical Study
par: Yang, Zeyu, et autres
Publié: (2024)
par: Yang, Zeyu, et autres
Publié: (2024)
Taming Sensitive Weights : Noise Perturbation Fine-tuning for Robust LLM Quantization
par: Wang, Dongwei, et autres
Publié: (2024)
par: Wang, Dongwei, et autres
Publié: (2024)
Documents similaires
-
Meta-Reasoning Improves Tool Use in Large Language Models
par: Alazraki, Lisa, et autres
Publié: (2024) -
AgentCoMa: A Compositional Benchmark Mixing Commonsense and Mathematical Reasoning in Real-World Scenarios
par: Alazraki, Lisa, et autres
Publié: (2025) -
Improving the OOD Performance of Closed-Source LLMs on NLI Through Strategic Data Selection
par: Stacey, Joe, et autres
Publié: (2025) -
Reverse Engineering Human Preferences with Reinforcement Learning
par: Alazraki, Lisa, et autres
Publié: (2025) -
No Need for Explanations: LLMs can implicitly learn from mistakes in-context
par: Alazraki, Lisa, et autres
Publié: (2025)