Improving the Robustness of Large Language Models via Consistency Alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Yukun, Yan, Lingyong, Sun, Weiwei, Xing, Guoliang, Wang, Shuaiqiang, Meng, Chong, Cheng, Zhicong, Ren, Zhaochun, Yin, Dawei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
por: Zhao, Yukun, et al.
Publicado: (2023)
por: Zhao, Yukun, et al.
Publicado: (2023)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
por: Sun, Weiwei, et al.
Publicado: (2023)
por: Sun, Weiwei, et al.
Publicado: (2023)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
por: Zhao, Yukun, et al.
Publicado: (2025)
por: Zhao, Yukun, et al.
Publicado: (2025)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
por: Zhu, Dongsheng, et al.
Publicado: (2025)
por: Zhu, Dongsheng, et al.
Publicado: (2025)
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
por: Tang, Hua, et al.
Publicado: (2025)
por: Tang, Hua, et al.
Publicado: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
por: Zhu, Junda, et al.
Publicado: (2025)
por: Zhu, Junda, et al.
Publicado: (2025)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
por: Chen, Yiqun, et al.
Publicado: (2025)
por: Chen, Yiqun, et al.
Publicado: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
por: Wu, Jiulong, et al.
Publicado: (2025)
por: Wu, Jiulong, et al.
Publicado: (2025)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
por: Jiang, Guanying, et al.
Publicado: (2024)
por: Jiang, Guanying, et al.
Publicado: (2024)
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
por: Shi, Zhengliang, et al.
Publicado: (2024)
por: Shi, Zhengliang, et al.
Publicado: (2024)
Learning to Use Tools via Cooperative and Interactive Agents
por: Shi, Zhengliang, et al.
Publicado: (2024)
por: Shi, Zhengliang, et al.
Publicado: (2024)
Direct Retrieval-augmented Optimization: Synergizing Knowledge Selection and Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
MAO-ARAG: Multi-Agent Orchestration for Adaptive Retrieval-Augmented Generation
por: Chen, Yiqun, et al.
Publicado: (2025)
por: Chen, Yiqun, et al.
Publicado: (2025)
ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator
por: Zhu, Junda, et al.
Publicado: (2024)
por: Zhu, Junda, et al.
Publicado: (2024)
Cross-model Control: Improving Multiple Large Language Models in One-time Training
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
How Large Language Models Encode Context Knowledge? A Layer-Wise Probing Study
por: Ju, Tianjie, et al.
Publicado: (2024)
por: Ju, Tianjie, et al.
Publicado: (2024)
Information Discovery in e-Commerce
por: Ren, Zhaochun, et al.
Publicado: (2024)
por: Ren, Zhaochun, et al.
Publicado: (2024)
Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models
por: Liu, Shuliang, et al.
Publicado: (2025)
por: Liu, Shuliang, et al.
Publicado: (2025)
Reinforced Efficient Reasoning via Semantically Diverse Exploration
por: Zhao, Ziqi, et al.
Publicado: (2026)
por: Zhao, Ziqi, et al.
Publicado: (2026)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
por: Liu, Wenhan, et al.
Publicado: (2024)
por: Liu, Wenhan, et al.
Publicado: (2024)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
por: Jia, Pengyue, et al.
Publicado: (2023)
por: Jia, Pengyue, et al.
Publicado: (2023)
DBR: Divergence-Based Regularization for Debiasing Natural Language Understanding Models
por: Li, Zihao, et al.
Publicado: (2025)
por: Li, Zihao, et al.
Publicado: (2025)
Contrastive Knowledge Transfer and Robust Optimization for Secure Alignment of Large Language Models
por: Zheng, Jiasen, et al.
Publicado: (2025)
por: Zheng, Jiasen, et al.
Publicado: (2025)
Hierarchical Alignment: Surgical Fine-Tuning via Functional Layer Specialization in Large Language Models
por: Zhang, Yukun, et al.
Publicado: (2025)
por: Zhang, Yukun, et al.
Publicado: (2025)
EnchTable: Unified Safety Alignment Transfer in Fine-tuned Large Language Models
por: Wu, Jialin, et al.
Publicado: (2025)
por: Wu, Jialin, et al.
Publicado: (2025)
Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering
por: Shi, Zhengliang, et al.
Publicado: (2024)
por: Shi, Zhengliang, et al.
Publicado: (2024)
MAIR: A Massive Benchmark for Evaluating Instructed Retrieval
por: Sun, Weiwei, et al.
Publicado: (2024)
por: Sun, Weiwei, et al.
Publicado: (2024)
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
por: Ni, Hang, et al.
Publicado: (2025)
por: Ni, Hang, et al.
Publicado: (2025)
Tool Learning with Large Language Models: A Survey
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
por: Sun, Hao, et al.
Publicado: (2024)
por: Sun, Hao, et al.
Publicado: (2024)
Measuring Maximum Activations in Open Large Language Models
por: Chen, Luxuan, et al.
Publicado: (2026)
por: Chen, Luxuan, et al.
Publicado: (2026)
Improving Faithfulness of Large Language Models in Summarization via Sliding Generation and Self-Consistency
por: Li, Taiji, et al.
Publicado: (2024)
por: Li, Taiji, et al.
Publicado: (2024)
Towards Completeness-Oriented Tool Retrieval for Large Language Models
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Disentangling Knowledge Representations for Large Language Model Editing
por: Zhang, Mengqi, et al.
Publicado: (2025)
por: Zhang, Mengqi, et al.
Publicado: (2025)
Ejemplares similares
-
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
por: Zhao, Yukun, et al.
Publicado: (2023) -
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
por: Sun, Weiwei, et al.
Publicado: (2023) -
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
por: Zhao, Yukun, et al.
Publicado: (2025) -
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025) -
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
por: Zhu, Dongsheng, et al.
Publicado: (2025)