Contrastive Knowledge Transfer and Robust Optimization for Secure Alignment of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zheng, Jiasen, Zhang, Huajun, Yan, Xu, Hao, Ran, Peng, Chong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Structured Prompt Optimization for Few-Shot Text Classification via Semantic Alignment in Latent Space
par: Zheng, Jiasen, et autres
Publié: (2026)
par: Zheng, Jiasen, et autres
Publié: (2026)
Large Knowledge Model: Perspectives and Challenges
par: Chen, Huajun
Publié: (2023)
par: Chen, Huajun
Publié: (2023)
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
par: Yang, Junjie, et autres
Publié: (2025)
par: Yang, Junjie, et autres
Publié: (2025)
Making Large Language Models Perform Better in Knowledge Graph Completion
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
Improving the Robustness of Large Language Models via Consistency Alignment
par: Zhao, Yukun, et autres
Publié: (2024)
par: Zhao, Yukun, et autres
Publié: (2024)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
par: Peng, Tianyu, et autres
Publié: (2024)
par: Peng, Tianyu, et autres
Publié: (2024)
Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions
par: Zhang, Xiaoyun, et autres
Publié: (2024)
par: Zhang, Xiaoyun, et autres
Publié: (2024)
Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
par: Pan, Yurui, et autres
Publié: (2026)
par: Pan, Yurui, et autres
Publié: (2026)
K-ON: Stacking Knowledge On the Head Layer of Large Language Model
par: Guo, Lingbing, et autres
Publié: (2025)
par: Guo, Lingbing, et autres
Publié: (2025)
Every Little Helps: Building Knowledge Graph Foundation Model with Fine-grained Transferable Multi-modal Tokens
par: Zhang, Yichi, et autres
Publié: (2026)
par: Zhang, Yichi, et autres
Publié: (2026)
J&H: Evaluating the Robustness of Large Language Models Under Knowledge-Injection Attacks in Legal Domain
par: Hu, Yiran, et autres
Publié: (2025)
par: Hu, Yiran, et autres
Publié: (2025)
Feature Alignment-Based Knowledge Distillation for Efficient Compression of Large Language Models
par: Wang, Shuo, et autres
Publié: (2024)
par: Wang, Shuo, et autres
Publié: (2024)
StressEval: Failure-Driven Dynamic Benchmarking for Knowledge-Intensive Reasoning in Large Language Models
par: Chen, Yongrui, et autres
Publié: (2026)
par: Chen, Yongrui, et autres
Publié: (2026)
WISE: Rethinking the Knowledge Memory for Lifelong Model Editing of Large Language Models
par: Wang, Peng, et autres
Publié: (2024)
par: Wang, Peng, et autres
Publié: (2024)
Delta -- Contrastive Decoding Mitigates Text Hallucinations in Large Language Models
par: Huang, Cheng Peng, et autres
Publié: (2025)
par: Huang, Cheng Peng, et autres
Publié: (2025)
Unveiling the Pitfalls of Knowledge Editing for Large Language Models
par: Li, Zhoubo, et autres
Publié: (2023)
par: Li, Zhoubo, et autres
Publié: (2023)
Evolutionary Contrastive Distillation for Language Model Alignment
par: Katz-Samuels, Julian, et autres
Publié: (2024)
par: Katz-Samuels, Julian, et autres
Publié: (2024)
The Knowledge Alignment Problem: Bridging Human and External Knowledge for Large Language Models
par: Zhang, Shuo, et autres
Publié: (2023)
par: Zhang, Shuo, et autres
Publié: (2023)
RTQA : Recursive Thinking for Complex Temporal Knowledge Graph Question Answering with Large Language Models
par: Gong, Zhaoyan, et autres
Publié: (2025)
par: Gong, Zhaoyan, et autres
Publié: (2025)
Detoxifying Large Language Models via Knowledge Editing
par: Wang, Mengru, et autres
Publié: (2024)
par: Wang, Mengru, et autres
Publié: (2024)
Refine Knowledge of Large Language Models via Adaptive Contrastive Learning
par: Li, Yinghui, et autres
Publié: (2025)
par: Li, Yinghui, et autres
Publié: (2025)
Calibrating the Confidence of Large Language Models by Eliciting Fidelity
par: Zhang, Mozhi, et autres
Publié: (2024)
par: Zhang, Mozhi, et autres
Publié: (2024)
Large Language Models Are Not Robust Multiple Choice Selectors
par: Zheng, Chujie, et autres
Publié: (2023)
par: Zheng, Chujie, et autres
Publié: (2023)
Contrastive Learning for Knowledge-Based Question Generation in Large Language Models
par: Zhang, Zhenhong, et autres
Publié: (2024)
par: Zhang, Zhenhong, et autres
Publié: (2024)
NEO-BENCH: Evaluating Robustness of Large Language Models with Neologisms
par: Zheng, Jonathan, et autres
Publié: (2024)
par: Zheng, Jonathan, et autres
Publié: (2024)
Cross-Lingual Optimization for Language Transfer in Large Language Models
par: Lee, Jungseob, et autres
Publié: (2025)
par: Lee, Jungseob, et autres
Publié: (2025)
Gradual Learning: Optimizing Fine-Tuning with Partially Mastered Knowledge in Large Language Models
par: Li, Bozhou, et autres
Publié: (2024)
par: Li, Bozhou, et autres
Publié: (2024)
Learning to Plan for Retrieval-Augmented Large Language Models from Knowledge Graphs
par: Wang, Junjie, et autres
Publié: (2024)
par: Wang, Junjie, et autres
Publié: (2024)
Exploring Multilingual Concepts of Human Value in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?
par: Xu, Shaoyang, et autres
Publié: (2024)
par: Xu, Shaoyang, et autres
Publié: (2024)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
STARS: Synchronous Token Alignment for Robust Supervision in Large Language Models
par: Quamar, Mohammad Atif, et autres
Publié: (2025)
par: Quamar, Mohammad Atif, et autres
Publié: (2025)
Multimodal Integrated Knowledge Transfer to Large Language Models through Preference Optimization with Biomedical Applications
par: Wang, Zhanliang, et autres
Publié: (2025)
par: Wang, Zhanliang, et autres
Publié: (2025)
Enhancing Large Language Models (LLMs) for Telecommunications using Knowledge Graphs and Retrieval-Augmented Generation
par: Yuan, Dun, et autres
Publié: (2025)
par: Yuan, Dun, et autres
Publié: (2025)
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
par: Wang, Xiaohan, et autres
Publié: (2024)
par: Wang, Xiaohan, et autres
Publié: (2024)
Knowledge Mechanisms in Large Language Models: A Survey and Perspective
par: Wang, Mengru, et autres
Publié: (2024)
par: Wang, Mengru, et autres
Publié: (2024)
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
par: Yang, Kevin, et autres
Publié: (2023)
par: Yang, Kevin, et autres
Publié: (2023)
Personality Alignment of Large Language Models
par: Zhu, Minjun, et autres
Publié: (2024)
par: Zhu, Minjun, et autres
Publié: (2024)
Self-Evolutionary Large Language Models through Uncertainty-Enhanced Preference Optimization
par: Wang, Jianing, et autres
Publié: (2024)
par: Wang, Jianing, et autres
Publié: (2024)
Mitigating Hallucinations of Large Language Models in Medical Information Extraction via Contrastive Decoding
par: Xu, Derong, et autres
Publié: (2024)
par: Xu, Derong, et autres
Publié: (2024)
Multi-perspective Improvement of Knowledge Graph Completion with Large Language Models
par: Xu, Derong, et autres
Publié: (2024)
par: Xu, Derong, et autres
Publié: (2024)
Documents similaires
-
Structured Prompt Optimization for Few-Shot Text Classification via Semantic Alignment in Latent Space
par: Zheng, Jiasen, et autres
Publié: (2026) -
Large Knowledge Model: Perspectives and Challenges
par: Chen, Huajun
Publié: (2023) -
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
par: Yang, Junjie, et autres
Publié: (2025) -
Making Large Language Models Perform Better in Knowledge Graph Completion
par: Zhang, Yichi, et autres
Publié: (2023) -
Improving the Robustness of Large Language Models via Consistency Alignment
par: Zhao, Yukun, et autres
Publié: (2024)