Alignment-Enhanced Decoding:Defending via Token-Level Adaptive Refining of Probability Distributions
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Quan, Zhou, Zhenhong, He, Longzhu, Liu, Yi, Zhang, Wei, Su, Sen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FlipGuard: Defending Preference Alignment against Update Regression with Constrained Optimization
por: Zhu, Mingye, et al.
Publicado: (2024)
por: Zhu, Mingye, et al.
Publicado: (2024)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
por: Zhou, Zhenhong, et al.
Publicado: (2024)
por: Zhou, Zhenhong, et al.
Publicado: (2024)
GRIFFIN: Effective Token Alignment for Faster Speculative Decoding
por: Hu, Shijing, et al.
Publicado: (2025)
por: Hu, Shijing, et al.
Publicado: (2025)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
por: Wu, Jialiang, et al.
Publicado: (2025)
por: Wu, Jialiang, et al.
Publicado: (2025)
Crabs: Consuming Resource via Auto-generation for LLM-DoS Attack under Black-box Settings
por: Zhang, Yuanhe, et al.
Publicado: (2024)
por: Zhang, Yuanhe, et al.
Publicado: (2024)
On-the-fly Preference Alignment via Principle-Guided Decoding
por: Zhu, Mingye, et al.
Publicado: (2025)
por: Zhu, Mingye, et al.
Publicado: (2025)
Token-Guard: Towards Token-Level Hallucination Control via Self-Checking Decoding
por: Zhu, Yifan, et al.
Publicado: (2026)
por: Zhu, Yifan, et al.
Publicado: (2026)
AIR: Complex Instruction Generation via Automatic Iterative Refinement
por: Liu, Wei, et al.
Publicado: (2025)
por: Liu, Wei, et al.
Publicado: (2025)
LARFT: Closing the Cognition-Action Gap for Length Instruction Following in Large Language Models
por: Zhang, Wei, et al.
Publicado: (2026)
por: Zhang, Wei, et al.
Publicado: (2026)
SafeDecoding: Defending against Jailbreak Attacks via Safety-Aware Decoding
por: Xu, Zhangchen, et al.
Publicado: (2024)
por: Xu, Zhangchen, et al.
Publicado: (2024)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
por: Zhang, Songming, et al.
Publicado: (2025)
por: Zhang, Songming, et al.
Publicado: (2025)
Token-Driven GammaTune: Adaptive Calibration for Enhanced Speculative Decoding
por: Gautam, Aayush, et al.
Publicado: (2025)
por: Gautam, Aayush, et al.
Publicado: (2025)
Condor: Enhance LLM Alignment with Knowledge-Driven Data Synthesis and Refinement
por: Cao, Maosong, et al.
Publicado: (2025)
por: Cao, Maosong, et al.
Publicado: (2025)
TPA: Next Token Probability Attribution for Detecting Hallucinations in RAG
por: Lu, Pengqian, et al.
Publicado: (2025)
por: Lu, Pengqian, et al.
Publicado: (2025)
AdaFuse: Adaptive Ensemble Decoding with Test-Time Scaling for LLMs
por: Cui, Chengming, et al.
Publicado: (2026)
por: Cui, Chengming, et al.
Publicado: (2026)
ProFit: Leveraging High-Value Signals in SFT via Probability-Guided Token Selection
por: Liu, Tao, et al.
Publicado: (2026)
por: Liu, Tao, et al.
Publicado: (2026)
Generative Sentiment Analysis via Latent Category Distribution and Constrained Decoding
por: Zhou, Jun, et al.
Publicado: (2024)
por: Zhou, Jun, et al.
Publicado: (2024)
Defending Large Language Models Against Jailbreak Attacks via In-Decoding Safety-Awareness Probing
por: Zhao, Yinzhi, et al.
Publicado: (2026)
por: Zhao, Yinzhi, et al.
Publicado: (2026)
Negating Negatives: Alignment with Human Negative Samples via Distributional Dispreference Optimization
por: Duan, Shitong, et al.
Publicado: (2024)
por: Duan, Shitong, et al.
Publicado: (2024)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
por: Liu, Peijie, et al.
Publicado: (2025)
por: Liu, Peijie, et al.
Publicado: (2025)
Evolutionary Guided Decoding: Iterative Value Refinement for LLMs
por: Liu, Zhenhua, et al.
Publicado: (2025)
por: Liu, Zhenhua, et al.
Publicado: (2025)
SEG:Seeds-Enhanced Iterative Refinement Graph Neural Network for Entity Alignment
por: Ai, Wei, et al.
Publicado: (2024)
por: Ai, Wei, et al.
Publicado: (2024)
TokenTiming: A Dynamic Alignment Method for Universal Speculative Decoding Model Pairs
por: Xiao, Sibo, et al.
Publicado: (2025)
por: Xiao, Sibo, et al.
Publicado: (2025)
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
por: He, Bowei, et al.
Publicado: (2026)
por: He, Bowei, et al.
Publicado: (2026)
Probabilistic Token Alignment for Large Language Model Fusion
por: Zeng, Runjia, et al.
Publicado: (2025)
por: Zeng, Runjia, et al.
Publicado: (2025)
Alirector: Alignment-Enhanced Chinese Grammatical Error Corrector
por: Yang, Haihui, et al.
Publicado: (2024)
por: Yang, Haihui, et al.
Publicado: (2024)
PAD: Personalized Alignment of LLMs at Decoding-Time
por: Chen, Ruizhe, et al.
Publicado: (2024)
por: Chen, Ruizhe, et al.
Publicado: (2024)
Course-Correction: Safety Alignment Using Synthetic Preferences
por: Xu, Rongwu, et al.
Publicado: (2024)
por: Xu, Rongwu, et al.
Publicado: (2024)
Unlocking Recursive Thinking of LLMs: Alignment via Refinement
por: Zhang, Haoke, et al.
Publicado: (2025)
por: Zhang, Haoke, et al.
Publicado: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
por: Zhang, Xiaotian, et al.
Publicado: (2025)
por: Zhang, Xiaotian, et al.
Publicado: (2025)
Enhancing the Medical Context-Awareness Ability of LLMs via Multifaceted Self-Refinement Learning
por: Zhou, Yuxuan, et al.
Publicado: (2025)
por: Zhou, Yuxuan, et al.
Publicado: (2025)
Token Alignment via Character Matching for Subword Completion
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
Direct Multi-Token Decoding
por: Luo, Xuan, et al.
Publicado: (2025)
por: Luo, Xuan, et al.
Publicado: (2025)
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
por: Zhou, Changzhi, et al.
Publicado: (2025)
por: Zhou, Changzhi, et al.
Publicado: (2025)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
por: Yao, Jui-Ming, et al.
Publicado: (2025)
por: Yao, Jui-Ming, et al.
Publicado: (2025)
StableMask: Refining Causal Masking in Decoder-only Transformer
por: Yin, Qingyu, et al.
Publicado: (2024)
por: Yin, Qingyu, et al.
Publicado: (2024)
Adaptive Token Biaser: Knowledge Editing via Biasing Key Entities
por: Bi, Baolong, et al.
Publicado: (2024)
por: Bi, Baolong, et al.
Publicado: (2024)
Exploring Multi-Temperature Strategies for Token- and Rollout-Level Control in RLVR
por: Zhuang, Haomin, et al.
Publicado: (2025)
por: Zhuang, Haomin, et al.
Publicado: (2025)
TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching
por: Nguyen, Truong, et al.
Publicado: (2026)
por: Nguyen, Truong, et al.
Publicado: (2026)
Language Models can Evaluate Themselves via Probability Discrepancy
por: Xia, Tingyu, et al.
Publicado: (2024)
por: Xia, Tingyu, et al.
Publicado: (2024)
Ejemplares similares
-
FlipGuard: Defending Preference Alignment against Update Regression with Constrained Optimization
por: Zhu, Mingye, et al.
Publicado: (2024) -
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
por: Zhou, Zhenhong, et al.
Publicado: (2024) -
GRIFFIN: Effective Token Alignment for Faster Speculative Decoding
por: Hu, Shijing, et al.
Publicado: (2025) -
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
por: Wu, Jialiang, et al.
Publicado: (2025) -
Crabs: Consuming Resource via Auto-generation for LLM-DoS Attack under Black-box Settings
por: Zhang, Yuanhe, et al.
Publicado: (2024)