Unlocking Decoding-time Controllability: Gradient-Free Multi-Objective Alignment with Contrastive Prompts
Fuente:
arXiv
Guardado en:
| Autores principales: | Fu, Tingchen, Hou, Yupeng, McAuley, Julian, Yan, Rui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Purely Semantic Indexing for LLM-based Generative Recommendation and Retrieval
por: Zhang, Ruohan, et al.
Publicado: (2025)
por: Zhang, Ruohan, et al.
Publicado: (2025)
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
por: Wang, Jianing, et al.
Publicado: (2024)
por: Wang, Jianing, et al.
Publicado: (2024)
Pctx: Tokenizing Personalized Context for Generative Recommendation
por: Zhong, Qiyong, et al.
Publicado: (2025)
por: Zhong, Qiyong, et al.
Publicado: (2025)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
por: Hu, Yuanzhe, et al.
Publicado: (2025)
por: Hu, Yuanzhe, et al.
Publicado: (2025)
Extending Input Contexts of Language Models through Training on Segmented Sequences
por: Karypis, Petros, et al.
Publicado: (2023)
por: Karypis, Petros, et al.
Publicado: (2023)
Same Question, Different Words: A Latent Adversarial Framework for Prompt Robustness
por: Fu, Tingchen, et al.
Publicado: (2025)
por: Fu, Tingchen, et al.
Publicado: (2025)
Disperse-Then-Merge: Pushing the Limits of Instruction Tuning via Alignment Tax Reduction
por: Fu, Tingchen, et al.
Publicado: (2024)
por: Fu, Tingchen, et al.
Publicado: (2024)
Multi-Behavior Generative Recommendation
por: Liu, Zihan, et al.
Publicado: (2024)
por: Liu, Zihan, et al.
Publicado: (2024)
Large Language Models are Zero-Shot Rankers for Recommender Systems
por: Hou, Yupeng, et al.
Publicado: (2023)
por: Hou, Yupeng, et al.
Publicado: (2023)
When Benchmarks Age: Temporal Misalignment through Large Language Model Factuality Evaluation
por: Jiang, Xunyi, et al.
Publicado: (2025)
por: Jiang, Xunyi, et al.
Publicado: (2025)
CAMELoT: Towards Large Language Models with Training-Free Consolidated Associative Memory
por: He, Zexue, et al.
Publicado: (2024)
por: He, Zexue, et al.
Publicado: (2024)
LVCHAT: Facilitating Long Video Comprehension
por: Wang, Yu, et al.
Publicado: (2024)
por: Wang, Yu, et al.
Publicado: (2024)
Pluralistic Off-policy Evaluation and Alignment
por: Huang, Chengkai, et al.
Publicado: (2025)
por: Huang, Chengkai, et al.
Publicado: (2025)
Multi-Agent Collaborative Filtering: Orchestrating Users and Items for Agentic Recommendations
por: Xia, Yu, et al.
Publicado: (2025)
por: Xia, Yu, et al.
Publicado: (2025)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
Large Scale Knowledge Washing
por: Wang, Yu, et al.
Publicado: (2024)
por: Wang, Yu, et al.
Publicado: (2024)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
por: Kim, Haven, et al.
Publicado: (2026)
por: Kim, Haven, et al.
Publicado: (2026)
Cognitive Bias in Decision-Making with LLMs
por: Echterhoff, Jessica, et al.
Publicado: (2024)
por: Echterhoff, Jessica, et al.
Publicado: (2024)
From Drafts to Answers: Unlocking LLM Potential via Aggregation Fine-Tuning
por: Li, Yafu, et al.
Publicado: (2025)
por: Li, Yafu, et al.
Publicado: (2025)
Mitigating Hallucination in Fictional Character Role-Play
por: Sadeq, Nafis, et al.
Publicado: (2024)
por: Sadeq, Nafis, et al.
Publicado: (2024)
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
por: Huang, Chengkai, et al.
Publicado: (2024)
por: Huang, Chengkai, et al.
Publicado: (2024)
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
por: Yoon, Se-eun, et al.
Publicado: (2024)
por: Yoon, Se-eun, et al.
Publicado: (2024)
Learning to Hint for Reinforcement Learning
por: Xia, Yu, et al.
Publicado: (2026)
por: Xia, Yu, et al.
Publicado: (2026)
Importance Sampling for Multi-Negative Multimodal Direct Preference Optimization
por: Li, Xintong, et al.
Publicado: (2025)
por: Li, Xintong, et al.
Publicado: (2025)
Self-Updatable Large Language Models by Integrating Context into Model Parameters
por: Wang, Yu, et al.
Publicado: (2024)
por: Wang, Yu, et al.
Publicado: (2024)
Mem-α: Learning Memory Construction via Reinforcement Learning
por: Wang, Yu, et al.
Publicado: (2025)
por: Wang, Yu, et al.
Publicado: (2025)
Improving In-Context Learning with Reasoning Distillation
por: Sadeq, Nafis, et al.
Publicado: (2025)
por: Sadeq, Nafis, et al.
Publicado: (2025)
Automatic Pair Construction for Contrastive Post-training
por: Xu, Canwen, et al.
Publicado: (2023)
por: Xu, Canwen, et al.
Publicado: (2023)
Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs
por: Xia, Yu, et al.
Publicado: (2024)
por: Xia, Yu, et al.
Publicado: (2024)
A Survey on Personalized and Pluralistic Preference Alignment in Large Language Models
por: Xie, Zhouhang, et al.
Publicado: (2025)
por: Xie, Zhouhang, et al.
Publicado: (2025)
Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models
por: Fu, Tingchen, et al.
Publicado: (2025)
por: Fu, Tingchen, et al.
Publicado: (2025)
Few-shot Dialogue Strategy Learning for Motivational Interviewing via Inductive Reasoning
por: Xie, Zhouhang, et al.
Publicado: (2024)
por: Xie, Zhouhang, et al.
Publicado: (2024)
Forecasting Live Chat Intent from Browsing History
por: Yoon, Se-eun, et al.
Publicado: (2024)
por: Yoon, Se-eun, et al.
Publicado: (2024)
ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces
por: Xu, Xin, et al.
Publicado: (2026)
por: Xu, Xin, et al.
Publicado: (2026)
Inductive Generative Recommendation via Retrieval-based Speculation
por: Ding, Yijie, et al.
Publicado: (2024)
por: Ding, Yijie, et al.
Publicado: (2024)
Steer Model beyond Assistant: Controlling System Prompt Strength via Contrastive Decoding
por: Dong, Yijiang River, et al.
Publicado: (2026)
por: Dong, Yijiang River, et al.
Publicado: (2026)
BBA: Bi-Modal Behavioral Alignment for Reasoning with Large Vision-Language Models
por: Zhao, Xueliang, et al.
Publicado: (2024)
por: Zhao, Xueliang, et al.
Publicado: (2024)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
por: Liu, Biao, et al.
Publicado: (2025)
por: Liu, Biao, et al.
Publicado: (2025)
Quantifying Cognitive Bias Induction in LLM-Generated Content
por: Alessa, Abeer, et al.
Publicado: (2025)
por: Alessa, Abeer, et al.
Publicado: (2025)
Ejemplares similares
-
Purely Semantic Indexing for LLM-based Generative Recommendation and Retrieval
por: Zhang, Ruohan, et al.
Publicado: (2025) -
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
por: Wang, Jianing, et al.
Publicado: (2024) -
Pctx: Tokenizing Personalized Context for Generative Recommendation
por: Zhong, Qiyong, et al.
Publicado: (2025) -
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
por: Hu, Yuanzhe, et al.
Publicado: (2025) -
Extending Input Contexts of Language Models through Training on Segmented Sequences
por: Karypis, Petros, et al.
Publicado: (2023)