A Systematic Examination of Preference Learning through the Lens of Instruction-Following
Fuente:
arXiv
Saved in:
| Main Authors: | Kim, Joongwon, Goyal, Anirudh, Zhang, Aston, Xiong, Bo, Hou, Rui, Kambadur, Melanie, Mahajan, Dhruv, Hajishirzi, Hannaneh, Tan, Liang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ASTRO: Teaching Language Models to Reason by Reflecting and Backtracking In-Context
by: Kim, Joongwon, et al.
Published: (2025)
by: Kim, Joongwon, et al.
Published: (2025)
Husky: A Unified, Open-Source Language Agent for Multi-Step Reasoning
by: Kim, Joongwon, et al.
Published: (2024)
by: Kim, Joongwon, et al.
Published: (2024)
Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens
by: Liu, Jiacheng, et al.
Published: (2024)
by: Liu, Jiacheng, et al.
Published: (2024)
Machine Reading Comprehension using Case-based Reasoning
by: Thai, Dung, et al.
Published: (2023)
by: Thai, Dung, et al.
Published: (2023)
ReFIT: Relevance Feedback from a Reranker during Inference
by: Reddy, Revanth Gangi, et al.
Published: (2023)
by: Reddy, Revanth Gangi, et al.
Published: (2023)
Beyond Content Relevance: Evaluating Instruction Following in Retrieval Models
by: Zhou, Jianqun, et al.
Published: (2024)
by: Zhou, Jianqun, et al.
Published: (2024)
Towards Better Instruction Following Retrieval Models
by: Zhuang, Yuchen, et al.
Published: (2025)
by: Zhuang, Yuchen, et al.
Published: (2025)
Masking or Mitigating? Deconstructing the Impact of Query Rewriting on Retriever Biases in RAG
by: Goyal, Agam, et al.
Published: (2026)
by: Goyal, Agam, et al.
Published: (2026)
HREF: Human Response-Guided Evaluation of Instruction Following in Language Models
by: Lyu, Xinxi, et al.
Published: (2024)
by: Lyu, Xinxi, et al.
Published: (2024)
Dual-View Training for Instruction-Following Information Retrieval
by: Zeng, Qingcheng, et al.
Published: (2026)
by: Zeng, Qingcheng, et al.
Published: (2026)
FollowTable: A Benchmark for Instruction-Following Table Retrieval
by: Jin, Rihui, et al.
Published: (2026)
by: Jin, Rihui, et al.
Published: (2026)
Reinforced Preference Optimization for Recommendation
by: Tan, Junfei, et al.
Published: (2025)
by: Tan, Junfei, et al.
Published: (2025)
OxygenREC: An Instruction-Following Generative Framework for E-commerce Recommendation
by: Hao, Xuegang, et al.
Published: (2025)
by: Hao, Xuegang, et al.
Published: (2025)
mFollowIR: a Multilingual Benchmark for Instruction Following in Retrieval
by: Weller, Orion, et al.
Published: (2025)
by: Weller, Orion, et al.
Published: (2025)
FollowIR: Evaluating and Teaching Information Retrieval Models to Follow Instructions
by: Weller, Orion, et al.
Published: (2024)
by: Weller, Orion, et al.
Published: (2024)
Meta-experiments: Improving experimentation through experimentation
by: Müller, Melanie J. I.
Published: (2024)
by: Müller, Melanie J. I.
Published: (2024)
Aligning Web Query Generation with Ranking Objectives via Direct Preference Optimization
by: Coelho, João, et al.
Published: (2025)
by: Coelho, João, et al.
Published: (2025)
Discrete Preference Learning for Personalized Multimodal Generation
by: Zhang, Yuting, et al.
Published: (2026)
by: Zhang, Yuting, et al.
Published: (2026)
Self-Generated Critiques Boost Reward Modeling for Language Models
by: Yu, Yue, et al.
Published: (2024)
by: Yu, Yue, et al.
Published: (2024)
Prospective Preference Enhanced Mixed Attentive Model for Session-based Recommendation
by: Peng, Bo, et al.
Published: (2022)
by: Peng, Bo, et al.
Published: (2022)
IFIR: A Comprehensive Benchmark for Evaluating Instruction-Following in Expert-Domain Information Retrieval
by: Song, Tingyu, et al.
Published: (2025)
by: Song, Tingyu, et al.
Published: (2025)
Empowering Retrieval-based Conversational Recommendation with Contrasting User Preferences
by: Kook, Heejin, et al.
Published: (2025)
by: Kook, Heejin, et al.
Published: (2025)
Learning Evolving Preferences: A Federated Continual Framework for User-Centric Recommendation
by: Zhang, Chunxu, et al.
Published: (2026)
by: Zhang, Chunxu, et al.
Published: (2026)
Direct Preference Optimization for LLM-Enhanced Recommendation Systems
by: Sun, Chao, et al.
Published: (2024)
by: Sun, Chao, et al.
Published: (2024)
Disentangled Modeling of Preferences and Social Influence for Group Recommendation
by: Ye, Guangze, et al.
Published: (2025)
by: Ye, Guangze, et al.
Published: (2025)
Synergizing RAG and Reasoning: A Systematic Review
by: Gao, Yunfan, et al.
Published: (2025)
by: Gao, Yunfan, et al.
Published: (2025)
A Personality-Guided Preference Aggregator for Ephemeral Group Recommendation
by: Ye, Guangze, et al.
Published: (2023)
by: Ye, Guangze, et al.
Published: (2023)
LISRec: Modeling User Preferences with Learned Item Shortcuts for Sequential Recommendation
by: Xin, Haidong, et al.
Published: (2025)
by: Xin, Haidong, et al.
Published: (2025)
Controlling Diversity at Inference: Guiding Diffusion Recommender Models with Targeted Category Preferences
by: Han, Gwangseok, et al.
Published: (2024)
by: Han, Gwangseok, et al.
Published: (2024)
Boosting Knowledge Graph-based Recommendations through Confidence-Aware Augmentation with Large Language Models
by: Cai, Rui, et al.
Published: (2025)
by: Cai, Rui, et al.
Published: (2025)
Generalizing Verifiable Instruction Following
by: Pyatkin, Valentina, et al.
Published: (2025)
by: Pyatkin, Valentina, et al.
Published: (2025)
CTR-Driven Ad Text Generation via Online Feedback Preference Optimization
by: Chen, Yanda, et al.
Published: (2025)
by: Chen, Yanda, et al.
Published: (2025)
ODataX: A Progressive Evolution of the Open Data Protocol
by: Ganesh, Anirudh, et al.
Published: (2025)
by: Ganesh, Anirudh, et al.
Published: (2025)
On Softmax Direct Preference Optimization for Recommendation
by: Chen, Yuxin, et al.
Published: (2024)
by: Chen, Yuxin, et al.
Published: (2024)
Embed Progressive Implicit Preference in Unified Space for Deep Collaborative Filtering
by: Zhang, Zhongjin, et al.
Published: (2025)
by: Zhang, Zhongjin, et al.
Published: (2025)
TrackRec: Iterative Alternating Feedback with Chain-of-Thought via Preference Alignment for Recommendation
by: Xia, Yu, et al.
Published: (2025)
by: Xia, Yu, et al.
Published: (2025)
CAPTS: Channel-Aware, Preference-Aligned Trigger Selection for Multi-Channel Item-to-Item Retrieval
by: Zhou, Xiaoyou, et al.
Published: (2026)
by: Zhou, Xiaoyou, et al.
Published: (2026)
Bringing Reasoning to Generative Recommendation Through the Lens of Cascaded Ranking
by: Lin, Xinyu, et al.
Published: (2026)
by: Lin, Xinyu, et al.
Published: (2026)
Toward General Instruction-Following Alignment for Retrieval-Augmented Generation
by: Dong, Guanting, et al.
Published: (2024)
by: Dong, Guanting, et al.
Published: (2024)
Fading to Grow: Growing Preference Ratios via Preference Fading Discrete Diffusion for Recommendation
by: Hu, Guoqing, et al.
Published: (2025)
by: Hu, Guoqing, et al.
Published: (2025)
Similar Items
-
ASTRO: Teaching Language Models to Reason by Reflecting and Backtracking In-Context
by: Kim, Joongwon, et al.
Published: (2025) -
Husky: A Unified, Open-Source Language Agent for Multi-Step Reasoning
by: Kim, Joongwon, et al.
Published: (2024) -
Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens
by: Liu, Jiacheng, et al.
Published: (2024) -
Machine Reading Comprehension using Case-based Reasoning
by: Thai, Dung, et al.
Published: (2023) -
ReFIT: Relevance Feedback from a Reranker during Inference
by: Reddy, Revanth Gangi, et al.
Published: (2023)