CLIPer: Tailoring Diverse User Preference via Classifier-Guided Inference-Time Personalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Su, Jinyan, Zhou, Jinpeng, Cardie, Claire, Sun, Wen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Knowing but Not Showing: LLMs Recognize Ambiguity but Rarely Ask Clarifying Questions
di: Su, Jinyan, et al.
Pubblicazione: (2026)
di: Su, Jinyan, et al.
Pubblicazione: (2026)
Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
Adapting Fake News Detection to the Era of Large Language Models
di: Su, Jinyan, et al.
Pubblicazione: (2023)
di: Su, Jinyan, et al.
Pubblicazione: (2023)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
Token-weighted Direct Preference Optimization with Attention
di: Huang, Chengyu, et al.
Pubblicazione: (2026)
di: Huang, Chengyu, et al.
Pubblicazione: (2026)
Multi-Hop Question Answering: When Can Humans Help, and Where do They Struggle?
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
Reasoning Court: Combining Reasoning, Action, and Judgment for Multi-Hop Reasoning
di: Wu, Jingtian, et al.
Pubblicazione: (2025)
di: Wu, Jingtian, et al.
Pubblicazione: (2025)
MASH: Modeling Abstention via Selective Help-Seeking
di: Gul, Mustafa Omer, et al.
Pubblicazione: (2025)
di: Gul, Mustafa Omer, et al.
Pubblicazione: (2025)
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
di: Huang, Chengyu, et al.
Pubblicazione: (2025)
di: Huang, Chengyu, et al.
Pubblicazione: (2025)
Corpus Poisoning via Approximate Greedy Gradient Descent
di: Su, Jinyan, et al.
Pubblicazione: (2024)
di: Su, Jinyan, et al.
Pubblicazione: (2024)
MetaAlign: Align Large Language Models with Diverse Preferences during Inference Time
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
Fast or Better? Balancing Accuracy and Cost in Retrieval-Augmented Generation with Flexible User Control
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
Diversity Augmentation of Dynamic User Preference Data for Boosting Personalized Text Summarizers
di: Chatterjee, Parthiv, et al.
Pubblicazione: (2025)
di: Chatterjee, Parthiv, et al.
Pubblicazione: (2025)
Bootstrapping Post-training Signals for Open-ended Tasks via Rubric-based Self-play on Pre-training Text
di: Huang, Chengyu, et al.
Pubblicazione: (2026)
di: Huang, Chengyu, et al.
Pubblicazione: (2026)
Better LLM Reasoning via Dual-Play
di: Zhang, Zhengxin, et al.
Pubblicazione: (2025)
di: Zhang, Zhengxin, et al.
Pubblicazione: (2025)
SPECTRA: Revealing the Full Spectrum of User Preferences via Distributional LLM Inference
di: Zhang, Luyang, et al.
Pubblicazione: (2025)
di: Zhang, Luyang, et al.
Pubblicazione: (2025)
Drift: Decoding-time Personalized Alignments with Implicit User Preferences
di: Kim, Minbeom, et al.
Pubblicazione: (2025)
di: Kim, Minbeom, et al.
Pubblicazione: (2025)
Clarification Is Not Enough: Post-Clarification Answering Remains the Bottleneck in Multi-Turn QA
di: Su, Jinyan, et al.
Pubblicazione: (2026)
di: Su, Jinyan, et al.
Pubblicazione: (2026)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
di: Chen, Yizhuo, et al.
Pubblicazione: (2025)
di: Chen, Yizhuo, et al.
Pubblicazione: (2025)
I Could've Asked That: Reformulating Unanswerable Questions
di: Zhao, Wenting, et al.
Pubblicazione: (2024)
di: Zhao, Wenting, et al.
Pubblicazione: (2024)
Whose Boat Does it Float? Improving Personalization in Preference Tuning via Inferred User Personas
di: Balepur, Nishant, et al.
Pubblicazione: (2025)
di: Balepur, Nishant, et al.
Pubblicazione: (2025)
PersonalLLM: Tailoring LLMs to Individual Preferences
di: Zollo, Thomas P., et al.
Pubblicazione: (2024)
di: Zollo, Thomas P., et al.
Pubblicazione: (2024)
Tailoring Diagnostic Modeling to Individual Learners: Personalized Distractor Generation via MCTS-Guided Reasoning Reconstruction
di: Wu, Tao, et al.
Pubblicazione: (2025)
di: Wu, Tao, et al.
Pubblicazione: (2025)
PITA: Preference-Guided Inference-Time Alignment for LLM Post-Training
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025)
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025)
WildChat: 1M ChatGPT Interaction Logs in the Wild
di: Zhao, Wenting, et al.
Pubblicazione: (2024)
di: Zhao, Wenting, et al.
Pubblicazione: (2024)
Are Triggers Needed for Document-Level Event Extraction?
di: Shaar, Shaden, et al.
Pubblicazione: (2024)
di: Shaar, Shaden, et al.
Pubblicazione: (2024)
From 1,000,000 Users to Every User: Scaling Up Personalized Preference for User-level Alignment
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Decisive: Guiding User Decisions with Optimal Preference Elicitation from Unstructured Documents
di: Jain, Akriti, et al.
Pubblicazione: (2026)
di: Jain, Akriti, et al.
Pubblicazione: (2026)
Personalized LLM Decoding via Contrasting Personal Preference
di: Bu, Hyungjune, et al.
Pubblicazione: (2025)
di: Bu, Hyungjune, et al.
Pubblicazione: (2025)
PersonalSum: A User-Subjective Guided Personalized Summarization Dataset for Large Language Models
di: Zhang, Lemei, et al.
Pubblicazione: (2024)
di: Zhang, Lemei, et al.
Pubblicazione: (2024)
TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization
di: Yao, Dingyu, et al.
Pubblicazione: (2025)
di: Yao, Dingyu, et al.
Pubblicazione: (2025)
Extended Inductive Reasoning for Personalized Preference Inference from Behavioral Signals
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Diverse Preference Optimization
di: Lanchantin, Jack, et al.
Pubblicazione: (2025)
di: Lanchantin, Jack, et al.
Pubblicazione: (2025)
Syntax-Guided Diffusion Language Models with User-Integrated Personalization
di: Zhang, Ruqian, et al.
Pubblicazione: (2025)
di: Zhang, Ruqian, et al.
Pubblicazione: (2025)
Personality Matters: User Traits Predict LLM Preferences in Multi-Turn Collaborative Tasks
di: Yunusov, Sarfaroz, et al.
Pubblicazione: (2025)
di: Yunusov, Sarfaroz, et al.
Pubblicazione: (2025)
Personalized Alignment Revisited: The Necessity and Sufficiency of User Diversity
di: Kang, Enoch Hyunwook
Pubblicazione: (2026)
di: Kang, Enoch Hyunwook
Pubblicazione: (2026)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
di: Wang, Haoxiang, et al.
Pubblicazione: (2024)
di: Wang, Haoxiang, et al.
Pubblicazione: (2024)
From Generic Empathy to Personalized Emotional Support: A Self-Evolution Framework for User Preference Alignment
di: Ye, Jing, et al.
Pubblicazione: (2025)
di: Ye, Jing, et al.
Pubblicazione: (2025)
Personalized Adaptation via In-Context Preference Learning
di: Lau, Allison, et al.
Pubblicazione: (2024)
di: Lau, Allison, et al.
Pubblicazione: (2024)
An Annotation Scheme and Classifier for Personal Facts in Dialogue
di: Zaitsev, Konstantin
Pubblicazione: (2026)
di: Zaitsev, Konstantin
Pubblicazione: (2026)
Documenti analoghi
-
Knowing but Not Showing: LLMs Recognize Ambiguity but Rarely Ask Clarifying Questions
di: Su, Jinyan, et al.
Pubblicazione: (2026) -
Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards
di: Su, Jinyan, et al.
Pubblicazione: (2025) -
Adapting Fake News Detection to the Era of Large Language Models
di: Su, Jinyan, et al.
Pubblicazione: (2023) -
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
di: Su, Jinyan, et al.
Pubblicazione: (2025) -
Token-weighted Direct Preference Optimization with Attention
di: Huang, Chengyu, et al.
Pubblicazione: (2026)