Towards Realistic Personalization: Evaluating Long-Horizon Preference Following in Personalized User-LLM Interactions
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Guo, Qianyun, Li, Yibo, Liu, Yue, Hooi, Bryan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
HorizonBench: Long-Horizon Personalization with Evolving Preferences
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2026)
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2026)
Toward Personalized LLM-Powered Agents: Foundations, Evaluation, and Future Directions
von: Xu, Yue, et al.
Veröffentlicht: (2026)
von: Xu, Yue, et al.
Veröffentlicht: (2026)
KLong: Training LLM Agent for Extremely Long-horizon Tasks
von: Liu, Yue, et al.
Veröffentlicht: (2026)
von: Liu, Yue, et al.
Veröffentlicht: (2026)
$π$-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
von: Zhang, Haoran, et al.
Veröffentlicht: (2026)
von: Zhang, Haoran, et al.
Veröffentlicht: (2026)
Mobile GUI Agent Privacy Personalization with Trajectory Induced Preference Optimization
von: Lin, Zhixin, et al.
Veröffentlicht: (2026)
von: Lin, Zhixin, et al.
Veröffentlicht: (2026)
Personalized LLM Decoding via Contrasting Personal Preference
von: Bu, Hyungjune, et al.
Veröffentlicht: (2025)
von: Bu, Hyungjune, et al.
Veröffentlicht: (2025)
PERMA: Benchmarking Personalized Memory Agents via Event-Driven Preference and Realistic Task Environments
von: Liu, Shuochen, et al.
Veröffentlicht: (2026)
von: Liu, Shuochen, et al.
Veröffentlicht: (2026)
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
von: Li, Yibo, et al.
Veröffentlicht: (2025)
von: Li, Yibo, et al.
Veröffentlicht: (2025)
Enabling Personalized Long-term Interactions in LLM-based Agents through Persistent Memory and User Profiles
von: Westhäußer, Rebecca, et al.
Veröffentlicht: (2025)
von: Westhäußer, Rebecca, et al.
Veröffentlicht: (2025)
Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation
von: Sui, Yuan, et al.
Veröffentlicht: (2026)
von: Sui, Yuan, et al.
Veröffentlicht: (2026)
RetailBench: Evaluating Long-Horizon Autonomous Decision-Making and Strategy Stability of LLM Agents in Realistic Retail Environments
von: Zhang, Linghua, et al.
Veröffentlicht: (2026)
von: Zhang, Linghua, et al.
Veröffentlicht: (2026)
PersonalAlign: Hierarchical Implicit Intent Alignment for Personalized GUI Agent with Long-Term User-Centric Records
von: Lyu, Yibo, et al.
Veröffentlicht: (2026)
von: Lyu, Yibo, et al.
Veröffentlicht: (2026)
Personalizing Embodied Multimodal Large Language Model Agents over Long-term User Interactions
von: Lee, Jeongeun, et al.
Veröffentlicht: (2026)
von: Lee, Jeongeun, et al.
Veröffentlicht: (2026)
Response-Aware User Memory Selection for LLM Personalization
von: Fisher, Jillian, et al.
Veröffentlicht: (2026)
von: Fisher, Jillian, et al.
Veröffentlicht: (2026)
KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation
von: Chen, Tongbo, et al.
Veröffentlicht: (2026)
von: Chen, Tongbo, et al.
Veröffentlicht: (2026)
InteractiveSurvey: An LLM-based Personalized and Interactive Survey Paper Generation System
von: Wen, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Wen, Zhiyuan, et al.
Veröffentlicht: (2025)
From 1,000,000 Users to Every User: Scaling Up Personalized Preference for User-level Alignment
von: Li, Jia-Nan, et al.
Veröffentlicht: (2025)
von: Li, Jia-Nan, et al.
Veröffentlicht: (2025)
Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies
von: Lou, Zhanzhi, et al.
Veröffentlicht: (2026)
von: Lou, Zhanzhi, et al.
Veröffentlicht: (2026)
The Tool Decathlon: Benchmarking Language Agents for Diverse, Realistic, and Long-Horizon Task Execution
von: Li, Junlong, et al.
Veröffentlicht: (2025)
von: Li, Junlong, et al.
Veröffentlicht: (2025)
PreferThinker: Reasoning-based Personalized Image Preference Assessment
von: Xu, Shengqi, et al.
Veröffentlicht: (2025)
von: Xu, Shengqi, et al.
Veröffentlicht: (2025)
Can LLM Agents Sustain Long-Horizon Organizational Dynamics?
von: Zhu, Xuancheng, et al.
Veröffentlicht: (2026)
von: Zhu, Xuancheng, et al.
Veröffentlicht: (2026)
Reinforcement Learning for Long-Horizon Interactive LLM Agents
von: Chen, Kevin, et al.
Veröffentlicht: (2025)
von: Chen, Kevin, et al.
Veröffentlicht: (2025)
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
von: Li, Yibo, et al.
Veröffentlicht: (2026)
von: Li, Yibo, et al.
Veröffentlicht: (2026)
EvoTest: Evolutionary Test-Time Learning for Self-Improving Agentic Systems
von: He, Yufei, et al.
Veröffentlicht: (2025)
von: He, Yufei, et al.
Veröffentlicht: (2025)
Efficient Sequential Recommendation for Long Term User Interest Via Personalization
von: Zhang, Qiang, et al.
Veröffentlicht: (2026)
von: Zhang, Qiang, et al.
Veröffentlicht: (2026)
Monte Carlo Tree Search for Comprehensive Exploration in LLM-Based Automatic Heuristic Design
von: Zheng, Zhi, et al.
Veröffentlicht: (2025)
von: Zheng, Zhi, et al.
Veröffentlicht: (2025)
Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences
von: Koo, Jabin, et al.
Veröffentlicht: (2026)
von: Koo, Jabin, et al.
Veröffentlicht: (2026)
PEToolLLM: Towards Personalized Tool Learning in Large Language Models
von: Xu, Qiancheng, et al.
Veröffentlicht: (2025)
von: Xu, Qiancheng, et al.
Veröffentlicht: (2025)
Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates
von: Li, Yibo, et al.
Veröffentlicht: (2026)
von: Li, Yibo, et al.
Veröffentlicht: (2026)
Personality as Relational Infrastructure: User Perceptions of Personality-Trait-Infused LLM Messaging
von: Hofer, Dominik P., et al.
Veröffentlicht: (2026)
von: Hofer, Dominik P., et al.
Veröffentlicht: (2026)
A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations
von: Li, Li, et al.
Veröffentlicht: (2025)
von: Li, Li, et al.
Veröffentlicht: (2025)
PersonaAgent with GraphRAG: Community-Aware Knowledge Graphs for Personalized LLM
von: Liang, Siqi, et al.
Veröffentlicht: (2025)
von: Liang, Siqi, et al.
Veröffentlicht: (2025)
Evaluating the Effectiveness of Direct Preference Optimization for Personalizing German Automatic Text Simplifications for Persons with Intellectual Disabilities
von: Gao, Yingqiang, et al.
Veröffentlicht: (2025)
von: Gao, Yingqiang, et al.
Veröffentlicht: (2025)
AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment
von: Xiao, Jianfei, et al.
Veröffentlicht: (2026)
von: Xiao, Jianfei, et al.
Veröffentlicht: (2026)
MGM-Omni: Scaling Omni LLMs to Personalized Long-Horizon Speech
von: Wang, Chengyao, et al.
Veröffentlicht: (2025)
von: Wang, Chengyao, et al.
Veröffentlicht: (2025)
CROWN: A Novel Approach to Comprehending Users' Preferences for Accurate Personalized News Recommendation
von: Ko, Yunyong, et al.
Veröffentlicht: (2023)
von: Ko, Yunyong, et al.
Veröffentlicht: (2023)
Towards Personalized Deep Research: Benchmarks and Evaluations
von: Liang, Yuan, et al.
Veröffentlicht: (2025)
von: Liang, Yuan, et al.
Veröffentlicht: (2025)
When Personalization Meets Reality: A Multi-Faceted Analysis of Personalized Preference Learning
von: Dong, Yijiang River, et al.
Veröffentlicht: (2025)
von: Dong, Yijiang River, et al.
Veröffentlicht: (2025)
PrefPalette: Personalized Preference Modeling with Latent Attributes
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2025)
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2025)
From Personal to Collective: On the Role of Local and Global Memory in LLM Personalization
von: Wang, Zehong, et al.
Veröffentlicht: (2025)
von: Wang, Zehong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
HorizonBench: Long-Horizon Personalization with Evolving Preferences
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2026) -
Toward Personalized LLM-Powered Agents: Foundations, Evaluation, and Future Directions
von: Xu, Yue, et al.
Veröffentlicht: (2026) -
KLong: Training LLM Agent for Extremely Long-horizon Tasks
von: Liu, Yue, et al.
Veröffentlicht: (2026) -
$π$-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
von: Zhang, Haoran, et al.
Veröffentlicht: (2026) -
Mobile GUI Agent Privacy Personalization with Trajectory Induced Preference Optimization
von: Lin, Zhixin, et al.
Veröffentlicht: (2026)