Dynamic Evaluation Framework for Personalized and Trustworthy Agents: A Multi-Session Approach to Preference Adaptability
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shah, Chirag, Joho, Hideo, Kaur, Kirandeep, Dammu, Preetam Prabhu Srikar |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Static Evaluation: Rethinking the Assessment of Personalized Agent Adaptability in Information Retrieval
par: Kaur, Kirandeep, et autres
Publié: (2025)
par: Kaur, Kirandeep, et autres
Publié: (2025)
Dynamic-KGQA: A Scalable Framework for Generating Adaptive Question Answering Datasets
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
iAgentBench: Benchmarking Sensemaking Capabilities of Information-Seeking Agents on High-Traffic Topics
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2026)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2026)
Efficient and Responsible Adaptation of Large Language Models for Robust Top-k Recommendations
par: Kaur, Kirandeep, et autres
Publié: (2024)
par: Kaur, Kirandeep, et autres
Publié: (2024)
Efficient and Responsible Adaptation of Large Language Models for Robust and Equitable Top-k Recommendations
par: Kaur, Kirandeep, et autres
Publié: (2025)
par: Kaur, Kirandeep, et autres
Publié: (2025)
VeritasFi: An Adaptable, Multi-tiered RAG Framework for Multi-modal Financial Question Answering
par: Tai, Zhenghan, et autres
Publié: (2025)
par: Tai, Zhenghan, et autres
Publié: (2025)
CROWN: A Novel Approach to Comprehending Users' Preferences for Accurate Personalized News Recommendation
par: Ko, Yunyong, et autres
Publié: (2023)
par: Ko, Yunyong, et autres
Publié: (2023)
Research Paper Recommender System by Considering Users' Information Seeking Behaviors
par: Xu, Zhelin, et autres
Publié: (2025)
par: Xu, Zhelin, et autres
Publié: (2025)
MACA: A Framework for Distilling Trustworthy LLMs into Efficient Retrievers
par: Gudipudi, Satya Swaroop, et autres
Publié: (2026)
par: Gudipudi, Satya Swaroop, et autres
Publié: (2026)
A Simple Yet Effective Approach for Diversified Session-Based Recommendation
par: Yin, Qing, et autres
Publié: (2024)
par: Yin, Qing, et autres
Publié: (2024)
Panmodal Information Interaction
par: Shah, Chirag, et autres
Publié: (2024)
par: Shah, Chirag, et autres
Publié: (2024)
SessionRec: Next Session Prediction Paradigm For Generative Sequential Recommendation
par: Huang, Lei, et autres
Publié: (2025)
par: Huang, Lei, et autres
Publié: (2025)
DynamicPO: Dynamic Preference Optimization for Recommendation
par: Hu, Xingyu, et autres
Publié: (2026)
par: Hu, Xingyu, et autres
Publié: (2026)
A Model-based Multi-Agent Personalized Short-Video Recommender System
par: Zhou, Peilun, et autres
Publié: (2024)
par: Zhou, Peilun, et autres
Publié: (2024)
MPFormer: Adaptive Framework for Industrial Multi-Task Personalized Sequential Retriever
par: Sun, Yijia, et autres
Publié: (2025)
par: Sun, Yijia, et autres
Publié: (2025)
MOSAIC: Multi-Domain Orthogonal Session Adaptive Intent Capture for Prescient Recommendations
par: Bahi, Abderaouf, et autres
Publié: (2026)
par: Bahi, Abderaouf, et autres
Publié: (2026)
A Multi-Agent Approach to Neurological Clinical Reasoning
par: Sorka, Moran, et autres
Publié: (2025)
par: Sorka, Moran, et autres
Publié: (2025)
Evaluation of Agents under Simulated AI Marketplace Dynamics
par: Kim, To Eun, et autres
Publié: (2026)
par: Kim, To Eun, et autres
Publié: (2026)
Resources for Automated Evaluation of Assistive RAG Systems that Help Readers with News Trustworthiness Assessment
par: Zhang, Dake, et autres
Publié: (2026)
par: Zhang, Dake, et autres
Publié: (2026)
Multi-view Intent Learning and Alignment with Large Language Models for Session-based Recommendation
par: Qiao, Shutong, et autres
Publié: (2024)
par: Qiao, Shutong, et autres
Publié: (2024)
PERSCEN: Learning Personalized Interaction Pattern and Scenario Preference for Multi-Scenario Matching
par: Du, Haotong, et autres
Publié: (2025)
par: Du, Haotong, et autres
Publié: (2025)
Large-Scale Multi-Domain Recommendation: an Automatic Domain Feature Extraction and Personalized Integration Framework
par: Xi, Dongbo, et autres
Publié: (2024)
par: Xi, Dongbo, et autres
Publié: (2024)
Enhancing Live Broadcast Engagement: A Multi-modal Approach to Short Video Recommendations Using MMGCN and User Preferences
par: Najafabadi, Saeid Aghasoleymani, et autres
Publié: (2025)
par: Najafabadi, Saeid Aghasoleymani, et autres
Publié: (2025)
Evaluating AI Recruitment Sourcing Tools by Human Preference
par: Slaykovskiy, Vladimir, et autres
Publié: (2025)
par: Slaykovskiy, Vladimir, et autres
Publié: (2025)
AgentRecBench: Benchmarking LLM Agent-based Personalized Recommender Systems
par: Shang, Yu, et autres
Publié: (2025)
par: Shang, Yu, et autres
Publié: (2025)
Greedy SLIM: A SLIM-Based Approach For Preference Elicitation
par: Proissl, Claudius, et autres
Publié: (2024)
par: Proissl, Claudius, et autres
Publié: (2024)
NutriOrion: A Hierarchical Multi-Agent Framework for Personalized Nutrition Intervention Grounded in Clinical Guidelines
par: Wu, Junwei, et autres
Publié: (2026)
par: Wu, Junwei, et autres
Publié: (2026)
Explainable Session-based Recommendation via Path Reasoning
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Disentangling ID and Modality Effects for Session-based Recommendation
par: Zhang, Xiaokun, et autres
Publié: (2024)
par: Zhang, Xiaokun, et autres
Publié: (2024)
Coverage, Not Averages: Semantic Stratification for Trustworthy Retrieval Evaluation
par: Klearman, Andrew, et autres
Publié: (2026)
par: Klearman, Andrew, et autres
Publié: (2026)
ManifoldMind: Dynamic Hyperbolic Reasoning for Trustworthy Recommendations
par: Harit, Anoushka, et autres
Publié: (2025)
par: Harit, Anoushka, et autres
Publié: (2025)
SciSage: A Multi-Agent Framework for High-Quality Scientific Survey Generation
par: Shi, Xiaofeng, et autres
Publié: (2025)
par: Shi, Xiaofeng, et autres
Publié: (2025)
Cross-domain Transfer of Valence Preferences via a Meta-optimization Approach
par: Zhao, Chuang, et autres
Publié: (2024)
par: Zhao, Chuang, et autres
Publié: (2024)
Optimizing Encoder-Only Transformers for Session-Based Recommendation Systems
par: Redjdal, Anis, et autres
Publié: (2024)
par: Redjdal, Anis, et autres
Publié: (2024)
Performance Comparison of Session-based Recommendation Algorithms based on GNNs
par: Shehzad, Faisal, et autres
Publié: (2023)
par: Shehzad, Faisal, et autres
Publié: (2023)
GenRec: A Preference-Oriented Generative Framework for Large-Scale Recommendation
par: Zou, Yanyan, et autres
Publié: (2026)
par: Zou, Yanyan, et autres
Publié: (2026)
Leveraging Evidence-Guided LLMs to Enhance Trustworthy Depression Diagnosis
par: Yuan, Yining, et autres
Publié: (2025)
par: Yuan, Yining, et autres
Publié: (2025)
Towards Trustworthy LLM-Based Recommendation via Rationale Integration
par: Park, Chung, et autres
Publié: (2025)
par: Park, Chung, et autres
Publié: (2025)
Trustworthy AI Psychotherapy: Multi-Agent LLM Workflow for Counseling and Explainable Mental Disorder Diagnosis
par: Ozgun, Mithat Can, et autres
Publié: (2025)
par: Ozgun, Mithat Can, et autres
Publié: (2025)
Building Data-Driven Occupation Taxonomies: A Bottom-Up Multi-Stage Approach via Semantic Clustering and Multi-Agent Collaboration
par: Li, Nan, et autres
Publié: (2025)
par: Li, Nan, et autres
Publié: (2025)
Documents similaires
-
Beyond Static Evaluation: Rethinking the Assessment of Personalized Agent Adaptability in Information Retrieval
par: Kaur, Kirandeep, et autres
Publié: (2025) -
Dynamic-KGQA: A Scalable Framework for Generating Adaptive Question Answering Datasets
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025) -
iAgentBench: Benchmarking Sensemaking Capabilities of Information-Seeking Agents on High-Traffic Topics
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2026) -
Efficient and Responsible Adaptation of Large Language Models for Robust Top-k Recommendations
par: Kaur, Kirandeep, et autres
Publié: (2024) -
Efficient and Responsible Adaptation of Large Language Models for Robust and Equitable Top-k Recommendations
par: Kaur, Kirandeep, et autres
Publié: (2025)