Prompt Optimization with Logged Bandit Data
Fuente:
arXiv
Guardado en:
| Autores principales: | Kiyohara, Haruka, Cao, Daniel Yiming, Saito, Yuta, Joachims, Thorsten |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fairness in Ranking under Disparate Uncertainty
por: Rastogi, Richa, et al.
Publicado: (2023)
por: Rastogi, Richa, et al.
Publicado: (2023)
StealthRank: LLM Ranking Manipulation via Stealthy Prompt Optimization
por: Tang, Yiming, et al.
Publicado: (2025)
por: Tang, Yiming, et al.
Publicado: (2025)
End-to-end Training for Recommendation with Language-based User Profiles
por: Gao, Zhaolin, et al.
Publicado: (2024)
por: Gao, Zhaolin, et al.
Publicado: (2024)
Contextual Bandit with Herding Effects: Algorithms and Recommendation Applications
por: Xu, Luyue, et al.
Publicado: (2024)
por: Xu, Luyue, et al.
Publicado: (2024)
AdaptEx: A Self-Service Contextual Bandit Platform
por: Black, William, et al.
Publicado: (2023)
por: Black, William, et al.
Publicado: (2023)
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
por: Shimizu, Tatsuhiro, et al.
Publicado: (2024)
por: Shimizu, Tatsuhiro, et al.
Publicado: (2024)
CoCoB: Adaptive Collaborative Combinatorial Bandits for Online Recommendation
por: Yan, Cairong, et al.
Publicado: (2025)
por: Yan, Cairong, et al.
Publicado: (2025)
Influence Maximization via Graph Neural Bandits
por: Feng, Yuting, et al.
Publicado: (2024)
por: Feng, Yuting, et al.
Publicado: (2024)
Item Cluster-aware Prompt Learning for Session-based Recommendation
por: Yang, Wooseong, et al.
Publicado: (2024)
por: Yang, Wooseong, et al.
Publicado: (2024)
PAP-REC: Personalized Automatic Prompt for Recommendation Language Model
por: Li, Zelong, et al.
Publicado: (2024)
por: Li, Zelong, et al.
Publicado: (2024)
Off-Policy Evaluation of Slate Bandit Policies via Optimizing Abstraction
por: Kiyohara, Haruka, et al.
Publicado: (2024)
por: Kiyohara, Haruka, et al.
Publicado: (2024)
Lightweight yet Efficient: An External Attentive Graph Convolutional Network with Positional Prompts for Sequential Recommendation
por: Zhang, Jinyu, et al.
Publicado: (2025)
por: Zhang, Jinyu, et al.
Publicado: (2025)
Not All Queries Need Rewriting: When Prompt-Only LLM Refinement Helps and Hurts Dense Retrieval
por: Kotte, Varun
Publicado: (2026)
por: Kotte, Varun
Publicado: (2026)
Optimizing Compound Retrieval Systems
por: Oosterhuis, Harrie, et al.
Publicado: (2025)
por: Oosterhuis, Harrie, et al.
Publicado: (2025)
Language-Based User Profiles for Recommendation
por: Zhou, Joyce, et al.
Publicado: (2024)
por: Zhou, Joyce, et al.
Publicado: (2024)
Optimizing Recommendations using Fine-Tuned LLMs
por: Cheema, Prabhdeep, et al.
Publicado: (2025)
por: Cheema, Prabhdeep, et al.
Publicado: (2025)
Causal Predictive Optimization and Generation for Business AI
por: Zhao, Liyang, et al.
Publicado: (2025)
por: Zhao, Liyang, et al.
Publicado: (2025)
Pessimistic Off-Policy Optimization for Learning to Rank
por: Cief, Matej, et al.
Publicado: (2022)
por: Cief, Matej, et al.
Publicado: (2022)
TIGER: Temporally Improved Graph Entity Linker
por: Zhang, Pengyu, et al.
Publicado: (2024)
por: Zhang, Pengyu, et al.
Publicado: (2024)
Talos: Optimizing Top-$K$ Accuracy in Recommender Systems
por: Zhang, Shengjia, et al.
Publicado: (2026)
por: Zhang, Shengjia, et al.
Publicado: (2026)
Async Learned User Embeddings for Ads Delivery Optimization
por: Tang, Mingwei, et al.
Publicado: (2024)
por: Tang, Mingwei, et al.
Publicado: (2024)
What Data is Really Necessary? A Feasibility Study of Inference Data Minimization for Recommender Systems
por: Leysen, Jens, et al.
Publicado: (2025)
por: Leysen, Jens, et al.
Publicado: (2025)
Position: Let's Develop Data Probes to Fundamentally Understand How Data Affects LLM Performance
por: Wang, Shiqiang, et al.
Publicado: (2026)
por: Wang, Shiqiang, et al.
Publicado: (2026)
Delivery Optimized Discovery in Behavioral User Segmentation under Budget Constraint
por: Chopra, Harshita, et al.
Publicado: (2024)
por: Chopra, Harshita, et al.
Publicado: (2024)
Advancing Cultural Inclusivity: Optimizing Embedding Spaces for Balanced Music Recommendations
por: Moradi, Armin, et al.
Publicado: (2024)
por: Moradi, Armin, et al.
Publicado: (2024)
DSL-R1: From SQL to DSL for Training Retrieval Agents across Structured and Unstructured Data with Reinforcement Learning
por: Hu, Yunhai, et al.
Publicado: (2026)
por: Hu, Yunhai, et al.
Publicado: (2026)
ECAT: A Entire space Continual and Adaptive Transfer Learning Framework for Cross-Domain Recommendation
por: Hou, Chaoqun, et al.
Publicado: (2024)
por: Hou, Chaoqun, et al.
Publicado: (2024)
Deep Learning Model Acceleration and Optimization Strategies for Real-Time Recommendation Systems
por: Shao, Junli, et al.
Publicado: (2025)
por: Shao, Junli, et al.
Publicado: (2025)
BEAR: Towards Beam-Search-Aware Optimization for Recommendation with Large Language Models
por: Yang, Weiqin, et al.
Publicado: (2026)
por: Yang, Weiqin, et al.
Publicado: (2026)
Scaling Session-Based Transformer Recommendations using Optimized Negative Sampling and Loss Functions
por: Wilm, Timo, et al.
Publicado: (2023)
por: Wilm, Timo, et al.
Publicado: (2023)
PromptDSI: Prompt-based Rehearsal-free Continual Learning for Document Retrieval
por: Huynh, Tuan-Luc, et al.
Publicado: (2024)
por: Huynh, Tuan-Luc, et al.
Publicado: (2024)
Optimization of Latent-Space Compression using Game-Theoretic Techniques for Transformer-Based Vector Search
por: Agrawal, Kushagra, et al.
Publicado: (2025)
por: Agrawal, Kushagra, et al.
Publicado: (2025)
Breaking the Top-$K$ Barrier: Advancing Top-$K$ Ranking Metrics Optimization in Recommender Systems
por: Yang, Weiqin, et al.
Publicado: (2025)
por: Yang, Weiqin, et al.
Publicado: (2025)
WellFactor: Patient Profiling using Integrative Embedding of Healthcare Data
por: Choi, Dongjin, et al.
Publicado: (2023)
por: Choi, Dongjin, et al.
Publicado: (2023)
ReCQR: Incorporating conversational query rewriting to improve Multimodal Image Retrieval
por: Hu, Yuan, et al.
Publicado: (2026)
por: Hu, Yuan, et al.
Publicado: (2026)
An Extremely Data-efficient and Generative LLM-based Reinforcement Learning Agent for Recommenders
por: Feng, Shuang, et al.
Publicado: (2024)
por: Feng, Shuang, et al.
Publicado: (2024)
CADC: Encoding User-Item Interactions for Compressing Recommendation Model Training Data
por: Zarch, Hossein Entezari, et al.
Publicado: (2024)
por: Zarch, Hossein Entezari, et al.
Publicado: (2024)
Ripple Knowledge Graph Convolutional Networks For Recommendation Systems
por: Li, Chen, et al.
Publicado: (2023)
por: Li, Chen, et al.
Publicado: (2023)
Policy Design for Two-sided Platforms with Participation Dynamics
por: Kiyohara, Haruka, et al.
Publicado: (2025)
por: Kiyohara, Haruka, et al.
Publicado: (2025)
No One Left Behind: How to Exploit the Incomplete and Skewed Multi-Label Data for Conversion Rate Prediction
por: Jia, Qinglin, et al.
Publicado: (2025)
por: Jia, Qinglin, et al.
Publicado: (2025)
Ejemplares similares
-
Fairness in Ranking under Disparate Uncertainty
por: Rastogi, Richa, et al.
Publicado: (2023) -
StealthRank: LLM Ranking Manipulation via Stealthy Prompt Optimization
por: Tang, Yiming, et al.
Publicado: (2025) -
End-to-end Training for Recommendation with Language-based User Profiles
por: Gao, Zhaolin, et al.
Publicado: (2024) -
Contextual Bandit with Herding Effects: Algorithms and Recommendation Applications
por: Xu, Luyue, et al.
Publicado: (2024) -
AdaptEx: A Self-Service Contextual Bandit Platform
por: Black, William, et al.
Publicado: (2023)