A Unified Online-Offline Framework for Co-Branding Campaign Recommendations
Fuente:
arXiv
Salvato in:
| Autori principali: | Dai, Xiangxiang, Sun, Xiaowei, Zuo, Jinhang, Liu, Xutong, Lui, John C. S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Semantic Caching for Low-Cost LLM Serving: From Offline Learning to Online Adaptation
di: Liu, Xutong, et al.
Pubblicazione: (2025)
di: Liu, Xutong, et al.
Pubblicazione: (2025)
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025)
di: Liu, Xutong, et al.
Pubblicazione: (2025)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
di: Poon, Manhin, et al.
Pubblicazione: (2025)
di: Poon, Manhin, et al.
Pubblicazione: (2025)
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
di: Han, Ziyi, et al.
Pubblicazione: (2025)
di: Han, Ziyi, et al.
Pubblicazione: (2025)
Stochastic Bandits Robust to Adversarial Attacks
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)
Steering Frozen LLMs: Adaptive Social Alignment via Online Prompt Routing
di: Zhang, Zeyu, et al.
Pubblicazione: (2026)
di: Zhang, Zeyu, et al.
Pubblicazione: (2026)
Cost-Effective Online Multi-LLM Selection with Versatile Reward Models
di: Dai, Xiangxiang, et al.
Pubblicazione: (2024)
di: Dai, Xiangxiang, et al.
Pubblicazione: (2024)
Combinatorial Logistic Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2024)
di: Liu, Xutong, et al.
Pubblicazione: (2024)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
di: Liu, Xutong, et al.
Pubblicazione: (2022)
di: Liu, Xutong, et al.
Pubblicazione: (2022)
Fusing Reward and Dueling Feedback in Stochastic Bandits
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
di: Liu, Xutong, et al.
Pubblicazione: (2023)
di: Liu, Xutong, et al.
Pubblicazione: (2023)
HiLoRA: Adaptive Hierarchical LoRA Routing for Training-Free Domain Generalization
di: Han, Ziyi, et al.
Pubblicazione: (2025)
di: Han, Ziyi, et al.
Pubblicazione: (2025)
Demystifying Online Clustering of Bandits: Enhanced Exploration Under Stochastic and Smoothed Adversarial Contexts
di: Li, Zhuohua, et al.
Pubblicazione: (2025)
di: Li, Zhuohua, et al.
Pubblicazione: (2025)
Offline Clustering of Linear Bandits: The Power of Clusters under Limited Data
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
di: Liu, Xutong, et al.
Pubblicazione: (2024)
di: Liu, Xutong, et al.
Pubblicazione: (2024)
Leveraging the Power of Conversations: Optimal Key Term Selection in Conversational Contextual Bandits
di: Liu, Maoli, et al.
Pubblicazione: (2025)
di: Liu, Maoli, et al.
Pubblicazione: (2025)
Continuous Semantic Caching for Low-Cost LLM Serving
di: Atalar, Baran, et al.
Pubblicazione: (2026)
di: Atalar, Baran, et al.
Pubblicazione: (2026)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
di: Guo, Siyuan, et al.
Pubblicazione: (2023)
di: Guo, Siyuan, et al.
Pubblicazione: (2023)
Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning
di: Chai, Jinhang, et al.
Pubblicazione: (2025)
di: Chai, Jinhang, et al.
Pubblicazione: (2025)
Trading Vector Data in Vector Databases
di: Cheng, Jin, et al.
Pubblicazione: (2025)
di: Cheng, Jin, et al.
Pubblicazione: (2025)
Behavior-Adaptive Q-Learning: A Unifying Framework for Offline-to-Online RL
di: Zu, Lipeng, et al.
Pubblicazione: (2025)
di: Zu, Lipeng, et al.
Pubblicazione: (2025)
Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF
di: Cen, Shicong, et al.
Pubblicazione: (2024)
di: Cen, Shicong, et al.
Pubblicazione: (2024)
Offline Clustering of Preference Learning with Active-data Augmentation
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
Online Clustering of Dueling Bandits
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
PASTA: A Unified Framework for Offline Assortment Learning
di: Dong, Juncheng, et al.
Pubblicazione: (2025)
di: Dong, Juncheng, et al.
Pubblicazione: (2025)
Unlearning Offline Stochastic Multi-Armed Bandits
di: Ye, Zichun, et al.
Pubblicazione: (2026)
di: Ye, Zichun, et al.
Pubblicazione: (2026)
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2024)
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2024)
CoRAST: Towards Foundation Model-Powered Correlated Data Analysis in Resource-Constrained CPS and IoT
di: Hu, Yi, et al.
Pubblicazione: (2024)
di: Hu, Yi, et al.
Pubblicazione: (2024)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
di: Yang, Hantao, et al.
Pubblicazione: (2024)
di: Yang, Hantao, et al.
Pubblicazione: (2024)
Online Learning to Rank under Corruption: A Robust Cascading Bandits Approach
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2025)
di: Ghaffari, Fatemeh, et al.
Pubblicazione: (2025)
Spectral Souping: A Unified Framework for Online Preference Alignment
di: Chow, Yinlam, et al.
Pubblicazione: (2026)
di: Chow, Yinlam, et al.
Pubblicazione: (2026)
MOORL: A Framework for Integrating Offline-Online Reinforcement Learning
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025)
di: Chaudhary, Gaurav, et al.
Pubblicazione: (2025)
Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning
di: Bui, Ha Manh, et al.
Pubblicazione: (2026)
di: Bui, Ha Manh, et al.
Pubblicazione: (2026)
Online Search with Predictions: Pareto-optimal Algorithm and its Applications in Energy Markets
di: Lee, Russell, et al.
Pubblicazione: (2022)
di: Lee, Russell, et al.
Pubblicazione: (2022)
One-Step Bellman Alignment Enables Provably Efficient Transfer in Online RL
di: Chen, Elynn, et al.
Pubblicazione: (2026)
di: Chen, Elynn, et al.
Pubblicazione: (2026)
Learning Best Paths in Quantum Networks
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
IntSR: An Integrated Generative Framework for Search and Recommendation
di: Yan, Huimin, et al.
Pubblicazione: (2025)
di: Yan, Huimin, et al.
Pubblicazione: (2025)
A Unified Causal Framework for Auditing Recommender Systems for Ethical Concerns
di: Sharma, Vibhhu, et al.
Pubblicazione: (2024)
di: Sharma, Vibhhu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Semantic Caching for Low-Cost LLM Serving: From Offline Learning to Online Adaptation
di: Liu, Xutong, et al.
Pubblicazione: (2025) -
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025) -
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
di: Poon, Manhin, et al.
Pubblicazione: (2025) -
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
di: Han, Ziyi, et al.
Pubblicazione: (2025) -
Stochastic Bandits Robust to Adversarial Attacks
di: Wang, Xuchuang, et al.
Pubblicazione: (2024)