Beyond Task Diversity: Provable Representation Transfer for Sequential Multi-Task Linear Bandits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Duong, Thang, Wang, Zhi, Zhang, Chicheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Bridging Lifelong and Multi-Task Representation Learning via Algorithm and Complexity Measure
par: Wang, Zhi, et autres
Publié: (2025)
par: Wang, Zhi, et autres
Publié: (2025)
Physics-Informed Parametric Bandits for Beam Alignment in mmWave Communications
par: Qin, Hao, et autres
Publié: (2025)
par: Qin, Hao, et autres
Publié: (2025)
Improving the Data-efficiency of Reinforcement Learning by Warm-starting with LLM
par: Duong, Thang, et autres
Publié: (2025)
par: Duong, Thang, et autres
Publié: (2025)
Learning Shared Representations for Multi-Task Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)
par: Lin, Jiabin, et autres
Publié: (2026)
Multi-Task Representation Learning for Conservative Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)
par: Lin, Jiabin, et autres
Publié: (2026)
Interactive and Hybrid Imitation Learning: Provably Beating Behavior Cloning
par: Li, Yichen, et autres
Publié: (2024)
par: Li, Yichen, et autres
Publié: (2024)
Kullback-Leibler Maillard Sampling for Multi-armed Bandits with Bounded Rewards
par: Qin, Hao, et autres
Publié: (2023)
par: Qin, Hao, et autres
Publié: (2023)
Taming the Monster Every Context: Complexity Measure and Unified Framework for Offline-Oracle Efficient Contextual Bandits
par: Qin, Hao, et autres
Publié: (2026)
par: Qin, Hao, et autres
Publié: (2026)
Beyond Centralization: Provable Communication Efficient Decentralized Multi-Task Learning
par: Kang, Donghwa, et autres
Publié: (2025)
par: Kang, Donghwa, et autres
Publié: (2025)
Efficient Low-Rank Matrix Estimation, Experimental Design, and Arm-Set-Dependent Low-Rank Bandits
par: Jang, Kyoungseok, et autres
Publié: (2024)
par: Jang, Kyoungseok, et autres
Publié: (2024)
Fast and Sample Efficient Multi-Task Representation Learning in Stochastic Contextual Bandits
par: Lin, Jiabin, et autres
Publié: (2024)
par: Lin, Jiabin, et autres
Publié: (2024)
Provable Multi-Task Representation Learning by Two-Layer ReLU Neural Networks
par: Collins, Liam, et autres
Publié: (2023)
par: Collins, Liam, et autres
Publié: (2023)
Towards Fundamental Limits for Active Multi-distribution Learning
par: Zhang, Chicheng, et autres
Publié: (2025)
par: Zhang, Chicheng, et autres
Publié: (2025)
Conservative Contextual Bandits: Beyond Linear Representations
par: Deb, Rohan, et autres
Publié: (2024)
par: Deb, Rohan, et autres
Publié: (2024)
Exploiting Adjacent Similarity in Multi-Armed Bandit Tasks via Transfer of Reward Samples
par: Rahul, NR, et autres
Publié: (2024)
par: Rahul, NR, et autres
Publié: (2024)
Transfer in Sequential Multi-armed Bandits via Reward Samples
par: R, Rahul N, et autres
Publié: (2024)
par: R, Rahul N, et autres
Publié: (2024)
Multi-Task Combinatorial Bandits for Budget Allocation
par: Ge, Lin, et autres
Publié: (2024)
par: Ge, Lin, et autres
Publié: (2024)
Representation Learning for Sequential Volumetric Design Tasks
par: Alam, Md Ferdous, et autres
Publié: (2023)
par: Alam, Md Ferdous, et autres
Publié: (2023)
Provable Multi-Task Reinforcement Learning: A Representation Learning Framework with Low Rank Rewards
par: Guo, Yaoze, et autres
Publié: (2026)
par: Guo, Yaoze, et autres
Publié: (2026)
Understanding the Transferability of Representations via Task-Relatedness
par: Mehra, Akshay, et autres
Publié: (2023)
par: Mehra, Akshay, et autres
Publié: (2023)
Transferable Tactile Transformers for Representation Learning Across Diverse Sensors and Tasks
par: Zhao, Jialiang, et autres
Publié: (2024)
par: Zhao, Jialiang, et autres
Publié: (2024)
Non-Stationary Restless Multi-Armed Bandits with Provable Guarantee
par: Hung, Yu-Heng, et autres
Publié: (2025)
par: Hung, Yu-Heng, et autres
Publié: (2025)
Statistical Inference for Sequential Feature Selection after Domain Adaptation
par: Loc, Duong Tan, et autres
Publié: (2025)
par: Loc, Duong Tan, et autres
Publié: (2025)
Efficient Active Learning Halfspaces with Tsybakov Noise: A Non-convex Optimization Approach
par: Li, Yinan, et autres
Publié: (2023)
par: Li, Yinan, et autres
Publié: (2023)
Agnostic Interactive Imitation Learning: New Theory and Practical Algorithms
par: Li, Yichen, et autres
Publié: (2023)
par: Li, Yichen, et autres
Publié: (2023)
Provably Adaptive Linear Approximation for the Shapley Value and Beyond
par: Li, Weida, et autres
Publié: (2026)
par: Li, Weida, et autres
Publié: (2026)
Weighted Sequential Bayesian Inference for Non-Stationary Linear Contextual Bandits
par: Werge, Nicklas, et autres
Publié: (2023)
par: Werge, Nicklas, et autres
Publié: (2023)
Inherent Trade-Offs between Diversity and Stability in Multi-Task Benchmarks
par: Zhang, Guanhua, et autres
Publié: (2024)
par: Zhang, Guanhua, et autres
Publié: (2024)
Single Index Bandits: Generalized Linear Contextual Bandits with Unknown Reward Functions
par: Kang, Yue, et autres
Publié: (2025)
par: Kang, Yue, et autres
Publié: (2025)
Hidden Representation Clustering with Multi-Task Representation Learning towards Robust Online Budget Allocation
par: Wang, Xiaohan, et autres
Publié: (2025)
par: Wang, Xiaohan, et autres
Publié: (2025)
Exploiting Task Relationships in Continual Learning via Transferability-Aware Task Embeddings
par: Wu, Yanru, et autres
Publié: (2025)
par: Wu, Yanru, et autres
Publié: (2025)
When is Task Vector Provably Effective for Model Editing? A Generalization Analysis of Nonlinear Transformers
par: Li, Hongkang, et autres
Publié: (2025)
par: Li, Hongkang, et autres
Publié: (2025)
Provably Efficient Multi-Objective Bandit Algorithms under Preference-Centric Customization
par: Cao, Linfeng, et autres
Publié: (2025)
par: Cao, Linfeng, et autres
Publié: (2025)
Heavy-Tailed Linear Bandits: Huber Regression with One-Pass Update
par: Wang, Jing, et autres
Publié: (2025)
par: Wang, Jing, et autres
Publié: (2025)
Sequential Learning of the Pareto Front for Multi-objective Bandits
par: Crépon, Elise, et autres
Publié: (2025)
par: Crépon, Elise, et autres
Publié: (2025)
Effects of Structural Allocation of Geometric Task Diversity in Linear Meta-Learning Models
par: Datta, Saptati, et autres
Publié: (2025)
par: Datta, Saptati, et autres
Publié: (2025)
Towards a Unified Representation Evaluation Framework Beyond Downstream Tasks
par: Plachouras, Christos, et autres
Publié: (2025)
par: Plachouras, Christos, et autres
Publié: (2025)
Provable In-Context Vector Arithmetic via Retrieving Task Concepts
par: Bu, Dake, et autres
Publié: (2025)
par: Bu, Dake, et autres
Publié: (2025)
The Fallacy of Minimizing Cumulative Regret in the Sequential Task Setting
par: Xu, Ziping, et autres
Publié: (2024)
par: Xu, Ziping, et autres
Publié: (2024)
Can Optimization Trajectories Explain Multi-Task Transfer?
par: Mueller, David, et autres
Publié: (2024)
par: Mueller, David, et autres
Publié: (2024)
Documents similaires
-
Bridging Lifelong and Multi-Task Representation Learning via Algorithm and Complexity Measure
par: Wang, Zhi, et autres
Publié: (2025) -
Physics-Informed Parametric Bandits for Beam Alignment in mmWave Communications
par: Qin, Hao, et autres
Publié: (2025) -
Improving the Data-efficiency of Reinforcement Learning by Warm-starting with LLM
par: Duong, Thang, et autres
Publié: (2025) -
Learning Shared Representations for Multi-Task Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026) -
Multi-Task Representation Learning for Conservative Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)