Adaptively Learning to Select-Rank in Online Platforms
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Jingyuan, Dong, Perry, Jin, Ying, Zhan, Ruohan, Zhou, Zhengyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Distributionally Robust Policy Learning under Concept Drifts
par: Wang, Jingyuan, et autres
Publié: (2024)
par: Wang, Jingyuan, et autres
Publié: (2024)
PLAN: Proactive Low-Rank Allocation for Continual Learning
par: Wang, Xiequn, et autres
Publié: (2025)
par: Wang, Xiequn, et autres
Publié: (2025)
TRANSIC: Sim-to-Real Policy Transfer by Learning from Online Correction
par: Jiang, Yunfan, et autres
Publié: (2024)
par: Jiang, Yunfan, et autres
Publié: (2024)
Observation-Free Attacks on Online Learning to Rank
par: Chattopadhyay, Sameep, et autres
Publié: (2025)
par: Chattopadhyay, Sameep, et autres
Publié: (2025)
Margin-Adaptive Confidence Ranking for Reliable LLM Judgement
par: Jin, Gaojie, et autres
Publié: (2026)
par: Jin, Gaojie, et autres
Publié: (2026)
Adaptive Policy Selection and Fine-Tuning under Interaction Budgets for Offline-to-Online Reinforcement Learning
par: Bozkurt, Alper Kamil, et autres
Publié: (2026)
par: Bozkurt, Alper Kamil, et autres
Publié: (2026)
Optimal Bayesian Stopping for Efficient Inference of Consistent LLM Answers
par: Huang, Jingkai, et autres
Publié: (2026)
par: Huang, Jingkai, et autres
Publié: (2026)
Concurrent Learning with Aggregated States via Randomized Least Squares Value Iteration
par: Chen, Yan, et autres
Publié: (2025)
par: Chen, Yan, et autres
Publié: (2025)
Single-Trajectory Distributionally Robust Reinforcement Learning
par: Liang, Zhipeng, et autres
Publié: (2023)
par: Liang, Zhipeng, et autres
Publié: (2023)
Adaptive Regularization of Representation Rank as an Implicit Constraint of Bellman Equation
par: He, Qiang, et autres
Publié: (2024)
par: He, Qiang, et autres
Publié: (2024)
FFT-based Dynamic Subspace Selection for Low-Rank Adaptive Optimization of Large Language Models
par: Modoranu, Ionut-Vlad, et autres
Publié: (2025)
par: Modoranu, Ionut-Vlad, et autres
Publié: (2025)
EXPO: Stable Reinforcement Learning with Expressive Policies
par: Dong, Perry, et autres
Publié: (2025)
par: Dong, Perry, et autres
Publié: (2025)
AGPO: Adaptive Group Policy Optimization with Dual Statistical Feedback
par: Hu, Miaobo, et autres
Publié: (2026)
par: Hu, Miaobo, et autres
Publié: (2026)
Simulation-Based Benchmarking of Reinforcement Learning Agents for Personalized Retail Promotions
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
Optimized Conformal Selection: Powerful Selective Inference After Conformity Score Optimization
par: Bai, Tian, et autres
Publié: (2024)
par: Bai, Tian, et autres
Publié: (2024)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
par: Song, Chihyeon, et autres
Publié: (2025)
par: Song, Chihyeon, et autres
Publié: (2025)
Reinforcement Learning via Implicit Imitation Guidance
par: Dong, Perry, et autres
Publié: (2025)
par: Dong, Perry, et autres
Publié: (2025)
Low-Rank Compression of Language Models via Differentiable Rank Selection
par: Sundrani, Sidhant, et autres
Publié: (2025)
par: Sundrani, Sidhant, et autres
Publié: (2025)
When to Trust Your Simulator: Dynamics-Aware Hybrid Offline-and-Online Reinforcement Learning
par: Niu, Haoyi, et autres
Publié: (2022)
par: Niu, Haoyi, et autres
Publié: (2022)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
par: Zhou, Yang, et autres
Publié: (2026)
par: Zhou, Yang, et autres
Publié: (2026)
Towards LLM-guided Efficient and Interpretable Multi-linear Tensor Network Rank Selection
par: Iacovides, Giorgos, et autres
Publié: (2024)
par: Iacovides, Giorgos, et autres
Publié: (2024)
Adaptive Online Learning with LSTM Networks for Energy Price Prediction
par: Salihoglu, Salih, et autres
Publié: (2025)
par: Salihoglu, Salih, et autres
Publié: (2025)
Is Prompt Selection Necessary for Task-Free Online Continual Learning?
par: Park, Seoyoung, et autres
Publié: (2026)
par: Park, Seoyoung, et autres
Publié: (2026)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
par: Ma, Xiaoteng, et autres
Publié: (2020)
par: Ma, Xiaoteng, et autres
Publié: (2020)
Functional Critics Are Essential for Actor-Critic: From Off-Policy Stability to Efficient Exploration
par: Bai, Qinxun, et autres
Publié: (2025)
par: Bai, Qinxun, et autres
Publié: (2025)
MetaLoRA: Tensor-Enhanced Adaptive Low-Rank Fine-tuning
par: Wang, Maolin, et autres
Publié: (2025)
par: Wang, Maolin, et autres
Publié: (2025)
Efficient Handwriting-Based Alzheimer,s Disease Diagnosis Using a Low-Rank Mixture of Experts Deep Learning Framework
par: Wang, Wu, et autres
Publié: (2026)
par: Wang, Wu, et autres
Publié: (2026)
Adaptive Online Mirror Descent for Tchebycheff Scalarization in Multi-Objective Learning
par: Liu, Meitong, et autres
Publié: (2024)
par: Liu, Meitong, et autres
Publié: (2024)
MANGO: Meta-Adaptive Network Gradient Optimization for Online Continual Learning
par: Awasthi, Ankita, et autres
Publié: (2026)
par: Awasthi, Ankita, et autres
Publié: (2026)
Online Boosting Adaptive Learning under Concept Drift for Multistream Classification
par: Yu, En, et autres
Publié: (2023)
par: Yu, En, et autres
Publié: (2023)
Improved Training Mechanism for Reinforcement Learning via Online Model Selection
par: Afshar, Aida, et autres
Publié: (2025)
par: Afshar, Aida, et autres
Publié: (2025)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
par: Yang, Letian, et autres
Publié: (2026)
par: Yang, Letian, et autres
Publié: (2026)
Ranking-aware Reinforcement Learning for Ordinal Ranking
par: Hao, Aiming, et autres
Publié: (2026)
par: Hao, Aiming, et autres
Publié: (2026)
Residual Q-Learning: Offline and Online Policy Customization without Value
par: Li, Chenran, et autres
Publié: (2023)
par: Li, Chenran, et autres
Publié: (2023)
Adaptive Selection of LoRA Components in Privacy-Preserving Federated Learning
par: Kim, Myoungjun, et autres
Publié: (2026)
par: Kim, Myoungjun, et autres
Publié: (2026)
SwitchLoRA: Switched Low-Rank Adaptation Can Learn Full-Rank Information
par: Zhou, Kaiye, et autres
Publié: (2024)
par: Zhou, Kaiye, et autres
Publié: (2024)
Ranking over Regression for Bayesian Optimization and Molecule Selection
par: Tom, Gary, et autres
Publié: (2024)
par: Tom, Gary, et autres
Publié: (2024)
Large Language Model Compression with Global Rank and Sparsity Optimization
par: Zhou, Changhai, et autres
Publié: (2025)
par: Zhou, Changhai, et autres
Publié: (2025)
SAL: Selective Adaptive Learning for Backpropagation-Free Training with Sparsification
par: Liu, Fanping, et autres
Publié: (2026)
par: Liu, Fanping, et autres
Publié: (2026)
Each Rank Could be an Expert: Single-Ranked Mixture of Experts LoRA for Multi-Task Learning
par: Zhao, Ziyu, et autres
Publié: (2025)
par: Zhao, Ziyu, et autres
Publié: (2025)
Documents similaires
-
Distributionally Robust Policy Learning under Concept Drifts
par: Wang, Jingyuan, et autres
Publié: (2024) -
PLAN: Proactive Low-Rank Allocation for Continual Learning
par: Wang, Xiequn, et autres
Publié: (2025) -
TRANSIC: Sim-to-Real Policy Transfer by Learning from Online Correction
par: Jiang, Yunfan, et autres
Publié: (2024) -
Observation-Free Attacks on Online Learning to Rank
par: Chattopadhyay, Sameep, et autres
Publié: (2025) -
Margin-Adaptive Confidence Ranking for Reliable LLM Judgement
par: Jin, Gaojie, et autres
Publié: (2026)