Low-Regret and Low-Complexity Learning for Hierarchical Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chattopadhyay, Sameep, Sutar, Vinay, Champati, Jaya Prakash, Moharir, Sharayu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Observation-Free Attacks on Online Learning to Rank
par: Chattopadhyay, Sameep, et autres
Publié: (2025)
par: Chattopadhyay, Sameep, et autres
Publié: (2025)
Inference Offloading for Cost-Sensitive Binary Classification at the Edge
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2025)
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2025)
Online Algorithms for Hierarchical Inference in Deep Learning applications at the Edge
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2023)
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2023)
Fixed-Budget Constrained Best Arm Identification in Grouped Bandits
par: Mukherjee, Raunak, et autres
Publié: (2026)
par: Mukherjee, Raunak, et autres
Publié: (2026)
Cascading Bandits With Feedback
par: Prakash, R Sri, et autres
Publié: (2025)
par: Prakash, R Sri, et autres
Publié: (2025)
Towards Efficient Multi-LLM Inference: Characterization and Analysis of LLM Routing and Hierarchical Techniques
par: Behera, Adarsh Prasad, et autres
Publié: (2025)
par: Behera, Adarsh Prasad, et autres
Publié: (2025)
Pay for Hints, Not Answers: LLM Shepherding for Cost-Efficient Inference
par: Dong, Ziming, et autres
Publié: (2026)
par: Dong, Ziming, et autres
Publié: (2026)
On-line Learning in Tree MDPs by Treating Policies as Bandit Arms
par: Shah, Anvay, et autres
Publié: (2026)
par: Shah, Anvay, et autres
Publié: (2026)
Unreliable Multi-Armed Bandits: A Novel Approach to Recommendation Systems
par: Ravi, Aditya Narayan, et autres
Publié: (2019)
par: Ravi, Aditya Narayan, et autres
Publié: (2019)
Exploring the Boundaries of On-Device Inference: When Tiny Falls Short, Go Hierarchical
par: Behera, Adarsh Prasad, et autres
Publié: (2024)
par: Behera, Adarsh Prasad, et autres
Publié: (2024)
Influencing Bandits: Arm Selection for Preference Shaping
par: Nadkarni, Viraj, et autres
Publié: (2024)
par: Nadkarni, Viraj, et autres
Publié: (2024)
Constrained Best Arm Identification in Grouped Bandits
par: Dharod, Sahil, et autres
Publié: (2024)
par: Dharod, Sahil, et autres
Publié: (2024)
Parameter-efficient Adaptation of Multilingual Multimodal Models for Low-resource ASR
par: Gupta, Abhishek, et autres
Publié: (2024)
par: Gupta, Abhishek, et autres
Publié: (2024)
Fixed-Confidence Best Arm Identification with Decreasing Variance
par: Roychowdhury, Tamojeet, et autres
Publié: (2025)
par: Roychowdhury, Tamojeet, et autres
Publié: (2025)
Minimizing Age of Detection for a Markov Source over a Lossy Channel
par: Garde, Shivang, et autres
Publié: (2025)
par: Garde, Shivang, et autres
Publié: (2025)
Improved Decision Module Selection for Hierarchical Inference in Resource-Constrained Edge Devices
par: Behera, Adarsh Prasad, et autres
Publié: (2024)
par: Behera, Adarsh Prasad, et autres
Publié: (2024)
Fast and Regret Optimal Best Arm Identification: Fundamental Limits and Low-Complexity Algorithms
par: Zhang, Qining, et autres
Publié: (2023)
par: Zhang, Qining, et autres
Publié: (2023)
Federated Q-Learning: Linear Regret Speedup with Low Communication Cost
par: Zheng, Zhong, et autres
Publié: (2023)
par: Zheng, Zhong, et autres
Publié: (2023)
The Perils of Optimizing Learned Reward Functions: Low Training Error Does Not Guarantee Low Regret
par: Fluri, Lukas, et autres
Publié: (2024)
par: Fluri, Lukas, et autres
Publié: (2024)
AMPS: ASR with Multimodal Paraphrase Supervision
par: Gupta, Abhishek, et autres
Publié: (2024)
par: Gupta, Abhishek, et autres
Publié: (2024)
Regret-Optimal Q-Learning with Low Cost for Single-Agent and Federated Reinforcement Learning
par: Zhang, Haochen, et autres
Publié: (2025)
par: Zhang, Haochen, et autres
Publié: (2025)
Federated Learning of Binary Neural Networks: Enabling Low-Cost Inference
par: Shankar, Nitin Priyadarshini, et autres
Publié: (2026)
par: Shankar, Nitin Priyadarshini, et autres
Publié: (2026)
Efficient, Low-Regret, Online Reinforcement Learning for Linear MDPs
par: John, Philips George, et autres
Publié: (2024)
par: John, Philips George, et autres
Publié: (2024)
Low-Complexity Inference in Continual Learning via Compressed Knowledge Transfer
par: Liu, Zhenrong, et autres
Publié: (2025)
par: Liu, Zhenrong, et autres
Publié: (2025)
Provably Efficient Exploration in Reward Machines with Low Regret
par: Bourel, Hippolyte, et autres
Publié: (2024)
par: Bourel, Hippolyte, et autres
Publié: (2024)
Context Matters: Leveraging Contextual Features for Time Series Forecasting
par: Chattopadhyay, Sameep, et autres
Publié: (2024)
par: Chattopadhyay, Sameep, et autres
Publié: (2024)
Hierarchical Deep Counterfactual Regret Minimization
par: Chen, Jiayu, et autres
Publié: (2023)
par: Chen, Jiayu, et autres
Publié: (2023)
Regret-Oracle Complexity Tradeoffs in Agnostic Online Learning
par: Attias, Idan, et autres
Publié: (2026)
par: Attias, Idan, et autres
Publié: (2026)
PEAR: Primitive Enabled Adaptive Relabeling for Boosting Hierarchical Reinforcement Learning
par: Singh, Utsav, et autres
Publié: (2023)
par: Singh, Utsav, et autres
Publié: (2023)
FOSSIL: Regret-Minimizing Curriculum Learning for Metadata-Free and Low-Data Mpox Diagnosis
par: Han, Sahng-Min, et autres
Publié: (2025)
par: Han, Sahng-Min, et autres
Publié: (2025)
CRISP: Curriculum Inducing Primitive Informed Subgoal Prediction for Hierarchical Reinforcement Learning
par: Singh, Utsav, et autres
Publié: (2023)
par: Singh, Utsav, et autres
Publié: (2023)
DHP: Discrete Hierarchical Planning for Hierarchical Reinforcement Learning Agents
par: Sharma, Shashank, et autres
Publié: (2025)
par: Sharma, Shashank, et autres
Publié: (2025)
Curiosity is Knowledge: Self-Consistent Learning and No-Regret Optimization with Active Inference
par: Li, Yingke, et autres
Publié: (2026)
par: Li, Yingke, et autres
Publié: (2026)
Quantum Machine Learning with HQC Architectures using non-Classically Simulable Feature Maps
par: Ahmad, Syed Farhan, et autres
Publié: (2021)
par: Ahmad, Syed Farhan, et autres
Publié: (2021)
COLA: Continual Learning via Autoencoder Retrieval of Adapters
par: Mandivarapu, Jaya Krishna
Publié: (2025)
par: Mandivarapu, Jaya Krishna
Publié: (2025)
Renting Edge Computing Resources for Service Hosting
par: Madnaik, Aadesh, et autres
Publié: (2022)
par: Madnaik, Aadesh, et autres
Publié: (2022)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
par: Wu, Xiaoyi, et autres
Publié: (2025)
par: Wu, Xiaoyi, et autres
Publié: (2025)
A Study on Regularization-Based Continual Learning Methods for Indic ASR
par: T, Gokul Adethya, et autres
Publié: (2025)
par: T, Gokul Adethya, et autres
Publié: (2025)
Spatiotemporal deep learning models for detection of rapid intensification in cyclones
par: Sutar, Vamshika, et autres
Publié: (2025)
par: Sutar, Vamshika, et autres
Publié: (2025)
SHARP-QoS: Sparsely-gated Hierarchical Adaptive Routing for joint Prediction of QoS
par: Kumar, Suraj, et autres
Publié: (2025)
par: Kumar, Suraj, et autres
Publié: (2025)
Documents similaires
-
Observation-Free Attacks on Online Learning to Rank
par: Chattopadhyay, Sameep, et autres
Publié: (2025) -
Inference Offloading for Cost-Sensitive Binary Classification at the Edge
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2025) -
Online Algorithms for Hierarchical Inference in Deep Learning applications at the Edge
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2023) -
Fixed-Budget Constrained Best Arm Identification in Grouped Bandits
par: Mukherjee, Raunak, et autres
Publié: (2026) -
Cascading Bandits With Feedback
par: Prakash, R Sri, et autres
Publié: (2025)