Learning to Optimize Feedback for One Million Students: Insights from Multi-Armed and Contextual Bandits in Large-Scale Online Tutoring
Fuente:
arXiv
Guardado en:
| Autores principales: | Schmucker, Robin, Pachapurkar, Nimish, Bala, Shanmuga, Shah, Miral, Mitchell, Tom |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Ruffle&Riley: Insights from Designing and Evaluating a Large Language Model-Based Conversational Tutoring System
por: Schmucker, Robin, et al.
Publicado: (2024)
por: Schmucker, Robin, et al.
Publicado: (2024)
TutorUp: What If Your Students Were Simulated? Training Tutors to Address Engagement Challenges in Online Learning
por: Pan, Sitong, et al.
Publicado: (2025)
por: Pan, Sitong, et al.
Publicado: (2025)
AI Mentors for Student Projects: Spotting Early Issues in Computer Science Proposals
por: Aher, Gati, et al.
Publicado: (2025)
por: Aher, Gati, et al.
Publicado: (2025)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
por: Li, Shaoang, et al.
Publicado: (2025)
por: Li, Shaoang, et al.
Publicado: (2025)
Quantile Multi-Armed Bandits with 1-bit Feedback
por: Lau, Ivan, et al.
Publicado: (2025)
por: Lau, Ivan, et al.
Publicado: (2025)
aiPlato: A Novel AI Tutoring and Step-wise Feedback System for Physics Homework
por: Dange, Atharva, et al.
Publicado: (2026)
por: Dange, Atharva, et al.
Publicado: (2026)
Automated Generation and Tagging of Knowledge Components from Multiple-Choice Questions
por: Moore, Steven, et al.
Publicado: (2024)
por: Moore, Steven, et al.
Publicado: (2024)
Active Inference in Contextual Multi-Armed Bandits for Autonomous Robotic Exploration
por: Wakayama, Shohei, et al.
Publicado: (2024)
por: Wakayama, Shohei, et al.
Publicado: (2024)
Observation-Augmented Contextual Multi-Armed Bandits for Robotic Search and Exploration
por: Wakayama, Shohei, et al.
Publicado: (2023)
por: Wakayama, Shohei, et al.
Publicado: (2023)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
por: Xiong, Guojun, et al.
Publicado: (2024)
por: Xiong, Guojun, et al.
Publicado: (2024)
Context Attribution with Multi-Armed Bandit Optimization
por: Pan, Deng, et al.
Publicado: (2025)
por: Pan, Deng, et al.
Publicado: (2025)
Hierarchical Multi-Armed Bandits for the Concurrent Intelligent Tutoring of Concepts and Problems of Varying Difficulty Levels
por: Castleman, Blake, et al.
Publicado: (2024)
por: Castleman, Blake, et al.
Publicado: (2024)
Multi-Agent Combinatorial-Multi-Armed-Bandit framework for the Submodular Welfare Problem under Bandit Feedback
por: Pokhriyal, Subham, et al.
Publicado: (2026)
por: Pokhriyal, Subham, et al.
Publicado: (2026)
Truthful Reverse Auctions for Adaptive Selection via Contextual Multi-Armed Bandits
por: Patra, Pronoy, et al.
Publicado: (2026)
por: Patra, Pronoy, et al.
Publicado: (2026)
Causal Feature Selection Method for Contextual Multi-Armed Bandits in Recommender System
por: Zhao, Zhenyu, et al.
Publicado: (2024)
por: Zhao, Zhenyu, et al.
Publicado: (2024)
CAREForMe: Contextual Multi-Armed Bandit Recommendation Framework for Mental Health
por: Yu, Sheng, et al.
Publicado: (2024)
por: Yu, Sheng, et al.
Publicado: (2024)
Contextual Restless Multi-Armed Bandits with Application to Demand Response Decision-Making
por: Chen, Xin, et al.
Publicado: (2024)
por: Chen, Xin, et al.
Publicado: (2024)
Multi-Armed Bandits-Based Optimization of Decision Trees
por: Shanto, Hasibul Karim, et al.
Publicado: (2025)
por: Shanto, Hasibul Karim, et al.
Publicado: (2025)
Multi-Armed Bandits with Interference
por: Jia, Su, et al.
Publicado: (2024)
por: Jia, Su, et al.
Publicado: (2024)
Imprecise Multi-Armed Bandits
por: Kosoy, Vanessa
Publicado: (2024)
por: Kosoy, Vanessa
Publicado: (2024)
Introduction to Multi-Armed Bandits
por: Slivkins, Aleksandrs
Publicado: (2019)
por: Slivkins, Aleksandrs
Publicado: (2019)
Flickering Multi-Armed Bandits
por: Chakraborty, Sourav, et al.
Publicado: (2026)
por: Chakraborty, Sourav, et al.
Publicado: (2026)
Large Language Model-Enhanced Multi-Armed Bandits
por: Sun, Jiahang, et al.
Publicado: (2025)
por: Sun, Jiahang, et al.
Publicado: (2025)
Integrating Multi-Armed Bandit, Active Learning, and Distributed Computing for Scalable Optimization
por: Hui-Mean, Foo, et al.
Publicado: (2026)
por: Hui-Mean, Foo, et al.
Publicado: (2026)
Optimizing Mastery Learning by Fast-Forwarding Over-Practice Steps
por: Xia, Meng, et al.
Publicado: (2025)
por: Xia, Meng, et al.
Publicado: (2025)
Multi-Armed Bandit Approach for Optimizing Training on Synthetic Data
por: Kerim, Abdulrahman, et al.
Publicado: (2024)
por: Kerim, Abdulrahman, et al.
Publicado: (2024)
Optimizing Online Advertising with Multi-Armed Bandits: Mitigating the Cold Start Problem under Auction Dynamics
por: Soboleva, Anastasiia, et al.
Publicado: (2025)
por: Soboleva, Anastasiia, et al.
Publicado: (2025)
The Impact of Item-Writing Flaws on Difficulty and Discrimination in Item Response Theory
por: Schmucker, Robin, et al.
Publicado: (2025)
por: Schmucker, Robin, et al.
Publicado: (2025)
Survey: Multi-Armed Bandits Meet Large Language Models
por: Bouneffouf, Djallel, et al.
Publicado: (2025)
por: Bouneffouf, Djallel, et al.
Publicado: (2025)
AQA: Adaptive Question Answering in a Society of LLMs via Contextual Multi-Armed Bandit
por: Hoveyda, Mohanna, et al.
Publicado: (2024)
por: Hoveyda, Mohanna, et al.
Publicado: (2024)
Multi-Armed Bandits with Network Interference
por: Agarwal, Abhineet, et al.
Publicado: (2024)
por: Agarwal, Abhineet, et al.
Publicado: (2024)
A Multi-Armed Bandit Approach to Online Selection and Evaluation of Generative Models
por: Hu, Xiaoyan, et al.
Publicado: (2024)
por: Hu, Xiaoyan, et al.
Publicado: (2024)
Access Probability Optimization in RACH: A Multi-Armed Bandits Approach
por: Elmeligy, Ahmed O., et al.
Publicado: (2025)
por: Elmeligy, Ahmed O., et al.
Publicado: (2025)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
por: Wu, Xiaoyi, et al.
Publicado: (2025)
por: Wu, Xiaoyi, et al.
Publicado: (2025)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
por: Ji, Wenlong, et al.
Publicado: (2025)
por: Ji, Wenlong, et al.
Publicado: (2025)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
por: Goyal, Tanmay, et al.
Publicado: (2025)
por: Goyal, Tanmay, et al.
Publicado: (2025)
Cost-Efficient Online Decision Making: A Combinatorial Multi-Armed Bandit Approach
por: Rahbar, Arman, et al.
Publicado: (2023)
por: Rahbar, Arman, et al.
Publicado: (2023)
Online Prompt Pricing based on Combinatorial Multi-Armed Bandit and Hierarchical Stackelberg Game
por: Li, Meiling, et al.
Publicado: (2024)
por: Li, Meiling, et al.
Publicado: (2024)
Distributed Online Bandit Nonconvex Optimization with One-Point Residual Feedback via Dynamic Regret
por: Hua, Youqing, et al.
Publicado: (2024)
por: Hua, Youqing, et al.
Publicado: (2024)
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits
por: Kang, Yue, et al.
Publicado: (2023)
por: Kang, Yue, et al.
Publicado: (2023)
Ejemplares similares
-
Ruffle&Riley: Insights from Designing and Evaluating a Large Language Model-Based Conversational Tutoring System
por: Schmucker, Robin, et al.
Publicado: (2024) -
TutorUp: What If Your Students Were Simulated? Training Tutors to Address Engagement Challenges in Online Learning
por: Pan, Sitong, et al.
Publicado: (2025) -
AI Mentors for Student Projects: Spotting Early Issues in Computer Science Proposals
por: Aher, Gati, et al.
Publicado: (2025) -
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
por: Li, Shaoang, et al.
Publicado: (2025) -
Quantile Multi-Armed Bandits with 1-bit Feedback
por: Lau, Ivan, et al.
Publicado: (2025)