Optimizing Coverage and Difficulty in Reinforcement Learning for Quiz Composition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Silva, Ricardo Pedro Querido Andrade, Bouarour, Nassim, Fettache, Dina, Boussouar, Sarab, Ibrahim, Noha, Amer-Yahia, Sihem |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Lever: Inference-Time Policy Reuse under Support Constraints
par: Vitenko, Ihor, et autres
Publié: (2026)
par: Vitenko, Ihor, et autres
Publié: (2026)
Producer-Fairness in Sequential Bundle Recommendation
par: Rio, Alexandre, et autres
Publié: (2025)
par: Rio, Alexandre, et autres
Publié: (2025)
A Sampling-based Framework for Hypothesis Testing on Large Attributed Graphs
par: Wang, Yun, et autres
Publié: (2024)
par: Wang, Yun, et autres
Publié: (2024)
Personalized Top-k Set Queries Over Predicted Scores
par: Nia, Sohrab Namazi, et autres
Publié: (2025)
par: Nia, Sohrab Namazi, et autres
Publié: (2025)
Distilling Tabular Foundation Models for Structured Health Data
par: Tanna, Aditya, et autres
Publié: (2026)
par: Tanna, Aditya, et autres
Publié: (2026)
Pocket Foundation Models: Distilling TFMs into CPU-Ready Gradient-Boosted Trees
par: Tanna, Aditya, et autres
Publié: (2026)
par: Tanna, Aditya, et autres
Publié: (2026)
Ensembling Tabular Foundation Models - A Diversity Ceiling And A Calibration Trap
par: Tanna, Aditya, et autres
Publié: (2026)
par: Tanna, Aditya, et autres
Publié: (2026)
Shaping the Prior: How Synthetic Task Distributions Determine Tabular Foundation Model Quality
par: Bouadi, Mohamed, et autres
Publié: (2026)
par: Bouadi, Mohamed, et autres
Publié: (2026)
Data Presentation Over Architecture: Resampling Strategies for Credit Risk Prediction with Tabular Foundation Models
par: Tanna, Aditya, et autres
Publié: (2026)
par: Tanna, Aditya, et autres
Publié: (2026)
A Reinforcement Learning Environment for Automatic Code Optimization in the MLIR Compiler
par: Tirichine, Mohammed, et autres
Publié: (2024)
par: Tirichine, Mohammed, et autres
Publié: (2024)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
par: Zhou, Yang, et autres
Publié: (2026)
par: Zhou, Yang, et autres
Publié: (2026)
Microeconomic Foundations of Multi-Agent Learning
par: Helou, Nassim
Publié: (2026)
par: Helou, Nassim
Publié: (2026)
Path-Based Quantum Meta-Learning for Adaptive Optimization of Reconfigurable Intelligent Surfaces
par: Hassan, Noha, et autres
Publié: (2026)
par: Hassan, Noha, et autres
Publié: (2026)
Terracorder: Sense Long and Prosper
par: Millar, Josh, et autres
Publié: (2024)
par: Millar, Josh, et autres
Publié: (2024)
Balancing the Reasoning Load: Difficulty-Differentiated Policy Optimization with Length Redistribution for Efficient and Robust Reinforcement Learning
par: Xia, Yinan, et autres
Publié: (2026)
par: Xia, Yinan, et autres
Publié: (2026)
PAC Guarantees for Reinforcement Learning: Sample Complexity, Coverage, and Structure
par: Steier, Joshua
Publié: (2026)
par: Steier, Joshua
Publié: (2026)
Offline Constrained Reinforcement Learning under Partial Data Coverage
par: Ko, Seokmin, et autres
Publié: (2025)
par: Ko, Seokmin, et autres
Publié: (2025)
ADHint: Adaptive Hints with Difficulty Priors for Reinforcement Learning
par: Zhang, Feng, et autres
Publié: (2025)
par: Zhang, Feng, et autres
Publié: (2025)
Reinforcement Learning for Compositional Generalization with Outcome-Level Optimization
par: Fu, Xiyan, et autres
Publié: (2026)
par: Fu, Xiyan, et autres
Publié: (2026)
Learning to Recharge: UAV Coverage Path Planning through Deep Reinforcement Learning
par: Theile, Mirco, et autres
Publié: (2023)
par: Theile, Mirco, et autres
Publié: (2023)
Mitigating Overthinking in Large Reasoning Models via Difficulty-aware Reinforcement Learning
par: Wan, Qian, et autres
Publié: (2026)
par: Wan, Qian, et autres
Publié: (2026)
Learning Coverage Paths in Unknown Environments with Deep Reinforcement Learning
par: Jonnarth, Arvi, et autres
Publié: (2023)
par: Jonnarth, Arvi, et autres
Publié: (2023)
Dense and Diverse Goal Coverage in Multi Goal Reinforcement Learning
par: Singh, Sagalpreet, et autres
Publié: (2025)
par: Singh, Sagalpreet, et autres
Publié: (2025)
Optimizing FPGA and Wafer Test Coverage with Spatial Sampling and Machine Learning
par: WeiQuan, Wang, et autres
Publié: (2025)
par: WeiQuan, Wang, et autres
Publié: (2025)
Federated Offline Reinforcement Learning: Collaborative Single-Policy Coverage Suffices
par: Woo, Jiin, et autres
Publié: (2024)
par: Woo, Jiin, et autres
Publié: (2024)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
par: Liu, Haolin, et autres
Publié: (2026)
par: Liu, Haolin, et autres
Publié: (2026)
Benchmarking Ultra-Low-Power $μ$NPUs
par: Millar, Josh, et autres
Publié: (2025)
par: Millar, Josh, et autres
Publié: (2025)
Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective
par: Kong, Deyang, et autres
Publié: (2025)
par: Kong, Deyang, et autres
Publié: (2025)
HeaPA: Difficulty-Aware Heap Sampling and On-Policy Query Augmentation for LLM Reinforcement Learning
par: Wang, Weiqi, et autres
Publié: (2026)
par: Wang, Weiqi, et autres
Publié: (2026)
Meta Reinforcement Learning for Strategic IoT Deployments Coverage in Disaster-Response UAV Swarms
par: Dhuheir, Marwan, et autres
Publié: (2024)
par: Dhuheir, Marwan, et autres
Publié: (2024)
Optimizing Reasoning Efficiency through Prompt Difficulty Prediction
par: Zhao, Bo, et autres
Publié: (2025)
par: Zhao, Bo, et autres
Publié: (2025)
On Efficient Approximate Aggregate Nearest Neighbor Queries over Learned Representations
par: Wang, Carrie, et autres
Publié: (2025)
par: Wang, Carrie, et autres
Publié: (2025)
KoopAGRU: A Koopman-based Anomaly Detection in Time-Series using Gated Recurrent Units
par: Yahia, Issam Ait, et autres
Publié: (2025)
par: Yahia, Issam Ait, et autres
Publié: (2025)
DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
par: Zhou, Yuhang, et autres
Publié: (2025)
par: Zhou, Yuhang, et autres
Publié: (2025)
Trajectory-Based Difficulty Scoring for Reliable Learning on Tabular Data
par: Lavi, Tomer, et autres
Publié: (2026)
par: Lavi, Tomer, et autres
Publié: (2026)
LOOPer: A Learned Automatic Code Optimizer For Polyhedral Compilers
par: Merouani, Massinissa, et autres
Publié: (2024)
par: Merouani, Massinissa, et autres
Publié: (2024)
An Introduction to Deep Reinforcement and Imitation Learning
par: Santana, Pedro
Publié: (2025)
par: Santana, Pedro
Publié: (2025)
D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning
par: Zhang, Ru, et autres
Publié: (2026)
par: Zhang, Ru, et autres
Publié: (2026)
Scaling Data Difficulty: Improving Coding Models via Reinforcement Learning on Fresh and Challenging Problems
par: Li, Zongqian, et autres
Publié: (2026)
par: Li, Zongqian, et autres
Publié: (2026)
LyriCAR: A Difficulty-Aware Curriculum Reinforcement Learning Framework For Controllable Lyric Translation
par: Ren, Le, et autres
Publié: (2025)
par: Ren, Le, et autres
Publié: (2025)
Documents similaires
-
Lever: Inference-Time Policy Reuse under Support Constraints
par: Vitenko, Ihor, et autres
Publié: (2026) -
Producer-Fairness in Sequential Bundle Recommendation
par: Rio, Alexandre, et autres
Publié: (2025) -
A Sampling-based Framework for Hypothesis Testing on Large Attributed Graphs
par: Wang, Yun, et autres
Publié: (2024) -
Personalized Top-k Set Queries Over Predicted Scores
par: Nia, Sohrab Namazi, et autres
Publié: (2025) -
Distilling Tabular Foundation Models for Structured Health Data
par: Tanna, Aditya, et autres
Publié: (2026)