Inducing Individual Students' Learning Strategies through Homomorphic POMDPs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Huifan, Zeng, Yifeng, Pan, Yinghui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WeatherSeg: Weather-Robust Image Segmentation using Teacher-Student Dual Learning and Classifier-Updating Attention
par: Zhang, Zhang, et autres
Publié: (2026)
par: Zhang, Zhang, et autres
Publié: (2026)
Active Legibility in Multiagent Reinforcement Learning
par: Liu, Yanyu, et autres
Publié: (2024)
par: Liu, Yanyu, et autres
Publié: (2024)
Learning Interpretable Policies in Hindsight-Observable POMDPs through Partially Supervised Reinforcement Learning
par: Lanier, Michael, et autres
Publié: (2024)
par: Lanier, Michael, et autres
Publié: (2024)
Tighter Value-Function Approximations for POMDPs
par: Krale, Merlijn, et autres
Publié: (2025)
par: Krale, Merlijn, et autres
Publié: (2025)
Rethinking Transformers in Solving POMDPs
par: Lu, Chenhao, et autres
Publié: (2024)
par: Lu, Chenhao, et autres
Publié: (2024)
Simplification of Risk Averse POMDPs with Performance Guarantees
par: Pariente, Yaacov, et autres
Publié: (2024)
par: Pariente, Yaacov, et autres
Publié: (2024)
What should be observed for optimal reward in POMDPs?
par: Konsta, Alyzia-Maria, et autres
Publié: (2024)
par: Konsta, Alyzia-Maria, et autres
Publié: (2024)
Multi-Environment POMDPs with Finite-Horizon Objectives
par: Brice, Léonard, et autres
Publié: (2026)
par: Brice, Léonard, et autres
Publié: (2026)
Planning under Distribution Shifts with Causal POMDPs
par: Ceriscioli, Matteo, et autres
Publié: (2026)
par: Ceriscioli, Matteo, et autres
Publié: (2026)
Finite-State Controllers for (Hidden-Model) POMDPs using Deep Reinforcement Learning
par: Hudák, David, et autres
Publié: (2026)
par: Hudák, David, et autres
Publié: (2026)
Belief-State Query Policies for User-Aligned POMDPs
par: Bramblett, Daniel, et autres
Publié: (2024)
par: Bramblett, Daniel, et autres
Publié: (2024)
Scalable Solution Methods for Dec-POMDPs with Deterministic Dynamics
par: You, Yang, et autres
Publié: (2025)
par: You, Yang, et autres
Publié: (2025)
Online Planning in POMDPs with State-Requests
par: Avalos, Raphael, et autres
Publié: (2024)
par: Avalos, Raphael, et autres
Publié: (2024)
BetaZero: Belief-State Planning for Long-Horizon POMDPs using Learned Approximations
par: Moss, Robert J., et autres
Publié: (2023)
par: Moss, Robert J., et autres
Publié: (2023)
Learning Temporal Abstractions via Variational Homomorphisms in Option-Induced Abstract MDPs
par: Li, Chang, et autres
Publié: (2025)
par: Li, Chang, et autres
Publié: (2025)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2024)
par: Galesloot, Maris F. L., et autres
Publié: (2024)
Factored Online Planning in Many-Agent POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2023)
par: Galesloot, Maris F. L., et autres
Publié: (2023)
Scalable Policy-Based RL Algorithms for POMDPs
par: Anjarlekar, Ameya, et autres
Publié: (2025)
par: Anjarlekar, Ameya, et autres
Publié: (2025)
Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics
par: Soffair, Nitsan
Publié: (2022)
par: Soffair, Nitsan
Publié: (2022)
Generalizing Multi-Step Inverse Models for Representation Learning to Finite-Memory POMDPs
par: Wu, Lili, et autres
Publié: (2024)
par: Wu, Lili, et autres
Publié: (2024)
Toward Learning POMDPs Beyond Full-Rank Actions and State Observability
par: Shaw, Seiji, et autres
Publié: (2026)
par: Shaw, Seiji, et autres
Publié: (2026)
Multi-Environment POMDPs: Discrete Model Uncertainty Under Partial Observability
par: Bovy, Eline M., et autres
Publié: (2025)
par: Bovy, Eline M., et autres
Publié: (2025)
Value of Information and Reward Specification in Active Inference and POMDPs
par: Wei, Ran
Publié: (2024)
par: Wei, Ran
Publié: (2024)
How to Explore with Belief: State Entropy Maximization in POMDPs
par: Zamboni, Riccardo, et autres
Publié: (2024)
par: Zamboni, Riccardo, et autres
Publié: (2024)
Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs
par: Wendland, Joshua, et autres
Publié: (2026)
par: Wendland, Joshua, et autres
Publié: (2026)
Optimizing Task Completion Time Updates Using POMDPs
par: Eddy, Duncan, et autres
Publié: (2026)
par: Eddy, Duncan, et autres
Publié: (2026)
Sequential Monte Carlo for Policy Optimization in Continuous POMDPs
par: Abdulsamad, Hany, et autres
Publié: (2025)
par: Abdulsamad, Hany, et autres
Publié: (2025)
A Privacy-Preserving Federated Learning Method with Homomorphic Encryption in Omics Data
par: Negoya, Yusaku, et autres
Publié: (2025)
par: Negoya, Yusaku, et autres
Publié: (2025)
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
par: Wang, Yongyi, et autres
Publié: (2025)
par: Wang, Yongyi, et autres
Publié: (2025)
Posterior Sampling-based Online Learning for Episodic POMDPs
par: Tang, Dengwang, et autres
Publié: (2023)
par: Tang, Dengwang, et autres
Publié: (2023)
Computing the Reachability Value of Posterior-Deterministic POMDPs
par: Fijalkow, Nathanaël, et autres
Publié: (2026)
par: Fijalkow, Nathanaël, et autres
Publié: (2026)
Point-Based Value Iteration for POMDPs with Neural Perception Mechanisms
par: Yan, Rui, et autres
Publié: (2023)
par: Yan, Rui, et autres
Publié: (2023)
Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2025)
par: Galesloot, Maris F. L., et autres
Publié: (2025)
Efficient Sensorimotor Learning for Open-world Robot Manipulation
par: Zhu, Yifeng
Publié: (2025)
par: Zhu, Yifeng
Publié: (2025)
Online Risk-Averse Planning in POMDPs Using Iterated CVaR Value Function
par: Pariente, Yaacov, et autres
Publié: (2026)
par: Pariente, Yaacov, et autres
Publié: (2026)
Interpreting systems as solving POMDPs: a step towards a formal understanding of agency
par: Biehl, Martin, et autres
Publié: (2022)
par: Biehl, Martin, et autres
Publié: (2022)
Statistical Tractability of Off-policy Evaluation of History-dependent Policies in POMDPs
par: Zhang, Yuheng, et autres
Publié: (2025)
par: Zhang, Yuheng, et autres
Publié: (2025)
Welfare Maximization Algorithm for Solving Budget-Constrained Multi-Component POMDPs
par: Vora, Manav, et autres
Publié: (2023)
par: Vora, Manav, et autres
Publié: (2023)
Learning Logic Specifications for Policy Guidance in POMDPs: an Inductive Logic Programming Approach
par: Meli, Daniele, et autres
Publié: (2024)
par: Meli, Daniele, et autres
Publié: (2024)
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
par: Vora, Manav, et autres
Publié: (2024)
par: Vora, Manav, et autres
Publié: (2024)
Documents similaires
-
WeatherSeg: Weather-Robust Image Segmentation using Teacher-Student Dual Learning and Classifier-Updating Attention
par: Zhang, Zhang, et autres
Publié: (2026) -
Active Legibility in Multiagent Reinforcement Learning
par: Liu, Yanyu, et autres
Publié: (2024) -
Learning Interpretable Policies in Hindsight-Observable POMDPs through Partially Supervised Reinforcement Learning
par: Lanier, Michael, et autres
Publié: (2024) -
Tighter Value-Function Approximations for POMDPs
par: Krale, Merlijn, et autres
Publié: (2025) -
Rethinking Transformers in Solving POMDPs
par: Lu, Chenhao, et autres
Publié: (2024)