Rationality Measurement and Theory for Reinforcement Learning Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Qian, Kejiang, Storkey, Amos, He, Fengxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Chunking: Continual Learning is not just about Distribution Shift
di: Lee, Thomas L., et al.
Pubblicazione: (2023)
di: Lee, Thomas L., et al.
Pubblicazione: (2023)
Label Noise: Correcting the Forward-Correction
di: Toner, William, et al.
Pubblicazione: (2023)
di: Toner, William, et al.
Pubblicazione: (2023)
Noisy Early Stopping for Noisy Labels
di: Toner, William, et al.
Pubblicazione: (2024)
di: Toner, William, et al.
Pubblicazione: (2024)
Efficient Offline Reinforcement Learning: First Imitate, then Improve
di: Jelley, Adam, et al.
Pubblicazione: (2024)
di: Jelley, Adam, et al.
Pubblicazione: (2024)
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
di: McInroe, Trevor, et al.
Pubblicazione: (2023)
di: McInroe, Trevor, et al.
Pubblicazione: (2023)
Approximate Bayesian Class-Conditional Models under Continuous Representation Shift
di: Lee, Thomas L., et al.
Pubblicazione: (2023)
di: Lee, Thomas L., et al.
Pubblicazione: (2023)
PRISM: Parallel Reward Integration with Symmetry for MORL
di: van der Knaap, Finn, et al.
Pubblicazione: (2026)
di: van der Knaap, Finn, et al.
Pubblicazione: (2026)
Adversarial robustness of VAEs through the lens of local geometry
di: Khan, Asif, et al.
Pubblicazione: (2022)
di: Khan, Asif, et al.
Pubblicazione: (2022)
When a Reinforcement Learning Agent Encounters Unknown Unknowns
di: Zhu, Juntian, et al.
Pubblicazione: (2025)
di: Zhu, Juntian, et al.
Pubblicazione: (2025)
Object-Centric World Models from Few-Shot Annotations for Sample-Efficient Reinforcement Learning
di: Zhang, Weipu, et al.
Pubblicazione: (2025)
di: Zhang, Weipu, et al.
Pubblicazione: (2025)
Adapting Time Series Foundation Models through Data Mixtures
di: Lee, Thomas L., et al.
Pubblicazione: (2026)
di: Lee, Thomas L., et al.
Pubblicazione: (2026)
Aligning Agents like Large Language Models
di: Jelley, Adam, et al.
Pubblicazione: (2024)
di: Jelley, Adam, et al.
Pubblicazione: (2024)
Ensuring Safety in an Uncertain Environment: Constrained MDPs via Stochastic Thresholds
di: Zuo, Qian, et al.
Pubblicazione: (2025)
di: Zuo, Qian, et al.
Pubblicazione: (2025)
HyperMARL: Adaptive Hypernetworks for Multi-Agent RL
di: Tessera, Kale-ab Abebe, et al.
Pubblicazione: (2024)
di: Tessera, Kale-ab Abebe, et al.
Pubblicazione: (2024)
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
di: Gupta, Akash, et al.
Pubblicazione: (2025)
di: Gupta, Akash, et al.
Pubblicazione: (2025)
Few-Shot Learning with Class Imbalance
di: Ochal, Mateusz, et al.
Pubblicazione: (2021)
di: Ochal, Mateusz, et al.
Pubblicazione: (2021)
Hyperparameter Selection in Continual Learning
di: Lee, Thomas L., et al.
Pubblicazione: (2024)
di: Lee, Thomas L., et al.
Pubblicazione: (2024)
Near-Constant Strong Violation and Last-Iterate Convergence for Online CMDPs via Decaying Safety Margins
di: Zuo, Qian, et al.
Pubblicazione: (2026)
di: Zuo, Qian, et al.
Pubblicazione: (2026)
Integrating LTL Constraints into PPO for Safe Reinforcement Learning
di: Zhang, Maifang, et al.
Pubblicazione: (2026)
di: Zhang, Maifang, et al.
Pubblicazione: (2026)
Probing Dec-POMDP Reasoning in Cooperative MARL
di: Tessera, Kale-ab, et al.
Pubblicazione: (2026)
di: Tessera, Kale-ab, et al.
Pubblicazione: (2026)
Kalman Linear Attention: Parallel Bayesian Filtering For Efficient Language Modelling and State Tracking
di: Shaj, Vaisakh, et al.
Pubblicazione: (2026)
di: Shaj, Vaisakh, et al.
Pubblicazione: (2026)
Remembering the Markov Property in Cooperative MARL
di: Tessera, Kale-ab Abebe, et al.
Pubblicazione: (2025)
di: Tessera, Kale-ab Abebe, et al.
Pubblicazione: (2025)
Reinforcement Learning Interventions on Boundedly Rational Human Agents in Frictionful Tasks
di: Nofshin, Eura, et al.
Pubblicazione: (2024)
di: Nofshin, Eura, et al.
Pubblicazione: (2024)
DAM: Towards A Foundation Model for Time Series Forecasting
di: Darlow, Luke, et al.
Pubblicazione: (2024)
di: Darlow, Luke, et al.
Pubblicazione: (2024)
Forgetting is Everywhere
di: Sanati, Ben, et al.
Pubblicazione: (2025)
di: Sanati, Ben, et al.
Pubblicazione: (2025)
On Harnessing Idle Compute at the Edge for Foundation Model Training
di: Xue, Leyang, et al.
Pubblicazione: (2025)
di: Xue, Leyang, et al.
Pubblicazione: (2025)
Adaptive Rational Activations to Boost Deep Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2021)
di: Delfosse, Quentin, et al.
Pubblicazione: (2021)
DeXposure: A Dataset and Benchmarks for Inter-protocol Credit Exposure in Decentralized Financial Networks
di: Wu, Wenbin, et al.
Pubblicazione: (2025)
di: Wu, Wenbin, et al.
Pubblicazione: (2025)
Balancing Expressivity and Robustness: Constrained Rational Activations for Reinforcement Learning
di: Surdej, Rafał, et al.
Pubblicazione: (2025)
di: Surdej, Rafał, et al.
Pubblicazione: (2025)
Generalisation of RLHF under Reward Shift and Clipped KL Regularisation
di: Tang, Kenton, et al.
Pubblicazione: (2026)
di: Tang, Kenton, et al.
Pubblicazione: (2026)
Reinforcement Learning for Machine Learning Engineering Agents
di: Yang, Sherry, et al.
Pubblicazione: (2025)
di: Yang, Sherry, et al.
Pubblicazione: (2025)
Physics-Aligned Canonical Equivariant Fourier Neural Operator under Symmetry-Induced Shifts
di: Xu, Jiaxiao, et al.
Pubblicazione: (2026)
di: Xu, Jiaxiao, et al.
Pubblicazione: (2026)
Dynamic Obstacle Avoidance with Bounded Rationality Adversarial Reinforcement Learning
di: Holgado-Alvarez, Jose-Luis, et al.
Pubblicazione: (2025)
di: Holgado-Alvarez, Jose-Luis, et al.
Pubblicazione: (2025)
Diffusion for World Modeling: Visual Details Matter in Atari
di: Alonso, Eloi, et al.
Pubblicazione: (2024)
di: Alonso, Eloi, et al.
Pubblicazione: (2024)
Multi-Agent Reinforcement Learning with Submodular Reward
di: Chen, Wenjing, et al.
Pubblicazione: (2026)
di: Chen, Wenjing, et al.
Pubblicazione: (2026)
Group-Agent Reinforcement Learning with Heterogeneous Agents
di: Wu, Kaiyue, et al.
Pubblicazione: (2025)
di: Wu, Kaiyue, et al.
Pubblicazione: (2025)
Game of Coding: Coding Theory in the Presence of Rational Adversaries, Motivated by Decentralized Machine Learning
di: Nodehi, Hanzaleh Akbari, et al.
Pubblicazione: (2026)
di: Nodehi, Hanzaleh Akbari, et al.
Pubblicazione: (2026)
AGILE: A Novel Reinforcement Learning Framework of LLM Agents
di: Feng, Peiyuan, et al.
Pubblicazione: (2024)
di: Feng, Peiyuan, et al.
Pubblicazione: (2024)
Towards Formalizing Reinforcement Learning Theory
di: Zhang, Shangtong
Pubblicazione: (2025)
di: Zhang, Shangtong
Pubblicazione: (2025)
Generative World Modelling for Humanoids: 1X World Model Challenge Technical Report
di: Mereu, Riccardo, et al.
Pubblicazione: (2025)
di: Mereu, Riccardo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Chunking: Continual Learning is not just about Distribution Shift
di: Lee, Thomas L., et al.
Pubblicazione: (2023) -
Label Noise: Correcting the Forward-Correction
di: Toner, William, et al.
Pubblicazione: (2023) -
Noisy Early Stopping for Noisy Labels
di: Toner, William, et al.
Pubblicazione: (2024) -
Efficient Offline Reinforcement Learning: First Imitate, then Improve
di: Jelley, Adam, et al.
Pubblicazione: (2024) -
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
di: McInroe, Trevor, et al.
Pubblicazione: (2023)