Meta-Cognitive Reinforcement Learning with Self-Doubt and Recovery
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Zhipeng, Su, Xiongfei, Li, Kai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Echoes of Socratic Doubt: Embracing Uncertainty in Calibrated Evidential Reinforcement Learning
di: Stutts, Alex Christopher, et al.
Pubblicazione: (2024)
di: Stutts, Alex Christopher, et al.
Pubblicazione: (2024)
Stable but Wrong: When More Data Degrades Scientific Conclusions
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026)
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026)
Inverse Reinforcement Learning With Constraint Recovery
di: Das, Nirjhar, et al.
Pubblicazione: (2023)
di: Das, Nirjhar, et al.
Pubblicazione: (2023)
Approximate Subgraph Matching with Neural Graph Representations and Reinforcement Learning
di: Li, Kaiyang, et al.
Pubblicazione: (2026)
di: Li, Kaiyang, et al.
Pubblicazione: (2026)
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
di: Li, Huanyu, et al.
Pubblicazione: (2026)
di: Li, Huanyu, et al.
Pubblicazione: (2026)
Single-Trajectory Distributionally Robust Reinforcement Learning
di: Liang, Zhipeng, et al.
Pubblicazione: (2023)
di: Liang, Zhipeng, et al.
Pubblicazione: (2023)
Continuity and Isolation Lead to Doubts or Dilemmas in Large Language Models
di: Pasten, Hector, et al.
Pubblicazione: (2025)
di: Pasten, Hector, et al.
Pubblicazione: (2025)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
di: Huang, Shiting, et al.
Pubblicazione: (2026)
di: Huang, Shiting, et al.
Pubblicazione: (2026)
Meta-Learning Reinforcement Learning for Crypto-Return Prediction
di: Wang, Junqiao, et al.
Pubblicazione: (2025)
di: Wang, Junqiao, et al.
Pubblicazione: (2025)
Meta-TTRL: A Metacognitive Framework for Self-Improving Test-Time Reinforcement Learning in Unified Multimodal Models
di: Tan, Lit Sin, et al.
Pubblicazione: (2026)
di: Tan, Lit Sin, et al.
Pubblicazione: (2026)
RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
di: Zhang, Zijing, et al.
Pubblicazione: (2025)
di: Zhang, Zijing, et al.
Pubblicazione: (2025)
The Constitutional Controller: Doubt-Calibrated Steering of Compliant Agents
di: Kohaut, Simon, et al.
Pubblicazione: (2025)
di: Kohaut, Simon, et al.
Pubblicazione: (2025)
Scalable Multi-Objective and Meta Reinforcement Learning via Gradient Estimation
di: Zhang, Zhenshuo, et al.
Pubblicazione: (2025)
di: Zhang, Zhenshuo, et al.
Pubblicazione: (2025)
Why Keep Your Doubts to Yourself? Trading Visual Uncertainties in Multi-Agent Bandit Systems
di: Zhang, Jusheng, et al.
Pubblicazione: (2026)
di: Zhang, Jusheng, et al.
Pubblicazione: (2026)
Directed-MAML: Meta Reinforcement Learning Algorithm with Task-directed Approximation
di: Zhang, Yang, et al.
Pubblicazione: (2025)
di: Zhang, Yang, et al.
Pubblicazione: (2025)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
di: Liu, Shirong, et al.
Pubblicazione: (2024)
di: Liu, Shirong, et al.
Pubblicazione: (2024)
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
di: Feng, Xidong, et al.
Pubblicazione: (2021)
di: Feng, Xidong, et al.
Pubblicazione: (2021)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
di: Liu, Zeyuan, et al.
Pubblicazione: (2025)
di: Liu, Zeyuan, et al.
Pubblicazione: (2025)
Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent
di: Hoppmann, Björn, et al.
Pubblicazione: (2026)
di: Hoppmann, Björn, et al.
Pubblicazione: (2026)
Theoretical Analysis of Meta Reinforcement Learning: Generalization Bounds and Convergence Guarantees
di: Wang, Cangqing, et al.
Pubblicazione: (2024)
di: Wang, Cangqing, et al.
Pubblicazione: (2024)
Training instability in deep learning follows low-dimensional dynamical principles
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026)
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026)
Reinforcement Learning for Control with Probabilistic Stability Guarantee: A Finite-Sample Approach
di: Han, Minghao, et al.
Pubblicazione: (2026)
di: Han, Minghao, et al.
Pubblicazione: (2026)
How Should We Meta-Learn Reinforcement Learning Algorithms?
di: Goldie, Alexander David, et al.
Pubblicazione: (2025)
di: Goldie, Alexander David, et al.
Pubblicazione: (2025)
SplAgger: Split Aggregation for Meta-Reinforcement Learning
di: Beck, Jacob, et al.
Pubblicazione: (2024)
di: Beck, Jacob, et al.
Pubblicazione: (2024)
Networked Restless Multi-Arm Bandits with Reinforcement Learning
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
di: Zhang, Hanmo, et al.
Pubblicazione: (2025)
Boosting Hierarchical Reinforcement Learning with Meta-Learning for Complex Task Adaptation
di: Khajooeinejad, Arash, et al.
Pubblicazione: (2024)
di: Khajooeinejad, Arash, et al.
Pubblicazione: (2024)
Memory Sequence Length of Data Sampling Impacts the Adaptation of Meta-Reinforcement Learning Agents
di: Zhang, Menglong, et al.
Pubblicazione: (2024)
di: Zhang, Menglong, et al.
Pubblicazione: (2024)
Concisely Explaining the Doubt: Minimum-Size Abductive Explanations for Linear Models with a Reject Option
di: Fernandes, Gleilson Pedro, et al.
Pubblicazione: (2026)
di: Fernandes, Gleilson Pedro, et al.
Pubblicazione: (2026)
Overconfident Errors Need Stronger Correction: Asymmetric Confidence Penalties for Reinforcement Learning
di: Xu, Yuanda, et al.
Pubblicazione: (2026)
di: Xu, Yuanda, et al.
Pubblicazione: (2026)
Reinforcement Learning via Self-Distillation
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
Self-Reinforced Graph Contrastive Learning
di: Hsieh, Chou-Ying, et al.
Pubblicazione: (2025)
di: Hsieh, Chou-Ying, et al.
Pubblicazione: (2025)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
A Fast Anti-Jamming Cognitive Radar Deployment Algorithm Based on Reinforcement Learning
di: Cai, Wencheng, et al.
Pubblicazione: (2025)
di: Cai, Wencheng, et al.
Pubblicazione: (2025)
Safe Reinforcement Learning via Recovery-based Shielding with Gaussian Process Dynamics Models
di: Goodall, Alexander W., et al.
Pubblicazione: (2026)
di: Goodall, Alexander W., et al.
Pubblicazione: (2026)
Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
di: Wang, Fan, et al.
Pubblicazione: (2025)
di: Wang, Fan, et al.
Pubblicazione: (2025)
Semi-supervised Anomaly Detection via Adaptive Reinforcement Learning-Enabled Method with Causal Inference for Sensor Signals
di: Chen, Xiangwei, et al.
Pubblicazione: (2024)
di: Chen, Xiangwei, et al.
Pubblicazione: (2024)
TTVS: Boosting Self-Exploring Reinforcement Learning via Test-time Variational Synthesis
di: Bai, Sikai, et al.
Pubblicazione: (2026)
di: Bai, Sikai, et al.
Pubblicazione: (2026)
TIMRL: A Novel Meta-Reinforcement Learning Framework for Non-Stationary and Multi-Task Environments
di: Qi, Chenyang, et al.
Pubblicazione: (2025)
di: Qi, Chenyang, et al.
Pubblicazione: (2025)
Conservative Distributional Reinforcement Learning with Safety Constraints
di: Zhang, Hengrui, et al.
Pubblicazione: (2022)
di: Zhang, Hengrui, et al.
Pubblicazione: (2022)
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
di: Zhang, Hai, et al.
Pubblicazione: (2024)
di: Zhang, Hai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Echoes of Socratic Doubt: Embracing Uncertainty in Calibrated Evidential Reinforcement Learning
di: Stutts, Alex Christopher, et al.
Pubblicazione: (2024) -
Stable but Wrong: When More Data Degrades Scientific Conclusions
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026) -
Inverse Reinforcement Learning With Constraint Recovery
di: Das, Nirjhar, et al.
Pubblicazione: (2023) -
Approximate Subgraph Matching with Neural Graph Representations and Reinforcement Learning
di: Li, Kaiyang, et al.
Pubblicazione: (2026) -
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
di: Li, Huanyu, et al.
Pubblicazione: (2026)