Curriculum reinforcement learning with measurable task representation learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wen, Yongyan, Li, Siyuan, Fu, Mingjian, Yang, Yiqin, Wang, Xun, Liu, Peng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks
par: Wen, Yongyan, et autres
Publié: (2024)
par: Wen, Yongyan, et autres
Publié: (2024)
Leveraging LLMs for reward function design in reinforcement learning control tasks
par: Cardenoso, Franklin, et autres
Publié: (2025)
par: Cardenoso, Franklin, et autres
Publié: (2025)
Curriculum reinforcement learning for quantum architecture search under hardware errors
par: Patel, Yash J., et autres
Publié: (2024)
par: Patel, Yash J., et autres
Publié: (2024)
Normalization and effective learning rates in reinforcement learning
par: Lyle, Clare, et autres
Publié: (2024)
par: Lyle, Clare, et autres
Publié: (2024)
TemporalPaD: a reinforcement-learning framework for temporal feature representation and dimension reduction
par: Mu, Xuechen, et autres
Publié: (2024)
par: Mu, Xuechen, et autres
Publié: (2024)
Agentic reinforcement learning empowers next-generation chemical language models for molecular design and synthesis
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
Deep progressive reinforcement learning-based flexible resource scheduling framework for IRS and UAV-assisted MEC system
par: Dong, Li, et autres
Publié: (2024)
par: Dong, Li, et autres
Publié: (2024)
Causal prompting model-based offline reinforcement learning
par: Yu, Xuehui, et autres
Publié: (2024)
par: Yu, Xuehui, et autres
Publié: (2024)
Logic-informed reinforcement learning for cross-domain optimization of large-scale cyber-physical systems
par: Wan, Guangxi, et autres
Publié: (2025)
par: Wan, Guangxi, et autres
Publié: (2025)
Fine-grained graph representation learning for heterogeneous mobile networks with attentive fusion and contrastive learning
par: Liu, Shengheng, et autres
Publié: (2024)
par: Liu, Shengheng, et autres
Publié: (2024)
An advantage based policy transfer algorithm for reinforcement learning with measures of transferability
par: Alam, Md Ferdous, et autres
Publié: (2023)
par: Alam, Md Ferdous, et autres
Publié: (2023)
Not all tokens are needed(NAT): token efficient reinforcement learning
par: Sang, Hejian, et autres
Publié: (2026)
par: Sang, Hejian, et autres
Publié: (2026)
AGA: An adaptive group alignment framework for structured medical cross-modal representation learning
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
Delayed homomorphic reinforcement learning for environments with delayed feedback
par: Lee, Jongsoo, et autres
Publié: (2026)
par: Lee, Jongsoo, et autres
Publié: (2026)
Counterfactual experience augmented off-policy reinforcement learning
par: Lee, Sunbowen, et autres
Publié: (2025)
par: Lee, Sunbowen, et autres
Publié: (2025)
Deep reinforcement learning with time-scale invariant memory
par: Kabir, Md Rysul, et autres
Publié: (2024)
par: Kabir, Md Rysul, et autres
Publié: (2024)
Offline reinforcement learning for job-shop scheduling problems
par: Echeverria, Imanol, et autres
Publié: (2024)
par: Echeverria, Imanol, et autres
Publié: (2024)
Bellman operator convergence enhancements in reinforcement learning algorithms
par: Kadurha, David Krame, et autres
Publié: (2025)
par: Kadurha, David Krame, et autres
Publié: (2025)
An approach of deep reinforcement learning for maximizing the net present value of stochastic projects
par: Xu, Wei, et autres
Publié: (2025)
par: Xu, Wei, et autres
Publié: (2025)
Trust Region Preference Approximation: A simple and stable reinforcement learning algorithm for LLM reasoning
par: Su, Xuerui, et autres
Publié: (2025)
par: Su, Xuerui, et autres
Publié: (2025)
Nonlocal operator learning for fMRI encoding and decoding tasks
par: Kramer, Andreas, et autres
Publié: (2026)
par: Kramer, Andreas, et autres
Publié: (2026)
Towards efficient representation identification in supervised learning
par: Ahuja, Kartik, et autres
Publié: (2022)
par: Ahuja, Kartik, et autres
Publié: (2022)
Found-RL: foundation model-enhanced reinforcement learning for autonomous driving
par: Qu, Yansong, et autres
Publié: (2026)
par: Qu, Yansong, et autres
Publié: (2026)
Bridging the phenotype-target gap for molecular generation via multi-objective reinforcement learning
par: Guo, Haotian, et autres
Publié: (2025)
par: Guo, Haotian, et autres
Publié: (2025)
Efficiency optimization of large-scale language models based on deep learning in natural language processing tasks
par: Mei, Taiyuan, et autres
Publié: (2024)
par: Mei, Taiyuan, et autres
Publié: (2024)
Learning to summarize user information for personalized reinforcement learning from human feedback
par: Nam, Hyunji, et autres
Publié: (2025)
par: Nam, Hyunji, et autres
Publié: (2025)
Leveraging weights signals -- Predicting and improving generalizability in reinforcement learning
par: Moulin, Olivier, et autres
Publié: (2025)
par: Moulin, Olivier, et autres
Publié: (2025)
Dynamic feature selection in medical predictive monitoring by reinforcement learning
par: Chen, Yutong, et autres
Publié: (2024)
par: Chen, Yutong, et autres
Publié: (2024)
Economic span selection of bridge based on deep reinforcement learning
par: Zhang, Leye, et autres
Publié: (2024)
par: Zhang, Leye, et autres
Publié: (2024)
Evaluating alignment between humans and neural network representations in image-based learning tasks
par: Demircan, Can, et autres
Publié: (2023)
par: Demircan, Can, et autres
Publié: (2023)
Survey on reinforcement learning for language processing
par: Uc-Cetina, Victor, et autres
Publié: (2021)
par: Uc-Cetina, Victor, et autres
Publié: (2021)
Maximum diffusion reinforcement learning
par: Berrueta, Thomas A., et autres
Publié: (2023)
par: Berrueta, Thomas A., et autres
Publié: (2023)
The intrinsic motivation of reinforcement and imitation learning for sequential tasks
par: Nguyen, Sao Mai
Publié: (2024)
par: Nguyen, Sao Mai
Publié: (2024)
Reinforcement learning for spin torque oscillator tasks
par: Mojsiejuk, Jakub, et autres
Publié: (2025)
par: Mojsiejuk, Jakub, et autres
Publié: (2025)
Task diversity produces systematic transfer but inhibits continual reinforcement learning
par: Seth, Purab, et autres
Publié: (2026)
par: Seth, Purab, et autres
Publié: (2026)
An efficient deep reinforcement learning environment for flexible job-shop scheduling
par: Wu, Xinquan, et autres
Publié: (2025)
par: Wu, Xinquan, et autres
Publié: (2025)
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
par: Obando-Ceron, Johan, et autres
Publié: (2024)
par: Obando-Ceron, Johan, et autres
Publié: (2024)
CAREL: Instruction-guided reinforcement learning with cross-modal auxiliary objectives
par: Saghafian, Armin, et autres
Publié: (2024)
par: Saghafian, Armin, et autres
Publié: (2024)
Policy-shaped prediction: avoiding distractions in model-based reinforcement learning
par: Hutson, Miles, et autres
Publié: (2024)
par: Hutson, Miles, et autres
Publié: (2024)
Emergent temporal abstractions in autoregressive models enable hierarchical reinforcement learning
par: Kobayashi, Seijin, et autres
Publié: (2025)
par: Kobayashi, Seijin, et autres
Publié: (2025)
Documents similaires
-
SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks
par: Wen, Yongyan, et autres
Publié: (2024) -
Leveraging LLMs for reward function design in reinforcement learning control tasks
par: Cardenoso, Franklin, et autres
Publié: (2025) -
Curriculum reinforcement learning for quantum architecture search under hardware errors
par: Patel, Yash J., et autres
Publié: (2024) -
Normalization and effective learning rates in reinforcement learning
par: Lyle, Clare, et autres
Publié: (2024) -
TemporalPaD: a reinforcement-learning framework for temporal feature representation and dimension reduction
par: Mu, Xuechen, et autres
Publié: (2024)