Saved in:
| Main Authors: | Feng, Xidong, Liu, Bo, Ren, Jie, Mai, Luo, Zhu, Rui, Zhang, Haifeng, Wang, Jun, Yang, Yaodong |
|---|---|
| Format: | Preprint |
| Published: |
2021
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2112.15400 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
by: Dai, Juntao, et al.
Published: (2024)
by: Dai, Juntao, et al.
Published: (2024)
Natural Language Reinforcement Learning
by: Feng, Xidong, et al.
Published: (2024)
by: Feng, Xidong, et al.
Published: (2024)
Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
by: Wang, Fan, et al.
Published: (2025)
by: Wang, Fan, et al.
Published: (2025)
Meta-Learn Unimodal Signals with Weak Supervision for Multimodal Sentiment Analysis
by: Mai, Sijie, et al.
Published: (2024)
by: Mai, Sijie, et al.
Published: (2024)
Natural Language Reinforcement Learning
by: Feng, Xidong, et al.
Published: (2024)
by: Feng, Xidong, et al.
Published: (2024)
Robust Multi-Agent Reinforcement Learning by Mutual Information Regularization
by: Li, Simin, et al.
Published: (2023)
by: Li, Simin, et al.
Published: (2023)
Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation
by: Bai, Fengshuo, et al.
Published: (2024)
by: Bai, Fengshuo, et al.
Published: (2024)
STAS: Spatial-Temporal Return Decomposition for Multi-agent Reinforcement Learning
by: Chen, Sirui, et al.
Published: (2023)
by: Chen, Sirui, et al.
Published: (2023)
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
by: Jin, Yonggang, et al.
Published: (2023)
by: Jin, Yonggang, et al.
Published: (2023)
Game-Theoretic Multiagent Reinforcement Learning
by: Yang, Yaodong, et al.
Published: (2020)
by: Yang, Yaodong, et al.
Published: (2020)
Theoretical Analysis of Meta Reinforcement Learning: Generalization Bounds and Convergence Guarantees
by: Wang, Cangqing, et al.
Published: (2024)
by: Wang, Cangqing, et al.
Published: (2024)
Understanding Simplicity Bias towards Compositional Mappings via Learning Dynamics
by: Ren, Yi, et al.
Published: (2024)
by: Ren, Yi, et al.
Published: (2024)
Goal Discovery with Causal Capacity for Efficient Reinforcement Learning
by: Yu, Yan, et al.
Published: (2025)
by: Yu, Yan, et al.
Published: (2025)
Tackling the Local Bias in Federated Graph Learning
by: Zhang, Binchi, et al.
Published: (2021)
by: Zhang, Binchi, et al.
Published: (2021)
Scalable Multi-Objective and Meta Reinforcement Learning via Gradient Estimation
by: Zhang, Zhenshuo, et al.
Published: (2025)
by: Zhang, Zhenshuo, et al.
Published: (2025)
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
by: Luo, Lirui, et al.
Published: (2026)
by: Luo, Lirui, et al.
Published: (2026)
Curious Causality-Seeking Agents Learn Meta Causal World
by: Zhao, Zhiyu, et al.
Published: (2025)
by: Zhao, Zhiyu, et al.
Published: (2025)
LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem Exploration
by: Qiu, Ruiyu, et al.
Published: (2025)
by: Qiu, Ruiyu, et al.
Published: (2025)
Finding Kissing Numbers with Game-theoretic Reinforcement Learning
by: Ma, Chengdong, et al.
Published: (2025)
by: Ma, Chengdong, et al.
Published: (2025)
SafeDreamer: Safe Reinforcement Learning with World Models
by: Huang, Weidong, et al.
Published: (2023)
by: Huang, Weidong, et al.
Published: (2023)
Mitigating Degree Bias Adaptively with Hard-to-Learn Nodes in Graph Contrastive Learning
by: Hu, Jingyu, et al.
Published: (2025)
by: Hu, Jingyu, et al.
Published: (2025)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
by: Huang, Shiting, et al.
Published: (2026)
by: Huang, Shiting, et al.
Published: (2026)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
by: Xu, Jiawei, et al.
Published: (2024)
by: Xu, Jiawei, et al.
Published: (2024)
Directed-MAML: Meta Reinforcement Learning Algorithm with Task-directed Approximation
by: Zhang, Yang, et al.
Published: (2025)
by: Zhang, Yang, et al.
Published: (2025)
Unbiased Gradient Low-Rank Projection
by: Pan, Rui, et al.
Published: (2025)
by: Pan, Rui, et al.
Published: (2025)
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
by: Li, Xidong, et al.
Published: (2026)
by: Li, Xidong, et al.
Published: (2026)
RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
by: Bai, Fengshuo, et al.
Published: (2024)
by: Bai, Fengshuo, et al.
Published: (2024)
PG-Rainbow: Using Distributional Reinforcement Learning in Policy Gradient Methods
by: Jeon, WooJae, et al.
Published: (2024)
by: Jeon, WooJae, et al.
Published: (2024)
Gradient Boosting Reinforcement Learning
by: Fuhrer, Benjamin, et al.
Published: (2024)
by: Fuhrer, Benjamin, et al.
Published: (2024)
Operator-Theoretic Framework for Gradient-Free Federated Learning
by: Kumar, Mohit, et al.
Published: (2025)
by: Kumar, Mohit, et al.
Published: (2025)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
by: Yang, Rui, et al.
Published: (2024)
by: Yang, Rui, et al.
Published: (2024)
Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
by: Li, Simin, et al.
Published: (2025)
by: Li, Simin, et al.
Published: (2025)
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
by: Ji, Jiaming, et al.
Published: (2023)
by: Ji, Jiaming, et al.
Published: (2023)
Meta-Learning Reinforcement Learning for Crypto-Return Prediction
by: Wang, Junqiao, et al.
Published: (2025)
by: Wang, Junqiao, et al.
Published: (2025)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
by: Ji, Jiaming, et al.
Published: (2025)
by: Ji, Jiaming, et al.
Published: (2025)
LearnAlign: Data Selection for LLM Reinforcement Learning with Improved Gradient Alignment
by: Li, Shipeng, et al.
Published: (2025)
by: Li, Shipeng, et al.
Published: (2025)
Controllable Flow Matching for Online Reinforcement Learning
by: Wang, Bin, et al.
Published: (2025)
by: Wang, Bin, et al.
Published: (2025)
Gradient Inversion in Federated Reinforcement Learning
by: He, Shenghong
Published: (2025)
by: He, Shenghong
Published: (2025)
Theoretical Barriers in Bellman-Based Reinforcement Learning
by: Pinon, Brieuc, et al.
Published: (2025)
by: Pinon, Brieuc, et al.
Published: (2025)
Align Once, Benefit Multilingually: Enforcing Multilingual Consistency for LLM Safety Alignment
by: Bu, Yuyan, et al.
Published: (2026)
by: Bu, Yuyan, et al.
Published: (2026)
Similar Items
-
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
by: Dai, Juntao, et al.
Published: (2024) -
Natural Language Reinforcement Learning
by: Feng, Xidong, et al.
Published: (2024) -
Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
by: Wang, Fan, et al.
Published: (2025) -
Meta-Learn Unimodal Signals with Weak Supervision for Multimodal Sentiment Analysis
by: Mai, Sijie, et al.
Published: (2024) -
Natural Language Reinforcement Learning
by: Feng, Xidong, et al.
Published: (2024)