ICRL: Learning to Internalize Self-Critique with Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Jianbo, Yu, Xiaomin, Xin, Yi, Guo, Yifu, Jiang, Zhuosong, Yue, Zhongqi, Wang, Weishi, Zou, Heqing, Qin, Chengwei, Xiong, Hui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning
di: Wu, Xiaoguang, et al.
Pubblicazione: (2026)
di: Wu, Xiaoguang, et al.
Pubblicazione: (2026)
FURINA: A Fully Customizable Role-Playing Benchmark via Scalable Multi-Agent Collaboration Pipeline
di: Wu, Haotian, et al.
Pubblicazione: (2025)
di: Wu, Haotian, et al.
Pubblicazione: (2025)
CCL: Collaborative Curriculum Learning for Sparse-Reward Multi-Agent Reinforcement Learning via Co-evolutionary Task Evolution
di: Lin, Yufei, et al.
Pubblicazione: (2025)
di: Lin, Yufei, et al.
Pubblicazione: (2025)
LLM-Enhanced Multi-Agent Reinforcement Learning with Expert Workflow for Real-Time P2P Energy Trading
di: Lou, Chengwei, et al.
Pubblicazione: (2025)
di: Lou, Chengwei, et al.
Pubblicazione: (2025)
Enhancing Traffic Signal Control through Model-based Reinforcement Learning and Policy Reuse
di: Li, Yihong, et al.
Pubblicazione: (2025)
di: Li, Yihong, et al.
Pubblicazione: (2025)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
di: Fu, Heming, et al.
Pubblicazione: (2025)
di: Fu, Heming, et al.
Pubblicazione: (2025)
Speaking the Language of Teamwork: LLM-Guided Credit Assignment in Multi-Agent Reinforcement Learning
di: Lin, Muhan, et al.
Pubblicazione: (2025)
di: Lin, Muhan, et al.
Pubblicazione: (2025)
INDICT: Code Generation with Internal Dialogues of Critiques for Both Security and Helpfulness
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game
di: Guo, Honglei, et al.
Pubblicazione: (2026)
di: Guo, Honglei, et al.
Pubblicazione: (2026)
Causal Mean Field Multi-Agent Reinforcement Learning
di: Ma, Hao, et al.
Pubblicazione: (2025)
di: Ma, Hao, et al.
Pubblicazione: (2025)
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning
di: Li, Dapeng, et al.
Pubblicazione: (2024)
di: Li, Dapeng, et al.
Pubblicazione: (2024)
YOLO-MARL: You Only LLM Once for Multi-Agent Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2024)
di: Zhuang, Yuan, et al.
Pubblicazione: (2024)
TVDO: Tchebycheff Value-Decomposition Optimization for Multi-Agent Reinforcement Learning
di: Hu, Xiaoliang, et al.
Pubblicazione: (2023)
di: Hu, Xiaoliang, et al.
Pubblicazione: (2023)
Distributed Zeroth-Order Policy Gradient for Networked Multi-agent Reinforcement Learning from Human Feedback
di: Dai, Pengcheng, et al.
Pubblicazione: (2026)
di: Dai, Pengcheng, et al.
Pubblicazione: (2026)
Multilevel Graph Reinforcement Learning for Consistent Cognitive Decision-making in Heterogeneous Mixed Autonomy
di: Gao, Xin, et al.
Pubblicazione: (2024)
di: Gao, Xin, et al.
Pubblicazione: (2024)
Adaptive TD-Lambda for Cooperative Multi-agent Reinforcement Learning
di: Deng, Yue, et al.
Pubblicazione: (2026)
di: Deng, Yue, et al.
Pubblicazione: (2026)
Heterogeneity in Multi-Agent Reinforcement Learning
di: Hu, Tianyi, et al.
Pubblicazione: (2025)
di: Hu, Tianyi, et al.
Pubblicazione: (2025)
Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning
di: Yu, Xin, et al.
Pubblicazione: (2023)
di: Yu, Xin, et al.
Pubblicazione: (2023)
Learning Efficient Communication Protocols for Multi-Agent Reinforcement Learning
di: Zhang, Xinren, et al.
Pubblicazione: (2025)
di: Zhang, Xinren, et al.
Pubblicazione: (2025)
Bayesian Critique-Tune-Based Reinforcement Learning with Adaptive Pressure for Multi-Intersection Traffic Signal Control
di: Duan, Wenchang, et al.
Pubblicazione: (2024)
di: Duan, Wenchang, et al.
Pubblicazione: (2024)
Strategic Coordination for Evolving Multi-agent Systems: A Hierarchical Reinforcement and Collective Learning Approach
di: Qin, Chuhao, et al.
Pubblicazione: (2025)
di: Qin, Chuhao, et al.
Pubblicazione: (2025)
Multi-agent Reinforcement Learning for Low-Carbon P2P Energy Trading among Self-Interested Microgrids
di: Ren, Junhao, et al.
Pubblicazione: (2026)
di: Ren, Junhao, et al.
Pubblicazione: (2026)
Multi-Agent Reinforcement Learning for Multi-Cell Spectrum and Power Allocation
di: Zhang, Yiming, et al.
Pubblicazione: (2023)
di: Zhang, Yiming, et al.
Pubblicazione: (2023)
Learning Nudges for Conditional Cooperation: A Multi-Agent Reinforcement Learning Model
di: Kulkarni, Shatayu, et al.
Pubblicazione: (2024)
di: Kulkarni, Shatayu, et al.
Pubblicazione: (2024)
Algorithmic Contract Design with Reinforcement Learning Agents
di: Concha, David Molina, et al.
Pubblicazione: (2024)
di: Concha, David Molina, et al.
Pubblicazione: (2024)
Moira: Language-driven Hierarchical Reinforcement Learning for Pair Trading
di: Giannouris, Polydoros, et al.
Pubblicazione: (2026)
di: Giannouris, Polydoros, et al.
Pubblicazione: (2026)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
di: Hu, Tianyi, et al.
Pubblicazione: (2024)
di: Hu, Tianyi, et al.
Pubblicazione: (2024)
Knowing What Not to Do: Leverage Language Model Insights for Action Space Pruning in Multi-agent Reinforcement Learning
di: Liu, Zhihao, et al.
Pubblicazione: (2024)
di: Liu, Zhihao, et al.
Pubblicazione: (2024)
VIL2C: Value-of-Information Aware Low-Latency Communication for Multi-Agent Reinforcement Learning
di: Zhang, Qian, et al.
Pubblicazione: (2025)
di: Zhang, Qian, et al.
Pubblicazione: (2025)
Chasing Moving Targets with Online Self-Play Reinforcement Learning for Safer Language Models
di: Liu, Mickel, et al.
Pubblicazione: (2025)
di: Liu, Mickel, et al.
Pubblicazione: (2025)
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
di: Liang, Yongheng, et al.
Pubblicazione: (2024)
di: Liang, Yongheng, et al.
Pubblicazione: (2024)
Self-Confirming Transformer for Belief-Conditioned Adaptation in Offline Multi-Agent Reinforcement Learning
di: Li, Tao, et al.
Pubblicazione: (2023)
di: Li, Tao, et al.
Pubblicazione: (2023)
Strategic Coordination of Drones via Short-term Distributed Optimization and Long-term Reinforcement Learning
di: Qin, Chuhao, et al.
Pubblicazione: (2023)
di: Qin, Chuhao, et al.
Pubblicazione: (2023)
Scalable UAV Multi-Hop Networking via Multi-Agent Reinforcement Learning with Large Language Models
di: Xu, Yanggang, et al.
Pubblicazione: (2025)
di: Xu, Yanggang, et al.
Pubblicazione: (2025)
How Exploration Breaks Cooperation in Shared-Policy Multi-Agent Reinforcement Learning
di: Weng, Yi-Ning, et al.
Pubblicazione: (2026)
di: Weng, Yi-Ning, et al.
Pubblicazione: (2026)
Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024
di: Azadeh, Reza
Pubblicazione: (2024)
di: Azadeh, Reza
Pubblicazione: (2024)
Sample-Efficient Distributionally Robust Multi-Agent Reinforcement Learning via Online Interaction
di: Farhat, Zain Ulabedeen, et al.
Pubblicazione: (2025)
di: Farhat, Zain Ulabedeen, et al.
Pubblicazione: (2025)
Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning
di: Lee, Min Whoo, et al.
Pubblicazione: (2025)
di: Lee, Min Whoo, et al.
Pubblicazione: (2025)
Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)
Dynamic Graph Communication for Decentralised Multi-Agent Reinforcement Learning
di: McClusky, Ben
Pubblicazione: (2024)
di: McClusky, Ben
Pubblicazione: (2024)
Documenti analoghi
-
LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning
di: Wu, Xiaoguang, et al.
Pubblicazione: (2026) -
FURINA: A Fully Customizable Role-Playing Benchmark via Scalable Multi-Agent Collaboration Pipeline
di: Wu, Haotian, et al.
Pubblicazione: (2025) -
CCL: Collaborative Curriculum Learning for Sparse-Reward Multi-Agent Reinforcement Learning via Co-evolutionary Task Evolution
di: Lin, Yufei, et al.
Pubblicazione: (2025) -
LLM-Enhanced Multi-Agent Reinforcement Learning with Expert Workflow for Real-Time P2P Energy Trading
di: Lou, Chengwei, et al.
Pubblicazione: (2025) -
Enhancing Traffic Signal Control through Model-based Reinforcement Learning and Policy Reuse
di: Li, Yihong, et al.
Pubblicazione: (2025)