Towards Empowerment Gain through Causal Structure Learning in Model-Based RL
Fuente:
arXiv
Saved in:
| Main Authors: | Cao, Hongye, Feng, Fan, Fang, Meng, Dong, Shaokang, Yang, Tianpei, Huo, Jing, Gao, Yang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Causal Information Prioritization for Efficient Reinforcement Learning
by: Cao, Hongye, et al.
Published: (2025)
by: Cao, Hongye, et al.
Published: (2025)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
by: Cao, Hongye, et al.
Published: (2025)
by: Cao, Hongye, et al.
Published: (2025)
Efficient Reinforcement Learning with Semantic and Token Entropy for LLM Reasoning
by: Cao, Hongye, et al.
Published: (2025)
by: Cao, Hongye, et al.
Published: (2025)
SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
by: Cao, Hongye, et al.
Published: (2025)
by: Cao, Hongye, et al.
Published: (2025)
Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
by: Gan, Siyuan, et al.
Published: (2026)
by: Gan, Siyuan, et al.
Published: (2026)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
by: Yang, Guang, et al.
Published: (2025)
by: Yang, Guang, et al.
Published: (2025)
Empowerment Gain and Causal Model Construction: Children and adults are sensitive to controllability and variability in their causal interventions
by: Yiu, Eunice, et al.
Published: (2025)
by: Yiu, Eunice, et al.
Published: (2025)
MDTeamGPT: A Self-Evolving LLM-based Multi-Agent Framework for Multi-Disciplinary Team Medical Consultation
by: Chen, Kai, et al.
Published: (2025)
by: Chen, Kai, et al.
Published: (2025)
MedSentry: Understanding and Mitigating Safety Risks in Medical LLM Multi-Agent Systems
by: Chen, Kai, et al.
Published: (2025)
by: Chen, Kai, et al.
Published: (2025)
Empowering Large Language Model Agents through Action Learning
by: Zhao, Haiteng, et al.
Published: (2024)
by: Zhao, Haiteng, et al.
Published: (2024)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
by: Yang, Yiqi, et al.
Published: (2024)
by: Yang, Yiqi, et al.
Published: (2024)
SOM: Structured Opponent Modeling for LLM-based Agents via Structural Causal Model
by: Cao, Shiyue, et al.
Published: (2026)
by: Cao, Shiyue, et al.
Published: (2026)
ReviewRL: Towards Automated Scientific Review with RL
by: Zeng, Sihang, et al.
Published: (2025)
by: Zeng, Sihang, et al.
Published: (2025)
Information Gain-Guided Causal Intervention for Autonomous Debiasing Large Language Models
by: Sun, Zhouhao, et al.
Published: (2025)
by: Sun, Zhouhao, et al.
Published: (2025)
Enhancing Large Language Models through Structured Reasoning
by: Dong, Yubo, et al.
Published: (2025)
by: Dong, Yubo, et al.
Published: (2025)
Learning to Substitute Words with Model-based Score Ranking
by: Liu, Hongye, et al.
Published: (2025)
by: Liu, Hongye, et al.
Published: (2025)
Biological Regulatory Network Inference through Circular Causal Structure Learning
by: Jiang, Hongyang, et al.
Published: (2025)
by: Jiang, Hongyang, et al.
Published: (2025)
SuperRL: Reinforcement Learning with Supervision to Boost Language Model Reasoning
by: Liu, Yihao, et al.
Published: (2025)
by: Liu, Yihao, et al.
Published: (2025)
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
by: Liu, Shulin, et al.
Published: (2025)
by: Liu, Shulin, et al.
Published: (2025)
CausalMMM: Learning Causal Structure for Marketing Mix Modeling
by: Gong, Chang, et al.
Published: (2024)
by: Gong, Chang, et al.
Published: (2024)
SortedRL: Accelerating RL Training for LLMs through Online Length-Aware Scheduling
by: Zhang, Yiqi, et al.
Published: (2026)
by: Zhang, Yiqi, et al.
Published: (2026)
UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities
by: Du, Dong, et al.
Published: (2025)
by: Du, Dong, et al.
Published: (2025)
MAGE:A Multi-stage Avatar Generator with Sparse Observations
by: Du, Fangyu, et al.
Published: (2025)
by: Du, Fangyu, et al.
Published: (2025)
LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL
by: Peng, Yingzhe, et al.
Published: (2025)
by: Peng, Yingzhe, et al.
Published: (2025)
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
by: Xi, Zhiheng, et al.
Published: (2025)
by: Xi, Zhiheng, et al.
Published: (2025)
Empowering Working Memory for Large Language Model Agents
by: Guo, Jing, et al.
Published: (2023)
by: Guo, Jing, et al.
Published: (2023)
Causal Invariance and Counterfactual Learning Driven Cooperative Game for Multi-Label Classification
by: Fan, Yijia, et al.
Published: (2025)
by: Fan, Yijia, et al.
Published: (2025)
Empowering Language Models with Active Inquiry for Deeper Understanding
by: Pang, Jing-Cheng, et al.
Published: (2024)
by: Pang, Jing-Cheng, et al.
Published: (2024)
Empowering Economic Simulation for Massively Multiplayer Online Games through Generative Agent-Based Modeling
by: Xu, Bihan, et al.
Published: (2025)
by: Xu, Bihan, et al.
Published: (2025)
Evolving in Tasks: Empowering the Multi-modality Large Language Model as the Computer Use Agent
by: Cheng, Yuhao, et al.
Published: (2025)
by: Cheng, Yuhao, et al.
Published: (2025)
Towards Explainable Harmful Meme Detection through Multimodal Debate between Large Language Models
by: Lin, Hongzhan, et al.
Published: (2024)
by: Lin, Hongzhan, et al.
Published: (2024)
AgentsCoDriver: Large Language Model Empowered Collaborative Driving with Lifelong Learning
by: Hu, Senkang, et al.
Published: (2024)
by: Hu, Senkang, et al.
Published: (2024)
CausalMACE: Causality Empowered Multi-Agents in Minecraft Cooperative Tasks
by: Chai, Qi, et al.
Published: (2025)
by: Chai, Qi, et al.
Published: (2025)
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
by: Wang, Yongyi, et al.
Published: (2025)
by: Wang, Yongyi, et al.
Published: (2025)
Agent^2 RL-Bench: Can LLM Agents Engineer Agentic RL Post-Training?
by: Chen, Wanyi, et al.
Published: (2026)
by: Chen, Wanyi, et al.
Published: (2026)
Toward Temporal Causal Representation Learning with Tensor Decomposition
by: Chen, Jianhong, et al.
Published: (2025)
by: Chen, Jianhong, et al.
Published: (2025)
Why Distillation can Outperform Zero-RL: The Role of Flexible Reasoning
by: Hu, Xiao, et al.
Published: (2025)
by: Hu, Xiao, et al.
Published: (2025)
Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain
by: Panagopoulos, Dimitris, et al.
Published: (2025)
by: Panagopoulos, Dimitris, et al.
Published: (2025)
Owen-Shapley Policy Optimization: A Principled RL Algorithm for Generative Search LLMs
by: Nath, Abhijnan, et al.
Published: (2026)
by: Nath, Abhijnan, et al.
Published: (2026)
PEER: Unified Process-Outcome Reinforcement Learning for Structured Empathetic Reasoning
by: Wang, Yunxiao, et al.
Published: (2025)
by: Wang, Yunxiao, et al.
Published: (2025)
Similar Items
-
Causal Information Prioritization for Efficient Reinforcement Learning
by: Cao, Hongye, et al.
Published: (2025) -
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
by: Cao, Hongye, et al.
Published: (2025) -
Efficient Reinforcement Learning with Semantic and Token Entropy for LLM Reasoning
by: Cao, Hongye, et al.
Published: (2025) -
SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
by: Cao, Hongye, et al.
Published: (2025) -
Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
by: Gan, Siyuan, et al.
Published: (2026)