Salvato in:
| Autori principali: | Cen, Zhepeng, Yao, Yihang, Han, William, Liu, Zuxin, Zhao, Ding |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2505.18917 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2023)
di: Yao, Yihang, et al.
Pubblicazione: (2023)
Learning from Sparse Offline Datasets via Conservative Density Estimation
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
di: Cen, Zhepeng, et al.
Pubblicazione: (2024)
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
di: Yao, Yihang, et al.
Pubblicazione: (2026)
di: Yao, Yihang, et al.
Pubblicazione: (2026)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2023)
di: Lin, Haohong, et al.
Pubblicazione: (2023)
TAIL: Task-specific Adapters for Imitation Learning with Large Pretrained Models
di: Liu, Zuxin, et al.
Pubblicazione: (2023)
di: Liu, Zuxin, et al.
Pubblicazione: (2023)
OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2024)
di: Yao, Yihang, et al.
Pubblicazione: (2024)
On Predictability of Reinforcement Learning Dynamics for Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2025)
di: Cai, Yuchen, et al.
Pubblicazione: (2025)
Signal, Image, or Symbolic: Exploring the Best Input Representation for Electrocardiogram-Language Models Through a Unified Framework
di: Han, William, et al.
Pubblicazione: (2025)
di: Han, William, et al.
Pubblicazione: (2025)
Behavior Preference Regression for Offline Reinforcement Learning
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2025)
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Behavioral Supervisor Tuning
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2024)
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2024)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
di: Zhou, Yang, et al.
Pubblicazione: (2026)
di: Zhou, Yang, et al.
Pubblicazione: (2026)
Stabilizing Reinforcement Learning for Diffusion Language Models
di: Zhong, Jianyuan, et al.
Pubblicazione: (2026)
di: Zhong, Jianyuan, et al.
Pubblicazione: (2026)
Behavior Backdoor for Deep Learning Models
di: Wang, Jiakai, et al.
Pubblicazione: (2024)
di: Wang, Jiakai, et al.
Pubblicazione: (2024)
POLO: Preference-Guided Multi-Turn Reinforcement Learning for Lead Optimization
di: Wang, Ziqing, et al.
Pubblicazione: (2025)
di: Wang, Ziqing, et al.
Pubblicazione: (2025)
Learning to Inject: Automated Prompt Injection via Reinforcement Learning
di: Chen, Xin, et al.
Pubblicazione: (2026)
di: Chen, Xin, et al.
Pubblicazione: (2026)
EXTRACT: Efficient Policy Learning by Extracting Transferable Robot Skills from Offline Data
di: Zhang, Jesse, et al.
Pubblicazione: (2024)
di: Zhang, Jesse, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Penalized Action Noise Injection
di: Oh, JunHyeok, et al.
Pubblicazione: (2025)
di: Oh, JunHyeok, et al.
Pubblicazione: (2025)
Replay Failures as Successes: Sample-Efficient Reinforcement Learning for Instruction Following
di: Zhang, Kongcheng, et al.
Pubblicazione: (2025)
di: Zhang, Kongcheng, et al.
Pubblicazione: (2025)
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
Token-Efficient Leverage Learning in Large Language Models
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
di: Lin, Haohong, et al.
Pubblicazione: (2024)
di: Lin, Haohong, et al.
Pubblicazione: (2024)
Discovery of False Data Injection Schemes on Frequency Controllers with Reinforcement Learning
di: Prasad, Romesh, et al.
Pubblicazione: (2024)
di: Prasad, Romesh, et al.
Pubblicazione: (2024)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2023)
di: Yang, Tong, et al.
Pubblicazione: (2023)
Fast and Distributed Equivariant Graph Neural Networks by Virtual Node Learning
di: Zhang, Yuelin, et al.
Pubblicazione: (2025)
di: Zhang, Yuelin, et al.
Pubblicazione: (2025)
From Observations to Events: Event-Aware World Model for Reinforcement Learning
di: Peng, Zhao-Han, et al.
Pubblicazione: (2026)
di: Peng, Zhao-Han, et al.
Pubblicazione: (2026)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
di: Liu, Shirong, et al.
Pubblicazione: (2024)
di: Liu, Shirong, et al.
Pubblicazione: (2024)
GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models
di: Tang, Xiaohang, et al.
Pubblicazione: (2026)
di: Tang, Xiaohang, et al.
Pubblicazione: (2026)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
di: Qian, Fuyuan, et al.
Pubblicazione: (2026)
Echo-LoRA: Parameter-Efficient Fine-Tuning via Cross-Layer Representation Injection
di: Peng, Yihang, et al.
Pubblicazione: (2026)
di: Peng, Yihang, et al.
Pubblicazione: (2026)
Preparing Lessons for Progressive Training on Language Models
di: Pan, Yu, et al.
Pubblicazione: (2024)
di: Pan, Yu, et al.
Pubblicazione: (2024)
Behavior-Consistent Deep Reinforcement Learning
di: Hussing, Marcel, et al.
Pubblicazione: (2026)
di: Hussing, Marcel, et al.
Pubblicazione: (2026)
Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
Large Language-Geometry Model: When LLM meets Equivariance
di: Li, Zongzhao, et al.
Pubblicazione: (2025)
di: Li, Zongzhao, et al.
Pubblicazione: (2025)
Mitigating LLM Hallucination via Behaviorally Calibrated Reinforcement Learning
di: Wu, Jiayun, et al.
Pubblicazione: (2025)
di: Wu, Jiayun, et al.
Pubblicazione: (2025)
UniRL-Zero: Reinforcement Learning on Unified Models with Joint Language Model and Diffusion Model Experts
di: Wang, Fu-Yun, et al.
Pubblicazione: (2025)
di: Wang, Fu-Yun, et al.
Pubblicazione: (2025)
CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
Continual Adversarial Reinforcement Learning (CARL) of False Data Injection detection: forgetting and explainability
di: Aslami, Pooja, et al.
Pubblicazione: (2024)
di: Aslami, Pooja, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2023) -
Learning from Sparse Offline Datasets via Conservative Density Estimation
di: Cen, Zhepeng, et al.
Pubblicazione: (2024) -
Feasibility Consistent Representation Learning for Safe Reinforcement Learning
di: Cen, Zhepeng, et al.
Pubblicazione: (2024) -
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
di: Yao, Yihang, et al.
Pubblicazione: (2026) -
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2023)