Learning Policy Representations for Steerable Behavior Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Beiming, Rozada, Sergio, Ribeiro, Alejandro |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Matrix Low-Rank Approximation For Policy Gradient Methods
par: Rozada, Sergio, et autres
Publié: (2024)
par: Rozada, Sergio, et autres
Publié: (2024)
Matrix Low-Rank Trust Region Policy Optimization
par: Rozada, Sergio, et autres
Publié: (2024)
par: Rozada, Sergio, et autres
Publié: (2024)
Tensor Low-rank Approximation of Finite-horizon Value Functions
par: Rozada, Sergio, et autres
Publié: (2024)
par: Rozada, Sergio, et autres
Publié: (2024)
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
par: Rozada, Sergio, et autres
Publié: (2022)
par: Rozada, Sergio, et autres
Publié: (2022)
Few-shot Steerable Alignment: Adapting Rewards and LLM Policies with Neural Processes
par: Kobalczyk, Katarzyna, et autres
Publié: (2024)
par: Kobalczyk, Katarzyna, et autres
Publié: (2024)
Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordination
par: Trivedi, Rakshit, et autres
Publié: (2026)
par: Trivedi, Rakshit, et autres
Publié: (2026)
Clifford-Steerable Convolutional Neural Networks
par: Zhdanov, Maksim, et autres
Publié: (2024)
par: Zhdanov, Maksim, et autres
Publié: (2024)
Conditional Language Policy: A General Framework for Steerable Multi-Objective Finetuning
par: Wang, Kaiwen, et autres
Publié: (2024)
par: Wang, Kaiwen, et autres
Publié: (2024)
Graph-Aware Diffusion for Signal Generation
par: Rozada, Sergio, et autres
Publié: (2025)
par: Rozada, Sergio, et autres
Publié: (2025)
Conditional Clifford-Steerable CNNs with Complete Kernel Basis for PDE Modeling
par: Szarvas, Bálint László, et autres
Publié: (2025)
par: Szarvas, Bálint László, et autres
Publié: (2025)
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
par: Guo, Hanze, et autres
Publié: (2025)
par: Guo, Hanze, et autres
Publié: (2025)
Deep Causal Behavioral Policy Learning: Applications to Healthcare
par: Knecht, Jonas, et autres
Publié: (2025)
par: Knecht, Jonas, et autres
Publié: (2025)
Deterministic Policy Gradient Primal-Dual Methods for Continuous-Space Constrained MDPs
par: Rozada, Sergio, et autres
Publié: (2024)
par: Rozada, Sergio, et autres
Publié: (2024)
Diversifying Policy Behaviors with Extrinsic Behavioral Curiosity
par: Wan, Zhenglin, et autres
Publié: (2024)
par: Wan, Zhenglin, et autres
Publié: (2024)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2025)
par: Gao, Chen-Xiao, et autres
Publié: (2025)
Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning
par: Reizinger, Patrik, et autres
Publié: (2025)
par: Reizinger, Patrik, et autres
Publié: (2025)
Exploration Behavior of Untrained Policies
par: Adamczyk, Jacob
Publié: (2025)
par: Adamczyk, Jacob
Publié: (2025)
Fine-tuning Behavioral Cloning Policies with Preference-Based Reinforcement Learning
par: Macuglia, Maël, et autres
Publié: (2025)
par: Macuglia, Maël, et autres
Publié: (2025)
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
par: Jia, Chengxing, et autres
Publié: (2024)
par: Jia, Chengxing, et autres
Publié: (2024)
Curricula for Learning Robust Policies with Factored State Representations in Changing Environments
par: Panayiotou, Panayiotis, et autres
Publié: (2024)
par: Panayiotou, Panayiotis, et autres
Publié: (2024)
Learning to Explore: Policy-Guided Outlier Synthesis for Graph Out-of-Distribution Detection
par: Sun, Li, et autres
Publié: (2026)
par: Sun, Li, et autres
Publié: (2026)
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
par: Lyu, Jiafei, et autres
Publié: (2024)
par: Lyu, Jiafei, et autres
Publié: (2024)
Symmetric Behavior Regularized Policy Optimization
par: Zhu, Lingwei, et autres
Publié: (2025)
par: Zhu, Lingwei, et autres
Publié: (2025)
Temporal Representations for Exploration: Learning Complex Exploratory Behavior without Extrinsic Rewards
par: Mohamed, Faisal, et autres
Publié: (2026)
par: Mohamed, Faisal, et autres
Publié: (2026)
Cross-Lingual Prompt Steerability: Towards Accurate and Robust LLM Behavior across Languages
par: Zhang, Lechen, et autres
Publié: (2025)
par: Zhang, Lechen, et autres
Publié: (2025)
Unsupervised Discovery of Steerable Factors When Graph Deep Generative Models Are Entangled
par: Liu, Shengchao, et autres
Publié: (2024)
par: Liu, Shengchao, et autres
Publié: (2024)
Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning
par: Qian, Fuyuan, et autres
Publié: (2026)
par: Qian, Fuyuan, et autres
Publié: (2026)
Two-Stage Representation Learning for Analyzing Movement Behavior Dynamics in People Living with Dementia
par: Cui, Jin, et autres
Publié: (2025)
par: Cui, Jin, et autres
Publié: (2025)
Trust-Region Behavior Blending for On-Policy Distillation
par: Plyusov, Daniil, et autres
Publié: (2026)
par: Plyusov, Daniil, et autres
Publié: (2026)
Policy Optimization for Personalized Interventions in Behavioral Health
par: Baek, Jackie, et autres
Publié: (2023)
par: Baek, Jackie, et autres
Publié: (2023)
VAMOS: A Hierarchical Vision-Language-Action Model for Capability-Modulated and Steerable Navigation
par: Castro, Mateo Guaman, et autres
Publié: (2025)
par: Castro, Mateo Guaman, et autres
Publié: (2025)
ACT-JEPA: Novel Joint-Embedding Predictive Architecture for Efficient Policy Representation Learning
par: Vujinovic, Aleksandar, et autres
Publié: (2025)
par: Vujinovic, Aleksandar, et autres
Publié: (2025)
Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching
par: Fraschini, Andrea, et autres
Publié: (2026)
par: Fraschini, Andrea, et autres
Publié: (2026)
Discovering Behavioral Modes in Deep Reinforcement Learning Policies Using Trajectory Clustering in Latent Space
par: Remman, Sindre Benjamin, et autres
Publié: (2024)
par: Remman, Sindre Benjamin, et autres
Publié: (2024)
Foundation Policies with Hilbert Representations
par: Park, Seohong, et autres
Publié: (2024)
par: Park, Seohong, et autres
Publié: (2024)
Pragmatic Policy Development via Interpretable Behavior Cloning
par: Matsson, Anton, et autres
Publié: (2025)
par: Matsson, Anton, et autres
Publié: (2025)
From Parameters to Behaviors: Unsupervised Compression of the Policy Space
par: Tenedini, Davide, et autres
Publié: (2025)
par: Tenedini, Davide, et autres
Publié: (2025)
LInK: Learning Joint Representations of Design and Performance Spaces through Contrastive Learning for Mechanism Synthesis
par: Nobari, Amin Heyrani, et autres
Publié: (2024)
par: Nobari, Amin Heyrani, et autres
Publié: (2024)
BIRD: Behavior Induction via Representation-structure Distillation
par: Pogoncheff, Galen, et autres
Publié: (2025)
par: Pogoncheff, Galen, et autres
Publié: (2025)
Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning
par: Lawson, Daniel, et autres
Publié: (2025)
par: Lawson, Daniel, et autres
Publié: (2025)
Documents similaires
-
Matrix Low-Rank Approximation For Policy Gradient Methods
par: Rozada, Sergio, et autres
Publié: (2024) -
Matrix Low-Rank Trust Region Policy Optimization
par: Rozada, Sergio, et autres
Publié: (2024) -
Tensor Low-rank Approximation of Finite-horizon Value Functions
par: Rozada, Sergio, et autres
Publié: (2024) -
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
par: Rozada, Sergio, et autres
Publié: (2022) -
Few-shot Steerable Alignment: Adapting Rewards and LLM Policies with Neural Processes
par: Kobalczyk, Katarzyna, et autres
Publié: (2024)