Enregistré dans:
| Auteurs principaux: | Scarpellini, Gianluca, Konyushkova, Ksenia, Fantacci, Claudio, Paine, Tom Le, Chen, Yutian, Denil, Misha |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2306.09800 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Vision-Language Model Dialog Games for Self-Improvement
par: Konyushkova, Ksenia, et autres
Publié: (2025)
par: Konyushkova, Ksenia, et autres
Publié: (2025)
Temporal Representation Alignment: Successor Features Enable Emergent Compositionality in Robot Instruction Following
par: Myers, Vivek, et autres
Publié: (2025)
par: Myers, Vivek, et autres
Publié: (2025)
Rapid Object Annotation
par: Denil, Misha
Publié: (2024)
par: Denil, Misha
Publié: (2024)
GATS: Gather-Attend-Scatter
par: Zolna, Konrad, et autres
Publié: (2024)
par: Zolna, Konrad, et autres
Publié: (2024)
Full-Gradient Successor Feature Representations
par: Shrirao, Ritish, et autres
Publié: (2026)
par: Shrirao, Ritish, et autres
Publié: (2026)
Fast Feature Field ($\text{F}^3$): A Predictive Representation of Events
par: Das, Richeek, et autres
Publié: (2025)
par: Das, Richeek, et autres
Publié: (2025)
AirIO: Learning Inertial Odometry with Enhanced IMU Feature Observability
par: Qiu, Yuheng, et autres
Publié: (2025)
par: Qiu, Yuheng, et autres
Publié: (2025)
SPLASH! Sample-efficient Preference-based inverse reinforcement learning for Long-horizon Adversarial tasks from Suboptimal Hierarchical demonstrations
par: Crowley, Peter, et autres
Publié: (2025)
par: Crowley, Peter, et autres
Publié: (2025)
Focusing Robot Open-Ended Reinforcement Learning Through Users' Purposes
par: Cartoni, Emilio, et autres
Publié: (2025)
par: Cartoni, Emilio, et autres
Publié: (2025)
Decoding High-Dimensional Finger Motion from EMG Using Riemannian Features and RNNs
par: Colot, Martin, et autres
Publié: (2026)
par: Colot, Martin, et autres
Publié: (2026)
Foundation Policies with Hilbert Representations
par: Park, Seohong, et autres
Publié: (2024)
par: Park, Seohong, et autres
Publié: (2024)
Learning Safe Autonomous Driving Policies Using Predictive Safety Representations
par: Keswani, Mahesh, et autres
Publié: (2025)
par: Keswani, Mahesh, et autres
Publié: (2025)
Ethics2vec: aligning automatic agents and human preferences
par: Bontempi, Gianluca
Publié: (2025)
par: Bontempi, Gianluca
Publié: (2025)
Language-Conditioned Representations and Mixture-of-Experts Policy for Robust Multi-Task Robotic Manipulation
par: Zhang, Xiucheng, et autres
Publié: (2025)
par: Zhang, Xiucheng, et autres
Publié: (2025)
Distributional Successor Features Enable Zero-Shot Policy Optimization
par: Zhu, Chuning, et autres
Publié: (2024)
par: Zhu, Chuning, et autres
Publié: (2024)
Diffusion Policy through Conditional Proximal Policy Optimization
par: Liu, Ben, et autres
Publié: (2026)
par: Liu, Ben, et autres
Publié: (2026)
Time-Unified Diffusion Policy with Action Discrimination for Robotic Manipulation
par: Niu, Ye, et autres
Publié: (2025)
par: Niu, Ye, et autres
Publié: (2025)
What is the relation between Slow Feature Analysis and the Successor Representation?
par: Seabrook, Eddie, et autres
Publié: (2024)
par: Seabrook, Eddie, et autres
Publié: (2024)
Practice Makes Perfect: Planning to Learn Skill Parameter Policies
par: Kumar, Nishanth, et autres
Publié: (2024)
par: Kumar, Nishanth, et autres
Publié: (2024)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
par: Yang, Shunpeng, et autres
Publié: (2026)
par: Yang, Shunpeng, et autres
Publié: (2026)
Learning Visual Feature-Based World Models via Residual Latent Action
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
DynamicDTA: Drug-Target Binding Affinity Prediction Using Dynamic Descriptors and Graph Representation
par: Luo, Dan, et autres
Publié: (2025)
par: Luo, Dan, et autres
Publié: (2025)
Diffusion Policy Policy Optimization
par: Ren, Allen Z., et autres
Publié: (2024)
par: Ren, Allen Z., et autres
Publié: (2024)
State-wise Constrained Policy Optimization
par: Zhao, Weiye, et autres
Publié: (2023)
par: Zhao, Weiye, et autres
Publié: (2023)
OmniGuide: Universal Guidance Fields for Enhancing Generalist Robot Policies
par: Song, Yunzhou, et autres
Publié: (2026)
par: Song, Yunzhou, et autres
Publié: (2026)
Which Features are Best for Successor Features?
par: Ollivier, Yann
Publié: (2025)
par: Ollivier, Yann
Publié: (2025)
State Chrono Representation for Enhancing Generalization in Reinforcement Learning
par: Chen, Jianda, et autres
Publié: (2024)
par: Chen, Jianda, et autres
Publié: (2024)
Fast Convergence of Softmax Policy Mirror Ascent
par: Asad, Reza, et autres
Publié: (2024)
par: Asad, Reza, et autres
Publié: (2024)
Dichotomous Diffusion Policy Optimization
par: Liang, Ruiming, et autres
Publié: (2025)
par: Liang, Ruiming, et autres
Publié: (2025)
PEEK: Guiding and Minimal Image Representations for Zero-Shot Generalization of Robot Manipulation Policies
par: Zhang, Jesse, et autres
Publié: (2025)
par: Zhang, Jesse, et autres
Publié: (2025)
FDPP: Fine-tune Diffusion Policy with Human Preference
par: Chen, Yuxin, et autres
Publié: (2025)
par: Chen, Yuxin, et autres
Publié: (2025)
Learning Successor Features the Simple Way
par: Chua, Raymond, et autres
Publié: (2024)
par: Chua, Raymond, et autres
Publié: (2024)
RLingua: Improving Reinforcement Learning Sample Efficiency in Robotic Manipulations With Large Language Models
par: Chen, Liangliang, et autres
Publié: (2024)
par: Chen, Liangliang, et autres
Publié: (2024)
Learning Getting-Up Policies for Real-World Humanoid Robots
par: He, Xialin, et autres
Publié: (2025)
par: He, Xialin, et autres
Publié: (2025)
Latent Policy Steering through One-Step Flow Policies
par: Im, Hokyun, et autres
Publié: (2026)
par: Im, Hokyun, et autres
Publié: (2026)
Residual Off-Policy RL for Finetuning Behavior Cloning Policies
par: Ankile, Lars, et autres
Publié: (2025)
par: Ankile, Lars, et autres
Publié: (2025)
Hierarchical Successor Representation for Robust Transfer
par: Yu, Changmin, et autres
Publié: (2026)
par: Yu, Changmin, et autres
Publié: (2026)
RoboPocket: Improve Robot Policies Instantly with Your Phone
par: Fang, Junjie, et autres
Publié: (2026)
par: Fang, Junjie, et autres
Publié: (2026)
A Motivational Architecture for Open-Ended Learning Challenges in Robots
par: Romero, Alejandro, et autres
Publié: (2025)
par: Romero, Alejandro, et autres
Publié: (2025)
Equivariant Diffusion Policy
par: Wang, Dian, et autres
Publié: (2024)
par: Wang, Dian, et autres
Publié: (2024)
Documents similaires
-
Vision-Language Model Dialog Games for Self-Improvement
par: Konyushkova, Ksenia, et autres
Publié: (2025) -
Temporal Representation Alignment: Successor Features Enable Emergent Compositionality in Robot Instruction Following
par: Myers, Vivek, et autres
Publié: (2025) -
Rapid Object Annotation
par: Denil, Misha
Publié: (2024) -
GATS: Gather-Attend-Scatter
par: Zolna, Konrad, et autres
Publié: (2024) -
Full-Gradient Successor Feature Representations
par: Shrirao, Ritish, et autres
Publié: (2026)