Guardado en:
| Autores principales: | Ma, Yecheng Jason, Liang, William, Wang, Guanzhi, Huang, De-An, Bastani, Osbert, Jayaraman, Dinesh, Zhu, Yuke, Fan, Linxi, Anandkumar, Anima |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2310.12931 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DrEureka: Language Model Guided Sim-To-Real Transfer
por: Ma, Yecheng Jason, et al.
Publicado: (2024)
por: Ma, Yecheng Jason, et al.
Publicado: (2024)
Eurekaverse: Environment Curriculum Generation via Large Language Models
por: Liang, William, et al.
Publicado: (2024)
por: Liang, William, et al.
Publicado: (2024)
Tether: Autonomous Functional Play with Correspondence-Driven Trajectory Warping
por: Liang, William, et al.
Publicado: (2026)
por: Liang, William, et al.
Publicado: (2026)
ARDuP: Active Region Video Diffusion for Universal Policies
por: Huang, Shuaiyi, et al.
Publicado: (2024)
por: Huang, Shuaiyi, et al.
Publicado: (2024)
Composing Pre-Trained Object-Centric Representations for Robotics From "What" and "Where" Foundation Models
por: Shi, Junyao, et al.
Publicado: (2024)
por: Shi, Junyao, et al.
Publicado: (2024)
Vision Language Models are In-Context Value Learners
por: Ma, Yecheng Jason, et al.
Publicado: (2024)
por: Ma, Yecheng Jason, et al.
Publicado: (2024)
TimeRewarder: Learning Dense Reward from Passive Videos via Frame-wise Temporal Distance
por: Liu, Yuyang, et al.
Publicado: (2025)
por: Liu, Yuyang, et al.
Publicado: (2025)
CaP-X: A Framework for Benchmarking and Improving Coding Agents for Robot Manipulation
por: Fu, Max, et al.
Publicado: (2026)
por: Fu, Max, et al.
Publicado: (2026)
SCIZOR: A Self-Supervised Approach to Data Curation for Large-Scale Imitation Learning
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
Leveling the Playing Field: Carefully Comparing Classical and Learned Controllers for Quadrotor Trajectory Tracking
por: Kunapuli, Pratik, et al.
Publicado: (2025)
por: Kunapuli, Pratik, et al.
Publicado: (2025)
Rethinking Algorithmic Fairness for Human-AI Collaboration
por: Ge, Haosen, et al.
Publicado: (2023)
por: Ge, Haosen, et al.
Publicado: (2023)
RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action Models
por: Sridhar, Kaustubh, et al.
Publicado: (2025)
por: Sridhar, Kaustubh, et al.
Publicado: (2025)
Asymptotic Normality of Generalized Low-Rank Matrix Sensing via Riemannian Geometry
por: Bastani, Osbert
Publicado: (2024)
por: Bastani, Osbert
Publicado: (2024)
Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on Humanoids
por: Lin, Toru, et al.
Publicado: (2025)
por: Lin, Toru, et al.
Publicado: (2025)
Improving Human Sequential Decision-Making with Reinforcement Learning
por: Bastani, Hamsa, et al.
Publicado: (2021)
por: Bastani, Hamsa, et al.
Publicado: (2021)
Recasting Generic Pretrained Vision Transformers As Object-Centric Scene Encoders For Manipulation Policies
por: Qian, Jianing, et al.
Publicado: (2024)
por: Qian, Jianing, et al.
Publicado: (2024)
Can Transformers Capture Spatial Relations between Objects?
por: Wen, Chuan, et al.
Publicado: (2024)
por: Wen, Chuan, et al.
Publicado: (2024)
Dynamic Grasping with a Learned Meta-Controller
por: Jia, Yinsen, et al.
Publicado: (2023)
por: Jia, Yinsen, et al.
Publicado: (2023)
Task-Oriented Hierarchical Object Decomposition for Visuomotor Control
por: Qian, Jianing, et al.
Publicado: (2024)
por: Qian, Jianing, et al.
Publicado: (2024)
Prismer: A Vision-Language Model with Multi-Task Experts
por: Liu, Shikun, et al.
Publicado: (2023)
por: Liu, Shikun, et al.
Publicado: (2023)
On-Robot Reinforcement Learning with Goal-Contrastive Rewards
por: Biza, Ondrej, et al.
Publicado: (2024)
por: Biza, Ondrej, et al.
Publicado: (2024)
EgoScale: Scaling Dexterous Manipulation with Diverse Egocentric Human Data
por: Zheng, Ruijie, et al.
Publicado: (2026)
por: Zheng, Ruijie, et al.
Publicado: (2026)
Privileged Sensing Scaffolds Reinforcement Learning
por: Hu, Edward S., et al.
Publicado: (2024)
por: Hu, Edward S., et al.
Publicado: (2024)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
por: Ge, Haosen, et al.
Publicado: (2024)
por: Ge, Haosen, et al.
Publicado: (2024)
Are AI Capabilities Increasing Exponentially? A Competing Hypothesis
por: Ge, Haosen, et al.
Publicado: (2026)
por: Ge, Haosen, et al.
Publicado: (2026)
DexUMI: Using Human Hand as the Universal Manipulation Interface for Dexterous Manipulation
por: Xu, Mengda, et al.
Publicado: (2025)
por: Xu, Mengda, et al.
Publicado: (2025)
EvoNav: Evolutionary Reward Function Design for Robot Navigation with Large Language Models
por: Zhao, Zhikai, et al.
Publicado: (2026)
por: Zhao, Zhikai, et al.
Publicado: (2026)
ZeroMimic: Distilling Robotic Manipulation Skills from Web Videos
por: Shi, Junyao, et al.
Publicado: (2025)
por: Shi, Junyao, et al.
Publicado: (2025)
HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation
por: Seneviratne, Gershom, et al.
Publicado: (2025)
por: Seneviratne, Gershom, et al.
Publicado: (2025)
FLARE: Robot Learning with Implicit World Modeling
por: Zheng, Ruijie, et al.
Publicado: (2025)
por: Zheng, Ruijie, et al.
Publicado: (2025)
DexMimicGen: Automated Data Generation for Bimanual Dexterous Manipulation via Imitation Learning
por: Jiang, Zhenyu, et al.
Publicado: (2024)
por: Jiang, Zhenyu, et al.
Publicado: (2024)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
por: Song, Peiyang, et al.
Publicado: (2024)
por: Song, Peiyang, et al.
Publicado: (2024)
VLMgineer: Vision Language Models as Robotic Toolsmiths
por: Gao, George Jiayuan, et al.
Publicado: (2025)
por: Gao, George Jiayuan, et al.
Publicado: (2025)
Memory-Consistent Neural Networks for Imitation Learning
por: Sridhar, Kaustubh, et al.
Publicado: (2023)
por: Sridhar, Kaustubh, et al.
Publicado: (2023)
Leveraging Symmetry to Accelerate Learning of Trajectory Tracking Controllers for Free-Flying Robotic Systems
por: Welde, Jake, et al.
Publicado: (2024)
por: Welde, Jake, et al.
Publicado: (2024)
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
por: Chakraborty, Souradip, et al.
Publicado: (2023)
por: Chakraborty, Souradip, et al.
Publicado: (2023)
HumanoidMimicGen: Data Generation for Loco-Manipulation via Whole-Body Planning
por: Lin, Kevin, et al.
Publicado: (2026)
por: Lin, Kevin, et al.
Publicado: (2026)
Neural-Fly Enables Rapid Learning for Agile Flight in Strong Winds
por: O'Connell, Michael, et al.
Publicado: (2022)
por: O'Connell, Michael, et al.
Publicado: (2022)
Self-Improving Vision-Language-Action Models with Data Generation via Residual RL
por: Xiao, Wenli, et al.
Publicado: (2025)
por: Xiao, Wenli, et al.
Publicado: (2025)
Beating the Winner's Curse via Inference-Aware Policy Optimization
por: Bastani, Hamsa, et al.
Publicado: (2025)
por: Bastani, Hamsa, et al.
Publicado: (2025)
Ejemplares similares
-
DrEureka: Language Model Guided Sim-To-Real Transfer
por: Ma, Yecheng Jason, et al.
Publicado: (2024) -
Eurekaverse: Environment Curriculum Generation via Large Language Models
por: Liang, William, et al.
Publicado: (2024) -
Tether: Autonomous Functional Play with Correspondence-Driven Trajectory Warping
por: Liang, William, et al.
Publicado: (2026) -
ARDuP: Active Region Video Diffusion for Universal Policies
por: Huang, Shuaiyi, et al.
Publicado: (2024) -
Composing Pre-Trained Object-Centric Representations for Robotics From "What" and "Where" Foundation Models
por: Shi, Junyao, et al.
Publicado: (2024)