AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cui, Jieming, Liu, Tengyu, Liu, Nian, Yang, Yaodong, Zhu, Yixin, Huang, Siyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GROVE: A Generalized Reward for Learning Open-Vocabulary Physical Skill
par: Cui, Jieming, et autres
Publié: (2025)
par: Cui, Jieming, et autres
Publié: (2025)
Ag2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations
par: Li, Puhao, et autres
Publié: (2024)
par: Li, Puhao, et autres
Publié: (2024)
Grasp Multiple Objects with One Hand
par: Li, Yuyang, et autres
Publié: (2023)
par: Li, Yuyang, et autres
Publié: (2023)
Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation
par: Li, Yuyang, et autres
Publié: (2025)
par: Li, Yuyang, et autres
Publié: (2025)
ModSkill: Physical Character Skill Modularization
par: Huang, Yiming, et autres
Publié: (2025)
par: Huang, Yiming, et autres
Publié: (2025)
ManipTrans: Efficient Dexterous Bimanual Manipulation Transfer via Residual Learning
par: Li, Kailin, et autres
Publié: (2025)
par: Li, Kailin, et autres
Publié: (2025)
Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling
par: Qiu, Xiaowen, et autres
Publié: (2025)
par: Qiu, Xiaowen, et autres
Publié: (2025)
Taccel: Scaling Up Vision-based Tactile Robotics via High-performance GPU Simulation
par: Li, Yuyang, et autres
Publié: (2025)
par: Li, Yuyang, et autres
Publié: (2025)
Affordance Agent Harness: Verification-Gated Skill Orchestration
par: Huang, Haojian, et autres
Publié: (2026)
par: Huang, Haojian, et autres
Publié: (2026)
SkillMimic: Learning Basketball Interaction Skills from Demonstrations
par: Wang, Yinhuai, et autres
Publié: (2024)
par: Wang, Yinhuai, et autres
Publié: (2024)
UniAct: Unified Motion Generation and Action Streaming for Humanoid Robots
par: Jiang, Nan, et autres
Publié: (2025)
par: Jiang, Nan, et autres
Publié: (2025)
Dissecting Embodied Abilities in Multimodal Language Models through Skill-level Evaluation and Diagnosis
par: Qi, Yu, et autres
Publié: (2025)
par: Qi, Yu, et autres
Publié: (2025)
UniPrototype: Humn-Robot Skill Learning with Uniform Prototypes
par: Hu, Xiao, et autres
Publié: (2025)
par: Hu, Xiao, et autres
Publié: (2025)
OpenESS: Event-based Semantic Scene Understanding with Open Vocabularies
par: Kong, Lingdong, et autres
Publié: (2024)
par: Kong, Lingdong, et autres
Publié: (2024)
FindAnything: Open-Vocabulary and Object-Centric Mapping for Robot Exploration in Any Environment
par: Laina, Sebastián Barbas, et autres
Publié: (2025)
par: Laina, Sebastián Barbas, et autres
Publié: (2025)
See and Switch: Vision-Based Branching for Interactive Robot-Skill Programming
par: Vanc, Petr, et autres
Publié: (2026)
par: Vanc, Petr, et autres
Publié: (2026)
UniSkill: Imitating Human Videos via Cross-Embodiment Skill Representations
par: Kim, Hanjung, et autres
Publié: (2025)
par: Kim, Hanjung, et autres
Publié: (2025)
VoxAfford: Multi-Scale Voxel-Token Fusion for Open-Vocabulary 3D Affordance Detection
par: Sun, Haowen, et autres
Publié: (2026)
par: Sun, Haowen, et autres
Publié: (2026)
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
par: Jia, Baoxiong, et autres
Publié: (2024)
par: Jia, Baoxiong, et autres
Publié: (2024)
LangMap: A Human-Verified Benchmark for Hierarchical Open-Vocabulary Goal Navigation
par: Miao, Bo, et autres
Publié: (2026)
par: Miao, Bo, et autres
Publié: (2026)
Leverage Cross-Attention for End-to-End Open-Vocabulary Panoptic Reconstruction
par: Yu, Xuan, et autres
Publié: (2025)
par: Yu, Xuan, et autres
Publié: (2025)
DOZE: A Dataset for Open-Vocabulary Zero-Shot Object Navigation in Dynamic Environments
par: Ma, Ji, et autres
Publié: (2024)
par: Ma, Ji, et autres
Publié: (2024)
UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents
par: Xiao, Jianqiang, et autres
Publié: (2025)
par: Xiao, Jianqiang, et autres
Publié: (2025)
Open-Vocabulary Online Semantic Mapping for SLAM
par: Martins, Tomas Berriel, et autres
Publié: (2024)
par: Martins, Tomas Berriel, et autres
Publié: (2024)
LOVON: Legged Open-Vocabulary Object Navigator
par: Peng, Daojie, et autres
Publié: (2025)
par: Peng, Daojie, et autres
Publié: (2025)
Learning Humanoid End-Effector Control for Open-Vocabulary Visual Loco-Manipulation
par: Dong, Runpei, et autres
Publié: (2026)
par: Dong, Runpei, et autres
Publié: (2026)
LOTUS: Continual Imitation Learning for Robot Manipulation Through Unsupervised Skill Discovery
par: Wan, Weikang, et autres
Publié: (2023)
par: Wan, Weikang, et autres
Publié: (2023)
RoboMatrix: A Skill-centric Hierarchical Framework for Scalable Robot Task Planning and Execution in Open-World
par: Mao, Weixin, et autres
Publié: (2024)
par: Mao, Weixin, et autres
Publié: (2024)
SlotLifter: Slot-guided Feature Lifting for Learning Object-centric Radiance Fields
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
WildOS: Open-Vocabulary Object Search in the Wild
par: Shah, Hardik, et autres
Publié: (2026)
par: Shah, Hardik, et autres
Publié: (2026)
DualMap: Online Open-Vocabulary Semantic Mapping for Natural Language Navigation in Dynamic Changing Scenes
par: Jiang, Jiajun, et autres
Publié: (2025)
par: Jiang, Jiajun, et autres
Publié: (2025)
Any-point Trajectory Modeling for Policy Learning
par: Wen, Chuan, et autres
Publié: (2023)
par: Wen, Chuan, et autres
Publié: (2023)
Enhancing Reusability of Learned Skills for Robot Manipulation via Gaze Information and Motion Bottlenecks
par: Takizawa, Ryo, et autres
Publié: (2025)
par: Takizawa, Ryo, et autres
Publié: (2025)
CMR-Agent: Learning a Cross-Modal Agent for Iterative Image-to-Point Cloud Registration
par: Yao, Gongxin, et autres
Publié: (2024)
par: Yao, Gongxin, et autres
Publié: (2024)
Open3DTrack: Towards Open-Vocabulary 3D Multi-Object Tracking
par: Ishaq, Ayesha, et autres
Publié: (2024)
par: Ishaq, Ayesha, et autres
Publié: (2024)
OpenOcc: Open Vocabulary 3D Scene Reconstruction via Occupancy Representation
par: Jiang, Haochen, et autres
Publié: (2024)
par: Jiang, Haochen, et autres
Publié: (2024)
GEMS: Agent-Native Multimodal Generation with Memory and Skills
par: He, Zefeng, et autres
Publié: (2026)
par: He, Zefeng, et autres
Publié: (2026)
Neural Attention Field: Emerging Point Relevance in 3D Scenes for One-Shot Dexterous Grasping
par: Wang, Qianxu, et autres
Publié: (2024)
par: Wang, Qianxu, et autres
Publié: (2024)
Scaling Up Dynamic Human-Scene Interaction Modeling
par: Jiang, Nan, et autres
Publié: (2024)
par: Jiang, Nan, et autres
Publié: (2024)
AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots
par: Zhang, Likui, et autres
Publié: (2026)
par: Zhang, Likui, et autres
Publié: (2026)
Documents similaires
-
GROVE: A Generalized Reward for Learning Open-Vocabulary Physical Skill
par: Cui, Jieming, et autres
Publié: (2025) -
Ag2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations
par: Li, Puhao, et autres
Publié: (2024) -
Grasp Multiple Objects with One Hand
par: Li, Yuyang, et autres
Publié: (2023) -
Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation
par: Li, Yuyang, et autres
Publié: (2025) -
ModSkill: Physical Character Skill Modularization
par: Huang, Yiming, et autres
Publié: (2025)