Learning a General Model: Folding Clothing with Topological Dynamics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yiming, Han, Lijun, Gu, Enlin, Wang, Hesheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BiFold: Bimanual Cloth Folding with Language Guidance
par: Barbany, Oriol, et autres
Publié: (2025)
par: Barbany, Oriol, et autres
Publié: (2025)
Beyond Static Perception: Integrating Temporal Context into VLMs for Cloth Folding
par: Barbany, Oriol, et autres
Publié: (2025)
par: Barbany, Oriol, et autres
Publié: (2025)
Diffusion Dynamics Models with Generative State Estimation for Cloth Manipulation
par: Tian, Tongxuan, et autres
Publié: (2025)
par: Tian, Tongxuan, et autres
Publié: (2025)
NRGS-SLAM: Monocular Non-Rigid SLAM for Endoscopy via Deformation-Aware 3D Gaussian Splatting
par: Shan, Jiwei, et autres
Publié: (2026)
par: Shan, Jiwei, et autres
Publié: (2026)
PG-SLAM: Photo-realistic and Geometry-aware RGB-D SLAM in Dynamic Environments
par: Li, Haoang, et autres
Publié: (2024)
par: Li, Haoang, et autres
Publié: (2024)
FoldNet: Learning Generalizable Closed-Loop Policy for Garment Folding via Keypoint-Driven Asset and Demonstration Synthesis
par: Chen, Yuxing, et autres
Publié: (2025)
par: Chen, Yuxing, et autres
Publié: (2025)
Cloth-Splatting: 3D Cloth State Estimation from RGB Supervision
par: Longhini, Alberta, et autres
Publié: (2025)
par: Longhini, Alberta, et autres
Publié: (2025)
SemGauss-SLAM: Dense Semantic Gaussian Splatting SLAM
par: Zhu, Siting, et autres
Publié: (2024)
par: Zhu, Siting, et autres
Publié: (2024)
Dream-SLAM: Dreaming the Unseen for Active SLAM in Dynamic Environments
par: Meng, Xiangqi, et autres
Publié: (2026)
par: Meng, Xiangqi, et autres
Publié: (2026)
Robot Learning from Human Videos: A Survey
par: Ma, Junyi, et autres
Publié: (2026)
par: Ma, Junyi, et autres
Publié: (2026)
MUT3R: Motion-aware Updating Transformer for Dynamic 3D Reconstruction
par: Shen, Guole, et autres
Publié: (2025)
par: Shen, Guole, et autres
Publié: (2025)
Incremental Joint Learning of Depth, Pose and Implicit Scene Representation on Monocular Camera in Large-scale Scenes
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
par: Xu, Yunzhe, et autres
Publié: (2024)
par: Xu, Yunzhe, et autres
Publié: (2024)
Mars Traversability Prediction: A Multi-modal Self-supervised Approach for Costmap Generation
par: Xie, Zongwu, et autres
Publié: (2025)
par: Xie, Zongwu, et autres
Publié: (2025)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
par: Wang, Hanqing, et autres
Publié: (2025)
par: Wang, Hanqing, et autres
Publié: (2025)
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
par: Pan, Yiyuan, et autres
Publié: (2024)
par: Pan, Yiyuan, et autres
Publié: (2024)
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation
par: Zhao, Hongxiang, et autres
Publié: (2025)
par: Zhao, Hongxiang, et autres
Publié: (2025)
CloSE: A Geometric Shape-Agnostic Cloth State Representation
par: Kamat, Jay, et autres
Publié: (2025)
par: Kamat, Jay, et autres
Publié: (2025)
NeSLAM: Neural Implicit Mapping and Self-Supervised Feature Tracking With Depth Completion and Denoising
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
End-to-end 2D-3D Registration between Image and LiDAR Point Cloud for Vehicle Localization
par: Wang, Guangming, et autres
Publié: (2023)
par: Wang, Guangming, et autres
Publié: (2023)
Compact 3D Gaussian Splatting For Dense Visual SLAM
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
Asynchronous Large Language Model Enhanced Planner for Autonomous Driving
par: Chen, Yuan, et autres
Publié: (2024)
par: Chen, Yuan, et autres
Publié: (2024)
DDN-SLAM: Real-time Dense Dynamic Neural Implicit SLAM
par: Li, Mingrui, et autres
Publié: (2024)
par: Li, Mingrui, et autres
Publié: (2024)
DSLO: Deep Sequence LiDAR Odometry Based on Inconsistent Spatio-temporal Propagation
par: Zhang, Huixin, et autres
Publié: (2024)
par: Zhang, Huixin, et autres
Publié: (2024)
NeuV-SLAM: Fast Neural Multiresolution Voxel Optimization for RGBD Dense SLAM
par: Guo, Wenzhi, et autres
Publié: (2024)
par: Guo, Wenzhi, et autres
Publié: (2024)
On-Road Object Importance Estimation: A New Dataset and A Model with Multi-Fold Top-Down Guidance
par: Nan, Zhixiong, et autres
Publié: (2024)
par: Nan, Zhixiong, et autres
Publié: (2024)
What Is The Best 3D Scene Representation for Robotics? From Geometric to Foundation Models
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
From Static to Dynamic: a Survey of Topology-Aware Perception in Autonomous Driving
par: Chen, Yixiao, et autres
Publié: (2025)
par: Chen, Yixiao, et autres
Publié: (2025)
NeRFs in Robotics: A Survey
par: Wang, Guangming, et autres
Publié: (2024)
par: Wang, Guangming, et autres
Publié: (2024)
CricaVPR: Cross-image Correlation-aware Representation Learning for Visual Place Recognition
par: Lu, Feng, et autres
Publié: (2024)
par: Lu, Feng, et autres
Publié: (2024)
Uni-Hand: Universal Hand Motion Forecasting in Egocentric Views
par: Ma, Junyi, et autres
Publié: (2025)
par: Ma, Junyi, et autres
Publié: (2025)
ClothPPO: A Proximal Policy Optimization Enhancing Framework for Robotic Cloth Manipulation with Observation-Aligned Action Spaces
par: Yang, Libing, et autres
Publié: (2024)
par: Yang, Libing, et autres
Publié: (2024)
DualMap: Online Open-Vocabulary Semantic Mapping for Natural Language Navigation in Dynamic Changing Scenes
par: Jiang, Jiajun, et autres
Publié: (2025)
par: Jiang, Jiajun, et autres
Publié: (2025)
Benchmarking the Sim-to-Real Gap in Cloth Manipulation
par: Blanco-Mulero, David, et autres
Publié: (2023)
par: Blanco-Mulero, David, et autres
Publié: (2023)
Cross-Sensor Touch Generation
par: Rodriguez, Samanta, et autres
Publié: (2025)
par: Rodriguez, Samanta, et autres
Publié: (2025)
Towards the Vision-Sound-Language-Action Paradigm: The HEAR Framework for Sound-Centric Manipulation
par: Nie, Chang, et autres
Publié: (2026)
par: Nie, Chang, et autres
Publié: (2026)
NaviDiffusor: Cost-Guided Diffusion Model for Visual Navigation
par: Zeng, Yiming, et autres
Publié: (2025)
par: Zeng, Yiming, et autres
Publié: (2025)
AsyncMDE: Real-Time Monocular Depth Estimation via Asynchronous Spatial Memory
par: Ma, Lianjie, et autres
Publié: (2026)
par: Ma, Lianjie, et autres
Publié: (2026)
Multi-Modal UAV Detection, Classification and Tracking Algorithm -- Technical Report for CVPR 2024 UG2 Challenge
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
StructBiHOI: Structured Articulation Modeling for Long--Horizon Bimanual Hand--Object Interaction Generation
par: Wang, Zhi, et autres
Publié: (2026)
par: Wang, Zhi, et autres
Publié: (2026)
Documents similaires
-
BiFold: Bimanual Cloth Folding with Language Guidance
par: Barbany, Oriol, et autres
Publié: (2025) -
Beyond Static Perception: Integrating Temporal Context into VLMs for Cloth Folding
par: Barbany, Oriol, et autres
Publié: (2025) -
Diffusion Dynamics Models with Generative State Estimation for Cloth Manipulation
par: Tian, Tongxuan, et autres
Publié: (2025) -
NRGS-SLAM: Monocular Non-Rigid SLAM for Endoscopy via Deformation-Aware 3D Gaussian Splatting
par: Shan, Jiwei, et autres
Publié: (2026) -
PG-SLAM: Photo-realistic and Geometry-aware RGB-D SLAM in Dynamic Environments
par: Li, Haoang, et autres
Publié: (2024)