DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jin, Yang, Lv, Jun, Jiang, Shuqiang, Lu, Cewu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiffPhysCam: Differentiable Physics-Based Camera Simulation for Inverse Rendering and Embodied AI
par: Chen, Bo-Hsun, et autres
Publié: (2025)
par: Chen, Bo-Hsun, et autres
Publié: (2025)
Differentiable Robot Rendering
par: Liu, Ruoshi, et autres
Publié: (2024)
par: Liu, Ruoshi, et autres
Publié: (2024)
Prof. Robot: Differentiable Robot Rendering Without Static and Self-Collisions
par: Ruan, Quanyuan, et autres
Publié: (2025)
par: Ruan, Quanyuan, et autres
Publié: (2025)
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
par: Liu, Kangcheng, et autres
Publié: (2023)
par: Liu, Kangcheng, et autres
Publié: (2023)
DiffCloud: Real-to-Sim from Point Clouds with Differentiable Simulation and Rendering of Deformable Objects
par: Sundaresan, Priya, et autres
Publié: (2022)
par: Sundaresan, Priya, et autres
Publié: (2022)
One-Shot Real-to-Sim via End-to-End Differentiable Simulation and Rendering
par: Zhu, Yifan, et autres
Publié: (2024)
par: Zhu, Yifan, et autres
Publié: (2024)
Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
GenH2R: Learning Generalizable Human-to-Robot Handover via Scalable Simulation, Demonstration, and Imitation
par: Wang, Zifan, et autres
Publié: (2024)
par: Wang, Zifan, et autres
Publié: (2024)
SKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
GenSim: Generating Robotic Simulation Tasks via Large Language Models
par: Wang, Lirui, et autres
Publié: (2023)
par: Wang, Lirui, et autres
Publié: (2023)
Visual-RRT: Finding Paths toward Visual-Goals via Differentiable Rendering
par: Lee, Sebin, et autres
Publié: (2026)
par: Lee, Sebin, et autres
Publié: (2026)
Lookahead Exploration with Neural Radiance Representation for Continuous Vision-Language Navigation
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
DiffPixelFormer: Differential Pixel-Aware Transformer for RGB-D Indoor Scene Segmentation
par: Gong, Yan, et autres
Publié: (2025)
par: Gong, Yan, et autres
Publié: (2025)
LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment
par: Xu, Yifu, et autres
Publié: (2026)
par: Xu, Yifu, et autres
Publié: (2026)
Digital Gene: Learning about the Physical World through Analytic Concepts
par: Sun, Jianhua, et autres
Publié: (2025)
par: Sun, Jianhua, et autres
Publié: (2025)
DiffPrompter: Differentiable Implicit Visual Prompts for Semantic-Segmentation in Adverse Conditions
par: Kalwar, Sanket, et autres
Publié: (2023)
par: Kalwar, Sanket, et autres
Publié: (2023)
RealD$^2$iff: Bridging Real-World Gap in Robot Manipulation via Depth Diffusion
par: Liang, Xiujian, et autres
Publié: (2025)
par: Liang, Xiujian, et autres
Publié: (2025)
Physically Ground Commonsense Knowledge for Articulated Object Manipulation with Analytic Concepts
par: Wei, Jiude, et autres
Publié: (2025)
par: Wei, Jiude, et autres
Publié: (2025)
See What Matters: Differentiable Grid Sample Pruning for Generalizable Vision-Language-Action Model
par: Feng, Yixu, et autres
Publié: (2026)
par: Feng, Yixu, et autres
Publié: (2026)
Unreal Robotics Lab: A High-Fidelity Robotics Simulator with Advanced Physics and Rendering
par: Embley-Riches, Jonathan, et autres
Publié: (2025)
par: Embley-Riches, Jonathan, et autres
Publié: (2025)
DOT-Sim: Differentiable Optical Tactile Simulation with Precise Real-to-Sim Physical Calibration
par: You, Yang, et autres
Publié: (2026)
par: You, Yang, et autres
Publié: (2026)
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
par: Mitra, Chancharik, et autres
Publié: (2025)
par: Mitra, Chancharik, et autres
Publié: (2025)
VLS: Steering Pretrained Robot Policies via Vision-Language Models
par: Liu, Shuo, et autres
Publié: (2026)
par: Liu, Shuo, et autres
Publié: (2026)
Robotic Manipulation by Imitating Generated Videos Without Physical Demonstrations
par: Patel, Shivansh, et autres
Publié: (2025)
par: Patel, Shivansh, et autres
Publié: (2025)
RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents
par: Chen, Zeren, et autres
Publié: (2024)
par: Chen, Zeren, et autres
Publié: (2024)
Taccel: Scaling Up Vision-based Tactile Robotics via High-performance GPU Simulation
par: Li, Yuyang, et autres
Publié: (2025)
par: Li, Yuyang, et autres
Publié: (2025)
DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving
par: Jiang, Anqing, et autres
Publié: (2025)
par: Jiang, Anqing, et autres
Publié: (2025)
Physically Grounded Vision-Language Models for Robotic Manipulation
par: Gao, Jensen, et autres
Publié: (2023)
par: Gao, Jensen, et autres
Publié: (2023)
Reduced-order Neural Modeling with Differentiable Simulation for High-Detail Tactile Perception
par: Guo, Yuhu, et autres
Publié: (2026)
par: Guo, Yuhu, et autres
Publié: (2026)
LaMP: Learning Vision-Language-Action Policies with 3D Scene Flow as Latent Motion Prior
par: Wang, Xinkai, et autres
Publié: (2026)
par: Wang, Xinkai, et autres
Publié: (2026)
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
par: Ding, Pengxiang, et autres
Publié: (2023)
par: Ding, Pengxiang, et autres
Publié: (2023)
U-ViLAR: Uncertainty-Aware Visual Localization for Autonomous Driving via Differentiable Association and Registration
par: Li, Xiaofan, et autres
Publié: (2025)
par: Li, Xiaofan, et autres
Publié: (2025)
Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision
par: Han, Xiaofeng, et autres
Publié: (2025)
par: Han, Xiaofeng, et autres
Publié: (2025)
RynnVLA-001: Using Human Demonstrations to Improve Robot Manipulation
par: Jiang, Yuming, et autres
Publié: (2025)
par: Jiang, Yuming, et autres
Publié: (2025)
DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control
par: Wen, Junjie, et autres
Publié: (2025)
par: Wen, Junjie, et autres
Publié: (2025)
DiffBMP: Differentiable Rendering with Bitmap Primitives
par: Hong, Seongmin, et autres
Publié: (2026)
par: Hong, Seongmin, et autres
Publié: (2026)
The Better You Learn, The Smarter You Prune: Towards Efficient Vision-language-action Models via Differentiable Token Pruning
par: Jiang, Titong, et autres
Publié: (2025)
par: Jiang, Titong, et autres
Publié: (2025)
ManiPose: A Comprehensive Benchmark for Pose-aware Object Manipulation in Robotics
par: Yu, Qiaojun, et autres
Publié: (2024)
par: Yu, Qiaojun, et autres
Publié: (2024)
NaVILA: Legged Robot Vision-Language-Action Model for Navigation
par: Cheng, An-Chieh, et autres
Publié: (2024)
par: Cheng, An-Chieh, et autres
Publié: (2024)
RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation
par: Wang, Yufei, et autres
Publié: (2023)
par: Wang, Yufei, et autres
Publié: (2023)
Documents similaires
-
DiffPhysCam: Differentiable Physics-Based Camera Simulation for Inverse Rendering and Embodied AI
par: Chen, Bo-Hsun, et autres
Publié: (2025) -
Differentiable Robot Rendering
par: Liu, Ruoshi, et autres
Publié: (2024) -
Prof. Robot: Differentiable Robot Rendering Without Static and Self-Collisions
par: Ruan, Quanyuan, et autres
Publié: (2025) -
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
par: Liu, Kangcheng, et autres
Publié: (2023) -
DiffCloud: Real-to-Sim from Point Clouds with Differentiable Simulation and Rendering of Deformable Objects
par: Sundaresan, Priya, et autres
Publié: (2022)