Vidarc: Embodied Video Diffusion Model for Closed-loop Control
Fuente:
arXiv
Guardado en:
| Autores principales: | Feng, Yao, Xiang, Chendong, Mao, Xinyi, Tan, Hengkai, Zhang, Zuyue, Huang, Shuhe, Zheng, Kaiwen, Liu, Haitian, Su, Hang, Zhu, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
por: Feng, Yao, et al.
Publicado: (2025)
por: Feng, Yao, et al.
Publicado: (2025)
AnyPos: Automated Task-Agnostic Actions for Bimanual Manipulation
por: Tan, Hengkai, et al.
Publicado: (2025)
por: Tan, Hengkai, et al.
Publicado: (2025)
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning
por: Tan, Hengkai, et al.
Publicado: (2024)
por: Tan, Hengkai, et al.
Publicado: (2024)
ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations
por: Tan, Hengkai, et al.
Publicado: (2024)
por: Tan, Hengkai, et al.
Publicado: (2024)
Motus: A Unified Latent Action World Model
por: Bi, Hongzhe, et al.
Publicado: (2025)
por: Bi, Hongzhe, et al.
Publicado: (2025)
MotuBrain: An Advanced World Action Model for Robot Control
por: MotuBrain Team, et al.
Publicado: (2026)
por: MotuBrain Team, et al.
Publicado: (2026)
H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation
por: Bi, Hongzhe, et al.
Publicado: (2025)
por: Bi, Hongzhe, et al.
Publicado: (2025)
RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation
por: Liu, Songming, et al.
Publicado: (2024)
por: Liu, Songming, et al.
Publicado: (2024)
Embodied Long Horizon Manipulation with Closed-loop Code Generation and Incremental Few-shot Adaptation
por: Meng, Yuan, et al.
Publicado: (2025)
por: Meng, Yuan, et al.
Publicado: (2025)
RDT2: Exploring the Scaling Limit of UMI Data Towards Zero-Shot Cross-Embodiment Generalization
por: Liu, Songming, et al.
Publicado: (2026)
por: Liu, Songming, et al.
Publicado: (2026)
Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model
por: Zhao, Min, et al.
Publicado: (2024)
por: Zhao, Min, et al.
Publicado: (2024)
Rethinking Closed-loop Planning Framework for Imitation-based Model Integrating Prediction and Planning
por: Guo, Jiayu, et al.
Publicado: (2024)
por: Guo, Jiayu, et al.
Publicado: (2024)
GE-Sim 2.0: A Roadmap Towards Comprehensive Closed-loop Video World Simulators for Robotic Manipulation
por: Qiu, Boxiang, et al.
Publicado: (2026)
por: Qiu, Boxiang, et al.
Publicado: (2026)
FreqCache: Accelerating Embodied VLN Models with Adaptive Frequency-Guided Token Caching
por: Zheng, Zihao, et al.
Publicado: (2026)
por: Zheng, Zihao, et al.
Publicado: (2026)
Evaluating Uncertainty-based Failure Detection for Closed-Loop LLM Planners
por: Zheng, Zhi, et al.
Publicado: (2024)
por: Zheng, Zhi, et al.
Publicado: (2024)
Causal Composition Diffusion Model for Closed-loop Traffic Generation
por: Lin, Haohong, et al.
Publicado: (2024)
por: Lin, Haohong, et al.
Publicado: (2024)
Closed-loop Control of Steerable Balloon Endoscopes for Robot-assisted Transcatheter Intracardiac Procedures
por: McCandless, Max, et al.
Publicado: (2025)
por: McCandless, Max, et al.
Publicado: (2025)
Theoretical Closed-loop Stability Bounds for Dynamical System Coupled with Diffusion Policies
por: Lauzier, Gabriel, et al.
Publicado: (2025)
por: Lauzier, Gabriel, et al.
Publicado: (2025)
Learning Free Terminal Time Optimal Closed-loop Control of Manipulators
por: Hu, Wei, et al.
Publicado: (2023)
por: Hu, Wei, et al.
Publicado: (2023)
Promptable Closed-loop Traffic Simulation
por: Tan, Shuhan, et al.
Publicado: (2024)
por: Tan, Shuhan, et al.
Publicado: (2024)
Analyzing Key Objectives in Human-to-Robot Retargeting for Dexterous Manipulation
por: Xin, Chendong, et al.
Publicado: (2025)
por: Xin, Chendong, et al.
Publicado: (2025)
Towards High-Consistency Embodied World Model with Multi-View Trajectory Videos
por: Su, Taiyi, et al.
Publicado: (2025)
por: Su, Taiyi, et al.
Publicado: (2025)
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
por: Yang, Yuxiao, et al.
Publicado: (2024)
por: Yang, Yuxiao, et al.
Publicado: (2024)
Domain Randomization for Robust, Affordable and Effective Closed-loop Control of Soft Robots
por: Tiboni, Gabriele, et al.
Publicado: (2023)
por: Tiboni, Gabriele, et al.
Publicado: (2023)
Evaluation as Evolution: Transforming Adversarial Diffusion into Closed-Loop Curricula for Autonomous Vehicles
por: Guo, Yicheng, et al.
Publicado: (2026)
por: Guo, Yicheng, et al.
Publicado: (2026)
EHC-MM: Embodied Holistic Control for Mobile Manipulation
por: Wang, Jiawen, et al.
Publicado: (2024)
por: Wang, Jiawen, et al.
Publicado: (2024)
EmbodiedCity: A Benchmark Platform for Embodied Agent in Real-world City Environment
por: Gao, Chen, et al.
Publicado: (2024)
por: Gao, Chen, et al.
Publicado: (2024)
CLEA: Closed-Loop Embodied Agent for Enhancing Task Execution in Dynamic Environments
por: Lei, Mingcong, et al.
Publicado: (2025)
por: Lei, Mingcong, et al.
Publicado: (2025)
Aligning Diffusion Behaviors with Q-functions for Efficient Continuous Control
por: Chen, Huayu, et al.
Publicado: (2024)
por: Chen, Huayu, et al.
Publicado: (2024)
PlanAgent: A Multi-modal Large Language Agent for Closed-loop Vehicle Motion Planning
por: Zheng, Yupeng, et al.
Publicado: (2024)
por: Zheng, Yupeng, et al.
Publicado: (2024)
KERV: Kinematic-Rectified Speculative Decoding for Embodied VLA Models
por: Zheng, Zihao, et al.
Publicado: (2026)
por: Zheng, Zihao, et al.
Publicado: (2026)
Language-Guided Object-Centric Diffusion Policy for Generalizable and Collision-Aware Robotic Manipulation
por: Li, Hang, et al.
Publicado: (2024)
por: Li, Hang, et al.
Publicado: (2024)
EO-1: An Open Unified Embodied Foundation Model for General Robot Control
por: Qu, Delin, et al.
Publicado: (2025)
por: Qu, Delin, et al.
Publicado: (2025)
RealMirror: A Comprehensive, Open-Source Vision-Language-Action Platform for Embodied AI
por: Tai, Cong, et al.
Publicado: (2025)
por: Tai, Cong, et al.
Publicado: (2025)
PCASim: Promptable Closed-loop Adversarial Simulation for Urban Traffic Environment
por: Zhang, Chuancheng, et al.
Publicado: (2026)
por: Zhang, Chuancheng, et al.
Publicado: (2026)
$\mathcal{P}^3$: Toward Versatile Embodied Agents
por: Zhou, Shengli, et al.
Publicado: (2025)
por: Zhou, Shengli, et al.
Publicado: (2025)
Coherence-Driven Multimodal Safety Dialogue with Active Learning for Embodied Agents
por: Hassan, Sabit, et al.
Publicado: (2024)
por: Hassan, Sabit, et al.
Publicado: (2024)
Closed-loop Multi-step Planning
por: Lafratta, Giulia, et al.
Publicado: (2024)
por: Lafratta, Giulia, et al.
Publicado: (2024)
A Survey: Learning Embodied Intelligence from Physical Simulators and World Models
por: Long, Xiaoxiao, et al.
Publicado: (2025)
por: Long, Xiaoxiao, et al.
Publicado: (2025)
VAG: Dual-Stream Video-Action Generation for Embodied Data Synthesis
por: Lang, Xiaolei, et al.
Publicado: (2026)
por: Lang, Xiaolei, et al.
Publicado: (2026)
Ejemplares similares
-
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
por: Feng, Yao, et al.
Publicado: (2025) -
AnyPos: Automated Task-Agnostic Actions for Bimanual Manipulation
por: Tan, Hengkai, et al.
Publicado: (2025) -
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning
por: Tan, Hengkai, et al.
Publicado: (2024) -
ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations
por: Tan, Hengkai, et al.
Publicado: (2024) -
Motus: A Unified Latent Action World Model
por: Bi, Hongzhe, et al.
Publicado: (2025)