LuciBot: Automated Robot Policy Learning from Generated Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Qiu, Xiaowen, Wang, Yian, Cai, Jiting, Chen, Zhehuan, Lin, Chunru, Wang, Tsun-Hsuan, Gan, Chuang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Architect: Generating Vivid and Interactive 3D Scenes with Hierarchical 2D Inpainting
di: Wang, Yian, et al.
Pubblicazione: (2024)
di: Wang, Yian, et al.
Pubblicazione: (2024)
Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling
di: Qiu, Xiaowen, et al.
Pubblicazione: (2025)
di: Qiu, Xiaowen, et al.
Pubblicazione: (2025)
RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation
di: Wang, Yufei, et al.
Pubblicazione: (2023)
di: Wang, Yufei, et al.
Pubblicazione: (2023)
Action Images: End-to-End Policy Learning via Multiview Video Generation
di: Zhen, Haoyu, et al.
Pubblicazione: (2026)
di: Zhen, Haoyu, et al.
Pubblicazione: (2026)
UBSoft: A Simulation Platform for Robotic Skill Learning in Unbounded Soft Environments
di: Lin, Chunru, et al.
Pubblicazione: (2024)
di: Lin, Chunru, et al.
Pubblicazione: (2024)
TopoGaussian: Inferring Internal Topology Structures from Visual Clues
di: Xiong, Xiaoyu, et al.
Pubblicazione: (2025)
di: Xiong, Xiaoyu, et al.
Pubblicazione: (2025)
RobotSmith: Generative Robotic Tool Design for Acquisition of Complex Manipulation Skills
di: Lin, Chunru, et al.
Pubblicazione: (2025)
di: Lin, Chunru, et al.
Pubblicazione: (2025)
VideoLucy: Deep Memory Backtracking for Long Video Understanding
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
Robotic Programmer: Video Instructed Policy Code Generation for Robotic Manipulation
di: Xie, Senwei, et al.
Pubblicazione: (2025)
di: Xie, Senwei, et al.
Pubblicazione: (2025)
ReBot: Scaling Robot Learning with Real-to-Sim-to-Real Robotic Video Synthesis
di: Fang, Yu, et al.
Pubblicazione: (2025)
di: Fang, Yu, et al.
Pubblicazione: (2025)
Video Generation with Predictive Latents
di: Zhao, Yian, et al.
Pubblicazione: (2026)
di: Zhao, Yian, et al.
Pubblicazione: (2026)
MCUNetV2: Memory-Efficient Patch-based Inference for Tiny Deep Learning
di: Lin, Ji, et al.
Pubblicazione: (2021)
di: Lin, Ji, et al.
Pubblicazione: (2021)
Learning Video Generation for Robotic Manipulation with Collaborative Trajectory Control
di: Fu, Xiao, et al.
Pubblicazione: (2025)
di: Fu, Xiao, et al.
Pubblicazione: (2025)
Cross-Age Contrastive Learning for Age-Invariant Face Recognition
di: Wang, Haoyi, et al.
Pubblicazione: (2023)
di: Wang, Haoyi, et al.
Pubblicazione: (2023)
Silver medal Solution for Image Matching Challenge 2024
di: Wang, Yian
Pubblicazione: (2024)
di: Wang, Yian
Pubblicazione: (2024)
From Age Estimation to Age-Invariant Face Recognition: Generalized Age Feature Extraction Using Order-Enhanced Contrastive Learning
di: Wang, Haoyi, et al.
Pubblicazione: (2025)
di: Wang, Haoyi, et al.
Pubblicazione: (2025)
ContPhy: Continuum Physical Concept Learning and Reasoning from Videos
di: Zheng, Zhicheng, et al.
Pubblicazione: (2024)
di: Zheng, Zhicheng, et al.
Pubblicazione: (2024)
MCD-Net: A Lightweight Deep Learning Baseline for Optical-Only Moraine Segmentation
di: Cao, Zhehuan, et al.
Pubblicazione: (2026)
di: Cao, Zhehuan, et al.
Pubblicazione: (2026)
Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations
di: Hu, Yucheng, et al.
Pubblicazione: (2024)
di: Hu, Yucheng, et al.
Pubblicazione: (2024)
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes
di: Liu, Jinxiu, et al.
Pubblicazione: (2024)
di: Liu, Jinxiu, et al.
Pubblicazione: (2024)
Plenoptic Video Generation
di: Fu, Xiao, et al.
Pubblicazione: (2026)
di: Fu, Xiao, et al.
Pubblicazione: (2026)
Probing Multimodal LLMs as World Models for Driving
di: Sreeram, Shiva, et al.
Pubblicazione: (2024)
di: Sreeram, Shiva, et al.
Pubblicazione: (2024)
VCA: Video Curious Agent for Long Video Understanding
di: Yang, Zeyuan, et al.
Pubblicazione: (2024)
di: Yang, Zeyuan, et al.
Pubblicazione: (2024)
SG-Bot: Object Rearrangement via Coarse-to-Fine Robotic Imagination on Scene Graphs
di: Zhai, Guangyao, et al.
Pubblicazione: (2023)
di: Zhai, Guangyao, et al.
Pubblicazione: (2023)
VidBot: Learning Generalizable 3D Actions from In-the-Wild 2D Human Videos for Zero-Shot Robotic Manipulation
di: Chen, Hanzhi, et al.
Pubblicazione: (2025)
di: Chen, Hanzhi, et al.
Pubblicazione: (2025)
STORM: Search-Guided Generative World Models for Robotic Manipulation
di: Lin, Wenjun, et al.
Pubblicazione: (2025)
di: Lin, Wenjun, et al.
Pubblicazione: (2025)
The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative Audio
di: Wang, Renhao, et al.
Pubblicazione: (2025)
di: Wang, Renhao, et al.
Pubblicazione: (2025)
TrackGo: A Flexible and Efficient Method for Controllable Video Generation
di: Zhou, Haitao, et al.
Pubblicazione: (2024)
di: Zhou, Haitao, et al.
Pubblicazione: (2024)
3D-VLA: A 3D Vision-Language-Action Generative World Model
di: Zhen, Haoyu, et al.
Pubblicazione: (2024)
di: Zhen, Haoyu, et al.
Pubblicazione: (2024)
MultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World
di: Hong, Yining, et al.
Pubblicazione: (2024)
di: Hong, Yining, et al.
Pubblicazione: (2024)
EmoVid: A Multimodal Emotion Video Dataset for Emotion-Centric Video Understanding and Generation
di: Qiu, Zongyang, et al.
Pubblicazione: (2025)
di: Qiu, Zongyang, et al.
Pubblicazione: (2025)
TalkCuts: A Large-Scale Dataset for Multi-Shot Human Speech Video Generation
di: Chen, Jiaben, et al.
Pubblicazione: (2025)
di: Chen, Jiaben, et al.
Pubblicazione: (2025)
Revisit Event Generation Model: Self-Supervised Learning of Event-to-Video Reconstruction with Implicit Neural Representations
di: Wang, Zipeng, et al.
Pubblicazione: (2024)
di: Wang, Zipeng, et al.
Pubblicazione: (2024)
Virtual Community: An Open World for Humans, Robots, and Society
di: Zhou, Qinhong, et al.
Pubblicazione: (2025)
di: Zhou, Qinhong, et al.
Pubblicazione: (2025)
EfficientViT: Multi-Scale Linear Attention for High-Resolution Dense Prediction
di: Cai, Han, et al.
Pubblicazione: (2022)
di: Cai, Han, et al.
Pubblicazione: (2022)
Take A Step Back: Rethinking the Two Stages in Visual Reasoning
di: Zhang, Mingyu, et al.
Pubblicazione: (2024)
di: Zhang, Mingyu, et al.
Pubblicazione: (2024)
PhysCorr: Dual-Reward DPO for Physics-Constrained Text-to-Video Generation with Automated Preference Selection
di: Wang, Peiyao, et al.
Pubblicazione: (2025)
di: Wang, Peiyao, et al.
Pubblicazione: (2025)
From Generated Human Videos to Physically Plausible Robot Trajectories
di: Ni, James, et al.
Pubblicazione: (2025)
di: Ni, James, et al.
Pubblicazione: (2025)
Generative Region-Language Pretraining for Open-Ended Object Detection
di: Lin, Chuang, et al.
Pubblicazione: (2024)
di: Lin, Chuang, et al.
Pubblicazione: (2024)
Robot Learning from Human Videos: A Survey
di: Ma, Junyi, et al.
Pubblicazione: (2026)
di: Ma, Junyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Architect: Generating Vivid and Interactive 3D Scenes with Hierarchical 2D Inpainting
di: Wang, Yian, et al.
Pubblicazione: (2024) -
Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling
di: Qiu, Xiaowen, et al.
Pubblicazione: (2025) -
RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation
di: Wang, Yufei, et al.
Pubblicazione: (2023) -
Action Images: End-to-End Policy Learning via Multiview Video Generation
di: Zhen, Haoyu, et al.
Pubblicazione: (2026) -
UBSoft: A Simulation Platform for Robotic Skill Learning in Unbounded Soft Environments
di: Lin, Chunru, et al.
Pubblicazione: (2024)