Enregistré dans:
| Auteurs principaux: | Li, Hang, Shen, Fengyi, Chen, Dong, Yang, Liudi, Wang, Xudong, Shi, Jinkui, Bing, Zhenshan, Liu, Ziyuan, Knoll, Alois |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.12942 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DualGazeNet: A Biologically Inspired Dual-Gaze Query Network for Salient Object Detection
par: Zhang, Yu, et autres
Publié: (2025)
par: Zhang, Yu, et autres
Publié: (2025)
ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation
par: Dong, Chengyu, et autres
Publié: (2025)
par: Dong, Chengyu, et autres
Publié: (2025)
Intelligent Transportation Systems Using External Infrastructure: A Literature Survey
par: Creß, Christian, et autres
Publié: (2021)
par: Creß, Christian, et autres
Publié: (2021)
CoVAR: Co-generation of Video and Action for Robotic Manipulation via Multi-Modal Diffusion
par: Yang, Liudi, et autres
Publié: (2025)
par: Yang, Liudi, et autres
Publié: (2025)
CE-NPBG: Connectivity Enhanced Neural Point-Based Graphics for Novel View Synthesis in Autonomous Driving Scenes
par: Altillawi, Mohammad, et autres
Publié: (2025)
par: Altillawi, Mohammad, et autres
Publié: (2025)
ControlUDA: Controllable Diffusion-assisted Unsupervised Domain Adaptation for Cross-Weather Semantic Segmentation
par: Shen, Fengyi, et autres
Publié: (2024)
par: Shen, Fengyi, et autres
Publié: (2024)
VideoWeaver: Multimodal Multi-View Video-to-Video Transfer for Embodied Agents
par: Eskandar, George, et autres
Publié: (2026)
par: Eskandar, George, et autres
Publié: (2026)
Deep Fuzzy Optimization for Batch-Size and Nearest Neighbors in Optimal Robot Motion Planning
par: Zhang, Liding, et autres
Publié: (2025)
par: Zhang, Liding, et autres
Publié: (2025)
Genetic Informed Trees (GIT*): Path Planning via Reinforced Genetic Programming Heuristics
par: Zhang, Liding, et autres
Publié: (2025)
par: Zhang, Liding, et autres
Publié: (2025)
Dreaming the Unseen: World Model-regularized Diffusion Policy for Out-of-Distribution Robustness
par: Hu, Ziou, et autres
Publié: (2026)
par: Hu, Ziou, et autres
Publié: (2026)
Dynamic event‐triggered sliding mode control of networked switched systems with imperfect transmissions
par: Chunlian Wang, et autres
Publié: (2024)
par: Chunlian Wang, et autres
Publié: (2024)
OpenDriveVLA: Towards End-to-end Autonomous Driving with Large Vision Language Action Model
par: Zhou, Xingcheng, et autres
Publié: (2025)
par: Zhou, Xingcheng, et autres
Publié: (2025)
DRAW2ACT: Turning Depth-Encoded Trajectories into Robotic Demonstration Videos
par: Bai, Yang, et autres
Publié: (2025)
par: Bai, Yang, et autres
Publié: (2025)
RoboSwap: A GAN-driven Video Diffusion Framework For Unsupervised Robot Arm Swapping
par: Bai, Yang, et autres
Publié: (2025)
par: Bai, Yang, et autres
Publié: (2025)
Contact Energy Based Hindsight Experience Prioritization
par: Sayar, Erdi, et autres
Publié: (2023)
par: Sayar, Erdi, et autres
Publié: (2023)
Language-Enhanced Mobile Manipulation for Efficient Object Search in Indoor Environments
par: Zhang, Liding, et autres
Publié: (2025)
par: Zhang, Liding, et autres
Publié: (2025)
Optimizing Dynamic Balance in a Rat Robot via the Lateral Flexion of a Soft Actuated Spine
par: Huang, Yuhong, et autres
Publié: (2024)
par: Huang, Yuhong, et autres
Publié: (2024)
Tree-Based Grafting Approach for Bidirectional Motion Planning with Local Subsets Optimization
par: Zhang, Liding, et autres
Publié: (2025)
par: Zhang, Liding, et autres
Publié: (2025)
Growing with Your Embodied Agent: A Human-in-the-Loop Lifelong Code Generation Framework for Long-Horizon Manipulation Skills
par: Meng, Yuan, et autres
Publié: (2025)
par: Meng, Yuan, et autres
Publié: (2025)
RobotDancing: Residual-Action Reinforcement Learning Enables Robust Long-Horizon Humanoid Motion Tracking
par: Sun, Zhenguo, et autres
Publié: (2025)
par: Sun, Zhenguo, et autres
Publié: (2025)
ConfCtrl: Enabling Precise Camera Control in Video Diffusion via Confidence-Aware Interpolation
par: Yang, Liudi, et autres
Publié: (2026)
par: Yang, Liudi, et autres
Publié: (2026)
LEMMo-Plan: LLM-Enhanced Learning from Multi-Modal Demonstration for Planning Sequential Contact-Rich Manipulation Tasks
par: Chen, Kejia, et autres
Publié: (2024)
par: Chen, Kejia, et autres
Publié: (2024)
MMaDA-VLA: Large Diffusion Vision-Language-Action Model with Unified Multi-Modal Instruction and Generation
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
ContactDexNet: Multi-fingered Robotic Hand Grasping in Cluttered Environments through Hand-object Contact Semantic Mapping
par: Zhang, Lei, et autres
Publié: (2024)
par: Zhang, Lei, et autres
Publié: (2024)
Pretrained Bayesian Non-parametric Knowledge Prior in Robotic Long-Horizon Reinforcement Learning
par: Meng, Yuan, et autres
Publié: (2025)
par: Meng, Yuan, et autres
Publié: (2025)
Language-Conditioned Imitation Learning with Base Skill Priors under Unstructured Data
par: Zhou, Hongkuan, et autres
Publié: (2023)
par: Zhou, Hongkuan, et autres
Publié: (2023)
Locomotion Generation for a Rat Robot based on Environmental Changes via Reinforcement Learning
par: Shan, Xinhui, et autres
Publié: (2024)
par: Shan, Xinhui, et autres
Publié: (2024)
Real-Time Adaptive Safety-Critical Control with Gaussian Processes in High-Order Uncertain Models
par: Zhang, Yu, et autres
Publié: (2024)
par: Zhang, Yu, et autres
Publié: (2024)
Real-time Contact State Estimation in Shape Control of Deformable Linear Objects under Small Environmental Constraints
par: Chen, Kejia, et autres
Publié: (2024)
par: Chen, Kejia, et autres
Publié: (2024)
GeoVLA: Empowering 3D Representations in Vision-Language-Action Models
par: Sun, Lin, et autres
Publié: (2025)
par: Sun, Lin, et autres
Publié: (2025)
RoboEnvision: A Long-Horizon Video Generation Model for Multi-Task Robot Manipulation
par: Yang, Liudi, et autres
Publié: (2025)
par: Yang, Liudi, et autres
Publié: (2025)
LoopVLA: Learning Sufficiency in Recurrent Refinement for Vision-Language-Action Models
par: Shen, Boyang, et autres
Publié: (2026)
par: Shen, Boyang, et autres
Publié: (2026)
OmniDexVLG: Learning Dexterous Grasp Generation from Vision Language Model-Guided Grasp Semantics, Taxonomy and Functional Affordance
par: Zhang, Lei, et autres
Publié: (2025)
par: Zhang, Lei, et autres
Publié: (2025)
VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback
par: Bi, Jianxin, et autres
Publié: (2025)
par: Bi, Jianxin, et autres
Publié: (2025)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
FUNCanon: Learning Pose-Aware Action Primitives via Functional Object Canonicalization for Generalizable Robotic Manipulation
par: Xu, Hongli, et autres
Publié: (2025)
par: Xu, Hongli, et autres
Publié: (2025)
GesVLA: Gesture-Aware Vision-Language-Action Model Embedded Representations
par: Guo, Wenxuan, et autres
Publié: (2026)
par: Guo, Wenxuan, et autres
Publié: (2026)
Motion Planning for Robotics: A Review for Sampling-based Planners
par: Zhang, Liding, et autres
Publié: (2024)
par: Zhang, Liding, et autres
Publié: (2024)
Elliptical K-Nearest Neighbors -- Path Optimization via Coulomb's Law and Invalid Vertices in C-space Obstacles
par: Zhang, Liding, et autres
Publié: (2025)
par: Zhang, Liding, et autres
Publié: (2025)
Online Efficient Safety-Critical Control for Mobile Robots in Unknown Dynamic Multi-Obstacle Environments
par: Zhang, Yu, et autres
Publié: (2024)
par: Zhang, Yu, et autres
Publié: (2024)
Documents similaires
-
DualGazeNet: A Biologically Inspired Dual-Gaze Query Network for Salient Object Detection
par: Zhang, Yu, et autres
Publié: (2025) -
ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation
par: Dong, Chengyu, et autres
Publié: (2025) -
Intelligent Transportation Systems Using External Infrastructure: A Literature Survey
par: Creß, Christian, et autres
Publié: (2021) -
CoVAR: Co-generation of Video and Action for Robotic Manipulation via Multi-Modal Diffusion
par: Yang, Liudi, et autres
Publié: (2025) -
CE-NPBG: Connectivity Enhanced Neural Point-Based Graphics for Novel View Synthesis in Autonomous Driving Scenes
par: Altillawi, Mohammad, et autres
Publié: (2025)