Salvato in:
| Autori principali: | Luan, Zhirong, Lai, Yujun, Huang, Rundong, Lan, Xiaruiqi, Chen, Liangjun, Chen, Badong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2402.03699 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hierarchical Large Language Models in Cloud Edge End Architecture for Heterogeneous Robot Cluster Control
di: Luan, Zhirong, et al.
Pubblicazione: (2024)
di: Luan, Zhirong, et al.
Pubblicazione: (2024)
LIT: Large Language Model Driven Intention Tracking for Proactive Human-Robot Collaboration -- A Robot Sous-Chef Application
di: Huang, Zhe, et al.
Pubblicazione: (2024)
di: Huang, Zhe, et al.
Pubblicazione: (2024)
Soft Prompt Generation for Domain Generalization
di: Bai, Shuanghao, et al.
Pubblicazione: (2024)
di: Bai, Shuanghao, et al.
Pubblicazione: (2024)
S3E: A Multi-Robot Multimodal Dataset for Collaborative SLAM
di: Feng, Dapeng, et al.
Pubblicazione: (2022)
di: Feng, Dapeng, et al.
Pubblicazione: (2022)
GAF: Gaussian Action Field as a 4D Representation for Dynamic World Modeling in Robotic Manipulation
di: Chai, Ying, et al.
Pubblicazione: (2025)
di: Chai, Ying, et al.
Pubblicazione: (2025)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
di: Shao, Rui, et al.
Pubblicazione: (2025)
di: Shao, Rui, et al.
Pubblicazione: (2025)
Patch-Based Spatial Authorship Attribution in Human-Robot Collaborative Paintings
di: Chen, Eric, et al.
Pubblicazione: (2026)
di: Chen, Eric, et al.
Pubblicazione: (2026)
Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration
di: Wang, Jun, et al.
Pubblicazione: (2026)
di: Wang, Jun, et al.
Pubblicazione: (2026)
QUART-Online: Latency-Free Large Multimodal Language Model for Quadruped Robot Learning
di: Tong, Xinyang, et al.
Pubblicazione: (2024)
di: Tong, Xinyang, et al.
Pubblicazione: (2024)
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
di: Huang, Haifeng, et al.
Pubblicazione: (2025)
di: Huang, Haifeng, et al.
Pubblicazione: (2025)
Causal World Modeling for Robot Control
di: Li, Lin, et al.
Pubblicazione: (2026)
di: Li, Lin, et al.
Pubblicazione: (2026)
Dual-Path Stable Soft Prompt Generation for Domain Generalization
di: Zhang, Yuedi, et al.
Pubblicazione: (2025)
di: Zhang, Yuedi, et al.
Pubblicazione: (2025)
ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver
di: Song, Wenxuan, et al.
Pubblicazione: (2025)
di: Song, Wenxuan, et al.
Pubblicazione: (2025)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
di: Wang, Hongyu, et al.
Pubblicazione: (2025)
di: Wang, Hongyu, et al.
Pubblicazione: (2025)
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
di: Liu, Kangcheng, et al.
Pubblicazione: (2023)
di: Liu, Kangcheng, et al.
Pubblicazione: (2023)
Swarm-SLAM : Sparse Decentralized Collaborative Simultaneous Localization and Mapping Framework for Multi-Robot Systems
di: Lajoie, Pierre-Yves, et al.
Pubblicazione: (2023)
di: Lajoie, Pierre-Yves, et al.
Pubblicazione: (2023)
Vision-Only Gaussian Splatting for Collaborative Semantic Occupancy Prediction
di: Chen, Cheng, et al.
Pubblicazione: (2025)
di: Chen, Cheng, et al.
Pubblicazione: (2025)
RoboLLM: Robotic Vision Tasks Grounded on Multimodal Large Language Models
di: Long, Zijun, et al.
Pubblicazione: (2023)
di: Long, Zijun, et al.
Pubblicazione: (2023)
HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model
di: Liu, Jiaming, et al.
Pubblicazione: (2025)
di: Liu, Jiaming, et al.
Pubblicazione: (2025)
Prompt-based Distribution Alignment for Unsupervised Domain Adaptation
di: Bai, Shuanghao, et al.
Pubblicazione: (2023)
di: Bai, Shuanghao, et al.
Pubblicazione: (2023)
Collaborative Representation Learning for Alignment of Tactile, Language, and Vision Modalities
di: Zhou, Yiyun, et al.
Pubblicazione: (2025)
di: Zhou, Yiyun, et al.
Pubblicazione: (2025)
Robot Manipulation in Salient Vision through Referring Image Segmentation and Geometric Constraints
di: Jiang, Chen, et al.
Pubblicazione: (2024)
di: Jiang, Chen, et al.
Pubblicazione: (2024)
RoboCerebra: A Large-scale Benchmark for Long-horizon Robotic Manipulation Evaluation
di: Han, Songhao, et al.
Pubblicazione: (2025)
di: Han, Songhao, et al.
Pubblicazione: (2025)
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
di: Ding, Pengxiang, et al.
Pubblicazione: (2023)
di: Ding, Pengxiang, et al.
Pubblicazione: (2023)
Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving
di: Jiang, Bo, et al.
Pubblicazione: (2024)
di: Jiang, Bo, et al.
Pubblicazione: (2024)
Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision
di: Han, Xiaofeng, et al.
Pubblicazione: (2025)
di: Han, Xiaofeng, et al.
Pubblicazione: (2025)
A Survey on Improving Human Robot Collaboration through Vision-and-Language Navigation
di: Yakolli, Nivedan, et al.
Pubblicazione: (2025)
di: Yakolli, Nivedan, et al.
Pubblicazione: (2025)
Multi-Camera Hand-Eye Calibration for Human-Robot Collaboration in Industrial Robotic Workcells
di: Allegro, Davide, et al.
Pubblicazione: (2024)
di: Allegro, Davide, et al.
Pubblicazione: (2024)
Asynchronous Large Language Model Enhanced Planner for Autonomous Driving
di: Chen, Yuan, et al.
Pubblicazione: (2024)
di: Chen, Yuan, et al.
Pubblicazione: (2024)
VERM: Leveraging Foundation Models to Create a Virtual Eye for Efficient 3D Robotic Manipulation
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
PhysPart: Physically Plausible Part Completion for Interactable Objects
di: Luo, Rundong, et al.
Pubblicazione: (2024)
di: Luo, Rundong, et al.
Pubblicazione: (2024)
Vision-Based Safe Human-Robot Collaboration with Uncertainty Guarantees
di: Thumm, Jakob, et al.
Pubblicazione: (2026)
di: Thumm, Jakob, et al.
Pubblicazione: (2026)
Evaluating Pointing Gestures for Target Selection in Human-Robot Collaboration
di: Sassali, Noora, et al.
Pubblicazione: (2025)
di: Sassali, Noora, et al.
Pubblicazione: (2025)
Dissecting Embodied Abilities in Multimodal Language Models through Skill-level Evaluation and Diagnosis
di: Qi, Yu, et al.
Pubblicazione: (2025)
di: Qi, Yu, et al.
Pubblicazione: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
di: Liu, Mengzhen, et al.
Pubblicazione: (2026)
di: Liu, Mengzhen, et al.
Pubblicazione: (2026)
Scaling Cross-Environment Failure Reasoning Data for Vision-Language Robotic Manipulation
di: Pacaud, Paul, et al.
Pubblicazione: (2025)
di: Pacaud, Paul, et al.
Pubblicazione: (2025)
Adapt2Reward: Adapting Video-Language Models to Generalizable Robotic Rewards via Failure Prompts
di: Yang, Yanting, et al.
Pubblicazione: (2024)
di: Yang, Yanting, et al.
Pubblicazione: (2024)
RobotSeg: A Model and Dataset for Segmenting Robots in Image and Video
di: Mei, Haiyang, et al.
Pubblicazione: (2025)
di: Mei, Haiyang, et al.
Pubblicazione: (2025)
Large Video Planner Enables Generalizable Robot Control
di: Chen, Boyuan, et al.
Pubblicazione: (2025)
di: Chen, Boyuan, et al.
Pubblicazione: (2025)
AutoMoT: A Unified Vision-Language-Action Model with Asynchronous Mixture-of-Transformers for End-to-End Autonomous Driving
di: Huang, Wenhui, et al.
Pubblicazione: (2026)
di: Huang, Wenhui, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Hierarchical Large Language Models in Cloud Edge End Architecture for Heterogeneous Robot Cluster Control
di: Luan, Zhirong, et al.
Pubblicazione: (2024) -
LIT: Large Language Model Driven Intention Tracking for Proactive Human-Robot Collaboration -- A Robot Sous-Chef Application
di: Huang, Zhe, et al.
Pubblicazione: (2024) -
Soft Prompt Generation for Domain Generalization
di: Bai, Shuanghao, et al.
Pubblicazione: (2024) -
S3E: A Multi-Robot Multimodal Dataset for Collaborative SLAM
di: Feng, Dapeng, et al.
Pubblicazione: (2022) -
GAF: Gaussian Action Field as a 4D Representation for Dynamic World Modeling in Robotic Manipulation
di: Chai, Ying, et al.
Pubblicazione: (2025)