Robot Manipulation in Salient Vision through Referring Image Segmentation and Geometric Constraints
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Chen, Luo, Allie, Jagersand, Martin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interpreting Behaviors and Geometric Constraints as Knowledge Graphs for Robot Manipulation Control
par: Jiang, Chen, et autres
Publié: (2023)
par: Jiang, Chen, et autres
Publié: (2023)
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
par: Huang, Haifeng, et autres
Publié: (2025)
par: Huang, Haifeng, et autres
Publié: (2025)
VO-DP: Semantic-Geometric Adaptive Diffusion Policy for Vision-Only Robotic Manipulation
par: Ni, Zehao, et autres
Publié: (2025)
par: Ni, Zehao, et autres
Publié: (2025)
Scaling Cross-Environment Failure Reasoning Data for Vision-Language Robotic Manipulation
par: Pacaud, Paul, et autres
Publié: (2025)
par: Pacaud, Paul, et autres
Publié: (2025)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
par: Wang, Hongyu, et autres
Publié: (2025)
par: Wang, Hongyu, et autres
Publié: (2025)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
par: Shao, Rui, et autres
Publié: (2025)
par: Shao, Rui, et autres
Publié: (2025)
Image Generation as a Visual Planner for Robotic Manipulation
par: Pang, Ye
Publié: (2025)
par: Pang, Ye
Publié: (2025)
Disentangled Object-Centric Image Representation for Robotic Manipulation
par: Emukpere, David, et autres
Publié: (2025)
par: Emukpere, David, et autres
Publié: (2025)
Observe Then Act: Asynchronous Active Vision-Action Model for Robotic Manipulation
par: Wang, Guokang, et autres
Publié: (2024)
par: Wang, Guokang, et autres
Publié: (2024)
Vision Language Action Models in Robotic Manipulation: A Systematic Review
par: Din, Muhayy Ud, et autres
Publié: (2025)
par: Din, Muhayy Ud, et autres
Publié: (2025)
Salient Sparse Visual Odometry With Pose-Only Supervision
par: Chen, Siyu, et autres
Publié: (2024)
par: Chen, Siyu, et autres
Publié: (2024)
Towards Generalizable Vision-Language Robotic Manipulation: A Benchmark and LLM-guided 3D Policy
par: Garcia, Ricardo, et autres
Publié: (2024)
par: Garcia, Ricardo, et autres
Publié: (2024)
Genie Envisioner: A Unified World Foundation Platform for Robotic Manipulation
par: Liao, Yue, et autres
Publié: (2025)
par: Liao, Yue, et autres
Publié: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
par: Liu, Mengzhen, et autres
Publié: (2026)
par: Liu, Mengzhen, et autres
Publié: (2026)
RC-NF: Robot-Conditioned Normalizing Flow for Real-Time Anomaly Detection in Robotic Manipulation
par: Zhou, Shijie, et autres
Publié: (2026)
par: Zhou, Shijie, et autres
Publié: (2026)
Manipulate-Anything: Automating Real-World Robots using Vision-Language Models
par: Duan, Jiafei, et autres
Publié: (2024)
par: Duan, Jiafei, et autres
Publié: (2024)
ViTA-Seg: Vision Transformer for Amodal Segmentation in Robotics
par: Caramia, Donato, et autres
Publié: (2025)
par: Caramia, Donato, et autres
Publié: (2025)
Improved Bag-of-Words Image Retrieval with Geometric Constraints for Ground Texture Localization
par: Wilhelm, Aaron, et autres
Publié: (2025)
par: Wilhelm, Aaron, et autres
Publié: (2025)
PASG: A Closed-Loop Framework for Automated Geometric Primitive Extraction and Semantic Anchoring in Robotic Manipulation
par: Zhu, Zhihao, et autres
Publié: (2025)
par: Zhu, Zhihao, et autres
Publié: (2025)
RobotSeg: A Model and Dataset for Segmenting Robots in Image and Video
par: Mei, Haiyang, et autres
Publié: (2025)
par: Mei, Haiyang, et autres
Publié: (2025)
ManipGPT: Is Affordance Segmentation by Large Vision Models Enough for Articulated Object Manipulation?
par: Kim, Taewhan, et autres
Publié: (2024)
par: Kim, Taewhan, et autres
Publié: (2024)
Fast Visuomotor Policy for Robotic Manipulation
par: Jia, Jingkai, et autres
Publié: (2025)
par: Jia, Jingkai, et autres
Publié: (2025)
Ensuring Force Safety in Vision-Guided Robotic Manipulation via Implicit Tactile Calibration
par: Wei, Lai, et autres
Publié: (2024)
par: Wei, Lai, et autres
Publié: (2024)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
par: Li, Runhao, et autres
Publié: (2025)
par: Li, Runhao, et autres
Publié: (2025)
EveryDayVLA: A Vision-Language-Action Model for Affordable Robotic Manipulation
par: Chopra, Samarth, et autres
Publié: (2025)
par: Chopra, Samarth, et autres
Publié: (2025)
PseudoTouch: Efficiently Imaging the Surface Feel of Objects for Robotic Manipulation
par: Röfer, Adrian, et autres
Publié: (2024)
par: Röfer, Adrian, et autres
Publié: (2024)
Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
par: Chen, Shizhe, et autres
Publié: (2025)
par: Chen, Shizhe, et autres
Publié: (2025)
Class-Aware Cartilage Segmentation for Autonomous US-CT Registration in Robotic Intercostal Ultrasound Imaging
par: Jiang, Zhongliang, et autres
Publié: (2024)
par: Jiang, Zhongliang, et autres
Publié: (2024)
ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation
par: Huang, Wenlong, et autres
Publié: (2024)
par: Huang, Wenlong, et autres
Publié: (2024)
Understanding the Impact of Geometric Foundation Models on Vision-Language-Action Models
par: Yang, Yurou, et autres
Publié: (2026)
par: Yang, Yurou, et autres
Publié: (2026)
Robotic Programmer: Video Instructed Policy Code Generation for Robotic Manipulation
par: Xie, Senwei, et autres
Publié: (2025)
par: Xie, Senwei, et autres
Publié: (2025)
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
par: Wen, Junjie, et autres
Publié: (2024)
par: Wen, Junjie, et autres
Publié: (2024)
Learning to See and Act: Task-Aware Virtual View Exploration for Robotic Manipulation
par: Bai, Yongjie, et autres
Publié: (2025)
par: Bai, Yongjie, et autres
Publié: (2025)
See, Plan, Rewind: Progress-Aware Vision-Language-Action Models for Robust Robotic Manipulation
par: Dai, Tingjun, et autres
Publié: (2026)
par: Dai, Tingjun, et autres
Publié: (2026)
Symmetry-Aware Fusion of Vision and Tactile Sensing via Bilateral Force Priors for Robotic Manipulation
par: Lee, Wonju, et autres
Publié: (2026)
par: Lee, Wonju, et autres
Publié: (2026)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
par: Zhou, Enshen, et autres
Publié: (2025)
par: Zhou, Enshen, et autres
Publié: (2025)
SEMNAV: Enhancing Visual Semantic Navigation in Robotics through Semantic Segmentation
par: Flor-Rodríguez, Rafael, et autres
Publié: (2025)
par: Flor-Rodríguez, Rafael, et autres
Publié: (2025)
Don't Let Your Robot be Harmful: Responsible Robotic Manipulation via Safety-as-Policy
par: Ni, Minheng, et autres
Publié: (2024)
par: Ni, Minheng, et autres
Publié: (2024)
ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics
par: Wei, Ziyu, et autres
Publié: (2026)
par: Wei, Ziyu, et autres
Publié: (2026)
Documents similaires
-
Interpreting Behaviors and Geometric Constraints as Knowledge Graphs for Robot Manipulation Control
par: Jiang, Chen, et autres
Publié: (2023) -
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
par: Huang, Haifeng, et autres
Publié: (2025) -
VO-DP: Semantic-Geometric Adaptive Diffusion Policy for Vision-Only Robotic Manipulation
par: Ni, Zehao, et autres
Publié: (2025) -
Scaling Cross-Environment Failure Reasoning Data for Vision-Language Robotic Manipulation
par: Pacaud, Paul, et autres
Publié: (2025) -
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
par: Wang, Hongyu, et autres
Publié: (2025)