Salvato in:
| Autori principali: | Nishimura, Takayuki, Kuyo, Katsuyuki, Kambara, Motonari, Sugiura, Komei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.00985 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Future Success Prediction in Open-Vocabulary Object Manipulation Tasks Based on End-Effector Trajectories
di: Kambara, Motonari, et al.
Pubblicazione: (2024)
di: Kambara, Motonari, et al.
Pubblicazione: (2024)
Task Success Prediction for Open-Vocabulary Manipulation Based on Multi-Level Aligned Representations
di: Goko, Miyu, et al.
Pubblicazione: (2024)
di: Goko, Miyu, et al.
Pubblicazione: (2024)
Pre-Manipulation Alignment Prediction with Parallel Deep State-Space and Transformer Models
di: Kambara, Motonari, et al.
Pubblicazione: (2025)
di: Kambara, Motonari, et al.
Pubblicazione: (2025)
DM2RM: Dual-Mode Multimodal Ranking for Target Objects and Receptacles Based on Open-Vocabulary Instructions
di: Korekata, Ryosuke, et al.
Pubblicazione: (2024)
di: Korekata, Ryosuke, et al.
Pubblicazione: (2024)
Mobile Manipulation Instruction Generation from Multiple Images with Automatic Metric Enhancement
di: Katsumata, Kei, et al.
Pubblicazione: (2025)
di: Katsumata, Kei, et al.
Pubblicazione: (2025)
Open-Vocabulary Mobile Manipulation Based on Double Relaxed Contrastive Learning with Dense Labeling
di: Yashima, Daichi, et al.
Pubblicazione: (2024)
di: Yashima, Daichi, et al.
Pubblicazione: (2024)
LILAC: Language-Conditioned Object-Centric Optical Flow for Open-Loop Trajectory Generation
di: Kambara, Motonari, et al.
Pubblicazione: (2026)
di: Kambara, Motonari, et al.
Pubblicazione: (2026)
AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation
di: Takagi, Yusuke, et al.
Pubblicazione: (2026)
di: Takagi, Yusuke, et al.
Pubblicazione: (2026)
Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation
di: Korekata, Ryosuke, et al.
Pubblicazione: (2025)
di: Korekata, Ryosuke, et al.
Pubblicazione: (2025)
GENNAV: Polygon Mask Generation for Generalized Referring Navigable Regions
di: Katsumata, Kei, et al.
Pubblicazione: (2025)
di: Katsumata, Kei, et al.
Pubblicazione: (2025)
Nearest Neighbor Future Captioning: Generating Descriptions for Possible Collisions in Object Placement Tasks
di: Komatsu, Takumi, et al.
Pubblicazione: (2024)
di: Komatsu, Takumi, et al.
Pubblicazione: (2024)
LOVON: Legged Open-Vocabulary Object Navigator
di: Peng, Daojie, et al.
Pubblicazione: (2025)
di: Peng, Daojie, et al.
Pubblicazione: (2025)
HomeRobot: Open-Vocabulary Mobile Manipulation
di: Yenamandra, Sriram, et al.
Pubblicazione: (2023)
di: Yenamandra, Sriram, et al.
Pubblicazione: (2023)
Leveraging Vision-Language Models for Open-Vocabulary Instance Segmentation and Tracking
di: Pätzold, Bastian, et al.
Pubblicazione: (2025)
di: Pätzold, Bastian, et al.
Pubblicazione: (2025)
WildOS: Open-Vocabulary Object Search in the Wild
di: Shah, Hardik, et al.
Pubblicazione: (2026)
di: Shah, Hardik, et al.
Pubblicazione: (2026)
Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling
di: Qiu, Xiaowen, et al.
Pubblicazione: (2025)
di: Qiu, Xiaowen, et al.
Pubblicazione: (2025)
Object-Centric Instruction Augmentation for Robotic Manipulation
di: Wen, Junjie, et al.
Pubblicazione: (2024)
di: Wen, Junjie, et al.
Pubblicazione: (2024)
Open3DTrack: Towards Open-Vocabulary 3D Multi-Object Tracking
di: Ishaq, Ayesha, et al.
Pubblicazione: (2024)
di: Ishaq, Ayesha, et al.
Pubblicazione: (2024)
Learning Humanoid End-Effector Control for Open-Vocabulary Visual Loco-Manipulation
di: Dong, Runpei, et al.
Pubblicazione: (2026)
di: Dong, Runpei, et al.
Pubblicazione: (2026)
Kinematify: Open-Vocabulary Synthesis of High-DoF Articulated Objects
di: Wang, Jiawei, et al.
Pubblicazione: (2025)
di: Wang, Jiawei, et al.
Pubblicazione: (2025)
Towards Open-World Mobile Manipulation in Homes: Lessons from the Neurips 2023 HomeRobot Open Vocabulary Mobile Manipulation Challenge
di: Yenamandra, Sriram, et al.
Pubblicazione: (2024)
di: Yenamandra, Sriram, et al.
Pubblicazione: (2024)
WoMAP: World Models For Embodied Open-Vocabulary Object Localization
di: Yin, Tenny, et al.
Pubblicazione: (2025)
di: Yin, Tenny, et al.
Pubblicazione: (2025)
OVGrasp: Open-Vocabulary Grasping Assistance via Multimodal Intent Detection
di: Hu, Chen, et al.
Pubblicazione: (2025)
di: Hu, Chen, et al.
Pubblicazione: (2025)
Adaptive Articulated Object Manipulation On The Fly with Foundation Model Reasoning and Part Grounding
di: Zhang, Xiaojie, et al.
Pubblicazione: (2025)
di: Zhang, Xiaojie, et al.
Pubblicazione: (2025)
Splat-MOVER: Multi-Stage, Open-Vocabulary Robotic Manipulation via Editable Gaussian Splatting
di: Shorinwa, Ola, et al.
Pubblicazione: (2024)
di: Shorinwa, Ola, et al.
Pubblicazione: (2024)
DOZE: A Dataset for Open-Vocabulary Zero-Shot Object Navigation in Dynamic Environments
di: Ma, Ji, et al.
Pubblicazione: (2024)
di: Ma, Ji, et al.
Pubblicazione: (2024)
ObjectVLA: End-to-End Open-World Object Manipulation Without Demonstration
di: Zhu, Minjie, et al.
Pubblicazione: (2025)
di: Zhu, Minjie, et al.
Pubblicazione: (2025)
Zero-shot Object-Centric Instruction Following: Integrating Foundation Models with Traditional Navigation
di: Raychaudhuri, Sonia, et al.
Pubblicazione: (2024)
di: Raychaudhuri, Sonia, et al.
Pubblicazione: (2024)
HomeRobot Open Vocabulary Mobile Manipulation Challenge 2023 Participant Report (Team KuzHum)
di: Kuzma, Volodymyr, et al.
Pubblicazione: (2024)
di: Kuzma, Volodymyr, et al.
Pubblicazione: (2024)
Attention Lattice Adapter: Visual Explanation Generation for Visual Foundation Model
di: Hirano, Shinnosuke, et al.
Pubblicazione: (2025)
di: Hirano, Shinnosuke, et al.
Pubblicazione: (2025)
Spot-Compose: A Framework for Open-Vocabulary Object Retrieval and Drawer Manipulation in Point Clouds
di: Lemke, Oliver, et al.
Pubblicazione: (2024)
di: Lemke, Oliver, et al.
Pubblicazione: (2024)
ManipGPT: Is Affordance Segmentation by Large Vision Models Enough for Articulated Object Manipulation?
di: Kim, Taewhan, et al.
Pubblicazione: (2024)
di: Kim, Taewhan, et al.
Pubblicazione: (2024)
SpaCeFormer: Fast Proposal-Free Open-Vocabulary 3D Instance Segmentation
di: Choy, Chris, et al.
Pubblicazione: (2026)
di: Choy, Chris, et al.
Pubblicazione: (2026)
OpenObj: Open-Vocabulary Object-Level Neural Radiance Fields with Fine-Grained Understanding
di: Deng, Yinan, et al.
Pubblicazione: (2024)
di: Deng, Yinan, et al.
Pubblicazione: (2024)
Deep Space Weather Model: Long-Range Solar Flare Prediction from Multi-Wavelength Images
di: Nagashima, Shunya, et al.
Pubblicazione: (2025)
di: Nagashima, Shunya, et al.
Pubblicazione: (2025)
OV9D: Open-Vocabulary Category-Level 9D Object Pose and Size Estimation
di: Cai, Junhao, et al.
Pubblicazione: (2024)
di: Cai, Junhao, et al.
Pubblicazione: (2024)
Closed-Loop Open-Vocabulary Mobile Manipulation with GPT-4V
di: Zhi, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhi, Peiyuan, et al.
Pubblicazione: (2024)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
ZISVFM: Zero-Shot Object Instance Segmentation in Indoor Robotic Environments with Vision Foundation Models
di: Zhang, Ying, et al.
Pubblicazione: (2025)
di: Zhang, Ying, et al.
Pubblicazione: (2025)
Are Open-Vocabulary Models Ready for Detection of MEP Elements on Construction Sites
di: Abdalwhab, Abdalwhab, et al.
Pubblicazione: (2025)
di: Abdalwhab, Abdalwhab, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Future Success Prediction in Open-Vocabulary Object Manipulation Tasks Based on End-Effector Trajectories
di: Kambara, Motonari, et al.
Pubblicazione: (2024) -
Task Success Prediction for Open-Vocabulary Manipulation Based on Multi-Level Aligned Representations
di: Goko, Miyu, et al.
Pubblicazione: (2024) -
Pre-Manipulation Alignment Prediction with Parallel Deep State-Space and Transformer Models
di: Kambara, Motonari, et al.
Pubblicazione: (2025) -
DM2RM: Dual-Mode Multimodal Ranking for Target Objects and Receptacles Based on Open-Vocabulary Instructions
di: Korekata, Ryosuke, et al.
Pubblicazione: (2024) -
Mobile Manipulation Instruction Generation from Multiple Images with Automatic Metric Enhancement
di: Katsumata, Kei, et al.
Pubblicazione: (2025)