GAgent: An Adaptive Rigid-Soft Gripping Agent with Vision Language Models for Complex Lighting Environments
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zhuowei, Zhang, Miao, Lin, Xiaotian, Yin, Meng, Lu, Shuai, Wang, Xueqian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cog-GA: A Large Language Models-based Generative Agent for Vision-Language Navigation in Continuous Environments
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
VacuumVLA: Boosting VLA Capabilities via a Unified Suction and Gripping Tool for Complex Robotic Manipulation
di: Zhou, Hui, et al.
Pubblicazione: (2025)
di: Zhou, Hui, et al.
Pubblicazione: (2025)
SoftMAC: Differentiable Soft Body Simulation with Forecast-based Contact Model and Two-way Coupling with Articulated Rigid Bodies and Clothes
di: Liu, Min, et al.
Pubblicazione: (2023)
di: Liu, Min, et al.
Pubblicazione: (2023)
VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments
di: Wu, Yuze, et al.
Pubblicazione: (2025)
di: Wu, Yuze, et al.
Pubblicazione: (2025)
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
di: Wang, Qiuyue, et al.
Pubblicazione: (2026)
di: Wang, Qiuyue, et al.
Pubblicazione: (2026)
Mastering Contact-rich Tasks by Combining Soft and Rigid Robotics with Imitation Learning
di: Montero, Mariano Ramírez, et al.
Pubblicazione: (2024)
di: Montero, Mariano Ramírez, et al.
Pubblicazione: (2024)
Vision Language Models Can Parse Floor Plan Maps
di: DeFazio, David, et al.
Pubblicazione: (2024)
di: DeFazio, David, et al.
Pubblicazione: (2024)
FalconWing: An Ultra-Light Indoor Fixed-Wing UAV Platform for Vision-Based Autonomy
di: Miao, Yan, et al.
Pubblicazione: (2025)
di: Miao, Yan, et al.
Pubblicazione: (2025)
A Vision-Language-Action Model for Adaptive Ultrasound-Guided Needle Insertion and Needle Tracking
di: Zhang, Yuelin, et al.
Pubblicazione: (2026)
di: Zhang, Yuelin, et al.
Pubblicazione: (2026)
Visual-tactile Fusion for Transparent Object Grasping in Complex Backgrounds
di: Li, Shoujie, et al.
Pubblicazione: (2022)
di: Li, Shoujie, et al.
Pubblicazione: (2022)
Adaptive Domain Modeling with Language Models: A Multi-Agent Approach to Task Planning
di: Babu, Harisankar, et al.
Pubblicazione: (2025)
di: Babu, Harisankar, et al.
Pubblicazione: (2025)
Bridging Embodiment Gaps: Deploying Vision-Language-Action Models on Soft Robots
di: Su, Haochen, et al.
Pubblicazione: (2025)
di: Su, Haochen, et al.
Pubblicazione: (2025)
DeepThinkVLA: Enhancing Reasoning Capability of Vision-Language-Action Models
di: Yin, Cheng, et al.
Pubblicazione: (2025)
di: Yin, Cheng, et al.
Pubblicazione: (2025)
Adaptive Capacity Allocation for Vision Language Action Fine-tuning
di: Kim, Donghoon, et al.
Pubblicazione: (2026)
di: Kim, Donghoon, et al.
Pubblicazione: (2026)
Reduced-Order Model-Guided Reinforcement Learning for Demonstration-Free Humanoid Locomotion
di: Liu, Shuai, et al.
Pubblicazione: (2025)
di: Liu, Shuai, et al.
Pubblicazione: (2025)
A Vision-Language-Action-Critic Model for Robotic Real-World Reinforcement Learning
di: Zhai, Shaopeng, et al.
Pubblicazione: (2025)
di: Zhai, Shaopeng, et al.
Pubblicazione: (2025)
AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models
di: Jia, Tingzheng, et al.
Pubblicazione: (2026)
di: Jia, Tingzheng, et al.
Pubblicazione: (2026)
General-Purpose Aerial Intelligent Agents Empowered by Large Language Models
di: Zhao, Ji, et al.
Pubblicazione: (2025)
di: Zhao, Ji, et al.
Pubblicazione: (2025)
Test-Time Adaptation for Tactile-Vision-Language Models
di: Ye, Chuyang, et al.
Pubblicazione: (2026)
di: Ye, Chuyang, et al.
Pubblicazione: (2026)
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
di: Liu, Xu, et al.
Pubblicazione: (2025)
di: Liu, Xu, et al.
Pubblicazione: (2025)
RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models
di: Liufu, Weijia, et al.
Pubblicazione: (2026)
di: Liufu, Weijia, et al.
Pubblicazione: (2026)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation
di: Su, Taiyi, et al.
Pubblicazione: (2026)
di: Su, Taiyi, et al.
Pubblicazione: (2026)
Endowing Embodied Agents with Spatial Reasoning Capabilities for Vision-and-Language Navigation
di: Bai, Qianqian, et al.
Pubblicazione: (2025)
di: Bai, Qianqian, et al.
Pubblicazione: (2025)
Align-Then-stEer: Adapting the Vision-Language Action Models through Unified Latent Guidance
di: Zhang, Yang, et al.
Pubblicazione: (2025)
di: Zhang, Yang, et al.
Pubblicazione: (2025)
Zero-shot Object Navigation with Vision-Language Models Reasoning
di: Wen, Congcong, et al.
Pubblicazione: (2024)
di: Wen, Congcong, et al.
Pubblicazione: (2024)
ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics
di: Wei, Ziyu, et al.
Pubblicazione: (2026)
di: Wei, Ziyu, et al.
Pubblicazione: (2026)
SayNav: Grounding Large Language Models for Dynamic Planning to Navigation in New Environments
di: Rajvanshi, Abhinav, et al.
Pubblicazione: (2023)
di: Rajvanshi, Abhinav, et al.
Pubblicazione: (2023)
MA-VLCM: A Vision Language Critic Model for Value Estimation of Policies in Multi-Agent Team Settings
di: Shaik, Shahil, et al.
Pubblicazione: (2026)
di: Shaik, Shahil, et al.
Pubblicazione: (2026)
Survey of Vision-Language-Action Models for Embodied Manipulation
di: Li, Haoran, et al.
Pubblicazione: (2025)
di: Li, Haoran, et al.
Pubblicazione: (2025)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
di: Zhang, Yihao, et al.
Pubblicazione: (2025)
di: Zhang, Yihao, et al.
Pubblicazione: (2025)
Learning Adaptive Hydrodynamic Models Using Neural ODEs in Complex Conditions
di: Wang, Cong, et al.
Pubblicazione: (2024)
di: Wang, Cong, et al.
Pubblicazione: (2024)
NEBULA: Do We Evaluate Vision-Language-Action Agents Correctly?
di: Peng, Jierui, et al.
Pubblicazione: (2025)
di: Peng, Jierui, et al.
Pubblicazione: (2025)
Probing a Vision-Language-Action Model for Symbolic States and Integration into a Cognitive Architecture
di: Lu, Hong, et al.
Pubblicazione: (2025)
di: Lu, Hong, et al.
Pubblicazione: (2025)
CrashAgent: Crash Scenario Generation via Multi-modal Reasoning
di: Li, Miao, et al.
Pubblicazione: (2025)
di: Li, Miao, et al.
Pubblicazione: (2025)
UAV-CodeAgents: Scalable UAV Mission Planning via Multi-Agent ReAct and Vision-Language Reasoning
di: Sautenkov, Oleg, et al.
Pubblicazione: (2025)
di: Sautenkov, Oleg, et al.
Pubblicazione: (2025)
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
di: Wang, Taowen, et al.
Pubblicazione: (2024)
di: Wang, Taowen, et al.
Pubblicazione: (2024)
SmoothVLA: Aligning Vision-Language-Action Models with Physical Constraints via Intrinsic Smoothness Optimization
di: Li, Jiashun, et al.
Pubblicazione: (2026)
di: Li, Jiashun, et al.
Pubblicazione: (2026)
Embodied Instruction Following in Unknown Environments
di: Wu, Zhenyu, et al.
Pubblicazione: (2024)
di: Wu, Zhenyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Cog-GA: A Large Language Models-based Generative Agent for Vision-Language Navigation in Continuous Environments
di: Li, Zhiyuan, et al.
Pubblicazione: (2024) -
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
di: Zhang, Zhen, et al.
Pubblicazione: (2023) -
VacuumVLA: Boosting VLA Capabilities via a Unified Suction and Gripping Tool for Complex Robotic Manipulation
di: Zhou, Hui, et al.
Pubblicazione: (2025) -
SoftMAC: Differentiable Soft Body Simulation with Forecast-based Contact Model and Two-way Coupling with Articulated Rigid Bodies and Clothes
di: Liu, Min, et al.
Pubblicazione: (2023) -
VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments
di: Wu, Yuze, et al.
Pubblicazione: (2025)