Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gbagbe, Koffivi Fidèle, Cabrera, Miguel Altamirano, Alabbas, Ali, Alyunes, Oussama, Lykov, Artem, Tsetserukou, Dzmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robots Can Feel: LLM-based Framework for Robot Ethical Reasoning
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
CognitiveOS: Large Multimodal Model based System to Endow Any Type of Robot with Generative AI
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
Shake-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Manipulations and Liquid Mixing
par: Khan, Muhamamd Haris, et autres
Publié: (2025)
par: Khan, Muhamamd Haris, et autres
Publié: (2025)
Industry 6.0: New Generation of Industry driven by Generative AI and Swarm of Heterogeneous Robots
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
MoveTouch: Robotic Motion Capturing System with Wearable Tactile Display to Achieve Safe HRI
par: Alabbas, Ali, et autres
Publié: (2024)
par: Alabbas, Ali, et autres
Publié: (2024)
GestLLM: Advanced Hand Gesture Interpretation via Large Language Models for Human-Robot Interaction
par: Kobzarev, Oleg, et autres
Publié: (2025)
par: Kobzarev, Oleg, et autres
Publié: (2025)
GestOS: Advanced Hand Gesture Interpretation via Large Language Models to control Any Type of Robot
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
Evolution 6.0: Robot Evolution through Generative Design
par: Khan, Muhammad Haris, et autres
Publié: (2025)
par: Khan, Muhammad Haris, et autres
Publié: (2025)
DroneVLA: VLA based Aerial Manipulation
par: Mehboob, Fawad, et autres
Publié: (2026)
par: Mehboob, Fawad, et autres
Publié: (2026)
HumanoidVLM: Vision-Language-Guided Impedance Control for Contact-Rich Humanoid Manipulation
par: Mahmoud, Yara, et autres
Publié: (2026)
par: Mahmoud, Yara, et autres
Publié: (2026)
CognitiveDog: Large Multimodal Model Based System to Translate Vision and Language into Action of Quadruped Robot
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
FlightDiffusion: Revolutionising Autonomous Drone Training with Diffusion Models Generating FPV Video
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation
par: Bazhenov, Artem, et autres
Publié: (2024)
par: Bazhenov, Artem, et autres
Publié: (2024)
GenerativeMPC: VLM-RAG-guided Whole-Body MPC with Virtual Impedance for Bimanual Mobile Manipulation
par: Fernando, Marcelino Julio, et autres
Publié: (2026)
par: Fernando, Marcelino Julio, et autres
Publié: (2026)
UAV-VLPA*: A Vision-Language-Path-Action System for Optimal Route Generation on a Large Scales
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
VR-GPT: Visual Language Model for Intelligent Virtual Reality Applications
par: Konenkov, Mikhail, et autres
Publié: (2024)
par: Konenkov, Mikhail, et autres
Publié: (2024)
RaceVLA: VLA-based Racing Drone Navigation with Human-like Behaviour
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
GraspSense: Physically Grounded Grasp and Grip Planning for a Dexterous Robotic Hand via Language-Guided Perception and Force Maps
par: Semenyakina, Elizaveta, et autres
Publié: (2026)
par: Semenyakina, Elizaveta, et autres
Publié: (2026)
PhysicalAgent: Towards General Cognitive Robotics with Foundation World Models
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
SafeHumanoid: VLM-RAG-driven Control of Upper Body Impedance for Humanoid Robot
par: Mahmoud, Yara, et autres
Publié: (2025)
par: Mahmoud, Yara, et autres
Publié: (2025)
AnywhereVLA: Language-Conditioned Exploration and Mobile Manipulation
par: Gubernatorov, Konstantin, et autres
Publié: (2025)
par: Gubernatorov, Konstantin, et autres
Publié: (2025)
HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing
par: Gubernatorov, Konstantin, et autres
Publié: (2026)
par: Gubernatorov, Konstantin, et autres
Publié: (2026)
UAV-VLRR: Vision-Language Informed NMPC for Rapid Response in UAV Search and Rescue
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
DiffusionCinema: Text-to-Aerial Cinematography
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
VLM-Auto: VLM-based Autonomous Driving Assistant with Human-like Behavior and Understanding for Complex Road Scenes
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
MissionGPT: Mission Planner for Mobile Robot based on Robotics Transformer Model
par: Berman, Vladimir, et autres
Publié: (2024)
par: Berman, Vladimir, et autres
Publié: (2024)
LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems
par: Lykov, Artem, et autres
Publié: (2023)
par: Lykov, Artem, et autres
Publié: (2023)
DreamToNav: Generalizable Navigation for Robots via Generative Video Planning
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
CognitiveDrone: A VLA Model and Evaluation Benchmark for Real-Time Cognitive Task Solving and Reasoning in UAVs
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
GazeGrasp: DNN-Driven Robotic Grasping with Wearable Eye-Gaze Interface
par: Tokmurziyev, Issatay, et autres
Publié: (2025)
par: Tokmurziyev, Issatay, et autres
Publié: (2025)
FADet: A Multi-sensor 3D Object Detection Network based on Local Featured Attention
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
Action Agent: Agentic Video Generation Meets Flow-Constrained Diffusion
par: Sam, Jeffrin, et autres
Publié: (2026)
par: Sam, Jeffrin, et autres
Publié: (2026)
UniBiDex: A Unified Teleoperation Framework for Robotic Bimanual Dexterous Manipulation
par: Li, Zhongxuan, et autres
Publié: (2026)
par: Li, Zhongxuan, et autres
Publié: (2026)
GrainGrasp: Dexterous Grasp Generation with Fine-grained Contact Guidance
par: Zhao, Fuqiang, et autres
Publié: (2024)
par: Zhao, Fuqiang, et autres
Publié: (2024)
Hybrid F' and ROS2 Architecture for Vision-Based Autonomous Flight: Design and Experimental Validation
par: Metwally, Abdelrahman, et autres
Publié: (2026)
par: Metwally, Abdelrahman, et autres
Publié: (2026)
GuideTouch: An Obstacle Avoidance Device with Tactile Feedback for Visually Impaired
par: Kozlov, Timofei, et autres
Publié: (2026)
par: Kozlov, Timofei, et autres
Publié: (2026)
GazeRace: Revolutionizing Remote Piloting with Eye-Gaze Control
par: Tokmurziyev, Issatay, et autres
Publié: (2024)
par: Tokmurziyev, Issatay, et autres
Publié: (2024)
TwinVLA: Data-Efficient Bimanual Manipulation with Twin Single-Arm Vision-Language-Action Models
par: Im, Hokyun, et autres
Publié: (2025)
par: Im, Hokyun, et autres
Publié: (2025)
Echo: An Open-Source, Low-Cost Teleoperation System with Force Feedback for Dataset Collection in Robot Learning
par: Bazhenov, Artem, et autres
Publié: (2025)
par: Bazhenov, Artem, et autres
Publié: (2025)
Documents similaires
-
Robots Can Feel: LLM-based Framework for Robot Ethical Reasoning
par: Lykov, Artem, et autres
Publié: (2024) -
CognitiveOS: Large Multimodal Model based System to Endow Any Type of Robot with Generative AI
par: Lykov, Artem, et autres
Publié: (2024) -
Shake-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Manipulations and Liquid Mixing
par: Khan, Muhamamd Haris, et autres
Publié: (2025) -
Industry 6.0: New Generation of Industry driven by Generative AI and Swarm of Heterogeneous Robots
par: Lykov, Artem, et autres
Publié: (2024) -
MoveTouch: Robotic Motion Capturing System with Wearable Tactile Display to Achieve Safe HRI
par: Alabbas, Ali, et autres
Publié: (2024)