CognitiveOS: Large Multimodal Model based System to Endow Any Type of Robot with Generative AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lykov, Artem, Konenkov, Mikhail, Gbagbe, Koffivi Fidèle, Litvinov, Mikhail, Davletshin, Denis, Fedoseev, Aleksey, Cabrera, Miguel Altamirano, Peter, Robinroy, Tsetserukou, Dzmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robots Can Feel: LLM-based Framework for Robot Ethical Reasoning
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
Industry 6.0: New Generation of Industry driven by Generative AI and Swarm of Heterogeneous Robots
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
VR-GPT: Visual Language Model for Intelligent Virtual Reality Applications
par: Konenkov, Mikhail, et autres
Publié: (2024)
par: Konenkov, Mikhail, et autres
Publié: (2024)
FlockGPT: Guiding UAV Flocking with Linguistic Orchestration
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
CognitiveDog: Large Multimodal Model Based System to Translate Vision and Language into Action of Quadruped Robot
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
GestOS: Advanced Hand Gesture Interpretation via Large Language Models to control Any Type of Robot
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
VLM-Auto: VLM-based Autonomous Driving Assistant with Human-like Behavior and Understanding for Complex Road Scenes
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
SharpSLAM: 3D Object-Oriented Visual SLAM with Deblurring for Agile Drones
par: Davletshin, Denis, et autres
Publié: (2024)
par: Davletshin, Denis, et autres
Publié: (2024)
PhysicalAgent: Towards General Cognitive Robotics with Foundation World Models
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
MAGNNET: Multi-Agent Graph Neural Network-based Efficient Task Allocation for Autonomous Vehicles with Deep Reinforcement Learning
par: Ratnabala, Lavanya, et autres
Publié: (2025)
par: Ratnabala, Lavanya, et autres
Publié: (2025)
HIPPO-MAT: Decentralized Task Allocation Using GraphSAGE and Multi-Agent Deep Reinforcement Learning
par: Ratnabala, Lavanya, et autres
Publié: (2025)
par: Ratnabala, Lavanya, et autres
Publié: (2025)
DiffusionCinema: Text-to-Aerial Cinematography
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
GestLLM: Advanced Hand Gesture Interpretation via Large Language Models for Human-Robot Interaction
par: Kobzarev, Oleg, et autres
Publié: (2025)
par: Kobzarev, Oleg, et autres
Publié: (2025)
Lander.AI: Adaptive Landing Behavior Agent for Expertise in 3D Dynamic Platform Landings
par: Peter, Robinroy, et autres
Publié: (2024)
par: Peter, Robinroy, et autres
Publié: (2024)
TornadoDrone: Bio-inspired DRL-based Drone Landing on 6D Platform with Wind Force Disturbances
par: Peter, Robinroy, et autres
Publié: (2024)
par: Peter, Robinroy, et autres
Publié: (2024)
MARLander: A Local Path Planning for Drone Swarms using Multiagent Deep Reinforcement Learning
par: Aschu, Demetros, et autres
Publié: (2024)
par: Aschu, Demetros, et autres
Publié: (2024)
Evolution 6.0: Robot Evolution through Generative Design
par: Khan, Muhammad Haris, et autres
Publié: (2025)
par: Khan, Muhammad Haris, et autres
Publié: (2025)
MorphoGear: An UAV with Multi-Limb Morphogenetic Gear for Rough-Terrain Locomotion
par: Martynov, Mikhail, et autres
Publié: (2024)
par: Martynov, Mikhail, et autres
Publié: (2024)
HawkDrive: A Transformer-driven Visual Perception System for Autonomous Driving in Night Scene
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation
par: Bazhenov, Artem, et autres
Publié: (2024)
par: Bazhenov, Artem, et autres
Publié: (2024)
LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems
par: Lykov, Artem, et autres
Publié: (2023)
par: Lykov, Artem, et autres
Publié: (2023)
H-RINS: Hierarchical Tightly-coupled Radar-Inertial Navigation via Smoothing and Mapping
par: Abdulkarim, Ali Alridha, et autres
Publié: (2026)
par: Abdulkarim, Ali Alridha, et autres
Publié: (2026)
FlightDiffusion: Revolutionising Autonomous Drone Training with Diffusion Models Generating FPV Video
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
SwarmVLM: VLM-Guided Impedance Control for Autonomous Navigation of Heterogeneous Robots in Dynamic Warehousing
par: Zafar, Malaika, et autres
Publié: (2025)
par: Zafar, Malaika, et autres
Publié: (2025)
Hybrid F' and ROS2 Architecture for Vision-Based Autonomous Flight: Design and Experimental Validation
par: Metwally, Abdelrahman, et autres
Publié: (2026)
par: Metwally, Abdelrahman, et autres
Publié: (2026)
GazeRace: Revolutionizing Remote Piloting with Eye-Gaze Control
par: Tokmurziyev, Issatay, et autres
Publié: (2024)
par: Tokmurziyev, Issatay, et autres
Publié: (2024)
Dynamic Subgoal based Path Formation and Task Allocation: A NeuroFleets Approach to Scalable Swarm Robotics
par: Peter, Robinroy, et autres
Publié: (2024)
par: Peter, Robinroy, et autres
Publié: (2024)
Closed-Loop Verbal Reinforcement Learning for Task-Level Robotic Planning
par: Plotnikov, Dmitrii, et autres
Publié: (2026)
par: Plotnikov, Dmitrii, et autres
Publié: (2026)
FADet: A Multi-sensor 3D Object Detection Network based on Local Featured Attention
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
MissionGPT: Mission Planner for Mobile Robot based on Robotics Transformer Model
par: Berman, Vladimir, et autres
Publié: (2024)
par: Berman, Vladimir, et autres
Publié: (2024)
SafeHumanoid: VLM-RAG-driven Control of Upper Body Impedance for Humanoid Robot
par: Mahmoud, Yara, et autres
Publié: (2025)
par: Mahmoud, Yara, et autres
Publié: (2025)
TiltXter: CNN-based Electro-tactile Rendering of Tilt Angle for Telemanipulation of Pasteur Pipettes
par: Cabrera, Miguel Altamirano, et autres
Publié: (2024)
par: Cabrera, Miguel Altamirano, et autres
Publié: (2024)
DeepXPalm: Tilt and Position Rendering using Palm-worn Haptic Display and CNN-based Tactile Pattern Recognition
par: Miguel, Altamirano Cabrera, et autres
Publié: (2022)
par: Miguel, Altamirano Cabrera, et autres
Publié: (2022)
UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
DreamToNav: Generalizable Navigation for Robots via Generative Video Planning
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
FlyNeRF: NeRF-Based Aerial Mapping for High-Quality 3D Scene Reconstruction
par: Dronova, Maria, et autres
Publié: (2024)
par: Dronova, Maria, et autres
Publié: (2024)
CognitiveDrone: A VLA Model and Evaluation Benchmark for Real-Time Cognitive Task Solving and Reasoning in UAVs
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
HyperSurf: Quadruped Robot Leg Capable of Surface Recognition with GRU and Real-to-Sim Transferring
par: Satsevich, Sergei, et autres
Publié: (2024)
par: Satsevich, Sergei, et autres
Publié: (2024)
UAV-VLRR: Vision-Language Informed NMPC for Rapid Response in UAV Search and Rescue
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
Documents similaires
-
Robots Can Feel: LLM-based Framework for Robot Ethical Reasoning
par: Lykov, Artem, et autres
Publié: (2024) -
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024) -
Industry 6.0: New Generation of Industry driven by Generative AI and Swarm of Heterogeneous Robots
par: Lykov, Artem, et autres
Publié: (2024) -
VR-GPT: Visual Language Model for Intelligent Virtual Reality Applications
par: Konenkov, Mikhail, et autres
Publié: (2024) -
FlockGPT: Guiding UAV Flocking with Linguistic Orchestration
par: Lykov, Artem, et autres
Publié: (2024)