Natural Multimodal Fusion-Based Human-Robot Interaction: Application With Voice and Deictic Posture via Large Language Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lai, Yuzhi, Yuan, Shenghai, Nassar, Youssef, Fan, Mingyu, Gopal, Atmaraaj, Yorita, Arihiro, Kubota, Naoyuki, Rätsch, Matthias |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NVP-HRI: Zero Shot Natural Voice and Posture-based Human-Robot Interaction via Large Language Model
par: Lai, Yuzhi, et autres
Publié: (2025)
par: Lai, Yuzhi, et autres
Publié: (2025)
Sticky-Glance: Robust Intent Recognition for Human Robot Collaboration via Single-Glance
par: Lai, Yuzhi, et autres
Publié: (2026)
par: Lai, Yuzhi, et autres
Publié: (2026)
FAM-HRI: Foundation-Model Assisted Multi-Modal Human-Robot Interaction Combining Gaze and Speech
par: Lai, Yuzhi, et autres
Publié: (2025)
par: Lai, Yuzhi, et autres
Publié: (2025)
DeiSAM: Segment Anything with Deictic Prompting
par: Shindo, Hikaru, et autres
Publié: (2024)
par: Shindo, Hikaru, et autres
Publié: (2024)
SEER-VAR: Semantic Egocentric Environment Reasoner for Vehicle Augmented Reality
par: Lai, Yuzhi, et autres
Publié: (2025)
par: Lai, Yuzhi, et autres
Publié: (2025)
Labeling Sentences with Symbolic and Deictic Gestures via Semantic Similarity
par: Gjaci, Ariel, et autres
Publié: (2024)
par: Gjaci, Ariel, et autres
Publié: (2024)
Benchmarking ML Approaches to UWB-Based Range-Only Posture Recognition for Human Robot-Interaction
par: Salimi, Salma, et autres
Publié: (2024)
par: Salimi, Salma, et autres
Publié: (2024)
Prompt-to-Gesture: Measuring the Capabilities of Image-to-Video Deictic Gesture Generation
par: Ali, Hassan, et autres
Publié: (2026)
par: Ali, Hassan, et autres
Publié: (2026)
PALo: Learning Posture-Aware Locomotion for Quadruped Robots
par: Miao, Xiangyu, et autres
Publié: (2025)
par: Miao, Xiangyu, et autres
Publié: (2025)
Generating Robotic Control Strategies With LLMs : Via Human–Robot Voice Interaction
par: Xiaopeng Wang, et autres
Publié: (2025)
par: Xiaopeng Wang, et autres
Publié: (2025)
Deictic Codes, Demonstratives, and Reference: A Step Toward Solving the Grounding Problem
par: Raftopoulos, Athanassios, et autres
Publié: (2025)
par: Raftopoulos, Athanassios, et autres
Publié: (2025)
Postural Virtual Fixtures for Ergonomic Physical Interactions with Supernumerary Robotic Bodies
par: Kastritsi, Theodora, et autres
Publié: (2026)
par: Kastritsi, Theodora, et autres
Publié: (2026)
Interactive Haptic System with Multimodal Tactile Sensing and Hydraulic Feedback for Realistic Human–Machine Interaction
par: Jingu Jeong, et autres
Publié: (2024)
par: Jingu Jeong, et autres
Publié: (2024)
TransforMerger: Transformer-based Voice-Gesture Fusion for Robust Human-Robot Communication
par: Vanc, Petr, et autres
Publié: (2025)
par: Vanc, Petr, et autres
Publié: (2025)
Multimodal Anomaly Detection for Human-Robot Interaction
par: Ribeiro, Guilherme, et autres
Publié: (2026)
par: Ribeiro, Guilherme, et autres
Publié: (2026)
Multimodal Safe Control for Human-Robot Interaction
par: Pandya, Ravi, et autres
Publié: (2023)
par: Pandya, Ravi, et autres
Publié: (2023)
Multi-Modal Contrastive Learning for Online Clinical Time-Series Applications
par: Baldenweg, Fabian, et autres
Publié: (2024)
par: Baldenweg, Fabian, et autres
Publié: (2024)
EchoVideo: Identity-Preserving Human Video Generation by Multimodal Feature Fusion
par: Wei, Jiangchuan, et autres
Publié: (2025)
par: Wei, Jiangchuan, et autres
Publié: (2025)
Recognizing Actions from Robotic View for Natural Human-Robot Interaction
par: Wang, Ziyi, et autres
Publié: (2025)
par: Wang, Ziyi, et autres
Publié: (2025)
Learning Multimodal Latent Dynamics for Human-Robot Interaction
par: Prasad, Vignesh, et autres
Publié: (2023)
par: Prasad, Vignesh, et autres
Publié: (2023)
Integrating Ergonomics and Manipulability for Upper Limb Postural Optimization in Bimanual Human-Robot Collaboration
par: Li, Chenzui, et autres
Publié: (2025)
par: Li, Chenzui, et autres
Publié: (2025)
TactEx: An Explainable Multimodal Robotic Interaction Framework for Human-Like Touch and Hardness Estimation
par: Verstraete, Felix, et autres
Publié: (2026)
par: Verstraete, Felix, et autres
Publié: (2026)
Unsupervised Anomaly Detection for Autonomous Robots via Mahalanobis SVDD with Audio-IMU Fusion
par: Yang, Yizhuo, et autres
Publié: (2025)
par: Yang, Yizhuo, et autres
Publié: (2025)
Behaviors of Martian CO2-driven dry climate system and conditions for atmospheric collapses
par: Watanabe, Yasuto, et autres
Publié: (2024)
par: Watanabe, Yasuto, et autres
Publié: (2024)
Towards Affect-Adaptive Human-Robot Interaction: A Protocol for Multimodal Dataset Collection on Social Anxiety
par: Poprcova, Vesna, et autres
Publié: (2025)
par: Poprcova, Vesna, et autres
Publié: (2025)
Structured Task Solving via Modular Embodied Intelligence: A Case Study on Rubik's Cube
par: Fan, Chongshan, et autres
Publié: (2025)
par: Fan, Chongshan, et autres
Publié: (2025)
Text2Interaction: Establishing Safe and Preferable Human-Robot Interaction
par: Thumm, Jakob, et autres
Publié: (2024)
par: Thumm, Jakob, et autres
Publié: (2024)
MMFformer: Multimodal Fusion Transformer Network for Depression Detection
par: Haque, Md Rezwanul, et autres
Publié: (2025)
par: Haque, Md Rezwanul, et autres
Publié: (2025)
Learning Multimodal Confidence for Intention Recognition in Human-Robot Interaction
par: Zhao, Xiyuan, et autres
Publié: (2024)
par: Zhao, Xiyuan, et autres
Publié: (2024)
Jacquard V2: Refining Datasets using the Human In the Loop Data Correction Method
par: Li, Qiuhao, et autres
Publié: (2024)
par: Li, Qiuhao, et autres
Publié: (2024)
Theory of Mind for Explainable Human-Robot Interaction
par: Bauer, Marie S., et autres
Publié: (2025)
par: Bauer, Marie S., et autres
Publié: (2025)
Unsupervised View-Invariant Human Posture Representation
par: Sardari, Faegheh, et autres
Publié: (2021)
par: Sardari, Faegheh, et autres
Publié: (2021)
Early Supraspinal Influences on Human Embryonic Posture
par: Sophie Plasschaert, et autres
Publié: (2024)
par: Sophie Plasschaert, et autres
Publié: (2024)
Four‐Wheeled Mobile Robot With Flexible Posture Control
par: Tianxiang Lan, et autres
Publié: (2024)
par: Tianxiang Lan, et autres
Publié: (2024)
Multi-modal Graph Learning over UMLS Knowledge Graphs
par: Burger, Manuel, et autres
Publié: (2023)
par: Burger, Manuel, et autres
Publié: (2023)
Kaiwu: A Multimodal Manipulation Dataset and Framework for Robot Learning and Human-Robot Interaction
par: Jiang, Shuo, et autres
Publié: (2025)
par: Jiang, Shuo, et autres
Publié: (2025)
FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs
par: An, Keyu, et autres
Publié: (2024)
par: An, Keyu, et autres
Publié: (2024)
Robust Understanding of Human-Robot Social Interactions through Multimodal Distillation
par: Bian, Tongfei, et autres
Publié: (2025)
par: Bian, Tongfei, et autres
Publié: (2025)
HARMONI: Multimodal Personalization of Multi-User Human-Robot Interactions with LLMs
par: Malécot, Jeanne, et autres
Publié: (2026)
par: Malécot, Jeanne, et autres
Publié: (2026)
Giving Robots a Voice: Human-in-the-Loop Voice Creation and open-ended Labeling
par: van Rijn, Pol, et autres
Publié: (2024)
par: van Rijn, Pol, et autres
Publié: (2024)
Documents similaires
-
NVP-HRI: Zero Shot Natural Voice and Posture-based Human-Robot Interaction via Large Language Model
par: Lai, Yuzhi, et autres
Publié: (2025) -
Sticky-Glance: Robust Intent Recognition for Human Robot Collaboration via Single-Glance
par: Lai, Yuzhi, et autres
Publié: (2026) -
FAM-HRI: Foundation-Model Assisted Multi-Modal Human-Robot Interaction Combining Gaze and Speech
par: Lai, Yuzhi, et autres
Publié: (2025) -
DeiSAM: Segment Anything with Deictic Prompting
par: Shindo, Hikaru, et autres
Publié: (2024) -
SEER-VAR: Semantic Egocentric Environment Reasoner for Vehicle Augmented Reality
par: Lai, Yuzhi, et autres
Publié: (2025)