Exploring Temporal Representation in Neural Processes for Multimodal Action Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fedozzi, Marco Gabriele, Nagai, Yukie, Rea, Francesco, Sciutti, Alessandra |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Let people fail! Exploring the influence of explainable virtual and robotic agents in learning-by-doing tasks
par: Matarese, Marco, et autres
Publié: (2024)
par: Matarese, Marco, et autres
Publié: (2024)
Building Knowledge from Interactions: An LLM-Based Architecture for Adaptive Tutoring and Social Reasoning
par: Garello, Luca, et autres
Publié: (2025)
par: Garello, Luca, et autres
Publié: (2025)
Game Theory to Study Cooperation in Human-Robot Mixed Groups: Exploring the Potential of the Public Good Game
par: Pusceddu, Giulia, et autres
Publié: (2025)
par: Pusceddu, Giulia, et autres
Publié: (2025)
To Whom are You Talking? A Deep Learning Model to Endow Social Robots with Addressee Estimation Skills
par: Mazzola, Carlo, et autres
Publié: (2023)
par: Mazzola, Carlo, et autres
Publié: (2023)
Correspondence learning between morphologically different robots via task demonstrations
par: Aktas, Hakan, et autres
Publié: (2023)
par: Aktas, Hakan, et autres
Publié: (2023)
Temporal Action Representation Learning for Tactical Resource Control and Subsequent Maneuver Generation
par: Jung, Hoseong, et autres
Publié: (2026)
par: Jung, Hoseong, et autres
Publié: (2026)
SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model
par: Qu, Delin, et autres
Publié: (2025)
par: Qu, Delin, et autres
Publié: (2025)
Cross-Embodied Affordance Transfer through Learning Affordance Equivalences
par: Aktas, Hakan, et autres
Publié: (2024)
par: Aktas, Hakan, et autres
Publié: (2024)
M2R2: MultiModal Robotic Representation for Temporal Action Segmentation
par: Sliwowski, Daniel, et autres
Publié: (2025)
par: Sliwowski, Daniel, et autres
Publié: (2025)
If They Disagree, Will You Conform? Exploring the Role of Robots' Value Awareness in a Decision-Making Task
par: Pusceddu, Giulia, et autres
Publié: (2025)
par: Pusceddu, Giulia, et autres
Publié: (2025)
Prediction with Action: Visual Policy Learning via Joint Denoising Process
par: Guo, Yanjiang, et autres
Publié: (2024)
par: Guo, Yanjiang, et autres
Publié: (2024)
Next-Gen Museum Guides: Autonomous Navigation and Visitor Interaction with an Agentic Robot
par: Garello, Luca, et autres
Publié: (2025)
par: Garello, Luca, et autres
Publié: (2025)
Decision-Focused Learning to Predict Action Costs for Planning
par: Mandi, Jayanta, et autres
Publié: (2024)
par: Mandi, Jayanta, et autres
Publié: (2024)
Expressing and Inferring Action Carefulness in Human-to-Robot Handovers
par: Lastrico, Linda, et autres
Publié: (2023)
par: Lastrico, Linda, et autres
Publié: (2023)
The Effects of Selected Object Features on a Pick-and-Place Task: a Human Multimodal Dataset
par: Lastrico, Linda, et autres
Publié: (2024)
par: Lastrico, Linda, et autres
Publié: (2024)
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
par: Wang, Taowen, et autres
Publié: (2024)
par: Wang, Taowen, et autres
Publié: (2024)
TIDAL: Temporally Interleaved Diffusion and Action Loop for High-Frequency VLA Control
par: Sun, Yuteng, et autres
Publié: (2026)
par: Sun, Yuteng, et autres
Publié: (2026)
Mapping Embodied Affective Touch Strategies on a Humanoid Robot
par: Ren, Qiaoqiao, et autres
Publié: (2026)
par: Ren, Qiaoqiao, et autres
Publié: (2026)
A Primer on SO(3) Action Representations in Deep Reinforcement Learning
par: Schuck, Martin, et autres
Publié: (2025)
par: Schuck, Martin, et autres
Publié: (2025)
Context-Aware Human Behavior Prediction Using Multimodal Large Language Models: Challenges and Insights
par: Liu, Yuchen, et autres
Publié: (2025)
par: Liu, Yuchen, et autres
Publié: (2025)
Bridging Scale Discrepancies in Robotic Control via Language-Based Action Representations
par: Zhang, Yuchi, et autres
Publié: (2025)
par: Zhang, Yuchi, et autres
Publié: (2025)
Low Dimensional State Representation Learning with Robotics Priors in Continuous Action Spaces
par: Botteghi, Nicolò, et autres
Publié: (2021)
par: Botteghi, Nicolò, et autres
Publié: (2021)
Bridging Bots: from Perception to Action via Multimodal-LMs and Knowledge Graphs
par: Martorana, Margherita, et autres
Publié: (2025)
par: Martorana, Margherita, et autres
Publié: (2025)
Premier-TACO is a Few-Shot Policy Learner: Pretraining Multitask Representation via Temporal Action-Driven Contrastive Loss
par: Zheng, Ruijie, et autres
Publié: (2024)
par: Zheng, Ruijie, et autres
Publié: (2024)
IMRL: Integrating Visual, Physical, Temporal, and Geometric Representations for Enhanced Food Acquisition
par: Liu, Rui, et autres
Publié: (2024)
par: Liu, Rui, et autres
Publié: (2024)
Exploring Embodied Multimodal Large Models: Development, Datasets, and Future Directions
par: Chen, Shoubin, et autres
Publié: (2025)
par: Chen, Shoubin, et autres
Publié: (2025)
A roadmap for AI in robotics
par: Billard, Aude, et autres
Publié: (2025)
par: Billard, Aude, et autres
Publié: (2025)
Exploring Spatial Representation to Enhance LLM Reasoning in Aerial Vision-Language Navigation
par: Gao, Yunpeng, et autres
Publié: (2024)
par: Gao, Yunpeng, et autres
Publié: (2024)
ETA-VLA: Efficient Token Adaptation via Temporal Fusion and Intra-LLM Sparsification for Vision-Language-Action Models
par: Wang, Yiru, et autres
Publié: (2026)
par: Wang, Yiru, et autres
Publié: (2026)
Action-to-Action Flow Matching
par: Jia, Jindou, et autres
Publié: (2026)
par: Jia, Jindou, et autres
Publié: (2026)
Discrete Gaussian Process Representations for Optimising UAV-based Precision Weed Mapping
par: Swindell, Jacob, et autres
Publié: (2025)
par: Swindell, Jacob, et autres
Publié: (2025)
Humanoid Agent via Embodied Chain-of-Action Reasoning with Multimodal Foundation Models for Zero-Shot Loco-Manipulation
par: Wen, Congcong, et autres
Publié: (2025)
par: Wen, Congcong, et autres
Publié: (2025)
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
par: Mazza, Lorenzo, et autres
Publié: (2026)
par: Mazza, Lorenzo, et autres
Publié: (2026)
Reconciling Spatial and Temporal Abstractions for Goal Representation
par: Zadem, Mehdi, et autres
Publié: (2024)
par: Zadem, Mehdi, et autres
Publié: (2024)
OASIS: Observation-Action Space Alignment via SE(3) Trajectory Prediction for Robotic Manipulation
par: Chen, Xinzhe, et autres
Publié: (2026)
par: Chen, Xinzhe, et autres
Publié: (2026)
Neural Interaction Energy for Multi-Agent Trajectory Prediction
par: Shen, Kaixin, et autres
Publié: (2024)
par: Shen, Kaixin, et autres
Publié: (2024)
Disentangled Neural Relational Inference for Interpretable Motion Prediction
par: Dax, Victoria M., et autres
Publié: (2024)
par: Dax, Victoria M., et autres
Publié: (2024)
Trajectory Entropy: Modeling Game State Stability from Multimodality Trajectory Prediction
par: Zhang, Yesheng, et autres
Publié: (2025)
par: Zhang, Yesheng, et autres
Publié: (2025)
ActionCodec: What Makes for Good Action Tokenizers
par: Dong, Zibin, et autres
Publié: (2026)
par: Dong, Zibin, et autres
Publié: (2026)
Action Hallucination in Generative Vision-Language-Action Models
par: Soh, Harold, et autres
Publié: (2026)
par: Soh, Harold, et autres
Publié: (2026)
Documents similaires
-
Let people fail! Exploring the influence of explainable virtual and robotic agents in learning-by-doing tasks
par: Matarese, Marco, et autres
Publié: (2024) -
Building Knowledge from Interactions: An LLM-Based Architecture for Adaptive Tutoring and Social Reasoning
par: Garello, Luca, et autres
Publié: (2025) -
Game Theory to Study Cooperation in Human-Robot Mixed Groups: Exploring the Potential of the Public Good Game
par: Pusceddu, Giulia, et autres
Publié: (2025) -
To Whom are You Talking? A Deep Learning Model to Endow Social Robots with Addressee Estimation Skills
par: Mazzola, Carlo, et autres
Publié: (2023) -
Correspondence learning between morphologically different robots via task demonstrations
par: Aktas, Hakan, et autres
Publié: (2023)