R-AIF: Solving Sparse-Reward Robotic Tasks from Pixels with Active Inference and World Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen, Viet Dung, Yang, Zhizhuo, Buckley, Christopher L., Ororbia, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Model-Agnostic Meta-Learning on MetaWorld ML10 Benchmark: Fast Adaptation in Robotic Manipulation Tasks
par: Atamuradov, Sanjar
Publié: (2025)
par: Atamuradov, Sanjar
Publié: (2025)
PathFormer: A Transformer with 3D Grid Constraints for Digital Twin Robot-Arm Trajectory Generation
par: Alanazi, Ahmed, et autres
Publié: (2025)
par: Alanazi, Ahmed, et autres
Publié: (2025)
Think, Act, Learn: A Framework for Autonomous Robotic Agents using Closed-Loop Large Language Models
par: Menon, Anjali R., et autres
Publié: (2025)
par: Menon, Anjali R., et autres
Publié: (2025)
Inducing Causal World Models in LLMs for Zero-Shot Physical Reasoning
par: Sharma, Aditya, et autres
Publié: (2025)
par: Sharma, Aditya, et autres
Publié: (2025)
To Whom are You Talking? A Deep Learning Model to Endow Social Robots with Addressee Estimation Skills
par: Mazzola, Carlo, et autres
Publié: (2023)
par: Mazzola, Carlo, et autres
Publié: (2023)
FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA Models
par: Chen, Kewei, et autres
Publié: (2025)
par: Chen, Kewei, et autres
Publié: (2025)
ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models
par: Chen, Kewei, et autres
Publié: (2026)
par: Chen, Kewei, et autres
Publié: (2026)
Agentic UAVs: LLM-Driven Autonomy with Integrated Tool-Calling and Cognitive Reasoning
par: Koubaa, Anis, et autres
Publié: (2025)
par: Koubaa, Anis, et autres
Publié: (2025)
A Landmark-Aware Visual Navigation Dataset
par: Johnson, Faith, et autres
Publié: (2024)
par: Johnson, Faith, et autres
Publié: (2024)
RACAS: Controlling Diverse Robots With a Single Agentic System
par: Ashley, Dylan R., et autres
Publié: (2026)
par: Ashley, Dylan R., et autres
Publié: (2026)
Method of UAV Inspection of Photovoltaic Modules Using Thermal and RGB Data Fusion
par: Lysyi, Andrii, et autres
Publié: (2025)
par: Lysyi, Andrii, et autres
Publié: (2025)
A Survey on Vision-Language-Action Models for Embodied AI
par: Ma, Yueen, et autres
Publié: (2024)
par: Ma, Yueen, et autres
Publié: (2024)
Unpacking Hateful Memes: Presupposed Context and False Claims
par: Cai, Weibin, et autres
Publié: (2025)
par: Cai, Weibin, et autres
Publié: (2025)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method
par: Koh, Hyunseo, et autres
Publié: (2026)
par: Koh, Hyunseo, et autres
Publié: (2026)
Cooperative Perception: A Resource-Efficient Framework for Multi-Drone 3D Scene Reconstruction Using Federated Diffusion and NeRF
par: Pourmandi, Massoud
Publié: (2025)
par: Pourmandi, Massoud
Publié: (2025)
Contrastive Consolidation of Top-Down Modulations Achieves Sparsely Supervised Continual Learning
par: Tran, Viet Anh Khoa, et autres
Publié: (2025)
par: Tran, Viet Anh Khoa, et autres
Publié: (2025)
Emergence of Goal-Directed Behaviors via Active Inference with Self-Prior
par: Kim, Dongmin, et autres
Publié: (2025)
par: Kim, Dongmin, et autres
Publié: (2025)
IDOL: Instant Photorealistic 3D Human Creation from a Single Image
par: Zhuang, Yiyu, et autres
Publié: (2024)
par: Zhuang, Yiyu, et autres
Publié: (2024)
RoboMoRe: LLM-based Robot Co-design via Joint Optimization of Morphology and Reward
par: Fang, Jiawei, et autres
Publié: (2025)
par: Fang, Jiawei, et autres
Publié: (2025)
Active Inference with a Self-Prior in the Mirror-Mark Task
par: Kim, Dongmin, et autres
Publié: (2026)
par: Kim, Dongmin, et autres
Publié: (2026)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Biomedical Visual Instruction Tuning with Clinician Preference Alignment
par: Cui, Hejie, et autres
Publié: (2024)
par: Cui, Hejie, et autres
Publié: (2024)
Multimodal Generative AI for Story Point Estimation in Software Development
par: Islam, Mohammad Rubyet, et autres
Publié: (2025)
par: Islam, Mohammad Rubyet, et autres
Publié: (2025)
ABot-Claw: A Foundation for Persistent, Cooperative, and Self-Evolving Robotic Agents
par: Huo, Dongjie, et autres
Publié: (2026)
par: Huo, Dongjie, et autres
Publié: (2026)
Perception-Consistency Multimodal Large Language Models Reasoning via Caption-Regularized Policy Optimization
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
JAM: Controllable and Responsible Text Generation via Causal Reasoning and Latent Vector Manipulation
par: Huang, Yingbing, et autres
Publié: (2025)
par: Huang, Yingbing, et autres
Publié: (2025)
Safe Distributed Control of Multi-Robot Systems with Communication Delays
par: Ballotta, Luca, et autres
Publié: (2024)
par: Ballotta, Luca, et autres
Publié: (2024)
GLL: A Differentiable Graph Learning Layer for Neural Networks
par: Brown, Jason, et autres
Publié: (2024)
par: Brown, Jason, et autres
Publié: (2024)
CaLoRAify: Calorie Estimation with Visual-Text Pairing and LoRA-Driven Visual Language Models
par: Yao, Dongyu, et autres
Publié: (2024)
par: Yao, Dongyu, et autres
Publié: (2024)
Deterministic Event-Graph Substrates as World Models for Counterfactual Reasoning
par: Rovai, Fabio
Publié: (2026)
par: Rovai, Fabio
Publié: (2026)
Spectral Integrated Gradients for Coarse-to-Fine Feature Attribution
par: Kim, Soyeon, et autres
Publié: (2026)
par: Kim, Soyeon, et autres
Publié: (2026)
Manifold-Aligned Guided Integrated Gradients for Reliable Feature Attribution
par: Kim, Soyeon, et autres
Publié: (2026)
par: Kim, Soyeon, et autres
Publié: (2026)
Incremental Bootstrapping and Classification of Structured Scenes in a Fuzzy Ontology
par: Buoncompagni, Luca, et autres
Publié: (2024)
par: Buoncompagni, Luca, et autres
Publié: (2024)
SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation
par: Huang, Mu, et autres
Publié: (2026)
par: Huang, Mu, et autres
Publié: (2026)
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
par: Qesaraku, Bjorna, et autres
Publié: (2025)
par: Qesaraku, Bjorna, et autres
Publié: (2025)
Rethinking Visual Intelligence: Insights from Video Pretraining
par: Acuaviva, Pablo, et autres
Publié: (2025)
par: Acuaviva, Pablo, et autres
Publié: (2025)
When Does Global Attention Help? A Unified Empirical Study on Atomistic Graph Learning
par: Chowdhury, Arindam, et autres
Publié: (2025)
par: Chowdhury, Arindam, et autres
Publié: (2025)
Complex Facial Expression Recognition Using Deep Knowledge Distillation of Basic Features
par: Maiden, Angus, et autres
Publié: (2023)
par: Maiden, Angus, et autres
Publié: (2023)
YOLO Ensemble for UAV-based Multispectral Defect Detection in Wind Turbine Components
par: Svystun, Serhii, et autres
Publié: (2025)
par: Svystun, Serhii, et autres
Publié: (2025)
Documents similaires
-
Evaluating Model-Agnostic Meta-Learning on MetaWorld ML10 Benchmark: Fast Adaptation in Robotic Manipulation Tasks
par: Atamuradov, Sanjar
Publié: (2025) -
PathFormer: A Transformer with 3D Grid Constraints for Digital Twin Robot-Arm Trajectory Generation
par: Alanazi, Ahmed, et autres
Publié: (2025) -
Think, Act, Learn: A Framework for Autonomous Robotic Agents using Closed-Loop Large Language Models
par: Menon, Anjali R., et autres
Publié: (2025) -
Inducing Causal World Models in LLMs for Zero-Shot Physical Reasoning
par: Sharma, Aditya, et autres
Publié: (2025) -
To Whom are You Talking? A Deep Learning Model to Endow Social Robots with Addressee Estimation Skills
par: Mazzola, Carlo, et autres
Publié: (2023)