HyCodePolicy: Hybrid Language Controllers for Multimodal Monitoring and Decision in Embodied Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yibin, Liang, Zhixuan, Chen, Zanxin, Chen, Tianxing, Hu, Mengkang, Dong, Wanxi, Xu, Congsheng, Han, Zhaoming, Qin, Yusen, Mu, Yao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation
par: Zhang, Yuhao, et autres
Publié: (2026)
par: Zhang, Yuhao, et autres
Publié: (2026)
ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs
par: Wu, Xin, et autres
Publié: (2026)
par: Wu, Xin, et autres
Publié: (2026)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
par: Hu, Mengkang, et autres
Publié: (2024)
par: Hu, Mengkang, et autres
Publié: (2024)
HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System
par: Yang, Tianshuo, et autres
Publié: (2026)
par: Yang, Tianshuo, et autres
Publié: (2026)
G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation
par: Chen, Tianxing, et autres
Publié: (2024)
par: Chen, Tianxing, et autres
Publié: (2024)
RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation
par: Chen, Tianxing, et autres
Publié: (2025)
par: Chen, Tianxing, et autres
Publié: (2025)
RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis
par: Mu, Yao, et autres
Publié: (2024)
par: Mu, Yao, et autres
Publié: (2024)
RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins (early version)
par: Mu, Yao, et autres
Publié: (2024)
par: Mu, Yao, et autres
Publié: (2024)
$π_0$-EqM: Equilibrium Matching for Closed-Loop Vision-Language-Action Control
par: Liu, Huanming, et autres
Publié: (2026)
par: Liu, Huanming, et autres
Publié: (2026)
RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins
par: Mu, Yao, et autres
Publié: (2025)
par: Mu, Yao, et autres
Publié: (2025)
Articulated Object Manipulation using Online Axis Estimation with SAM2-Based Tracking
par: Wang, Xi, et autres
Publié: (2024)
par: Wang, Xi, et autres
Publié: (2024)
HyTIP: Hybrid Temporal Information Propagation for Masked Conditional Residual Video Coding
par: Chen, Yi-Hsin, et autres
Publié: (2025)
par: Chen, Yi-Hsin, et autres
Publié: (2025)
From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation
par: Liu, Yibin, et autres
Publié: (2026)
par: Liu, Yibin, et autres
Publié: (2026)
Text2World: Benchmarking Large Language Models for Symbolic World Model Generation
par: Hu, Mengkang, et autres
Publié: (2025)
par: Hu, Mengkang, et autres
Publié: (2025)
Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models
par: Wang, Dehui, et autres
Publié: (2026)
par: Wang, Dehui, et autres
Publié: (2026)
HyMem: Hybrid Memory Architecture with Dynamic Retrieval Scheduling
par: Zhao, Xiaochen, et autres
Publié: (2026)
par: Zhao, Xiaochen, et autres
Publié: (2026)
Factors Influencing the Visualization of Fallopian Tubes in Hysterosalpingo‐Contrast Sonography (HyCoSy)—The Value of Multimodal HyCoSy in Visualizing the Fallopian Tubes
par: Yan Li, et autres
Publié: (2024)
par: Yan Li, et autres
Publié: (2024)
DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation
par: Liang, Zhixuan, et autres
Publié: (2024)
par: Liang, Zhixuan, et autres
Publié: (2024)
MM-ACT: Learn from Multimodal Parallel Generation to Act
par: Liang, Haotian, et autres
Publié: (2025)
par: Liang, Haotian, et autres
Publié: (2025)
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
par: Cheng, Zhili, et autres
Publié: (2025)
par: Cheng, Zhili, et autres
Publié: (2025)
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
par: Li, Manling, et autres
Publié: (2024)
par: Li, Manling, et autres
Publié: (2024)
X-WebAgentBench: A Multilingual Interactive Web Benchmark for Evaluating Global Agentic System
par: Wang, Peng, et autres
Publié: (2025)
par: Wang, Peng, et autres
Publié: (2025)
All Robots in One: A New Standard and Unified Dataset for Versatile, General-Purpose Embodied Agents
par: Wang, Zhiqiang, et autres
Publié: (2024)
par: Wang, Zhiqiang, et autres
Publié: (2024)
Force Policy: Learning Hybrid Force-Position Control Policy under Interaction Frame for Contact-Rich Manipulation
par: Fang, Hongjie, et autres
Publié: (2026)
par: Fang, Hongjie, et autres
Publié: (2026)
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models
par: Chen, Zhongxi, et autres
Publié: (2026)
par: Chen, Zhongxi, et autres
Publié: (2026)
Harnessing Embodied Agents: Runtime Governance for Policy-Constrained Execution
par: Qin, Xue, et autres
Publié: (2026)
par: Qin, Xue, et autres
Publié: (2026)
VideoWeaver: Multimodal Multi-View Video-to-Video Transfer for Embodied Agents
par: Eskandar, George, et autres
Publié: (2026)
par: Eskandar, George, et autres
Publié: (2026)
Do Coding Agents Understand Least-Privilege Authorization?
par: Yan, Zheng, et autres
Publié: (2026)
par: Yan, Zheng, et autres
Publié: (2026)
HyMAD: A Hybrid Multi-Activity Detection Approach for Border Surveillance and Monitoring
par: Srinivasan, Sriram, et autres
Publié: (2025)
par: Srinivasan, Sriram, et autres
Publié: (2025)
HyRES: A Hybrid Replication and Erasure Coding Approach to Data Storage
par: Lucani, Daniel E., et autres
Publié: (2025)
par: Lucani, Daniel E., et autres
Publié: (2025)
Extending Embodied Question Answering from Perception to Decision
par: Gong, Xicheng, et autres
Publié: (2026)
par: Gong, Xicheng, et autres
Publié: (2026)
HyEvo: Self-Evolving Hybrid Agentic Workflows for Efficient Reasoning
par: Xu, Beibei, et autres
Publié: (2026)
par: Xu, Beibei, et autres
Publié: (2026)
Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation
par: Yuan, Yifu, et autres
Publié: (2025)
par: Yuan, Yifu, et autres
Publié: (2025)
DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning
par: Li, Jianxiong, et autres
Publié: (2024)
par: Li, Jianxiong, et autres
Publié: (2024)
DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation
par: Han, Yifan, et autres
Publié: (2026)
par: Han, Yifan, et autres
Publié: (2026)
OWMM-Agent: Open World Mobile Manipulation With Multi-modal Agentic Data Synthesis
par: Chen, Junting, et autres
Publié: (2025)
par: Chen, Junting, et autres
Publié: (2025)
Scalable Multi-Agent Reinforcement Learning for Residential Load Scheduling under Data Governance
par: Qin, Zhaoming, et autres
Publié: (2021)
par: Qin, Zhaoming, et autres
Publié: (2021)
ProAct: A Dual-System Framework for Proactive Embodied Social Agents
par: Zhang, Zeyi, et autres
Publié: (2026)
par: Zhang, Zeyi, et autres
Publié: (2026)
HyMiRec: A Hybrid Multi-interest Learning Framework for LLM-based Sequential Recommendation
par: Zhou, Jingyi, et autres
Publié: (2025)
par: Zhou, Jingyi, et autres
Publié: (2025)
xiang-tian/FBGKm: FBGKm
par: Dong, Tianxing
Publié: (2025)
par: Dong, Tianxing
Publié: (2025)
Documents similaires
-
R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation
par: Zhang, Yuhao, et autres
Publié: (2026) -
ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs
par: Wu, Xin, et autres
Publié: (2026) -
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
par: Hu, Mengkang, et autres
Publié: (2024) -
HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System
par: Yang, Tianshuo, et autres
Publié: (2026) -
G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation
par: Chen, Tianxing, et autres
Publié: (2024)