GaLa: Hypergraph-Guided Visual Language Models for Procedural Planning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Kun, Li, Yiming, Qu, Mingcheng, Zhang, Aqiang, Yang, Guang, Su, Tonghua |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HMVLA: Hyperbolic Multimodal Fusion for Vision-Language-Action Models
par: Wang, Kun, et autres
Publié: (2026)
par: Wang, Kun, et autres
Publié: (2026)
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
par: Qu, Mingcheng, et autres
Publié: (2025)
par: Qu, Mingcheng, et autres
Publié: (2025)
Memory-Augmented Incomplete Multimodal Survival Prediction via Cross-Slide and Gene-Attentive Hypergraph Learning
par: Qu, Mingcheng, et autres
Publié: (2025)
par: Qu, Mingcheng, et autres
Publié: (2025)
LaViPlan : Language-Guided Visual Path Planning with RLVR
par: Oh, Hayeon
Publié: (2025)
par: Oh, Hayeon
Publié: (2025)
Visual-Language-Guided Task Planning for Horticultural Robots
par: Cuaran, Jose, et autres
Publié: (2026)
par: Cuaran, Jose, et autres
Publié: (2026)
Language-Guided Long Horizon Manipulation with LLM-based Planning and Visual Perception
par: Zhou, Changshi, et autres
Publié: (2025)
par: Zhou, Changshi, et autres
Publié: (2025)
Floor Plan-Guided Visual Navigation Incorporating Depth and Directional Cues
par: Huang, Weiqi, et autres
Publié: (2025)
par: Huang, Weiqi, et autres
Publié: (2025)
FloorPlan-VLN: A New Paradigm for Floor Plan Guided Vision-Language Navigation
par: Chen, Kehan, et autres
Publié: (2026)
par: Chen, Kehan, et autres
Publié: (2026)
VLMPlanner: Integrating Visual Language Models with Motion Planning
par: Tang, Zhipeng, et autres
Publié: (2025)
par: Tang, Zhipeng, et autres
Publié: (2025)
Policy-Guided World Model Planning for Language-Conditioned Visual Navigation
par: Chahe, Amirhosein, et autres
Publié: (2026)
par: Chahe, Amirhosein, et autres
Publié: (2026)
Guiding Long-Horizon Task and Motion Planning with Vision Language Models
par: Yang, Zhutian, et autres
Publié: (2024)
par: Yang, Zhutian, et autres
Publié: (2024)
NaviDiffusor: Cost-Guided Diffusion Model for Visual Navigation
par: Zeng, Yiming, et autres
Publié: (2025)
par: Zeng, Yiming, et autres
Publié: (2025)
A Vision-Language-Action Model with Visual Prompt for OFF-Road Autonomous Driving
par: Zhang, Liangdong, et autres
Publié: (2026)
par: Zhang, Liangdong, et autres
Publié: (2026)
LLM-GROP: Visually Grounded Robot Task and Motion Planning with Large Language Models
par: Zhang, Xiaohan, et autres
Publié: (2025)
par: Zhang, Xiaohan, et autres
Publié: (2025)
LLM+MAP: Bimanual Robot Task Planning using Large Language Models and Planning Domain Definition Language
par: Chu, Kun, et autres
Publié: (2025)
par: Chu, Kun, et autres
Publié: (2025)
WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models
par: Chen, Hongjin, et autres
Publié: (2026)
par: Chen, Hongjin, et autres
Publié: (2026)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
par: Xue, Wei, et autres
Publié: (2026)
par: Xue, Wei, et autres
Publié: (2026)
Multi-Agent Planning Using Visual Language Models
par: Brienza, Michele, et autres
Publié: (2024)
par: Brienza, Michele, et autres
Publié: (2024)
TAPOM: Task-Space Topology-Guided Motion Planning for Manipulating Elongated Object in Cluttered Environments
par: Li, Zihao, et autres
Publié: (2025)
par: Li, Zihao, et autres
Publié: (2025)
Boundary-Guided Learning for Gene Expression Prediction in Spatial Transcriptomics
par: Qu, Mingcheng, et autres
Publié: (2024)
par: Qu, Mingcheng, et autres
Publié: (2024)
H-WM: Robotic Task and Motion Planning Guided by Hierarchical World Model
par: Huang, Jinbang, et autres
Publié: (2026)
par: Huang, Jinbang, et autres
Publié: (2026)
GeneralVLA: Generalizable Vision-Language-Action Models with Knowledge-Guided Trajectory Planning
par: Ma, Guoqing, et autres
Publié: (2026)
par: Ma, Guoqing, et autres
Publié: (2026)
Direct Contact-Tolerant Motion Planning With Vision Language Models
par: Li, He, et autres
Publié: (2026)
par: Li, He, et autres
Publié: (2026)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
par: Ren, Ke, et autres
Publié: (2026)
par: Ren, Ke, et autres
Publié: (2026)
DepthCache: Depth-Guided Training-Free Visual Token Merging for Vision-Language-Action Model Inference
par: Li, Yuquan, et autres
Publié: (2026)
par: Li, Yuquan, et autres
Publié: (2026)
RoboDexVLM: Visual Language Model-Enabled Task Planning and Motion Control for Dexterous Robot Manipulation
par: Liu, Haichao, et autres
Publié: (2025)
par: Liu, Haichao, et autres
Publié: (2025)
Configuration Space Distance Fields for Manipulation Planning
par: Li, Yiming, et autres
Publié: (2024)
par: Li, Yiming, et autres
Publié: (2024)
FloNa: Floor Plan Guided Embodied Visual Navigation
par: Li, Jiaxin, et autres
Publié: (2024)
par: Li, Jiaxin, et autres
Publié: (2024)
VIP-Loco: A Visually Guided Infinite Horizon Planning Framework for Legged Locomotion
par: Shirwatkar, Aditya, et autres
Publié: (2026)
par: Shirwatkar, Aditya, et autres
Publié: (2026)
PSALM-V: Automating Symbolic Planning in Interactive Visual Environments with Large Language Models
par: Zhu, Wang Bill, et autres
Publié: (2025)
par: Zhu, Wang Bill, et autres
Publié: (2025)
PlanAgent: A Multi-modal Large Language Agent for Closed-loop Vehicle Motion Planning
par: Zheng, Yupeng, et autres
Publié: (2024)
par: Zheng, Yupeng, et autres
Publié: (2024)
Lazy-DaSH: Lazy Approach for Hypergraph-based Multi-robot Task and Motion Planning
par: Lee, Seongwon, et autres
Publié: (2025)
par: Lee, Seongwon, et autres
Publié: (2025)
AutoFPDesigner: Automated Flight Procedure Design Based on Multi-Agent Large Language Model
par: Zhu, Longtao, et autres
Publié: (2024)
par: Zhu, Longtao, et autres
Publié: (2024)
Precise Interception Flight Targets by Image-based Visual Servoing of Multicopter
par: Yan, Hailong, et autres
Publié: (2024)
par: Yan, Hailong, et autres
Publié: (2024)
HBTP: Heuristic Behavior Tree Planning with Large Language Model Reasoning
par: Cai, Yishuai, et autres
Publié: (2024)
par: Cai, Yishuai, et autres
Publié: (2024)
Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching
par: Wei, Yujie, et autres
Publié: (2026)
par: Wei, Yujie, et autres
Publié: (2026)
Mixed-Reality-Guided Teleoperation of a Collaborative Robot for Surgical Procedures
par: Rus, Gabriela, et autres
Publié: (2024)
par: Rus, Gabriela, et autres
Publié: (2024)
SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model
par: Qu, Delin, et autres
Publié: (2025)
par: Qu, Delin, et autres
Publié: (2025)
Vision Language Models Can Parse Floor Plan Maps
par: DeFazio, David, et autres
Publié: (2024)
par: DeFazio, David, et autres
Publié: (2024)
SmallPlan: Leverage Small Language Models for Sequential Path Planning with Simulation-Powered, LLM-Guided Distillation
par: Pham, Quang P. M., et autres
Publié: (2025)
par: Pham, Quang P. M., et autres
Publié: (2025)
Documents similaires
-
HMVLA: Hyperbolic Multimodal Fusion for Vision-Language-Action Models
par: Wang, Kun, et autres
Publié: (2026) -
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
par: Qu, Mingcheng, et autres
Publié: (2025) -
Memory-Augmented Incomplete Multimodal Survival Prediction via Cross-Slide and Gene-Attentive Hypergraph Learning
par: Qu, Mingcheng, et autres
Publié: (2025) -
LaViPlan : Language-Guided Visual Path Planning with RLVR
par: Oh, Hayeon
Publié: (2025) -
Visual-Language-Guided Task Planning for Horticultural Robots
par: Cuaran, Jose, et autres
Publié: (2026)