EmbodiedVSR: Dynamic Scene Graph-Guided Chain-of-Thought Reasoning for Visual Spatial Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yi, Zhang, Qiang, Ju, Xiaozhu, Liu, Zhaoyang, Mao, Jilei, Sun, Jingkai, Wu, Jintao, Gao, Shixiong, Cai, Shihan, Qin, Zhiyuan, Liang, Linkai, Wang, Jiaxu, Duan, Yiqun, Cao, Jiahang, Xu, Renjing, Tang, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Event Masked Autoencoder: Point-wise Action Recognition with Event-Based Cameras
di: Sun, Jingkai, et al.
Pubblicazione: (2025)
di: Sun, Jingkai, et al.
Pubblicazione: (2025)
Prompting Multi-Modal Tokens to Enhance End-to-End Autonomous Driving Imitation Learning with LLMs
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
Prompt, Plan, Perform: LLM-based Humanoid Control via Quantized Imitation Learning
di: Sun, Jingkai, et al.
Pubblicazione: (2023)
di: Sun, Jingkai, et al.
Pubblicazione: (2023)
MoSA: Motion-constrained Stress Adaptation for Mitigating Real-to-Sim Gap in Continuum Dynamics via Learning Residual Anisotropy
di: Wang, Jiaxu, et al.
Pubblicazione: (2026)
di: Wang, Jiaxu, et al.
Pubblicazione: (2026)
Query-based Semantic Gaussian Field for Scene Representation in Reinforcement Learning
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
Occupancy World Model for Robots
di: Zhang, Zhang, et al.
Pubblicazione: (2025)
di: Zhang, Zhang, et al.
Pubblicazione: (2025)
Fully Spiking Neural Network for Legged Robots
di: Jiang, Xiaoyang, et al.
Pubblicazione: (2023)
di: Jiang, Xiaoyang, et al.
Pubblicazione: (2023)
Distillation-PPO: A Novel Two-Stage Reinforcement Learning Framework for Humanoid Robot Perceptive Locomotion
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
Modality-Composable Diffusion Policy via Inference-Time Distribution-level Composition
di: Cao, Jiahang, et al.
Pubblicazione: (2025)
di: Cao, Jiahang, et al.
Pubblicazione: (2025)
Robust SG-NeRF: Robust Scene Graph Aided Neural Surface Reconstruction
di: Gu, Yi, et al.
Pubblicazione: (2024)
di: Gu, Yi, et al.
Pubblicazione: (2024)
DEGS: Deformable Event-based 3D Gaussian Splatting from RGB and Event Stream
di: He, Junhao, et al.
Pubblicazione: (2025)
di: He, Junhao, et al.
Pubblicazione: (2025)
LiPS: Large-Scale Humanoid Robot Reinforcement Learning with Parallel-Series Structures
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
Reinforcement Learning with Generalizable Gaussian Splatting
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
DEL: Discrete Element Learner for Learning 3D Particle Dynamics with Neural Rendering
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
Trinity: A Modular Humanoid Robot AI System
di: Sun, Jingkai, et al.
Pubblicazione: (2025)
di: Sun, Jingkai, et al.
Pubblicazione: (2025)
Fast ECoT: Efficient Embodied Chain-of-Thought via Thoughts Reuse
di: Duan, Zhekai, et al.
Pubblicazione: (2025)
di: Duan, Zhekai, et al.
Pubblicazione: (2025)
Mamba as Decision Maker: Exploring Multi-scale Sequence Modeling in Offline Reinforcement Learning
di: Cao, Jiahang, et al.
Pubblicazione: (2024)
di: Cao, Jiahang, et al.
Pubblicazione: (2024)
EvGGS: A Collaborative Learning Framework for Event-based Generalizable Gaussian Splatting
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
ES-Parkour: Advanced Robot Parkour with Bio-inspired Event Camera and Spiking Neural Network
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning
di: Liu, Yuecheng, et al.
Pubblicazione: (2025)
di: Liu, Yuecheng, et al.
Pubblicazione: (2025)
E2H: A Two-Stage Non-Invasive Neural Signal Driven Humanoid Robotic Whole-Body Control Framework
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
FreeFly-Thinking : Aligning Chain-of-Thought Reasoning with Continuous UAV Navigation
di: Zhou, Jiaxu, et al.
Pubblicazione: (2026)
di: Zhou, Jiaxu, et al.
Pubblicazione: (2026)
DPL: Depth-only Perceptive Humanoid Locomotion via Realistic Depth Synthesis and Cross-Attention Terrain Reconstruction
di: Sun, Jingkai, et al.
Pubblicazione: (2025)
di: Sun, Jingkai, et al.
Pubblicazione: (2025)
Mamba Policy: Towards Efficient 3D Diffusion Policy with Hybrid Selective State Models
di: Cao, Jiahang, et al.
Pubblicazione: (2024)
di: Cao, Jiahang, et al.
Pubblicazione: (2024)
Learning Robust Generalizable Radiance Field with Visibility and Feature Augmented Point Representation
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
Chasing Day and Night: Towards Robust and Efficient All-Day Object Detection Guided by an Event Camera
di: Cao, Jiahang, et al.
Pubblicazione: (2023)
di: Cao, Jiahang, et al.
Pubblicazione: (2023)
Whole-body Humanoid Robot Locomotion with Human Reference
di: Zhang, Qiang, et al.
Pubblicazione: (2024)
di: Zhang, Qiang, et al.
Pubblicazione: (2024)
Expand VSR Benchmark for VLLM to Expertize in Spatial Rules
di: Xie, Peijin, et al.
Pubblicazione: (2024)
di: Xie, Peijin, et al.
Pubblicazione: (2024)
EagleVision: A Dual-Stage Framework with BEV-grounding-based Chain-of-Thought for Spatial Intelligence
di: Wan, Jiaxu, et al.
Pubblicazione: (2025)
di: Wan, Jiaxu, et al.
Pubblicazione: (2025)
Learning Null Geodesics for Gravitational Lensing Rendering in General Relativity
di: Sun, Mingyuan, et al.
Pubblicazione: (2025)
di: Sun, Mingyuan, et al.
Pubblicazione: (2025)
SmartAgent: Chain-of-User-Thought for Embodied Personalized Agent in Cyber World
di: Zhang, Jiaqi, et al.
Pubblicazione: (2024)
di: Zhang, Jiaqi, et al.
Pubblicazione: (2024)
Sparse View Distractor-Free Gaussian Splatting
di: Gu, Yi, et al.
Pubblicazione: (2026)
di: Gu, Yi, et al.
Pubblicazione: (2026)
Physical Priors Augmented Event-Based 3D Reconstruction
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
PFGS: High Fidelity Point Cloud Rendering via Feature Splatting
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
Do Latent Tokens Think? A Causal and Adversarial Analysis of Chain-of-Continuous-Thought
di: Zhang, Yuyi, et al.
Pubblicazione: (2025)
di: Zhang, Yuyi, et al.
Pubblicazione: (2025)
Body Discovery of Embodied AI
di: Sun, Zhe, et al.
Pubblicazione: (2025)
di: Sun, Zhe, et al.
Pubblicazione: (2025)
HumanoidPano: Hybrid Spherical Panoramic-LiDAR Cross-Modal Perception for Humanoid Robots
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
SEEA-R1: Tree-Structured Reinforcement Fine-Tuning for Self-Evolving Embodied Agents
di: Tian, Wanxin, et al.
Pubblicazione: (2025)
di: Tian, Wanxin, et al.
Pubblicazione: (2025)
Knowledge Editing through Chain-of-Thought
di: Wang, Changyue, et al.
Pubblicazione: (2024)
di: Wang, Changyue, et al.
Pubblicazione: (2024)
OmniD: Generalizable Robot Manipulation Policy via Image-Based BEV Representation
di: Mao, Jilei, et al.
Pubblicazione: (2025)
di: Mao, Jilei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Event Masked Autoencoder: Point-wise Action Recognition with Event-Based Cameras
di: Sun, Jingkai, et al.
Pubblicazione: (2025) -
Prompting Multi-Modal Tokens to Enhance End-to-End Autonomous Driving Imitation Learning with LLMs
di: Duan, Yiqun, et al.
Pubblicazione: (2024) -
Prompt, Plan, Perform: LLM-based Humanoid Control via Quantized Imitation Learning
di: Sun, Jingkai, et al.
Pubblicazione: (2023) -
MoSA: Motion-constrained Stress Adaptation for Mitigating Real-to-Sim Gap in Continuum Dynamics via Learning Residual Anisotropy
di: Wang, Jiaxu, et al.
Pubblicazione: (2026) -
Query-based Semantic Gaussian Field for Scene Representation in Reinforcement Learning
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)