Efficient and Generalizable Environmental Understanding for Visual Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Ruoyu, Li, Xinshu, Wang, Chen, Yao, Lina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Causality-aligned Prompt Learning via Diffusion-based Counterfactual Generation
par: Li, Xinshu, et autres
Publié: (2025)
par: Li, Xinshu, et autres
Publié: (2025)
Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation
par: Gu, Shutian, et autres
Publié: (2026)
par: Gu, Shutian, et autres
Publié: (2026)
Causality-Aware Transformer Networks for Robotic Navigation
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Self-Distilled Disentangled Learning for Counterfactual Prediction
par: Li, Xinshu, et autres
Publié: (2024)
par: Li, Xinshu, et autres
Publié: (2024)
Deconfounded Causality-aware Parameter-Efficient Fine-Tuning for Problem-Solving Improvement of LLMs
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Independence Constrained Disentangled Representation Learning from Epistemological Perspective
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Regularized Multi-LLMs Collaboration for Enhanced Score-based Causal Discovery
par: Li, Xiaoxuan, et autres
Publié: (2024)
par: Li, Xiaoxuan, et autres
Publié: (2024)
DICE: Dynamic In-Context Example Selection in LLM Agents via Efficient Knowledge Transfer
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
SA-EMO: Structure-Aligned Encoder Mixture of Operators for Generalizable Full-waveform Inversion
par: Zhenyu, Wang, et autres
Publié: (2025)
par: Zhenyu, Wang, et autres
Publié: (2025)
GeNIE: A Generalizable Navigation System for In-the-Wild Environments
par: Wang, Jiaming, et autres
Publié: (2025)
par: Wang, Jiaming, et autres
Publié: (2025)
Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction
par: Li, Jia, et autres
Publié: (2026)
par: Li, Jia, et autres
Publié: (2026)
UnitedVLN: Generalizable Gaussian Splatting for Continuous Vision-Language Navigation
par: Dai, Guangzhao, et autres
Publié: (2024)
par: Dai, Guangzhao, et autres
Publié: (2024)
EasyInsert: A Data-Efficient and Generalizable Insertion Policy
par: Li, Guanghe, et autres
Publié: (2025)
par: Li, Guanghe, et autres
Publié: (2025)
Navigating Beyond Dropout: An Intriguing Solution Towards Generalizable Image Super Resolution
par: Wang, Hongjun, et autres
Publié: (2024)
par: Wang, Hongjun, et autres
Publié: (2024)
Towards Generalizable Safety in Crowd Navigation via Conformal Uncertainty Handling
par: Yao, Jianpeng, et autres
Publié: (2025)
par: Yao, Jianpeng, et autres
Publié: (2025)
An Efficient Insect-inspired Approach for Visual Point-goal Navigation
par: Lu, Yihe, et autres
Publié: (2026)
par: Lu, Yihe, et autres
Publié: (2026)
On Causally Disentangled State Representation Learning for Reinforcement Learning based Recommender Systems
par: Wang, Siyu, et autres
Publié: (2024)
par: Wang, Siyu, et autres
Publié: (2024)
MeshONet: A Generalizable and Efficient Operator Learning Method for Structured Mesh Generation
par: Xiao, Jing, et autres
Publié: (2025)
par: Xiao, Jing, et autres
Publié: (2025)
Understanding Task Aggregation for Generalizable Ultrasound Foundation Models
par: Wang, Fangyijie, et autres
Publié: (2026)
par: Wang, Fangyijie, et autres
Publié: (2026)
VecFormer: Towards Efficient and Generalizable Graph Transformer with Graph Token Attention
par: Zhou, Jingbo, et autres
Publié: (2026)
par: Zhou, Jingbo, et autres
Publié: (2026)
S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity
par: Yang, Xinyu, et autres
Publié: (2024)
par: Yang, Xinyu, et autres
Publié: (2024)
Visualizing the Invisible: Generative Visual Grounding Empowers Universal EEG Understanding in MLLMs
par: Pan, Jun-Yu, et autres
Publié: (2026)
par: Pan, Jun-Yu, et autres
Publié: (2026)
Generalizable Speech Deepfake Detection via Information Bottleneck Enhanced Adversarial Alignment
par: Huang, Pu, et autres
Publié: (2025)
par: Huang, Pu, et autres
Publié: (2025)
Unveiling the Surprising Efficacy of Navigation Understanding in End-to-End Autonomous Driving
par: Hua, Zhihua, et autres
Publié: (2026)
par: Hua, Zhihua, et autres
Publié: (2026)
EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
par: Yang, Zebin, et autres
Publié: (2025)
par: Yang, Zebin, et autres
Publié: (2025)
Audio-Guided Dynamic Modality Fusion with Stereo-Aware Attention for Audio-Visual Navigation
par: Li, Jia, et autres
Publié: (2025)
par: Li, Jia, et autres
Publié: (2025)
CANINE: Coaching Visually Impaired Users for Interactive Navigation with a Robot Guide Dog
par: Yu, Cunjun, et autres
Publié: (2026)
par: Yu, Cunjun, et autres
Publié: (2026)
Is That Rain? Understanding Effects on Visual Odometry Performance for Autonomous UAVs and Efficient DNN-based Rain Classification at the Edge
par: Albanese, Andrea, et autres
Publié: (2024)
par: Albanese, Andrea, et autres
Publié: (2024)
SpecVQA: A Benchmark for Spectral Understanding and Visual Question Answering in Scientific Images
par: Shen, Jialu, et autres
Publié: (2026)
par: Shen, Jialu, et autres
Publié: (2026)
AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes
par: Qiu, Jiahao, et autres
Publié: (2025)
par: Qiu, Jiahao, et autres
Publié: (2025)
Aerial World Model for Long-horizon Visual Generation and Navigation in 3D Space
par: Zhang, Weichen, et autres
Publié: (2025)
par: Zhang, Weichen, et autres
Publié: (2025)
Audio-Guided Visual Perception for Audio-Visual Navigation
par: Wang, Yi, et autres
Publié: (2025)
par: Wang, Yi, et autres
Publié: (2025)
Transferring Foundation Models for Generalizable Robotic Manipulation
par: Yang, Jiange, et autres
Publié: (2023)
par: Yang, Jiange, et autres
Publié: (2023)
OmniVideoBench: Towards Audio-Visual Understanding Evaluation for Omni MLLMs
par: Li, Caorui, et autres
Publié: (2025)
par: Li, Caorui, et autres
Publié: (2025)
MIRAGE: The Illusion of Visual Understanding
par: Asadi, Mohammad, et autres
Publié: (2026)
par: Asadi, Mohammad, et autres
Publié: (2026)
UNeMo: Collaborative Visual-Language Reasoning and Navigation via a Multimodal World Model
par: Huang, Changxin, et autres
Publié: (2025)
par: Huang, Changxin, et autres
Publié: (2025)
The Fourier Spectral Transformer Networks For Efficient and Generalizable Nonlinear PDEs Prediction
par: Li, Beibei
Publié: (2025)
par: Li, Beibei
Publié: (2025)
Exploring Context Generalizability in Citywide Crowd Mobility Prediction: An Analytic Framework and Benchmark
par: Chen, Liyue, et autres
Publié: (2021)
par: Chen, Liyue, et autres
Publié: (2021)
Parallel Reinforcement Learning Simulation for Visual Quadrotor Navigation
par: Saunders, Jack, et autres
Publié: (2022)
par: Saunders, Jack, et autres
Publié: (2022)
Beyond Matching to Tiles: Bridging Unaligned Aerial and Satellite Views for Vision-Only UAV Navigation
par: Liu, Kejia, et autres
Publié: (2026)
par: Liu, Kejia, et autres
Publié: (2026)
Documents similaires
-
Causality-aligned Prompt Learning via Diffusion-based Counterfactual Generation
par: Li, Xinshu, et autres
Publié: (2025) -
Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation
par: Gu, Shutian, et autres
Publié: (2026) -
Causality-Aware Transformer Networks for Robotic Navigation
par: Wang, Ruoyu, et autres
Publié: (2024) -
Self-Distilled Disentangled Learning for Counterfactual Prediction
par: Li, Xinshu, et autres
Publié: (2024) -
Deconfounded Causality-aware Parameter-Efficient Fine-Tuning for Problem-Solving Improvement of LLMs
par: Wang, Ruoyu, et autres
Publié: (2024)