Customizable Perturbation Synthesis for Robust SLAM Benchmarking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Xiaohao, Zhang, Tianyi, Wang, Sibo, Li, Xiang, Chen, Yongqi, Li, Ye, Raj, Bhiksha, Johnson-Roberson, Matthew, Huang, Xiaonan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Perfect to Noisy World Simulation: Customizable Embodied Multi-modal Perturbations for SLAM Robustness Benchmarking
par: Xu, Xiaohao, et autres
Publié: (2024)
par: Xu, Xiaohao, et autres
Publié: (2024)
Scalable Benchmarking and Robust Learning for Noise-Free Ego-Motion and 3D Reconstruction from Noisy Video
par: Xu, Xiaohao, et autres
Publié: (2025)
par: Xu, Xiaohao, et autres
Publié: (2025)
Learning Shared RGB-D Fields: Unified Self-supervised Pre-training for Label-efficient LiDAR-Camera 3D Perception
par: Xu, Xiaohao, et autres
Publié: (2024)
par: Xu, Xiaohao, et autres
Publié: (2024)
Towards Ambiguity-Free Spatial Foundation Model: Rethinking and Decoupling Depth Ambiguity
par: Xu, Xiaohao, et autres
Publié: (2025)
par: Xu, Xiaohao, et autres
Publié: (2025)
2D or 3D: Who Governs Salience in VLA Models? -- Tri-Stage Token Pruning Framework with Modality Salience Awareness
par: Zheng, Zihao, et autres
Publié: (2026)
par: Zheng, Zihao, et autres
Publié: (2026)
PanoGen++: Domain-Adapted Text-Guided Panoramic Environment Generation for Vision-and-Language Navigation
par: Wang, Sen, et autres
Publié: (2025)
par: Wang, Sen, et autres
Publié: (2025)
$\text{R}^2$-Bench: Benchmarking the Robustness of Referring Perception Models under Perturbations
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
StereoVAE: A lightweight stereo-matching system using embedded GPUs
par: Chang, Qiong, et autres
Publié: (2023)
par: Chang, Qiong, et autres
Publié: (2023)
XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments
par: Qian, Kangan, et autres
Publié: (2026)
par: Qian, Kangan, et autres
Publié: (2026)
Integrating Multi-Modal Sensors: A Review of Fusion Techniques for Intelligent Vehicles
par: Wei, Chuheng, et autres
Publié: (2025)
par: Wei, Chuheng, et autres
Publié: (2025)
EQ-TAA: Equivariant Traffic Accident Anticipation via Diffusion-Based Accident Video Synthesis
par: Fang, Jianwu, et autres
Publié: (2025)
par: Fang, Jianwu, et autres
Publié: (2025)
HR-INR: Continuous Space-Time Video Super-Resolution via Event Camera
par: Lu, Yunfan, et autres
Publié: (2024)
par: Lu, Yunfan, et autres
Publié: (2024)
RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
par: Huang, Zhijian, et autres
Publié: (2024)
par: Huang, Zhijian, et autres
Publié: (2024)
WoW: Towards a World omniscient World model Through Embodied Interaction
par: Chi, Xiaowei, et autres
Publié: (2025)
par: Chi, Xiaowei, et autres
Publié: (2025)
Is Your LiDAR Placement Optimized for 3D Scene Understanding?
par: Li, Ye, et autres
Publié: (2024)
par: Li, Ye, et autres
Publié: (2024)
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
Photorealistic Phantom Roads in Real Scenes: Disentangling 3D Hallucinations from Physical Geometry
par: Nguyen, Hoang, et autres
Publié: (2025)
par: Nguyen, Hoang, et autres
Publié: (2025)
DarkGS: Learning Neural Illumination and 3D Gaussians Relighting for Robotic Exploration in the Dark
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
WaterVG: Waterway Visual Grounding based on Text-Guided Vision and mmWave Radar
par: Guan, Runwei, et autres
Publié: (2024)
par: Guan, Runwei, et autres
Publié: (2024)
UniScene: Multi-Camera Unified Pre-training via 3D Scene Reconstruction for Autonomous Driving
par: Min, Chen, et autres
Publié: (2023)
par: Min, Chen, et autres
Publié: (2023)
EVA: An Embodied World Model for Future Video Anticipation
par: Chi, Xiaowei, et autres
Publié: (2024)
par: Chi, Xiaowei, et autres
Publié: (2024)
Unifying Scene Representation and Hand-Eye Calibration with 3D Foundation Models
par: Zhi, Weiming, et autres
Publié: (2024)
par: Zhi, Weiming, et autres
Publié: (2024)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
par: Miao, Bingchen, et autres
Publié: (2024)
par: Miao, Bingchen, et autres
Publié: (2024)
MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
par: Zeng, Kang, et autres
Publié: (2024)
par: Zeng, Kang, et autres
Publié: (2024)
Exploring Event-based Human Pose Estimation with 3D Event Representations
par: Yin, Xiaoting, et autres
Publié: (2023)
par: Yin, Xiaoting, et autres
Publié: (2023)
TimeSpot: Benchmarking Geo-Temporal Understanding in Vision-Language Models in Real-World Settings
par: Wasi, Azmine Toushik, et autres
Publié: (2026)
par: Wasi, Azmine Toushik, et autres
Publié: (2026)
SplArt: Articulation Estimation and Part-Level Reconstruction with 3D Gaussian Splatting
par: Lin, Shengjie, et autres
Publié: (2025)
par: Lin, Shengjie, et autres
Publié: (2025)
Extending Visual Dynamics for Video-to-Music Generation
par: Liu, Xiaohao, et autres
Publié: (2025)
par: Liu, Xiaohao, et autres
Publié: (2025)
PhysNav-DG: A Novel Adaptive Framework for Robust VLM-Sensor Fusion in Navigation Applications
par: Srinivasan, Trisanth, et autres
Publié: (2025)
par: Srinivasan, Trisanth, et autres
Publié: (2025)
SurgSora: Object-Aware Diffusion Model for Controllable Surgical Video Generation
par: Chen, Tong, et autres
Publié: (2024)
par: Chen, Tong, et autres
Publié: (2024)
MorphText: Deep Morphology Regularized Arbitrary-shape Scene Text Detection
par: Xu, Chengpei, et autres
Publié: (2024)
par: Xu, Chengpei, et autres
Publié: (2024)
Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration
par: Wang, Jun, et autres
Publié: (2026)
par: Wang, Jun, et autres
Publié: (2026)
Transferable Learned Image Compression-Resistant Adversarial Perturbations
par: Sui, Yang, et autres
Publié: (2024)
par: Sui, Yang, et autres
Publié: (2024)
When Search Becomes Memory: Turning Robot Design Trials into Transferable Skills
par: Wang, Yunfei, et autres
Publié: (2026)
par: Wang, Yunfei, et autres
Publié: (2026)
Bi-Manual Joint Camera Calibration and Scene Representation
par: Tang, Haozhan, et autres
Publié: (2025)
par: Tang, Haozhan, et autres
Publié: (2025)
Enhancing Generalization in Medical Visual Question Answering Tasks via Gradient-Guided Model Perturbation
par: Liu, Gang, et autres
Publié: (2024)
par: Liu, Gang, et autres
Publié: (2024)
SpecFLASH: A Latent-Guided Semi-autoregressive Speculative Decoding Framework for Efficient Multimodal Generation
par: Wang, Zihua, et autres
Publié: (2025)
par: Wang, Zihua, et autres
Publié: (2025)
A Very Big Video Reasoning Suite
par: Wang, Maijunxian, et autres
Publié: (2026)
par: Wang, Maijunxian, et autres
Publié: (2026)
VC-Bench: Pioneering the Video Connecting Benchmark with a Dataset and Evaluation Metrics
par: Yin, Zhiyu, et autres
Publié: (2026)
par: Yin, Zhiyu, et autres
Publié: (2026)
Seeing Text in the Dark: Algorithm and Benchmark
par: Xu, Chengpei, et autres
Publié: (2024)
par: Xu, Chengpei, et autres
Publié: (2024)
Documents similaires
-
From Perfect to Noisy World Simulation: Customizable Embodied Multi-modal Perturbations for SLAM Robustness Benchmarking
par: Xu, Xiaohao, et autres
Publié: (2024) -
Scalable Benchmarking and Robust Learning for Noise-Free Ego-Motion and 3D Reconstruction from Noisy Video
par: Xu, Xiaohao, et autres
Publié: (2025) -
Learning Shared RGB-D Fields: Unified Self-supervised Pre-training for Label-efficient LiDAR-Camera 3D Perception
par: Xu, Xiaohao, et autres
Publié: (2024) -
Towards Ambiguity-Free Spatial Foundation Model: Rethinking and Decoupling Depth Ambiguity
par: Xu, Xiaohao, et autres
Publié: (2025) -
2D or 3D: Who Governs Salience in VLA Models? -- Tri-Stage Token Pruning Framework with Modality Salience Awareness
par: Zheng, Zihao, et autres
Publié: (2026)