RLBind: Adversarial-Invariant Cross-Modal Alignment for Unified Robust Embeddings
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Lu, Yuhong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SGAligner++: Cross-Modal Language-Aided 3D Scene Graph Alignment
von: Singh, Binod, et al.
Veröffentlicht: (2025)
von: Singh, Binod, et al.
Veröffentlicht: (2025)
Fast, Robust, Permutation-and-Sign Invariant SO(3) Pattern Alignment
von: Sarker, Anik, et al.
Veröffentlicht: (2025)
von: Sarker, Anik, et al.
Veröffentlicht: (2025)
Robust 3D Object Detection from LiDAR-Radar Point Clouds via Cross-Modal Feature Augmentation
von: Deng, Jianning, et al.
Veröffentlicht: (2023)
von: Deng, Jianning, et al.
Veröffentlicht: (2023)
Collaborative Representation Learning for Alignment of Tactile, Language, and Vision Modalities
von: Zhou, Yiyun, et al.
Veröffentlicht: (2025)
von: Zhou, Yiyun, et al.
Veröffentlicht: (2025)
Autoregressive End-to-End Planning with Time-Invariant Spatial Alignment and Multi-Objective Policy Refinement
von: Zhao, Jianbo, et al.
Veröffentlicht: (2025)
von: Zhao, Jianbo, et al.
Veröffentlicht: (2025)
ViTaPEs: Visuotactile Position Encodings for Cross-Modal Alignment in Multimodal Transformers
von: Lygerakis, Fotios, et al.
Veröffentlicht: (2025)
von: Lygerakis, Fotios, et al.
Veröffentlicht: (2025)
123D: Unifying Multi-Modal Autonomous Driving Data at Scale
von: Dauner, Daniel, et al.
Veröffentlicht: (2026)
von: Dauner, Daniel, et al.
Veröffentlicht: (2026)
BEVPose: Unveiling Scene Semantics through Pose-Guided Multi-Modal BEV Alignment
von: Hosseinzadeh, Mehdi, et al.
Veröffentlicht: (2024)
von: Hosseinzadeh, Mehdi, et al.
Veröffentlicht: (2024)
AffordGrasp: Cross-Modal Diffusion for Affordance-Aware Grasp Synthesis
von: Wu, Xiaofei, et al.
Veröffentlicht: (2026)
von: Wu, Xiaofei, et al.
Veröffentlicht: (2026)
Perspective-Invariant 3D Object Detection
von: Liang, Ao, et al.
Veröffentlicht: (2025)
von: Liang, Ao, et al.
Veröffentlicht: (2025)
Alignment Scores: Robust Metrics for Multiview Pose Accuracy Evaluation
von: Lee, Seong Hun, et al.
Veröffentlicht: (2024)
von: Lee, Seong Hun, et al.
Veröffentlicht: (2024)
Cross-Modal Visual Relocalization in Prior LiDAR Maps Utilizing Intensity Textures
von: Shen, Qiyuan, et al.
Veröffentlicht: (2024)
von: Shen, Qiyuan, et al.
Veröffentlicht: (2024)
Towards Dense and Accurate Radar Perception Via Efficient Cross-Modal Diffusion Model
von: Zhang, Ruibin, et al.
Veröffentlicht: (2024)
von: Zhang, Ruibin, et al.
Veröffentlicht: (2024)
XM-ALIGN: Unified Cross-Modal Embedding Alignment for Face-Voice Association
von: Fang, Zhihua, et al.
Veröffentlicht: (2025)
von: Fang, Zhihua, et al.
Veröffentlicht: (2025)
Multimodal Graph Representation Learning for Robust Surgical Workflow Recognition with Adversarial Feature Disentanglement
von: Bai, Long, et al.
Veröffentlicht: (2025)
von: Bai, Long, et al.
Veröffentlicht: (2025)
Multi-Modal Graph Convolutional Network with Sinusoidal Encoding for Robust Human Action Segmentation
von: Xing, Hao, et al.
Veröffentlicht: (2025)
von: Xing, Hao, et al.
Veröffentlicht: (2025)
Real-Time Lane Detection via Efficient Feature Alignment and Covariance Optimization for Low-Power Embedded Systems
von: Liu, Yian, et al.
Veröffentlicht: (2026)
von: Liu, Yian, et al.
Veröffentlicht: (2026)
Cross-Modal Semi-Dense 6-DoF Tracking of an Event Camera in Challenging Conditions
von: Zuo, Yi-Fan, et al.
Veröffentlicht: (2024)
von: Zuo, Yi-Fan, et al.
Veröffentlicht: (2024)
MambaPlace:Text-to-Point-Cloud Cross-Modal Place Recognition with Attention Mamba Mechanisms
von: Shang, Tianyi, et al.
Veröffentlicht: (2024)
von: Shang, Tianyi, et al.
Veröffentlicht: (2024)
CMR-Agent: Learning a Cross-Modal Agent for Iterative Image-to-Point Cloud Registration
von: Yao, Gongxin, et al.
Veröffentlicht: (2024)
von: Yao, Gongxin, et al.
Veröffentlicht: (2024)
IRIS-SLAM: Unified Geo-Instance Representations for Robust Semantic Localization and Mapping
von: Xiao, Tingyang, et al.
Veröffentlicht: (2026)
von: Xiao, Tingyang, et al.
Veröffentlicht: (2026)
SLAM Adversarial Lab: An Extensible Framework for Visual SLAM Robustness Evaluation under Adverse Conditions
von: Hefny, Mohamed, et al.
Veröffentlicht: (2026)
von: Hefny, Mohamed, et al.
Veröffentlicht: (2026)
RISeg: Robot Interactive Object Segmentation via Body Frame-Invariant Features
von: Qian, Howard H., et al.
Veröffentlicht: (2024)
von: Qian, Howard H., et al.
Veröffentlicht: (2024)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
von: Bai, Long, et al.
Veröffentlicht: (2024)
von: Bai, Long, et al.
Veröffentlicht: (2024)
DualCross: Cross-Modality Cross-Domain Adaptation for Monocular BEV Perception
von: Man, Yunze, et al.
Veröffentlicht: (2023)
von: Man, Yunze, et al.
Veröffentlicht: (2023)
UGG: Unified Generative Grasping
von: Lu, Jiaxin, et al.
Veröffentlicht: (2023)
von: Lu, Jiaxin, et al.
Veröffentlicht: (2023)
LiDAR-VGGT: Cross-Modal Coarse-to-Fine Fusion for Globally Consistent and Metric-Scale Dense Mapping
von: Wang, Lijie, et al.
Veröffentlicht: (2025)
von: Wang, Lijie, et al.
Veröffentlicht: (2025)
Bridging Text and Vision: A Multi-View Text-Vision Registration Approach for Cross-Modal Place Recognition
von: Shang, Tianyi, et al.
Veröffentlicht: (2025)
von: Shang, Tianyi, et al.
Veröffentlicht: (2025)
Structure-Invariant Range-Visual-Inertial Odometry
von: Alberico, Ivan, et al.
Veröffentlicht: (2024)
von: Alberico, Ivan, et al.
Veröffentlicht: (2024)
ComPose: A Unified Completion-Pose Framework for Robust Category-Level Object Pose Estimation
von: Ren, Huan, et al.
Veröffentlicht: (2026)
von: Ren, Huan, et al.
Veröffentlicht: (2026)
(MGS)$^2$-Net: Unifying Micro-Geometric Scale and Macro-Geometric Structure for Cross-View Geo-Localization
von: Li, Minglei, et al.
Veröffentlicht: (2026)
von: Li, Minglei, et al.
Veröffentlicht: (2026)
LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment
von: Xu, Yifu, et al.
Veröffentlicht: (2026)
von: Xu, Yifu, et al.
Veröffentlicht: (2026)
Monocular Visual Place Recognition in LiDAR Maps via Cross-Modal State Space Model and Multi-View Matching
von: Yao, Gongxin, et al.
Veröffentlicht: (2024)
von: Yao, Gongxin, et al.
Veröffentlicht: (2024)
UniBEV: Multi-modal 3D Object Detection with Uniform BEV Encoders for Robustness against Missing Sensor Modalities
von: Wang, Shiming, et al.
Veröffentlicht: (2023)
von: Wang, Shiming, et al.
Veröffentlicht: (2023)
Accelerated Rotation-Invariant Convolution for UAV Image Segmentation
von: Manduhu, Manduhu, et al.
Veröffentlicht: (2025)
von: Manduhu, Manduhu, et al.
Veröffentlicht: (2025)
BILTS: A Bi-Invariant Similarity Measure for Robust Object Trajectory Recognition under Reference Frame Variations
von: Verduyn, Arno, et al.
Veröffentlicht: (2024)
von: Verduyn, Arno, et al.
Veröffentlicht: (2024)
HAVT-IVD: Heterogeneity-Aware Cross-Modal Network for Audio-Visual Surveillance: Idling Vehicles Detection With Multichannel Audio and Multiscale Visual Cues
von: Li, Xiwen, et al.
Veröffentlicht: (2025)
von: Li, Xiwen, et al.
Veröffentlicht: (2025)
ModaLink: Unifying Modalities for Efficient Image-to-PointCloud Place Recognition
von: Xie, Weidong, et al.
Veröffentlicht: (2024)
von: Xie, Weidong, et al.
Veröffentlicht: (2024)
Residual Cross-Modal Fusion Networks for Audio-Visual Navigation
von: Wang, Yi, et al.
Veröffentlicht: (2026)
von: Wang, Yi, et al.
Veröffentlicht: (2026)
UniMoCo: Unified Modality Completion for Robust Multi-Modal Embeddings
von: Qin, Jiajun, et al.
Veröffentlicht: (2025)
von: Qin, Jiajun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SGAligner++: Cross-Modal Language-Aided 3D Scene Graph Alignment
von: Singh, Binod, et al.
Veröffentlicht: (2025) -
Fast, Robust, Permutation-and-Sign Invariant SO(3) Pattern Alignment
von: Sarker, Anik, et al.
Veröffentlicht: (2025) -
Robust 3D Object Detection from LiDAR-Radar Point Clouds via Cross-Modal Feature Augmentation
von: Deng, Jianning, et al.
Veröffentlicht: (2023) -
Collaborative Representation Learning for Alignment of Tactile, Language, and Vision Modalities
von: Zhou, Yiyun, et al.
Veröffentlicht: (2025) -
Autoregressive End-to-End Planning with Time-Invariant Spatial Alignment and Multi-Objective Policy Refinement
von: Zhao, Jianbo, et al.
Veröffentlicht: (2025)