Enhanced Cross-modal 3D Retrieval via Tri-modal Reconstruction
Fuente:
arXiv
Salvato in:
| Autori principali: | Ren, Junlong, Wang, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SCA3D: Enhancing Cross-modal 3D Retrieval via 3D Shape and Caption Paired Data Augmentation
di: Ren, Junlong, et al.
Pubblicazione: (2025)
di: Ren, Junlong, et al.
Pubblicazione: (2025)
Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval
di: Wang, Yabing, et al.
Pubblicazione: (2024)
di: Wang, Yabing, et al.
Pubblicazione: (2024)
Prototype-based Aleatoric Uncertainty Quantification for Cross-modal Retrieval
di: Li, Hao, et al.
Pubblicazione: (2023)
di: Li, Hao, et al.
Pubblicazione: (2023)
Masked Contrastive Reconstruction for Cross-modal Medical Image-Report Retrieval
di: Wei, Zeqiang, et al.
Pubblicazione: (2023)
di: Wei, Zeqiang, et al.
Pubblicazione: (2023)
Dynamic Adapter with Semantics Disentangling for Cross-lingual Cross-modal Retrieval
di: Cai, Rui, et al.
Pubblicazione: (2024)
di: Cai, Rui, et al.
Pubblicazione: (2024)
SeCG: Semantic-Enhanced 3D Visual Grounding via Cross-modal Graph Attention
di: Xiao, Feng, et al.
Pubblicazione: (2024)
di: Xiao, Feng, et al.
Pubblicazione: (2024)
CrossTracker: Robust Multi-modal 3D Multi-Object Tracking via Cross Correction
di: Gu, Lipeng, et al.
Pubblicazione: (2024)
di: Gu, Lipeng, et al.
Pubblicazione: (2024)
Lightweight Contrastive Distilled Hashing for Online Cross-modal Retrieval
di: Li, Jiaxing, et al.
Pubblicazione: (2025)
di: Li, Jiaxing, et al.
Pubblicazione: (2025)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
Deep Reversible Consistency Learning for Cross-modal Retrieval
di: Pu, Ruitao, et al.
Pubblicazione: (2025)
di: Pu, Ruitao, et al.
Pubblicazione: (2025)
Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution
di: Yuan, Junyi, et al.
Pubblicazione: (2025)
di: Yuan, Junyi, et al.
Pubblicazione: (2025)
WaMo: Wavelet-Enhanced Multi-Frequency Trajectory Analysis for Fine-Grained Text-Motion Retrieval
di: Ren, Junlong, et al.
Pubblicazione: (2025)
di: Ren, Junlong, et al.
Pubblicazione: (2025)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
di: Zhang, Runmin, et al.
Pubblicazione: (2024)
di: Zhang, Runmin, et al.
Pubblicazione: (2024)
Mitigating Cross-modal Representation Bias for Multicultural Image-to-Recipe Retrieval
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion Recognition
di: He, Wen-Jue, et al.
Pubblicazione: (2025)
di: He, Wen-Jue, et al.
Pubblicazione: (2025)
AsyncBEV: Cross-modal Flow Alignment in Asynchronous 3D Object Detection
di: Wang, Shiming, et al.
Pubblicazione: (2026)
di: Wang, Shiming, et al.
Pubblicazione: (2026)
Enhancing Scientific Figure Captioning Through Cross-modal Learning
di: Rojas, Mateo Alejandro, et al.
Pubblicazione: (2024)
di: Rojas, Mateo Alejandro, et al.
Pubblicazione: (2024)
Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
di: Ren, Junlong, et al.
Pubblicazione: (2025)
di: Ren, Junlong, et al.
Pubblicazione: (2025)
Enhancing Incomplete Multi-modal Brain Tumor Segmentation with Intra-modal Asymmetry and Inter-modal Dependency
di: Liu, Weide, et al.
Pubblicazione: (2024)
di: Liu, Weide, et al.
Pubblicazione: (2024)
Tri-modal Confluence with Temporal Dynamics for Scene Graph Generation in Operating Rooms
di: Guo, Diandian, et al.
Pubblicazione: (2024)
di: Guo, Diandian, et al.
Pubblicazione: (2024)
Fine-grained Context and Multi-modal Alignment for Freehand 3D Ultrasound Reconstruction
di: Yan, Zhongnuo, et al.
Pubblicazione: (2024)
di: Yan, Zhongnuo, et al.
Pubblicazione: (2024)
FLEX-CLIP: Feature-Level GEneration Network Enhanced CLIP for X-shot Cross-modal Retrieval
di: Xie, Jingyou, et al.
Pubblicazione: (2024)
di: Xie, Jingyou, et al.
Pubblicazione: (2024)
Mentor3AD: Feature Reconstruction-based 3D Anomaly Detection via Multi-modality Mentor Learning
di: Liang, Hanzhe
Pubblicazione: (2025)
di: Liang, Hanzhe
Pubblicazione: (2025)
Multi-modal Semantic Understanding with Contrastive Cross-modal Feature Alignment
di: Zhang, Ming, et al.
Pubblicazione: (2024)
di: Zhang, Ming, et al.
Pubblicazione: (2024)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
di: Ma, Zehong, et al.
Pubblicazione: (2025)
di: Ma, Zehong, et al.
Pubblicazione: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
Hierarchical Cross-modal Prompt Learning for Vision-Language Models
di: Zheng, Hao, et al.
Pubblicazione: (2025)
di: Zheng, Hao, et al.
Pubblicazione: (2025)
Cross-modal learning for plankton recognition
di: Kareinen, Joona, et al.
Pubblicazione: (2026)
di: Kareinen, Joona, et al.
Pubblicazione: (2026)
OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
CLIP Multi-modal Hashing for Multimedia Retrieval
di: Zhu, Jian, et al.
Pubblicazione: (2024)
di: Zhu, Jian, et al.
Pubblicazione: (2024)
Unsupervised Spike Depth Estimation via Cross-modality Cross-domain Knowledge Transfer
di: Liu, Jiaming, et al.
Pubblicazione: (2022)
di: Liu, Jiaming, et al.
Pubblicazione: (2022)
T2ICount: Enhancing Cross-modal Understanding for Zero-Shot Counting
di: Qian, Yifei, et al.
Pubblicazione: (2025)
di: Qian, Yifei, et al.
Pubblicazione: (2025)
Reliable Cross-modal Alignment via Prototype Iterative Construction
di: Ma, Xiang, et al.
Pubblicazione: (2025)
di: Ma, Xiang, et al.
Pubblicazione: (2025)
Multi-modal Generation via Cross-Modal In-Context Learning
di: Kumar, Amandeep, et al.
Pubblicazione: (2024)
di: Kumar, Amandeep, et al.
Pubblicazione: (2024)
CDPR: Cross-modal Diffusion with Polarization for Reliable Monocular Depth Estimation
di: Yu, Rongjia, et al.
Pubblicazione: (2026)
di: Yu, Rongjia, et al.
Pubblicazione: (2026)
Eliminating Cross-modal Conflicts in BEV Space for LiDAR-Camera 3D Object Detection
di: Fu, Jiahui, et al.
Pubblicazione: (2024)
di: Fu, Jiahui, et al.
Pubblicazione: (2024)
A 3D Cross-modal Keypoint Descriptor for MR-US Matching and Registration
di: Morozov, Daniil, et al.
Pubblicazione: (2025)
di: Morozov, Daniil, et al.
Pubblicazione: (2025)
CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models
di: Huang, Junming, et al.
Pubblicazione: (2026)
di: Huang, Junming, et al.
Pubblicazione: (2026)
TRRG: Towards Truthful Radiology Report Generation With Cross-modal Disease Clue Enhanced Large Language Model
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
3DMIT: 3D Multi-modal Instruction Tuning for Scene Understanding
di: Li, Zeju, et al.
Pubblicazione: (2024)
di: Li, Zeju, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SCA3D: Enhancing Cross-modal 3D Retrieval via 3D Shape and Caption Paired Data Augmentation
di: Ren, Junlong, et al.
Pubblicazione: (2025) -
Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval
di: Wang, Yabing, et al.
Pubblicazione: (2024) -
Prototype-based Aleatoric Uncertainty Quantification for Cross-modal Retrieval
di: Li, Hao, et al.
Pubblicazione: (2023) -
Masked Contrastive Reconstruction for Cross-modal Medical Image-Report Retrieval
di: Wei, Zeqiang, et al.
Pubblicazione: (2023) -
Dynamic Adapter with Semantics Disentangling for Cross-lingual Cross-modal Retrieval
di: Cai, Rui, et al.
Pubblicazione: (2024)