DistillGrasp: Integrating Features Correlation with Knowledge Distillation for Depth Completion of Transparent Objects
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yiheng, Chen, Junhong, Michiels, Nick, Asim, Muhammad, Claesen, Luc, Liu, Wenyin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DASP: Self-supervised Nighttime Monocular Depth Estimation with Domain Adaptation of Spatiotemporal Priors
par: Huang, Yiheng, et autres
Publié: (2025)
par: Huang, Yiheng, et autres
Publié: (2025)
Bit-mask Robust Contrastive Knowledge Distillation for Unsupervised Semantic Hashing
par: He, Liyang, et autres
Publié: (2024)
par: He, Liyang, et autres
Publié: (2024)
Semantic-Cohesive Knowledge Distillation for Deep Cross-modal Hashing
par: Sun, Changchang, et autres
Publié: (2025)
par: Sun, Changchang, et autres
Publié: (2025)
Multimodal Transformer Distillation for Audio-Visual Synchronization
par: Chen, Xuanjun, et autres
Publié: (2022)
par: Chen, Xuanjun, et autres
Publié: (2022)
RDP: Ranked Differential Privacy for Facial Feature Protection in Multiscale Sparsified Subspace
par: Ou, Lu, et autres
Publié: (2024)
par: Ou, Lu, et autres
Publié: (2024)
AlbumFill: Album-Guided Reasoning and Retrieval for Personalized Image Completion
par: Tsai, Yu-Ju, et autres
Publié: (2026)
par: Tsai, Yu-Ju, et autres
Publié: (2026)
FashionStylist: An Expert Knowledge-enhanced Multimodal Dataset for Fashion Understanding
par: Feng, Kaidong, et autres
Publié: (2026)
par: Feng, Kaidong, et autres
Publié: (2026)
FM2DS: Few-Shot Multimodal Multihop Data Synthesis with Knowledge Distillation for Question Answering
par: Abaskohi, Amirhossein, et autres
Publié: (2024)
par: Abaskohi, Amirhossein, et autres
Publié: (2024)
NanoVDR: Distilling a 2B Vision-Language Retriever into a 70M Text-Only Encoder for Visual Document Retrieval
par: Liu, Zhuchenyang, et autres
Publié: (2026)
par: Liu, Zhuchenyang, et autres
Publié: (2026)
Preference-Consistent Knowledge Distillation for Recommender System
par: Zhu, Zhangchi, et autres
Publié: (2023)
par: Zhu, Zhangchi, et autres
Publié: (2023)
PCFEx: Point Cloud Feature Extraction for Graph Neural Networks
par: Masud, Abdullah Al, et autres
Publié: (2026)
par: Masud, Abdullah Al, et autres
Publié: (2026)
PromptMM: Multi-Modal Knowledge Distillation for Recommendation with Prompt-Tuning
par: Wei, Wei, et autres
Publié: (2024)
par: Wei, Wei, et autres
Publié: (2024)
Unity is Strength: Unifying Convolutional and Transformeral Features for Better Person Re-Identification
par: Wang, Yuhao, et autres
Publié: (2024)
par: Wang, Yuhao, et autres
Publié: (2024)
Leveraging High-Resolution Features for Improved Deep Hashing-based Image Retrieval
par: Berriche, Aymene, et autres
Publié: (2024)
par: Berriche, Aymene, et autres
Publié: (2024)
Benchmarking Multimodal Large Language Models for Missing Modality Completion in Product Catalogues
par: Fu, Junchen, et autres
Publié: (2026)
par: Fu, Junchen, et autres
Publié: (2026)
FF-PNet: A Pyramid Network Based on Feature and Field for Brain Image Registration
par: Zhang, Ying, et autres
Publié: (2025)
par: Zhang, Ying, et autres
Publié: (2025)
GMM-Based Comprehensive Feature Extraction and Relative Distance Preservation For Few-Shot Cross-Modal Retrieval
par: Sun, Chengsong, et autres
Publié: (2025)
par: Sun, Chengsong, et autres
Publié: (2025)
FGNet: Leveraging Feature-Guided Attention to Refine SAM2 for 3D EM Neuron Segmentation
par: Li, Zhenghua, et autres
Publié: (2025)
par: Li, Zhenghua, et autres
Publié: (2025)
mmGAT: Pose Estimation by Graph Attention with Mutual Features from mmWave Radar Point Cloud
par: Masud, Abdullah Al, et autres
Publié: (2026)
par: Masud, Abdullah Al, et autres
Publié: (2026)
YOLO-Vehicle-Pro: A Cloud-Edge Collaborative Framework for Object Detection in Autonomous Driving under Adverse Weather Conditions
par: Li, Xiguang, et autres
Publié: (2024)
par: Li, Xiguang, et autres
Publié: (2024)
NativE: Multi-modal Knowledge Graph Completion in the Wild
par: Zhang, Yichi, et autres
Publié: (2024)
par: Zhang, Yichi, et autres
Publié: (2024)
Self-supervised Learning of Rotation-invariant 3D Point Set Features using Transformer and its Self-distillation
par: Furuya, Takahiko, et autres
Publié: (2023)
par: Furuya, Takahiko, et autres
Publié: (2023)
Rethinking Transparent Object Grasping: Depth Completion with Monocular Depth Estimation and Instance Mask
par: Cheng, Yaofeng, et autres
Publié: (2025)
par: Cheng, Yaofeng, et autres
Publié: (2025)
Feature Interaction Fusion Self-Distillation Network For CTR Prediction
par: Sang, Lei, et autres
Publié: (2024)
par: Sang, Lei, et autres
Publié: (2024)
Scalable Residual Feature Aggregation Framework with Hybrid Metaheuristic Optimization for Robust Early Pancreatic Neoplasm Detection in Multimodal CT Imaging
par: Thiruvengadam, Janani Annur, et autres
Publié: (2025)
par: Thiruvengadam, Janani Annur, et autres
Publié: (2025)
A Comprehensive Survey of Knowledge-Based Vision Question Answering Systems: The Lifecycle of Knowledge in Visual Reasoning Task
par: Deng, Jiaqi, et autres
Publié: (2025)
par: Deng, Jiaqi, et autres
Publié: (2025)
LOVO: Efficient Complex Object Query in Large-Scale Video Datasets
par: Liu, Yuxin, et autres
Publié: (2025)
par: Liu, Yuxin, et autres
Publié: (2025)
From Drawings to Decisions: A Hybrid Vision-Language Framework for Parsing 2D Engineering Drawings into Structured Manufacturing Knowledge
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
par: Khan, Muhammad Tayyab, et autres
Publié: (2025)
PairDistill: Pairwise Relevance Distillation for Dense Retrieval
par: Huang, Chao-Wei, et autres
Publié: (2024)
par: Huang, Chao-Wei, et autres
Publié: (2024)
Magic Tokens: Select Diverse Tokens for Multi-modal Object Re-Identification
par: Zhang, Pingping, et autres
Publié: (2024)
par: Zhang, Pingping, et autres
Publié: (2024)
Personalized Video Summarization using Text-Based Queries and Conditional Modeling
par: Huang, Jia-Hong
Publié: (2024)
par: Huang, Jia-Hong
Publié: (2024)
Beyond Final Answers: CRYSTAL Benchmark for Transparent Multimodal Reasoning Evaluation
par: Barrios, Wayner, et autres
Publié: (2026)
par: Barrios, Wayner, et autres
Publié: (2026)
Siamese Content-based Search Engine for a More Transparent Skin and Breast Cancer Diagnosis through Histological Imaging
par: Tabatabaei, Zahra, et autres
Publié: (2024)
par: Tabatabaei, Zahra, et autres
Publié: (2024)
Enabling Collaborative Parametric Knowledge Calibration for Retrieval-Augmented Vision Question Answering
par: Deng, Jiaqi, et autres
Publié: (2025)
par: Deng, Jiaqi, et autres
Publié: (2025)
From Swath to Full-Disc: Advancing Precipitation Retrieval with Multimodal Knowledge Expansion
par: Wang, Zheng, et autres
Publié: (2025)
par: Wang, Zheng, et autres
Publié: (2025)
Knowledge Discovery in Optical Music Recognition: Enhancing Information Retrieval with Instance Segmentation
par: Shatri, Elona, et autres
Publié: (2024)
par: Shatri, Elona, et autres
Publié: (2024)
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
par: Huang, Jinghao, et autres
Publié: (2025)
par: Huang, Jinghao, et autres
Publié: (2025)
From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents
par: Lian, Niu, et autres
Publié: (2026)
par: Lian, Niu, et autres
Publié: (2026)
Metric Learning with Progressive Self-Distillation for Audio-Visual Embedding Learning
par: Zeng, Donghuo, et autres
Publié: (2025)
par: Zeng, Donghuo, et autres
Publié: (2025)
Spatial-Temporal Knowledge Distillation for Takeaway Recommendation
par: Zhao, Shuyuan, et autres
Publié: (2024)
par: Zhao, Shuyuan, et autres
Publié: (2024)
Documents similaires
-
DASP: Self-supervised Nighttime Monocular Depth Estimation with Domain Adaptation of Spatiotemporal Priors
par: Huang, Yiheng, et autres
Publié: (2025) -
Bit-mask Robust Contrastive Knowledge Distillation for Unsupervised Semantic Hashing
par: He, Liyang, et autres
Publié: (2024) -
Semantic-Cohesive Knowledge Distillation for Deep Cross-modal Hashing
par: Sun, Changchang, et autres
Publié: (2025) -
Multimodal Transformer Distillation for Audio-Visual Synchronization
par: Chen, Xuanjun, et autres
Publié: (2022) -
RDP: Ranked Differential Privacy for Facial Feature Protection in Multiscale Sparsified Subspace
par: Ou, Lu, et autres
Publié: (2024)