Dual Dynamic Threshold Adjustment Strategy for Deep Metric Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Xiruo, Yao, Yazhou, Liu, Sheng, Shen, Fumin, Nie, Liqiang, Hua, Xiansheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Semi-supervised Semantic Segmentation with Multi-Constraint Consistency Learning
por: Yin, Jianjian, et al.
Publicado: (2025)
por: Yin, Jianjian, et al.
Publicado: (2025)
Efficient Token Compression for Vision Transformer with Spatial Information Preserved
por: Mao, Junzhu, et al.
Publicado: (2025)
por: Mao, Junzhu, et al.
Publicado: (2025)
Anti-Collapse Loss for Deep Metric Learning Based on Coding Rate Metric
por: Jiang, Xiruo, et al.
Publicado: (2024)
por: Jiang, Xiruo, et al.
Publicado: (2024)
A Light-weight Transformer-based Self-supervised Matching Network for Heterogeneous Images
por: Zhang, Wang, et al.
Publicado: (2024)
por: Zhang, Wang, et al.
Publicado: (2024)
Multimodal Learning on Low-Quality Data with Conformal Predictive Self-Calibration
por: Jiang, Xun, et al.
Publicado: (2026)
por: Jiang, Xun, et al.
Publicado: (2026)
Dual Knowledge-Enhanced Two-Stage Reasoner for Multimodal Dialog Systems
por: Chen, Xiaolin, et al.
Publicado: (2025)
por: Chen, Xiaolin, et al.
Publicado: (2025)
Multimodal Dialog Systems with Dual Knowledge-enhanced Generative Pretrained Language Model
por: Chen, Xiaolin, et al.
Publicado: (2022)
por: Chen, Xiaolin, et al.
Publicado: (2022)
Sentiment-enhanced Graph-based Sarcasm Explanation in Dialogue
por: Ouyang, Kun, et al.
Publicado: (2024)
por: Ouyang, Kun, et al.
Publicado: (2024)
Attribute-driven Disentangled Representation Learning for Multimodal Recommendation
por: Li, Zhenyang, et al.
Publicado: (2023)
por: Li, Zhenyang, et al.
Publicado: (2023)
Universal Organizer of SAM for Unsupervised Semantic Segmentation
por: Li, Tingting, et al.
Publicado: (2024)
por: Li, Tingting, et al.
Publicado: (2024)
Dynamic Multimodal Fusion via Meta-Learning Towards Micro-Video Recommendation
por: Liu, Han, et al.
Publicado: (2025)
por: Liu, Han, et al.
Publicado: (2025)
Self-Training Boosted Multi-Factor Matching Network for Composed Image Retrieval
por: Wen, Haokun, et al.
Publicado: (2023)
por: Wen, Haokun, et al.
Publicado: (2023)
Simple but Effective Raw-Data Level Multimodal Fusion for Composed Image Retrieval
por: Wen, Haokun, et al.
Publicado: (2024)
por: Wen, Haokun, et al.
Publicado: (2024)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
por: Gong, HongLin, et al.
Publicado: (2024)
por: Gong, HongLin, et al.
Publicado: (2024)
Dual-Stream Decoupled Learning for Temporal Consistency and Speaker Interaction in AVSD
por: Xiao, Junhao, et al.
Publicado: (2025)
por: Xiao, Junhao, et al.
Publicado: (2025)
GeoLink: A 3D-Aware Framework Towards Better Generalization in Cross-View Geo-Localization
por: Zhang, Hongyang, et al.
Publicado: (2026)
por: Zhang, Hongyang, et al.
Publicado: (2026)
Privacy-Preserving Multimedia Mobile Cloud Computing Using Protective Perturbation
por: Tang, Zhongze, et al.
Publicado: (2024)
por: Tang, Zhongze, et al.
Publicado: (2024)
RA-BLIP: Multimodal Adaptive Retrieval-Augmented Bootstrapping Language-Image Pre-training
por: Ding, Muhe, et al.
Publicado: (2024)
por: Ding, Muhe, et al.
Publicado: (2024)
PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning
por: Lyu, Yibo, et al.
Publicado: (2025)
por: Lyu, Yibo, et al.
Publicado: (2025)
Group Benefits Instances Selection for Data Purification
por: Cai, Zhenhuang, et al.
Publicado: (2024)
por: Cai, Zhenhuang, et al.
Publicado: (2024)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
por: Lin, Haoqiang, et al.
Publicado: (2025)
por: Lin, Haoqiang, et al.
Publicado: (2025)
Relating CNN-Transformer Fusion Network for Change Detection
por: Gao, Yuhao, et al.
Publicado: (2024)
por: Gao, Yuhao, et al.
Publicado: (2024)
Understanding Before Recommendation: Semantic Aspect-Aware Review Exploitation via Large Language Models
por: Liu, Fan, et al.
Publicado: (2023)
por: Liu, Fan, et al.
Publicado: (2023)
MAC-SLU: Multi-Intent Automotive Cabin Spoken Language Understanding Benchmark
por: Peng, Yuezhang, et al.
Publicado: (2025)
por: Peng, Yuezhang, et al.
Publicado: (2025)
Challenging Dataset and Multi-modal Gated Mixture of Experts Model for Remote Sensing Copy-Move Forgery Understanding
por: Zhang, Ze, et al.
Publicado: (2025)
por: Zhang, Ze, et al.
Publicado: (2025)
Deep Mamba Multi-modal Learning
por: Zhu, Jian, et al.
Publicado: (2024)
por: Zhu, Jian, et al.
Publicado: (2024)
GSSF: Generalized Structural Sparse Function for Deep Cross-modal Metric Learning
por: Diao, Haiwen, et al.
Publicado: (2024)
por: Diao, Haiwen, et al.
Publicado: (2024)
Truth in the Few: High-Value Data Selection for Efficient Multi-Modal Reasoning
por: Li, Shenshen, et al.
Publicado: (2025)
por: Li, Shenshen, et al.
Publicado: (2025)
UniCVR: From Alignment to Reranking for Unified Zero-Shot Composed Visual Retrieval
por: Wen, Haokun, et al.
Publicado: (2026)
por: Wen, Haokun, et al.
Publicado: (2026)
BadCM: Invisible Backdoor Attack Against Cross-Modal Learning
por: Zhang, Zheng, et al.
Publicado: (2024)
por: Zhang, Zheng, et al.
Publicado: (2024)
Balanced Multimodal Learning: An Unidirectional Dynamic Interaction Perspective
por: Wang, Shijie, et al.
Publicado: (2025)
por: Wang, Shijie, et al.
Publicado: (2025)
DIP: Diffusion Learning of Inconsistency Pattern for General DeepFake Detection
por: Nie, Fan, et al.
Publicado: (2024)
por: Nie, Fan, et al.
Publicado: (2024)
Cross-Modality and Within-Modality Regularization for Audio-Visual DeepFake Detection
por: Zou, Heqing, et al.
Publicado: (2024)
por: Zou, Heqing, et al.
Publicado: (2024)
Evaluation of Objective Image Quality Metrics for High-Fidelity Image Compression
por: Mohammadi, Shima, et al.
Publicado: (2025)
por: Mohammadi, Shima, et al.
Publicado: (2025)
ZO-ASR: Zeroth-Order Fine-Tuning of Speech Foundation Models without Back-Propagation
por: Peng, Yuezhang, et al.
Publicado: (2025)
por: Peng, Yuezhang, et al.
Publicado: (2025)
EyEar: Learning Audio Synchronized Human Gaze Trajectory Based on Physics-Informed Dynamics
por: Liu, Xiaochuan, et al.
Publicado: (2025)
por: Liu, Xiaochuan, et al.
Publicado: (2025)
NeRF View Synthesis: Subjective Quality Assessment and Objective Metrics Evaluation
por: Martin, Pedro, et al.
Publicado: (2024)
por: Martin, Pedro, et al.
Publicado: (2024)
HAIC: Improving Human Action Understanding and Generation with Better Captions for Multi-modal Large Language Models
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
Perceptual-oriented Learned Image Compression with Dynamic Kernel
por: Fu, Nianxiang, et al.
Publicado: (2024)
por: Fu, Nianxiang, et al.
Publicado: (2024)
DREAM: A Dual Representation Learning Model for Multimodal Recommendation
por: Zhang, Kangning, et al.
Publicado: (2024)
por: Zhang, Kangning, et al.
Publicado: (2024)
Ejemplares similares
-
Semi-supervised Semantic Segmentation with Multi-Constraint Consistency Learning
por: Yin, Jianjian, et al.
Publicado: (2025) -
Efficient Token Compression for Vision Transformer with Spatial Information Preserved
por: Mao, Junzhu, et al.
Publicado: (2025) -
Anti-Collapse Loss for Deep Metric Learning Based on Coding Rate Metric
por: Jiang, Xiruo, et al.
Publicado: (2024) -
A Light-weight Transformer-based Self-supervised Matching Network for Heterogeneous Images
por: Zhang, Wang, et al.
Publicado: (2024) -
Multimodal Learning on Low-Quality Data with Conformal Predictive Self-Calibration
por: Jiang, Xun, et al.
Publicado: (2026)