Diffusion-Based Cross-Modal Feature Extraction for Multi-Label Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Lan, Tian, Zheng, Yiming, Yin, Jianxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Visual Error Patterns in Multi-Modal AI: A Statistical Approach
di: Wang, Ching-Yi
Pubblicazione: (2024)
di: Wang, Ching-Yi
Pubblicazione: (2024)
Style-Based Neural Architectures for Real-Time Weather Classification
di: Ouattara, Hamed, et al.
Pubblicazione: (2026)
di: Ouattara, Hamed, et al.
Pubblicazione: (2026)
TASTE: A Designer-Annotated Multi-Dimensional Preference Dataset for AI-Generated Graphic Design
di: Zhu, Haonan, et al.
Pubblicazione: (2026)
di: Zhu, Haonan, et al.
Pubblicazione: (2026)
VACT: A Video Automatic Causal Testing System and a Benchmark
di: Yang, Haotong, et al.
Pubblicazione: (2025)
di: Yang, Haotong, et al.
Pubblicazione: (2025)
Morphological Detection and Classification of Microplastics and Nanoplastics Emerged from Consumer Products by Deep Learning
di: Rezvani, Hadi, et al.
Pubblicazione: (2024)
di: Rezvani, Hadi, et al.
Pubblicazione: (2024)
MultiDiffSense: Diffusion-Based Multi-Modal Visuo-Tactile Image Generation Conditioned on Object Shape and Contact Pose
di: Bhouri, Sirine, et al.
Pubblicazione: (2026)
di: Bhouri, Sirine, et al.
Pubblicazione: (2026)
Multi-Modal Video Feature Extraction for Popularity Prediction
di: Liu, Haixu, et al.
Pubblicazione: (2025)
di: Liu, Haixu, et al.
Pubblicazione: (2025)
Multi-Prompt with Depth Partitioned Cross-Modal Learning
di: Tian, Yingjie, et al.
Pubblicazione: (2023)
di: Tian, Yingjie, et al.
Pubblicazione: (2023)
Unifying Visual and Semantic Feature Spaces with Diffusion Models for Enhanced Cross-Modal Alignment
di: Zheng, Yuze, et al.
Pubblicazione: (2024)
di: Zheng, Yuze, et al.
Pubblicazione: (2024)
Landcover classification and change detection using remote sensing and machine learning: a case study of Western Fiji
di: Gurjar, Yadvendra, et al.
Pubblicazione: (2025)
di: Gurjar, Yadvendra, et al.
Pubblicazione: (2025)
Scalable Dynamic Origin-Destination Demand Estimation Enhanced by High-Resolution Satellite Imagery Data
di: Liu, Jiachao, et al.
Pubblicazione: (2025)
di: Liu, Jiachao, et al.
Pubblicazione: (2025)
AI-Assisted Decision-Making for Clinical Assessment of Auto-Segmented Contour Quality
di: Wang, Biling, et al.
Pubblicazione: (2025)
di: Wang, Biling, et al.
Pubblicazione: (2025)
IMC 2024 Methods & Solutions Review
di: Gupta, Shyam, et al.
Pubblicazione: (2024)
di: Gupta, Shyam, et al.
Pubblicazione: (2024)
Remote sensing data imputation using deep learning for multispectral imagery
di: Liua, Shuang, et al.
Pubblicazione: (2026)
di: Liua, Shuang, et al.
Pubblicazione: (2026)
Aortic root landmark localization with optimal transport loss for heatmap regression
di: Ishizone, Tsuyoshi, et al.
Pubblicazione: (2024)
di: Ishizone, Tsuyoshi, et al.
Pubblicazione: (2024)
OrthoDiffusion: A Generalizable Multi-Task Diffusion Foundation Model for Musculoskeletal MRI Interpretation
di: Lan, Tian, et al.
Pubblicazione: (2026)
di: Lan, Tian, et al.
Pubblicazione: (2026)
TinyBayes: Closed-Form Bayesian Inference via Jacobi Prior for Real-Time Image Classification on Edge Devices
di: Sardar, Shouvik, et al.
Pubblicazione: (2026)
di: Sardar, Shouvik, et al.
Pubblicazione: (2026)
Seeing is Believing: Robust Vision-Guided Cross-Modal Prompt Learning under Label Noise
di: Geng, Zibin, et al.
Pubblicazione: (2026)
di: Geng, Zibin, et al.
Pubblicazione: (2026)
A Large-Scale Benchmark of Cross-Modal Learning for Histology and Gene Expression in Spatial Transcriptomics
di: Gindra, Rushin H., et al.
Pubblicazione: (2025)
di: Gindra, Rushin H., et al.
Pubblicazione: (2025)
Semantic-Consistent Bidirectional Contrastive Hashing for Noisy Multi-Label Cross-Modal Retrieval
di: Peng, Likang, et al.
Pubblicazione: (2025)
di: Peng, Likang, et al.
Pubblicazione: (2025)
Provable Contrastive Continual Learning
di: Wen, Yichen, et al.
Pubblicazione: (2024)
di: Wen, Yichen, et al.
Pubblicazione: (2024)
Incomplete Multi-View Multi-Label Classification via Shared Codebook and Fused-Teacher Self-Distillation
di: Yan, Xu, et al.
Pubblicazione: (2026)
di: Yan, Xu, et al.
Pubblicazione: (2026)
MDF-MLLM: Deep Fusion Through Cross-Modal Feature Alignment for Contextually Aware Fundoscopic Image Classification
di: Jordan, Jason, et al.
Pubblicazione: (2025)
di: Jordan, Jason, et al.
Pubblicazione: (2025)
Distilling Cross-Modal Knowledge via Feature Disentanglement
di: Liu, Junhong, et al.
Pubblicazione: (2025)
di: Liu, Junhong, et al.
Pubblicazione: (2025)
Tri-Modal Motion Retrieval by Learning a Joint Embedding Space
di: Yin, Kangning, et al.
Pubblicazione: (2024)
di: Yin, Kangning, et al.
Pubblicazione: (2024)
Multi-Modal Character Localization and Extraction for Chinese Text Recognition
di: Li, Qilong, et al.
Pubblicazione: (2026)
di: Li, Qilong, et al.
Pubblicazione: (2026)
Leveraging Cross-Modal Neighbor Representation for Improved CLIP Classification
di: Yi, Chao, et al.
Pubblicazione: (2024)
di: Yi, Chao, et al.
Pubblicazione: (2024)
On-Device Diffusion Transformer Policy for Efficient Robot Manipulation
di: Wu, Yiming, et al.
Pubblicazione: (2025)
di: Wu, Yiming, et al.
Pubblicazione: (2025)
Hierarchical Multi-modal Transformer for Cross-modal Long Document Classification
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
KM-GPT: An Automated Pipeline for Reconstructing Individual Patient Data from Kaplan-Meier Plots
di: Zhao, Yao, et al.
Pubblicazione: (2025)
di: Zhao, Yao, et al.
Pubblicazione: (2025)
BiDepth: A Bidirectional-Depth Neural Network for Spatio-Temporal Prediction
di: Ehsani, Sina, et al.
Pubblicazione: (2025)
di: Ehsani, Sina, et al.
Pubblicazione: (2025)
AlphaEarth Satellite Embeddings for Modelling Climate Sensitive Diseases Towards Global Health Resilience
di: Nazir, Usman, et al.
Pubblicazione: (2026)
di: Nazir, Usman, et al.
Pubblicazione: (2026)
Promoting AI Equity in Science: Generalized Domain Prompt Learning for Accessible VLM Research
di: Cao, Qinglong, et al.
Pubblicazione: (2024)
di: Cao, Qinglong, et al.
Pubblicazione: (2024)
Massimo: Public Queue Monitoring and Management using Mass-Spring Model
di: Kumar, Abhijeet, et al.
Pubblicazione: (2024)
di: Kumar, Abhijeet, et al.
Pubblicazione: (2024)
Wilcoxon Nonparametric CFAR Scheme for Ship Detection in SAR Image
di: Meng, Xiangwei
Pubblicazione: (2024)
di: Meng, Xiangwei
Pubblicazione: (2024)
SDTN and TRN: Adaptive Spectral-Spatial Feature Extraction for Hyperspectral Image Classification
di: Ye, Fuyin, et al.
Pubblicazione: (2025)
di: Ye, Fuyin, et al.
Pubblicazione: (2025)
Multi-Label Classification Framework for Hurricane Damage Assessment
di: Liu, Zhangding, et al.
Pubblicazione: (2025)
di: Liu, Zhangding, et al.
Pubblicazione: (2025)
HELM: Hierarchical and Explicit Label Modeling with Graph Learning for Multi-Label Image Classification
di: Stoimchev, Marjan, et al.
Pubblicazione: (2026)
di: Stoimchev, Marjan, et al.
Pubblicazione: (2026)
Understanding Learning with Sliced-Wasserstein Requires Rethinking Informative Slices
di: Tran, Huy, et al.
Pubblicazione: (2024)
di: Tran, Huy, et al.
Pubblicazione: (2024)
CRFT: Consistent-Recurrent Feature Flow Transformer for Cross-Modal Image Registration
di: Liu, Xuecong, et al.
Pubblicazione: (2026)
di: Liu, Xuecong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Visual Error Patterns in Multi-Modal AI: A Statistical Approach
di: Wang, Ching-Yi
Pubblicazione: (2024) -
Style-Based Neural Architectures for Real-Time Weather Classification
di: Ouattara, Hamed, et al.
Pubblicazione: (2026) -
TASTE: A Designer-Annotated Multi-Dimensional Preference Dataset for AI-Generated Graphic Design
di: Zhu, Haonan, et al.
Pubblicazione: (2026) -
VACT: A Video Automatic Causal Testing System and a Benchmark
di: Yang, Haotong, et al.
Pubblicazione: (2025) -
Morphological Detection and Classification of Microplastics and Nanoplastics Emerged from Consumer Products by Deep Learning
di: Rezvani, Hadi, et al.
Pubblicazione: (2024)