Deep Contrastive Multi-view Clustering under Semantic Feature Guidance
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Siwen, Liu, Jinyan, Yuan, Hanning, Li, Qi, Geng, Jing, Yuan, Ziqiang, Han, Huaxu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Follow-Your-MultiPose: Tuning-Free Multi-Character Text-to-Video Generation via Pose Guidance
por: Zhang, Beiyuan, et al.
Publicado: (2024)
por: Zhang, Beiyuan, et al.
Publicado: (2024)
DeepSPG: Exploring Deep Semantic Prior Guidance for Low-light Image Enhancement with Multimodal Learning
por: Lu, Jialang, et al.
Publicado: (2025)
por: Lu, Jialang, et al.
Publicado: (2025)
Simple Yet Effective Selective Imputation for Incomplete Multi-view Clustering
por: Xu, Cai, et al.
Publicado: (2025)
por: Xu, Cai, et al.
Publicado: (2025)
Robust Fuzzy Multi-view Learning under View Conflict
por: Duan, Siyuan, et al.
Publicado: (2026)
por: Duan, Siyuan, et al.
Publicado: (2026)
MVPbev: Multi-view Perspective Image Generation from BEV with Test-time Controllability and Generalizability
por: Liu, Buyu, et al.
Publicado: (2024)
por: Liu, Buyu, et al.
Publicado: (2024)
SMC++: Masked Learning of Unsupervised Video Semantic Compression
por: Tian, Yuan, et al.
Publicado: (2024)
por: Tian, Yuan, et al.
Publicado: (2024)
Regularized Contrastive Partial Multi-view Outlier Detection
por: Wang, Yijia, et al.
Publicado: (2024)
por: Wang, Yijia, et al.
Publicado: (2024)
RealX3D: A Physically-Degraded 3D Benchmark for Multi-view Visual Restoration and Reconstruction
por: Liu, Shuhong, et al.
Publicado: (2025)
por: Liu, Shuhong, et al.
Publicado: (2025)
Continual Panoptic Perception: Towards Multi-modal Incremental Interpretation of Remote Sensing Images
por: Yuan, Bo, et al.
Publicado: (2024)
por: Yuan, Bo, et al.
Publicado: (2024)
Contrastive Pre-Training with Multi-View Fusion for No-Reference Point Cloud Quality Assessment
por: Shan, Ziyu, et al.
Publicado: (2024)
por: Shan, Ziyu, et al.
Publicado: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
Semantic-Aware Adversarial Training for Reliable Deep Hashing Retrieval
por: Yuan, Xu, et al.
Publicado: (2023)
por: Yuan, Xu, et al.
Publicado: (2023)
Calibration & Reconstruction: Deep Integrated Language for Referring Image Segmentation
por: Yan, Yichen, et al.
Publicado: (2024)
por: Yan, Yichen, et al.
Publicado: (2024)
Generalizable Deepfake Detection Based on Forgery-aware Layer Masking and Multi-artifact Subspace Decomposition
por: Zhang, Xiang, et al.
Publicado: (2026)
por: Zhang, Xiang, et al.
Publicado: (2026)
Rethinking Multi-view Representation Learning via Distilled Disentangling
por: Ke, Guanzhou, et al.
Publicado: (2024)
por: Ke, Guanzhou, et al.
Publicado: (2024)
Adaptive 3D Gaussian Splatting Video Streaming
por: Gong, Han, et al.
Publicado: (2025)
por: Gong, Han, et al.
Publicado: (2025)
EALD-MLLM: Emotion Analysis in Long-sequential and De-identity videos with Multi-modal Large Language Model
por: Li, Deng, et al.
Publicado: (2024)
por: Li, Deng, et al.
Publicado: (2024)
Spatial-Aware Efficient Projector for MLLMs via Multi-Layer Feature Aggregation
por: Qian, Shun, et al.
Publicado: (2024)
por: Qian, Shun, et al.
Publicado: (2024)
Generalized Video Anomaly Event Detection: Systematic Taxonomy and Comparison of Deep Models
por: Liu, Yang, et al.
Publicado: (2023)
por: Liu, Yang, et al.
Publicado: (2023)
Probabilistic Temporal Masked Attention for Cross-view Online Action Detection
por: Xie, Liping, et al.
Publicado: (2025)
por: Xie, Liping, et al.
Publicado: (2025)
Proxy-Tuning: Tailoring Multimodal Autoregressive Models for Subject-Driven Image Generation
por: Wu, Yi, et al.
Publicado: (2025)
por: Wu, Yi, et al.
Publicado: (2025)
In Anticipation of Perfect Deepfake: Identity-anchored Artifact-agnostic Detection under Rebalanced Deepfake Detection Protocol
por: Wang, Wei-Han, et al.
Publicado: (2024)
por: Wang, Wei-Han, et al.
Publicado: (2024)
Wavelet-Decoupling Contrastive Enhancement Network for Fine-Grained Skeleton-Based Action Recognition
por: Chang, Haochen, et al.
Publicado: (2024)
por: Chang, Haochen, et al.
Publicado: (2024)
DT-UFC: Universal Large Model Feature Coding via Peaky-to-Balanced Distribution Transformation
por: Gao, Changsheng, et al.
Publicado: (2025)
por: Gao, Changsheng, et al.
Publicado: (2025)
PetalView: Fine-grained Location and Orientation Extraction of Street-view Images via Cross-view Local Search with Supplementary Materials
por: Hu, Wenmiao, et al.
Publicado: (2024)
por: Hu, Wenmiao, et al.
Publicado: (2024)
Dynamic Resolution Guidance for Facial Expression Recognition
por: Wang, Songpan, et al.
Publicado: (2024)
por: Wang, Songpan, et al.
Publicado: (2024)
Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval
por: Yang, Yuxin, et al.
Publicado: (2026)
por: Yang, Yuxin, et al.
Publicado: (2026)
MindTuner: Cross-Subject Visual Decoding with Visual Fingerprint and Semantic Correction
por: Gong, Zixuan, et al.
Publicado: (2024)
por: Gong, Zixuan, et al.
Publicado: (2024)
Multiscale Feature Importance-based Bit Allocation for End-to-End Feature Coding for Machines
por: Liu, Junle, et al.
Publicado: (2025)
por: Liu, Junle, et al.
Publicado: (2025)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
por: Gao, Jiayi, et al.
Publicado: (2025)
por: Gao, Jiayi, et al.
Publicado: (2025)
MERIT: Multilingual Semantic Retrieval with Interleaved Multi-Condition Query
por: Chow, Wei, et al.
Publicado: (2025)
por: Chow, Wei, et al.
Publicado: (2025)
Multi-modal Speech Emotion Recognition via Feature Distribution Adaptation Network
por: Li, Shaokai, et al.
Publicado: (2024)
por: Li, Shaokai, et al.
Publicado: (2024)
OS-HGAdapter: Open Semantic Hypergraph Adapter for Large Language Models Assisted Entropy-Enhanced Image-Text Alignment
por: Chen, Rongjun, et al.
Publicado: (2025)
por: Chen, Rongjun, et al.
Publicado: (2025)
Agent Journey Beyond RGB: Hierarchical Semantic-Spatial Representation Enrichment for Vision-and-Language Navigation
por: Zhang, Xuesong, et al.
Publicado: (2024)
por: Zhang, Xuesong, et al.
Publicado: (2024)
SNP-S3: Shared Network Pre-training and Significant Semantic Strengthening for Various Video-Text Tasks
por: Dong, Xingning, et al.
Publicado: (2024)
por: Dong, Xingning, et al.
Publicado: (2024)
Mono3DVG-EnSD: Enhanced Spatial-aware and Dimension-decoupled Text Encoding for Monocular 3D Visual Grounding
por: Li, Yuzhen, et al.
Publicado: (2025)
por: Li, Yuzhen, et al.
Publicado: (2025)
D2SL: Decouple Defogging and Semantic Learning for Foggy Domain-Adaptive Segmentation
por: Sun, Xuan, et al.
Publicado: (2024)
por: Sun, Xuan, et al.
Publicado: (2024)
Semi-supervised Semantic Segmentation with Multi-Constraint Consistency Learning
por: Yin, Jianjian, et al.
Publicado: (2025)
por: Yin, Jianjian, et al.
Publicado: (2025)
WVSC: Wireless Video Semantic Communication with Multi-frame Compensation
por: Xie, Bingyan, et al.
Publicado: (2025)
por: Xie, Bingyan, et al.
Publicado: (2025)
Dual-Modal Attention-Enhanced Text-Video Retrieval with Triplet Partial Margin Contrastive Learning
por: Jiang, Chen, et al.
Publicado: (2023)
por: Jiang, Chen, et al.
Publicado: (2023)
Ejemplares similares
-
Follow-Your-MultiPose: Tuning-Free Multi-Character Text-to-Video Generation via Pose Guidance
por: Zhang, Beiyuan, et al.
Publicado: (2024) -
DeepSPG: Exploring Deep Semantic Prior Guidance for Low-light Image Enhancement with Multimodal Learning
por: Lu, Jialang, et al.
Publicado: (2025) -
Simple Yet Effective Selective Imputation for Incomplete Multi-view Clustering
por: Xu, Cai, et al.
Publicado: (2025) -
Robust Fuzzy Multi-view Learning under View Conflict
por: Duan, Siyuan, et al.
Publicado: (2026) -
MVPbev: Multi-view Perspective Image Generation from BEV with Test-time Controllability and Generalizability
por: Liu, Buyu, et al.
Publicado: (2024)