Wasserstein-Aligned Hyperbolic Multi-View Clustering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Rui, Jiang, Yuting, Luo, Xiaoqing, Wu, Xiao-Jun, Sebe, Nicu, Chen, Ziheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hyperbolic Busemann Neural Networks
par: Chen, Ziheng, et autres
Publié: (2026)
par: Chen, Ziheng, et autres
Publié: (2026)
Understanding Matrix Function Normalizations in Covariance Pooling through the Lens of Riemannian Geometry
par: Chen, Ziheng, et autres
Publié: (2024)
par: Chen, Ziheng, et autres
Publié: (2024)
AlignCAT: Visual-Linguistic Alignment of Category and Attribute for Weakly Supervised Visual Grounding
par: Wang, Yidan, et autres
Publié: (2025)
par: Wang, Yidan, et autres
Publié: (2025)
PoInit-of-View: Poisoning Initialization of Views Transfers Across Multiple 3D Reconstruction Systems
par: Wang, Weijie, et autres
Publié: (2026)
par: Wang, Weijie, et autres
Publié: (2026)
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
Token Reduction via Local and Global Contexts Optimization for Efficient Video Large Language Models
par: Li, Jinlong, et autres
Publié: (2026)
par: Li, Jinlong, et autres
Publié: (2026)
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
par: Xing, Songlong, et autres
Publié: (2025)
par: Xing, Songlong, et autres
Publié: (2025)
Vision+X: A Survey on Multimodal Learning in the Light of Data
par: Zhu, Ye, et autres
Publié: (2022)
par: Zhu, Ye, et autres
Publié: (2022)
Hierarchical Cross-Attention Network for Virtual Try-On
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
RankFeat&RankWeight: Rank-1 Feature/Weight Removal for Out-of-distribution Detection
par: Song, Yue, et autres
Publié: (2023)
par: Song, Yue, et autres
Publié: (2023)
Rethinking the Learning Paradigm for Facial Expression Recognition
par: Wang, Weijie, et autres
Publié: (2022)
par: Wang, Weijie, et autres
Publié: (2022)
Reverse Personalization
par: Kung, Han-Wei, et autres
Publié: (2025)
par: Kung, Han-Wei, et autres
Publié: (2025)
Probabilistically Aligned View-unaligned Clustering with Adaptive Template Selection
par: Dong, Wenhua, et autres
Publié: (2024)
par: Dong, Wenhua, et autres
Publié: (2024)
Generalized Fine-Grained Category Discovery with Multi-Granularity Conceptual Experts
par: Zheng, Haiyang, et autres
Publié: (2025)
par: Zheng, Haiyang, et autres
Publié: (2025)
Asymmetric GANs for Image-to-Image Translation
par: Tang, Hao, et autres
Publié: (2019)
par: Tang, Hao, et autres
Publié: (2019)
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
par: Li, Jinlong, et autres
Publié: (2025)
par: Li, Jinlong, et autres
Publié: (2025)
High-Fidelity 3D Facial Avatar Synthesis with Controllable Fine-Grained Expressions
par: He, Yikang, et autres
Publié: (2026)
par: He, Yikang, et autres
Publié: (2026)
Anti-Forgetting Adaptation for Unsupervised Person Re-identification
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Inverse Virtual Try-On: Generating Multi-Category Product-Style Images from Clothed Individuals
par: Lobba, Davide, et autres
Publié: (2025)
par: Lobba, Davide, et autres
Publié: (2025)
NullFace: Training-Free Localized Face Anonymization
par: Kung, Han-Wei, et autres
Publié: (2025)
par: Kung, Han-Wei, et autres
Publié: (2025)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
MTGA: Multi-View Temporal Granularity Aligned Aggregation for Event-Based Lip-Reading
par: Zhang, Wenhao, et autres
Publié: (2024)
par: Zhang, Wenhao, et autres
Publié: (2024)
Generate, Refine, and Encode: Leveraging Synthesized Novel Samples for On-the-Fly Fine-Grained Category Discovery
par: Liu, Xiao, et autres
Publié: (2025)
par: Liu, Xiao, et autres
Publié: (2025)
Cues3D: Unleashing the Power of Sole NeRF for Consistent and Unique Instances in Open-Vocabulary 3D Panoptic Segmentation
par: Xue, Feng, et autres
Publié: (2025)
par: Xue, Feng, et autres
Publié: (2025)
RAGME: Retrieval Augmented Video Generation for Enhanced Motion Realism
par: Peruzzo, Elia, et autres
Publié: (2025)
par: Peruzzo, Elia, et autres
Publié: (2025)
Prototypical Hash Encoding for On-the-Fly Fine-Grained Category Discovery
par: Zheng, Haiyang, et autres
Publié: (2024)
par: Zheng, Haiyang, et autres
Publié: (2024)
Optimizing Resource Consumption in Diffusion Models through Hallucination Early Detection
par: Betti, Federico, et autres
Publié: (2024)
par: Betti, Federico, et autres
Publié: (2024)
Hallucination Early Detection in Diffusion Models
par: Betti, Federico, et autres
Publié: (2026)
par: Betti, Federico, et autres
Publié: (2026)
Textual Knowledge Matters: Cross-Modality Co-Teaching for Generalized Visual Class Discovery
par: Zheng, Haiyang, et autres
Publié: (2024)
par: Zheng, Haiyang, et autres
Publié: (2024)
Transferable-guided Attention Is All You Need for Video Domain Adaptation
par: Sacilotti, André, et autres
Publié: (2024)
par: Sacilotti, André, et autres
Publié: (2024)
MVReward: Better Aligning and Evaluating Multi-View Diffusion Models with Human Preferences
par: Wang, Weitao, et autres
Publié: (2024)
par: Wang, Weitao, et autres
Publié: (2024)
Towards End-to-End Explainable Facial Action Unit Recognition via Vision-Language Joint Learning
par: Ge, Xuri, et autres
Publié: (2024)
par: Ge, Xuri, et autres
Publié: (2024)
FisherTune: Fisher-Guided Robust Tuning of Vision Foundation Models for Domain Generalized Segmentation
par: Zhao, Dong, et autres
Publié: (2025)
par: Zhao, Dong, et autres
Publié: (2025)
In defense of the two-stage framework for open-set domain adaptive semantic segmentation
par: Ren, Wenqi, et autres
Publié: (2026)
par: Ren, Wenqi, et autres
Publié: (2026)
FreeInsert: Disentangled Text-Guided Object Insertion in 3D Gaussian Scene without Spatial Priors
par: Li, Chenxi, et autres
Publié: (2025)
par: Li, Chenxi, et autres
Publié: (2025)
Fully-Geometric Cross-Attention for Point Cloud Registration
par: Wang, Weijie, et autres
Publié: (2025)
par: Wang, Weijie, et autres
Publié: (2025)
Causal Disentanglement for Robust Long-tail Medical Image Generation
par: Nie, Weizhi, et autres
Publié: (2025)
par: Nie, Weizhi, et autres
Publié: (2025)
Stable Neighbor Denoising for Source-free Domain Adaptive Segmentation
par: Zhao, Dong, et autres
Publié: (2024)
par: Zhao, Dong, et autres
Publié: (2024)
Documents similaires
-
Hyperbolic Busemann Neural Networks
par: Chen, Ziheng, et autres
Publié: (2026) -
Understanding Matrix Function Normalizations in Covariance Pooling through the Lens of Riemannian Geometry
par: Chen, Ziheng, et autres
Publié: (2024) -
AlignCAT: Visual-Linguistic Alignment of Category and Attribute for Weakly Supervised Visual Grounding
par: Wang, Yidan, et autres
Publié: (2025) -
PoInit-of-View: Poisoning Initialization of Views Transfers Across Multiple 3D Reconstruction Systems
par: Wang, Weijie, et autres
Publié: (2026) -
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
par: Liu, Jiaqi, et autres
Publié: (2025)