Multimodal Variational Autoencoder: a Barycentric View
Fuente:
arXiv
Salvato in:
| Autori principali: | Qiu, Peijie, Zhu, Wenhui, Kumar, Sayantan, Chen, Xiwen, Sun, Xiaotong, Yang, Jin, Razi, Abolfazl, Wang, Yalin, Sotiras, Aristeidis |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DGR-MIL: Exploring Diverse Global Representation in Multiple Instance Learning for Whole Slide Image Classification
di: Zhu, Wenhui, et al.
Pubblicazione: (2024)
di: Zhu, Wenhui, et al.
Pubblicazione: (2024)
SelfReg-UNet: Self-Regularized UNet for Medical Image Segmentation
di: Zhu, Wenhui, et al.
Pubblicazione: (2024)
di: Zhu, Wenhui, et al.
Pubblicazione: (2024)
How Effective Can Dropout Be in Multiple Instance Learning ?
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
Cracking Instance Jigsaw Puzzles: An Alternative to Multiple Instance Learning for Whole Slide Image Analysis
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
Prompt-OT: An Optimal Transport Regularization Paradigm for Knowledge Preservation in Vision-Language Model Adaptation
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
Imaging Signal Recovery Using Neural Network Priors Under Uncertain Forward Model Parameters
di: Chen, Xiwen, et al.
Pubblicazione: (2024)
di: Chen, Xiwen, et al.
Pubblicazione: (2024)
SC-MIL: Sparsely Coded Multiple Instance Learning for Whole Slide Image Classification
di: Qiu, Peijie, et al.
Pubblicazione: (2023)
di: Qiu, Peijie, et al.
Pubblicazione: (2023)
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
di: Zhu, Wenhui, et al.
Pubblicazione: (2025)
AgileFormer: Spatially Agile Transformer UNet for Medical Image Segmentation
di: Qiu, Peijie, et al.
Pubblicazione: (2024)
di: Qiu, Peijie, et al.
Pubblicazione: (2024)
Multimodal normative modeling in Alzheimers Disease with introspective variational autoencoders
di: Kumar, Sayantan, et al.
Pubblicazione: (2026)
di: Kumar, Sayantan, et al.
Pubblicazione: (2026)
TimeMIL: Advancing Multivariate Time Series Classification via a Time-aware Multiple Instance Learning
di: Chen, Xiwen, et al.
Pubblicazione: (2024)
di: Chen, Xiwen, et al.
Pubblicazione: (2024)
Sequence Complementor: Complementing Transformers For Time Series Forecasting with Learnable Sequences
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
SC-VAE: Sparse Coding-based Variational Autoencoder with Learned ISTA
di: Xiao, Pan, et al.
Pubblicazione: (2023)
di: Xiao, Pan, et al.
Pubblicazione: (2023)
D-Net: Dynamic Large Kernel with Dynamic Feature Fusion for Volumetric Medical Image Segmentation
di: Yang, Jin, et al.
Pubblicazione: (2024)
di: Yang, Jin, et al.
Pubblicazione: (2024)
Normative Modeling using Multimodal Variational Autoencoders to Identify Abnormal Brain Structural Patterns in Alzheimer Disease
di: Kumar, Sayantan, et al.
Pubblicazione: (2021)
di: Kumar, Sayantan, et al.
Pubblicazione: (2021)
FIC-TSC: Learning Time Series Classification with Fisher Information Constraint
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
PDL: Regularizing Multiple Instance Learning with Progressive Dropout Layers
di: Zhu, Wenhui, et al.
Pubblicazione: (2023)
di: Zhu, Wenhui, et al.
Pubblicazione: (2023)
RBAD: A Dataset and Benchmark for Retinal Vessels Branching Angle Detection
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
DRA-GRPO: Your GRPO Needs to Know Diverse Reasoning Paths for Mathematical Reasoning
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
OTPrune: Distribution-Aligned Visual Token Pruning via Optimal Transport
di: Chen, Xiwen, et al.
Pubblicazione: (2026)
di: Chen, Xiwen, et al.
Pubblicazione: (2026)
Adapting Medical Vision Foundation Models for Volumetric Medical Image Segmentation via Active Learning and Selective Semi-supervised Fine-tuning
di: Yang, Jin, et al.
Pubblicazione: (2025)
di: Yang, Jin, et al.
Pubblicazione: (2025)
Dynamic U-Net: Adaptively Calibrate Features for Abdominal Multi-organ Segmentation
di: Yang, Jin, et al.
Pubblicazione: (2024)
di: Yang, Jin, et al.
Pubblicazione: (2024)
DMC-Net: Lightweight Dynamic Multi-Scale and Multi-Resolution Convolution Network for Pancreas Segmentation in CT Images
di: Yang, Jin, et al.
Pubblicazione: (2024)
di: Yang, Jin, et al.
Pubblicazione: (2024)
Many-MobileNet: Multi-Model Augmentation for Robust Retinal Disease Classification
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
QCResUNet: Joint Subject-level and Voxel-level Segmentation Quality Prediction
di: Qiu, Peijie, et al.
Pubblicazione: (2024)
di: Qiu, Peijie, et al.
Pubblicazione: (2024)
STA-Unet: Rethink the semantic redundant for Medical Imaging Segmentation
di: Vasa, Vamsi Krishna, et al.
Pubblicazione: (2024)
di: Vasa, Vamsi Krishna, et al.
Pubblicazione: (2024)
FedMIL: Federated-Multiple Instance Learning for Video Analysis with Optimized DPP Scheduling
di: Bastola, Ashish, et al.
Pubblicazione: (2024)
di: Bastola, Ashish, et al.
Pubblicazione: (2024)
LLaDA-MedV: Exploring Large Language Diffusion Models for Biomedical Image Understanding
di: Dong, Xuanzhao, et al.
Pubblicazione: (2025)
di: Dong, Xuanzhao, et al.
Pubblicazione: (2025)
nnMobileNet: Rethinking CNN for Retinopathy Research
di: Zhu, Wenhui, et al.
Pubblicazione: (2023)
di: Zhu, Wenhui, et al.
Pubblicazione: (2023)
Fast 2DGS: Efficient Image Representation with Deep Gaussian Prior
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
FLAME Diffuser: Wildfire Image Synthesis using Mask Guided Diffusion
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
Latent Space Characterization of Autoencoder Variants
di: Shrivastava, Anika, et al.
Pubblicazione: (2024)
di: Shrivastava, Anika, et al.
Pubblicazione: (2024)
TokenCom: Vision-Language Model for Multimodal and Multitask Token Communications
di: Jiang, Feibo, et al.
Pubblicazione: (2026)
di: Jiang, Feibo, et al.
Pubblicazione: (2026)
HawkRover: An Autonomous mmWave Vehicular Communication Testbed with Multi-sensor Fusion and Deep Learning
di: Zhu, Ethan, et al.
Pubblicazione: (2024)
di: Zhu, Ethan, et al.
Pubblicazione: (2024)
A BERT-Style Self-Supervised Learning CNN for Disease Identification from Retinal Images
di: Li, Xin, et al.
Pubblicazione: (2025)
di: Li, Xin, et al.
Pubblicazione: (2025)
Track Initialization and Re-Identification for~3D Multi-View Multi-Object Tracking
di: Van Ma, Linh, et al.
Pubblicazione: (2024)
di: Van Ma, Linh, et al.
Pubblicazione: (2024)
Diffusion Prism: Enhancing Diversity and Morphology Consistency in Mask-to-Image Diffusion
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
CUNSB-RFIE: Context-aware Unpaired Neural Schrödinger Bridge in Retinal Fundus Image Enhancement
di: Dong, Xuanzhao, et al.
Pubblicazione: (2024)
di: Dong, Xuanzhao, et al.
Pubblicazione: (2024)
Mags-RL: Wearing Multimodal LLMs a Magnifying Glass via Agentic Reinforcement Learning For Complex Scene Reasoning
di: Dong, Xuanzhao, et al.
Pubblicazione: (2026)
di: Dong, Xuanzhao, et al.
Pubblicazione: (2026)
Context-Aware Optimal Transport Learning for Retinal Fundus Image Enhancement
di: Vasa, Vamsi Krishna, et al.
Pubblicazione: (2024)
di: Vasa, Vamsi Krishna, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DGR-MIL: Exploring Diverse Global Representation in Multiple Instance Learning for Whole Slide Image Classification
di: Zhu, Wenhui, et al.
Pubblicazione: (2024) -
SelfReg-UNet: Self-Regularized UNet for Medical Image Segmentation
di: Zhu, Wenhui, et al.
Pubblicazione: (2024) -
How Effective Can Dropout Be in Multiple Instance Learning ?
di: Zhu, Wenhui, et al.
Pubblicazione: (2025) -
Cracking Instance Jigsaw Puzzles: An Alternative to Multiple Instance Learning for Whole Slide Image Analysis
di: Chen, Xiwen, et al.
Pubblicazione: (2025) -
Prompt-OT: An Optimal Transport Regularization Paradigm for Knowledge Preservation in Vision-Language Model Adaptation
di: Chen, Xiwen, et al.
Pubblicazione: (2025)