Multimodal Variational Autoencoder: a Barycentric View
Fuente:
arXiv
Saved in:
| Main Authors: | Qiu, Peijie, Zhu, Wenhui, Kumar, Sayantan, Chen, Xiwen, Sun, Xiaotong, Yang, Jin, Razi, Abolfazl, Wang, Yalin, Sotiras, Aristeidis |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DGR-MIL: Exploring Diverse Global Representation in Multiple Instance Learning for Whole Slide Image Classification
by: Zhu, Wenhui, et al.
Published: (2024)
by: Zhu, Wenhui, et al.
Published: (2024)
SelfReg-UNet: Self-Regularized UNet for Medical Image Segmentation
by: Zhu, Wenhui, et al.
Published: (2024)
by: Zhu, Wenhui, et al.
Published: (2024)
How Effective Can Dropout Be in Multiple Instance Learning ?
by: Zhu, Wenhui, et al.
Published: (2025)
by: Zhu, Wenhui, et al.
Published: (2025)
Cracking Instance Jigsaw Puzzles: An Alternative to Multiple Instance Learning for Whole Slide Image Analysis
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
Prompt-OT: An Optimal Transport Regularization Paradigm for Knowledge Preservation in Vision-Language Model Adaptation
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
Imaging Signal Recovery Using Neural Network Priors Under Uncertain Forward Model Parameters
by: Chen, Xiwen, et al.
Published: (2024)
by: Chen, Xiwen, et al.
Published: (2024)
SC-MIL: Sparsely Coded Multiple Instance Learning for Whole Slide Image Classification
by: Qiu, Peijie, et al.
Published: (2023)
by: Qiu, Peijie, et al.
Published: (2023)
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
by: Zhu, Wenhui, et al.
Published: (2025)
by: Zhu, Wenhui, et al.
Published: (2025)
AgileFormer: Spatially Agile Transformer UNet for Medical Image Segmentation
by: Qiu, Peijie, et al.
Published: (2024)
by: Qiu, Peijie, et al.
Published: (2024)
Multimodal normative modeling in Alzheimers Disease with introspective variational autoencoders
by: Kumar, Sayantan, et al.
Published: (2026)
by: Kumar, Sayantan, et al.
Published: (2026)
TimeMIL: Advancing Multivariate Time Series Classification via a Time-aware Multiple Instance Learning
by: Chen, Xiwen, et al.
Published: (2024)
by: Chen, Xiwen, et al.
Published: (2024)
Sequence Complementor: Complementing Transformers For Time Series Forecasting with Learnable Sequences
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
SC-VAE: Sparse Coding-based Variational Autoencoder with Learned ISTA
by: Xiao, Pan, et al.
Published: (2023)
by: Xiao, Pan, et al.
Published: (2023)
D-Net: Dynamic Large Kernel with Dynamic Feature Fusion for Volumetric Medical Image Segmentation
by: Yang, Jin, et al.
Published: (2024)
by: Yang, Jin, et al.
Published: (2024)
Normative Modeling using Multimodal Variational Autoencoders to Identify Abnormal Brain Structural Patterns in Alzheimer Disease
by: Kumar, Sayantan, et al.
Published: (2021)
by: Kumar, Sayantan, et al.
Published: (2021)
FIC-TSC: Learning Time Series Classification with Fisher Information Constraint
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
PDL: Regularizing Multiple Instance Learning with Progressive Dropout Layers
by: Zhu, Wenhui, et al.
Published: (2023)
by: Zhu, Wenhui, et al.
Published: (2023)
RBAD: A Dataset and Benchmark for Retinal Vessels Branching Angle Detection
by: Wang, Hao, et al.
Published: (2024)
by: Wang, Hao, et al.
Published: (2024)
DRA-GRPO: Your GRPO Needs to Know Diverse Reasoning Paths for Mathematical Reasoning
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
OTPrune: Distribution-Aligned Visual Token Pruning via Optimal Transport
by: Chen, Xiwen, et al.
Published: (2026)
by: Chen, Xiwen, et al.
Published: (2026)
Adapting Medical Vision Foundation Models for Volumetric Medical Image Segmentation via Active Learning and Selective Semi-supervised Fine-tuning
by: Yang, Jin, et al.
Published: (2025)
by: Yang, Jin, et al.
Published: (2025)
Dynamic U-Net: Adaptively Calibrate Features for Abdominal Multi-organ Segmentation
by: Yang, Jin, et al.
Published: (2024)
by: Yang, Jin, et al.
Published: (2024)
DMC-Net: Lightweight Dynamic Multi-Scale and Multi-Resolution Convolution Network for Pancreas Segmentation in CT Images
by: Yang, Jin, et al.
Published: (2024)
by: Yang, Jin, et al.
Published: (2024)
Many-MobileNet: Multi-Model Augmentation for Robust Retinal Disease Classification
by: Wang, Hao, et al.
Published: (2024)
by: Wang, Hao, et al.
Published: (2024)
QCResUNet: Joint Subject-level and Voxel-level Segmentation Quality Prediction
by: Qiu, Peijie, et al.
Published: (2024)
by: Qiu, Peijie, et al.
Published: (2024)
STA-Unet: Rethink the semantic redundant for Medical Imaging Segmentation
by: Vasa, Vamsi Krishna, et al.
Published: (2024)
by: Vasa, Vamsi Krishna, et al.
Published: (2024)
FedMIL: Federated-Multiple Instance Learning for Video Analysis with Optimized DPP Scheduling
by: Bastola, Ashish, et al.
Published: (2024)
by: Bastola, Ashish, et al.
Published: (2024)
LLaDA-MedV: Exploring Large Language Diffusion Models for Biomedical Image Understanding
by: Dong, Xuanzhao, et al.
Published: (2025)
by: Dong, Xuanzhao, et al.
Published: (2025)
nnMobileNet: Rethinking CNN for Retinopathy Research
by: Zhu, Wenhui, et al.
Published: (2023)
by: Zhu, Wenhui, et al.
Published: (2023)
Fast 2DGS: Efficient Image Representation with Deep Gaussian Prior
by: Wang, Hao, et al.
Published: (2025)
by: Wang, Hao, et al.
Published: (2025)
FLAME Diffuser: Wildfire Image Synthesis using Mask Guided Diffusion
by: Wang, Hao, et al.
Published: (2024)
by: Wang, Hao, et al.
Published: (2024)
Latent Space Characterization of Autoencoder Variants
by: Shrivastava, Anika, et al.
Published: (2024)
by: Shrivastava, Anika, et al.
Published: (2024)
TokenCom: Vision-Language Model for Multimodal and Multitask Token Communications
by: Jiang, Feibo, et al.
Published: (2026)
by: Jiang, Feibo, et al.
Published: (2026)
HawkRover: An Autonomous mmWave Vehicular Communication Testbed with Multi-sensor Fusion and Deep Learning
by: Zhu, Ethan, et al.
Published: (2024)
by: Zhu, Ethan, et al.
Published: (2024)
A BERT-Style Self-Supervised Learning CNN for Disease Identification from Retinal Images
by: Li, Xin, et al.
Published: (2025)
by: Li, Xin, et al.
Published: (2025)
Diffusion Prism: Enhancing Diversity and Morphology Consistency in Mask-to-Image Diffusion
by: Wang, Hao, et al.
Published: (2025)
by: Wang, Hao, et al.
Published: (2025)
Track Initialization and Re-Identification for~3D Multi-View Multi-Object Tracking
by: Van Ma, Linh, et al.
Published: (2024)
by: Van Ma, Linh, et al.
Published: (2024)
CUNSB-RFIE: Context-aware Unpaired Neural Schrödinger Bridge in Retinal Fundus Image Enhancement
by: Dong, Xuanzhao, et al.
Published: (2024)
by: Dong, Xuanzhao, et al.
Published: (2024)
Mags-RL: Wearing Multimodal LLMs a Magnifying Glass via Agentic Reinforcement Learning For Complex Scene Reasoning
by: Dong, Xuanzhao, et al.
Published: (2026)
by: Dong, Xuanzhao, et al.
Published: (2026)
Context-Aware Optimal Transport Learning for Retinal Fundus Image Enhancement
by: Vasa, Vamsi Krishna, et al.
Published: (2024)
by: Vasa, Vamsi Krishna, et al.
Published: (2024)
Similar Items
-
DGR-MIL: Exploring Diverse Global Representation in Multiple Instance Learning for Whole Slide Image Classification
by: Zhu, Wenhui, et al.
Published: (2024) -
SelfReg-UNet: Self-Regularized UNet for Medical Image Segmentation
by: Zhu, Wenhui, et al.
Published: (2024) -
How Effective Can Dropout Be in Multiple Instance Learning ?
by: Zhu, Wenhui, et al.
Published: (2025) -
Cracking Instance Jigsaw Puzzles: An Alternative to Multiple Instance Learning for Whole Slide Image Analysis
by: Chen, Xiwen, et al.
Published: (2025) -
Prompt-OT: An Optimal Transport Regularization Paradigm for Knowledge Preservation in Vision-Language Model Adaptation
by: Chen, Xiwen, et al.
Published: (2025)