A Mutual Information Perspective on Multiple Latent Variable Generative Models for Positive View Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Serez, Dario, Cristani, Marco, Del Bue, Alessio, Murino, Vittorio, Morerio, Pietro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pre-trained Multiple Latent Variable Generative Models are good defenders against Adversarial Attacks
par: Serez, Dario, et autres
Publié: (2024)
par: Serez, Dario, et autres
Publié: (2024)
Anticipating Next Active Objects for Egocentric Videos
par: Thakur, Sanket, et autres
Publié: (2023)
par: Thakur, Sanket, et autres
Publié: (2023)
Model Debiasing by Learnable Data Augmentation
par: Morerio, Pietro, et autres
Publié: (2024)
par: Morerio, Pietro, et autres
Publié: (2024)
BillBoard Splatting (BBSplat): Learnable Textured Primitives for Novel View Synthesis
par: Svitov, David, et autres
Publié: (2024)
par: Svitov, David, et autres
Publié: (2024)
CloseUpAvatar: High-Fidelity Animatable Full-Body Avatars with Mixture of Multi-Scale Textures
par: Svitov, David, et autres
Publié: (2025)
par: Svitov, David, et autres
Publié: (2025)
HAHA: Highly Articulated Gaussian Human Avatars with Textured Mesh Prior
par: Svitov, David, et autres
Publié: (2024)
par: Svitov, David, et autres
Publié: (2024)
Upper-Body Pose-based Gaze Estimation for Privacy-Preserving 3D Gaze Target Detection
par: Toaiari, Andrea, et autres
Publié: (2024)
par: Toaiari, Andrea, et autres
Publié: (2024)
DiffAssemble: A Unified Graph-Diffusion Model for 2D and 3D Reassembly
par: Scarpellini, Gianluca, et autres
Publié: (2024)
par: Scarpellini, Gianluca, et autres
Publié: (2024)
ReassembleNet: Learnable Keypoints and Diffusion for 2D Fresco Reconstruction
par: Islam, Adeela, et autres
Publié: (2025)
par: Islam, Adeela, et autres
Publié: (2025)
Look Around and Learn: Self-Training Object Detection by Exploration
par: Scarpellini, Gianluca, et autres
Publié: (2023)
par: Scarpellini, Gianluca, et autres
Publié: (2023)
Memory-Augmented Vision-Language Agents for Persistent and Semantically Consistent Object Captioning
par: Galliena, Tommaso, et autres
Publié: (2026)
par: Galliena, Tommaso, et autres
Publié: (2026)
Embodied Image Captioning: Self-supervised Learning Agents for Spatially Coherent Image Descriptions
par: Galliena, Tommaso, et autres
Publié: (2025)
par: Galliena, Tommaso, et autres
Publié: (2025)
E-M3RF: An Equivariant Multimodal 3D Re-assembly Framework
par: Islam, Adeela, et autres
Publié: (2025)
par: Islam, Adeela, et autres
Publié: (2025)
Uncertainty-guided Open-Set Source-Free Unsupervised Domain Adaptation with Target-private Class Segregation
par: Litrico, Mattia, et autres
Publié: (2024)
par: Litrico, Mattia, et autres
Publié: (2024)
PRAGO: Differentiable Multi-View Pose Optimization From Objectness Detections
par: Taiana, Matteo, et autres
Publié: (2024)
par: Taiana, Matteo, et autres
Publié: (2024)
Maps from Motion (MfM): Generating 2D Semantic Maps from Sparse Multi-view Images
par: Toso, Matteo, et autres
Publié: (2024)
par: Toso, Matteo, et autres
Publié: (2024)
MADPOT: Medical Anomaly Detection with CLIP Adaptation and Partial Optimal Transport
par: Shiri, Mahshid, et autres
Publié: (2025)
par: Shiri, Mahshid, et autres
Publié: (2025)
Discriminator-Guided Adaptive Diffusion for Source-Free Test-Time Adaptation under Image Corruptions
par: Olivato, Francesco, et autres
Publié: (2026)
par: Olivato, Francesco, et autres
Publié: (2026)
HAC: Parameter-Efficient Hyperbolic Adaptation of CLIP for Zero-Shot VQA
par: Dibitonto, Francesco, et autres
Publié: (2026)
par: Dibitonto, Francesco, et autres
Publié: (2026)
MadCLIP: Few-shot Medical Anomaly Detection with CLIP
par: Shiri, Mahshid, et autres
Publié: (2025)
par: Shiri, Mahshid, et autres
Publié: (2025)
Lifelong Imitation Learning with Multimodal Latent Replay and Incremental Adjustment
par: Yu, Fanqi, et autres
Publié: (2026)
par: Yu, Fanqi, et autres
Publié: (2026)
Learning to Evaluate Autonomous Behaviour in Human-Robot Interaction
par: Tiezzi, Matteo, et autres
Publié: (2025)
par: Tiezzi, Matteo, et autres
Publié: (2025)
SelfGeo: Self-supervised and Geodesic-consistent Estimation of Keypoints on Deformable Shapes
par: Zohaib, Mohammad, et autres
Publié: (2024)
par: Zohaib, Mohammad, et autres
Publié: (2024)
Multi-Camera Industrial Open-Set Person Re-Identification and Tracking
par: Cunico, Federico, et autres
Publié: (2024)
par: Cunico, Federico, et autres
Publié: (2024)
6DGS: 6D Pose Estimation from a Single Image and a 3D Gaussian Splatting Model
par: Bortolon, Matteo, et autres
Publié: (2024)
par: Bortolon, Matteo, et autres
Publié: (2024)
SplatFill: 3D Scene Inpainting via Depth-Guided Gaussian Splatting
par: Dahaghin, Mahtab, et autres
Publié: (2025)
par: Dahaghin, Mahtab, et autres
Publié: (2025)
Gaussian Heritage: 3D Digitization of Cultural Heritage with Integrated Object Segmentation
par: Dahaghin, Mahtab, et autres
Publié: (2024)
par: Dahaghin, Mahtab, et autres
Publié: (2024)
IFFNeRF: Initialisation Free and Fast 6DoF pose estimation from a single image and a NeRF model
par: Bortolon, Matteo, et autres
Publié: (2024)
par: Bortolon, Matteo, et autres
Publié: (2024)
LoomNet: Enhancing Multi-View Image Generation via Latent Space Weaving
par: Federico, Giulio, et autres
Publié: (2025)
par: Federico, Giulio, et autres
Publié: (2025)
Leveraging Latent Diffusion Models for Training-Free In-Distribution Data Augmentation for Surface Defect Detection
par: Girella, Federico, et autres
Publié: (2024)
par: Girella, Federico, et autres
Publié: (2024)
Contrastive Gaussian Clustering: Weakly Supervised 3D Scene Segmentation
par: Silva, Myrna C., et autres
Publié: (2024)
par: Silva, Myrna C., et autres
Publié: (2024)
Revisiting Mutual Information Maximization for Generalized Category Discovery
par: Tan, Zhaorui, et autres
Publié: (2024)
par: Tan, Zhaorui, et autres
Publié: (2024)
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
par: Pippi, Vittorio, et autres
Publié: (2025)
par: Pippi, Vittorio, et autres
Publié: (2025)
APEX: Assumption-free Projection-based Embedding eXamination Metric for Image Quality Assessment
par: Gallegati, Caterina, et autres
Publié: (2026)
par: Gallegati, Caterina, et autres
Publié: (2026)
Intra-finger Variability of Diffusion-based Latent Fingerprint Generation
par: Hussein, Noor, et autres
Publié: (2026)
par: Hussein, Noor, et autres
Publié: (2026)
Learning Mutual View Information Graph for Adaptive Adversarial Collaborative Perception
par: Tao, Yihang, et autres
Publié: (2026)
par: Tao, Yihang, et autres
Publié: (2026)
InfoNorm: Mutual Information Shaping of Normals for Sparse-View Reconstruction
par: Wang, Xulong, et autres
Publié: (2024)
par: Wang, Xulong, et autres
Publié: (2024)
Autoregressive Styled Text Image Generation, but Make it Reliable
par: Zaccagnino, Carmine, et autres
Publié: (2025)
par: Zaccagnino, Carmine, et autres
Publié: (2025)
Beyond SOT: Tracking Multiple Generic Objects at Once
par: Mayer, Christoph, et autres
Publié: (2022)
par: Mayer, Christoph, et autres
Publié: (2022)
Multi-Level Conditioning by Pairing Localized Text and Sketch for Fashion Image Generation
par: Liu, Ziyue, et autres
Publié: (2026)
par: Liu, Ziyue, et autres
Publié: (2026)
Documents similaires
-
Pre-trained Multiple Latent Variable Generative Models are good defenders against Adversarial Attacks
par: Serez, Dario, et autres
Publié: (2024) -
Anticipating Next Active Objects for Egocentric Videos
par: Thakur, Sanket, et autres
Publié: (2023) -
Model Debiasing by Learnable Data Augmentation
par: Morerio, Pietro, et autres
Publié: (2024) -
BillBoard Splatting (BBSplat): Learnable Textured Primitives for Novel View Synthesis
par: Svitov, David, et autres
Publié: (2024) -
CloseUpAvatar: High-Fidelity Animatable Full-Body Avatars with Mixture of Multi-Scale Textures
par: Svitov, David, et autres
Publié: (2025)