Distribution Matching for Multi-Task Learning of Classification Tasks: a Large-Scale Study on Faces & Beyond
Fuente:
arXiv
Guardado en:
| Autores principales: | Kollias, Dimitrios, Sharmanska, Viktoriia, Zafeiriou, Stefanos |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
7th ABAW Competition: Multi-Task Learning and Compound Expression Recognition
por: Kollias, Dimitrios, et al.
Publicado: (2024)
por: Kollias, Dimitrios, et al.
Publicado: (2024)
Visual-Word Tokenizer: Beyond Fixed Sets of Tokens in Vision Transformers
por: Gee, Leonidas, et al.
Publicado: (2024)
por: Gee, Leonidas, et al.
Publicado: (2024)
Domain adaptation, Explainability & Fairness in AI for Medical Image Analysis: Diagnosis of COVID-19 based on 3-D Chest CT-scans
por: Kollias, Dimitrios, et al.
Publicado: (2024)
por: Kollias, Dimitrios, et al.
Publicado: (2024)
Uncertainty-guided Contrastive Learning for Single Source Domain Generalisation
por: Arsenos, Anastasios, et al.
Publicado: (2024)
por: Arsenos, Anastasios, et al.
Publicado: (2024)
SAM2CLIP2SAM: Vision Language Model for Segmentation of 3D CT Scans for Covid-19 Detection
por: Kollias, Dimitrios, et al.
Publicado: (2024)
por: Kollias, Dimitrios, et al.
Publicado: (2024)
DermaFlux: Synthetic Skin Lesion Generation with Rectified Flows for Enhanced Image Classification
por: Galanakis, Stathis, et al.
Publicado: (2026)
por: Galanakis, Stathis, et al.
Publicado: (2026)
Geo-ID: Test-Time Geometric Consensus for Cross-View Consistent Intrinsics
por: Dirik, Alara, et al.
Publicado: (2026)
por: Dirik, Alara, et al.
Publicado: (2026)
COVID-19 Computer-aided Diagnosis through AI-assisted CT Imaging Analysis: Deploying a Medical AI System
por: Gerogiannis, Demetris, et al.
Publicado: (2024)
por: Gerogiannis, Demetris, et al.
Publicado: (2024)
The 6th Affective Behavior Analysis in-the-wild (ABAW) Competition
por: Kollias, Dimitrios, et al.
Publicado: (2024)
por: Kollias, Dimitrios, et al.
Publicado: (2024)
ID-Consistent, Precise Expression Generation with Blendshape-Guided Diffusion
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2025)
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2025)
Arc2Face: A Foundation Model for ID-Consistent Human Faces
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2024)
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2024)
Deep Face Restoration: A Survey
por: Wang, Tao, et al.
Publicado: (2022)
por: Wang, Tao, et al.
Publicado: (2022)
DAD-3DHeads: A Large-scale Dense, Accurate and Diverse Dataset for 3D Head Alignment from a Single Image
por: Martyniuk, Tetiana, et al.
Publicado: (2022)
por: Martyniuk, Tetiana, et al.
Publicado: (2022)
Common Corruptions for Enhancing and Evaluating Robustness in Air-to-Air Visual Object Detection
por: Arsenos, Anastasios, et al.
Publicado: (2024)
por: Arsenos, Anastasios, et al.
Publicado: (2024)
Dyn-HaMR: Recovering 4D Interacting Hand Motion from a Dynamic Camera
por: Yu, Zhengdi, et al.
Publicado: (2024)
por: Yu, Zhengdi, et al.
Publicado: (2024)
SynchroRaMa : Lip-Synchronized and Emotion-Aware Talking Face Generation via Multi-Modal Emotion Embedding
por: Yee, Phyo Thet, et al.
Publicado: (2025)
por: Yee, Phyo Thet, et al.
Publicado: (2025)
A Closed-Form Solution for Debiasing Vision-Language Models with Utility Guarantees Across Modalities and Tasks
por: Lian, Tangzheng, et al.
Publicado: (2026)
por: Lian, Tangzheng, et al.
Publicado: (2026)
Arc2Avatar: Generating Expressive 3D Avatars from a Single Image via ID Guidance
por: Gerogiannis, Dimitrios, et al.
Publicado: (2025)
por: Gerogiannis, Dimitrios, et al.
Publicado: (2025)
Design2Cloth: 3D Cloth Generation from 2D Masks
por: Zheng, Jiali, et al.
Publicado: (2024)
por: Zheng, Jiali, et al.
Publicado: (2024)
Large Learning Rates Simultaneously Achieve Robustness to Spurious Correlations and Compressibility
por: Barsbey, Melih, et al.
Publicado: (2025)
por: Barsbey, Melih, et al.
Publicado: (2025)
SpinMeRound: Consistent Multi-View Identity Generation Using Diffusion Models
por: Galanakis, Stathis, et al.
Publicado: (2025)
por: Galanakis, Stathis, et al.
Publicado: (2025)
FitDiff: Robust monocular 3D facial shape and reflectance estimation using Diffusion Models
por: Galanakis, Stathis, et al.
Publicado: (2023)
por: Galanakis, Stathis, et al.
Publicado: (2023)
ImHead: A Large-scale Implicit Morphable Model for Localized Head Modeling
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2025)
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2025)
Multi-Task Faces (MTF) Data Set: A Legally and Ethically Compliant Collection of Face Images for Various Classification Tasks
por: Haffar, Rami, et al.
Publicado: (2023)
por: Haffar, Rami, et al.
Publicado: (2023)
HO-Flow: Generalizable Hand-Object Interaction Generation with Latent Flow Matching
por: Chen, Zerui, et al.
Publicado: (2026)
por: Chen, Zerui, et al.
Publicado: (2026)
Ensuring UAV Safety: A Vision-only and Real-time Framework for Collision Avoidance Through Object Detection, Tracking, and Distance Estimation
por: Karampinis, Vasileios, et al.
Publicado: (2024)
por: Karampinis, Vasileios, et al.
Publicado: (2024)
UV-free Texture Generation with Denoising and Geodesic Heat Diffusions
por: Foti, Simone, et al.
Publicado: (2024)
por: Foti, Simone, et al.
Publicado: (2024)
ShapeFusion: A 3D diffusion model for localized shape editing
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2024)
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2024)
WiLoR: End-to-end 3D Hand Localization and Reconstruction in-the-wild
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2024)
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2024)
Context-self contrastive pretraining for crop type semantic segmentation
por: Tarasiou, Michail, et al.
Publicado: (2021)
por: Tarasiou, Michail, et al.
Publicado: (2021)
Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC
por: Hu, Guanyu, et al.
Publicado: (2025)
por: Hu, Guanyu, et al.
Publicado: (2025)
Pruning Overparameterized Multi-Task Networks for Degraded Web Image Restoration
por: Katraouras, Thomas, et al.
Publicado: (2025)
por: Katraouras, Thomas, et al.
Publicado: (2025)
Estimating the Robustness Radius for Randomized Smoothing with 100$\times$ Sample Efficiency
por: Seferis, Emmanouil, et al.
Publicado: (2024)
por: Seferis, Emmanouil, et al.
Publicado: (2024)
Task-adaptive Q-Face
por: Sun, Haomiao, et al.
Publicado: (2024)
por: Sun, Haomiao, et al.
Publicado: (2024)
From Affect to Complex Behavior: Advancing Multimodal Human-Centered AI at the 10th ABAW Workshop & Competition
por: Kollias, Dimitrios, et al.
Publicado: (2026)
por: Kollias, Dimitrios, et al.
Publicado: (2026)
ReasonX: MLLM-Guided Intrinsic Image Decomposition
por: Dirik, Alara, et al.
Publicado: (2025)
por: Dirik, Alara, et al.
Publicado: (2025)
Mask-Guided Multi-Task Network for Face Attribute Recognition
por: Gao, Gong, et al.
Publicado: (2026)
por: Gao, Gong, et al.
Publicado: (2026)
Stable-Drift: A Patient-Aware Latent Drift Replay Method for Stabilizing Representations in Continual Learning
por: Theofilou, Paraskevi-Antonia, et al.
Publicado: (2025)
por: Theofilou, Paraskevi-Antonia, et al.
Publicado: (2025)
AnimateMe: 4D Facial Expressions via Diffusion Models
por: Gerogiannis, Dimitrios, et al.
Publicado: (2024)
por: Gerogiannis, Dimitrios, et al.
Publicado: (2024)
ID-to-3D: Expressive ID-guided 3D Heads via Score Distillation Sampling
por: Babiloni, Francesca, et al.
Publicado: (2024)
por: Babiloni, Francesca, et al.
Publicado: (2024)
Ejemplares similares
-
7th ABAW Competition: Multi-Task Learning and Compound Expression Recognition
por: Kollias, Dimitrios, et al.
Publicado: (2024) -
Visual-Word Tokenizer: Beyond Fixed Sets of Tokens in Vision Transformers
por: Gee, Leonidas, et al.
Publicado: (2024) -
Domain adaptation, Explainability & Fairness in AI for Medical Image Analysis: Diagnosis of COVID-19 based on 3-D Chest CT-scans
por: Kollias, Dimitrios, et al.
Publicado: (2024) -
Uncertainty-guided Contrastive Learning for Single Source Domain Generalisation
por: Arsenos, Anastasios, et al.
Publicado: (2024) -
SAM2CLIP2SAM: Vision Language Model for Segmentation of 3D CT Scans for Covid-19 Detection
por: Kollias, Dimitrios, et al.
Publicado: (2024)