Make me an Expert: Distilling from Generalist Black-Box Models into Specialized Models for Semantic Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Benigmim, Yasser, Roy, Subhankar, Oublal, Khalid, Marouf, Imad Eddine, Essid, Slim, Kalogeiton, Vicky, Lathuilière, Stéphane |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Collaborating Foundation Models for Domain Generalized Semantic Segmentation
par: Benigmim, Yasser, et autres
Publié: (2023)
par: Benigmim, Yasser, et autres
Publié: (2023)
Weighted Ensemble Models Are Strong Continual Learners
par: Marouf, Imad Eddine, et autres
Publié: (2023)
par: Marouf, Imad Eddine, et autres
Publié: (2023)
Enhancing Plasticity for First Session Adaptation Continual Learning
par: Marouf, Imad Eddine, et autres
Publié: (2023)
par: Marouf, Imad Eddine, et autres
Publié: (2023)
Di$\mathtt{[M]}$O: Distilling Masked Diffusion Models into One-step Generator
par: Zhu, Yuanzhi, et autres
Publié: (2025)
par: Zhu, Yuanzhi, et autres
Publié: (2025)
Diffusion Reinforcement Learning via Centered Reward Distillation
par: Zhu, Yuanzhi, et autres
Publié: (2026)
par: Zhu, Yuanzhi, et autres
Publié: (2026)
TACO: Training-free Sound Prompted Segmentation via Semantically Constrained Audio-visual CO-factorization
par: Malard, Hugo, et autres
Publié: (2024)
par: Malard, Hugo, et autres
Publié: (2024)
Ask and Remember: A Questions-Only Replay Strategy for Continual Visual Question Answering
par: Marouf, Imad Eddine, et autres
Publié: (2025)
par: Marouf, Imad Eddine, et autres
Publié: (2025)
An Eye for an Ear: Zero-shot Audio Description Leveraging an Image Captioner using Audiovisual Distribution Alignment
par: Malard, Hugo, et autres
Publié: (2024)
par: Malard, Hugo, et autres
Publié: (2024)
Soft-Di[M]O: Improving One-Step Discrete Image Generation with Soft Embeddings
par: Zhu, Yuanzhi, et autres
Publié: (2025)
par: Zhu, Yuanzhi, et autres
Publié: (2025)
TimeSAE: Sparse Decoding for Faithful Explanations of Black-Box Time Series Models
par: Oublal, Khalid, et autres
Publié: (2026)
par: Oublal, Khalid, et autres
Publié: (2026)
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models
par: De Min, Thomas, et autres
Publié: (2026)
par: De Min, Thomas, et autres
Publié: (2026)
TinyMU: A Compact Audio-Language Model for Music Understanding
par: Li, Xiquan, et autres
Publié: (2026)
par: Li, Xiquan, et autres
Publié: (2026)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
par: Serre, Thomas, et autres
Publié: (2026)
par: Serre, Thomas, et autres
Publié: (2026)
S-SONDO: Self-Supervised Knowledge Distillation for General Audio Foundation Models
par: Adlouni, Mohammed Ali El, et autres
Publié: (2026)
par: Adlouni, Mohammed Ali El, et autres
Publié: (2026)
Less is more: Summarizing Patch Tokens for efficient Multi-Label Class-Incremental Learning
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
Group-robust Machine Unlearning
par: De Min, Thomas, et autres
Publié: (2025)
par: De Min, Thomas, et autres
Publié: (2025)
Unlearning Personal Data from a Single Image
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
FLOSS: Free Lunch in Open-vocabulary Semantic Segmentation
par: Benigmim, Yasser, et autres
Publié: (2025)
par: Benigmim, Yasser, et autres
Publié: (2025)
One-step Diffusion Models with Bregman Density Ratio Matching
par: Zhu, Yuanzhi, et autres
Publié: (2025)
par: Zhu, Yuanzhi, et autres
Publié: (2025)
Less Forgetting for Better Generalization: Exploring Continual-learning Fine-tuning Methods for Speech Self-supervised Representations
par: Zaiem, Salah, et autres
Publié: (2024)
par: Zaiem, Salah, et autres
Publié: (2024)
A Contrastive Self-Supervised Learning scheme for beat tracking amenable to few-shot learning
par: Gagnere, Antonin, et autres
Publié: (2024)
par: Gagnere, Antonin, et autres
Publié: (2024)
Perceptual Noise-Masking with Music through Deep Spectral Envelope Shaping
par: Berger, Clémentine, et autres
Publié: (2025)
par: Berger, Clémentine, et autres
Publié: (2025)
Controlling Contrastive Self-Supervised Learning with Knowledge-Driven Multiple Hypothesis: Application to Beat Tracking
par: Gagnere, Antonin, et autres
Publié: (2025)
par: Gagnere, Antonin, et autres
Publié: (2025)
Online speaker diarization of meetings guided by speech separation
par: Gruttadauria, Elio, et autres
Publié: (2024)
par: Gruttadauria, Elio, et autres
Publié: (2024)
SALT: Standardized Audio event Label Taxonomy
par: Stamatiadis, Paraskevas, et autres
Publié: (2024)
par: Stamatiadis, Paraskevas, et autres
Publié: (2024)
A sound description: Exploring prompt templates and class descriptions to enhance zero-shot audio classification
par: Olvera, Michel, et autres
Publié: (2024)
par: Olvera, Michel, et autres
Publié: (2024)
BTS: Harmonizing Specialized Experts into a Generalist LLM
par: Zhang, Qizhen, et autres
Publié: (2025)
par: Zhang, Qizhen, et autres
Publié: (2025)
FunnyNet-W: Multimodal Learning of Funny Moments in Videos in the Wild
par: Liu, Zhi-Song, et autres
Publié: (2024)
par: Liu, Zhi-Song, et autres
Publié: (2024)
Studying Image Diffusion Features for Zero-Shot Video Object Segmentation
par: Delatolas, Thanos, et autres
Publié: (2025)
par: Delatolas, Thanos, et autres
Publié: (2025)
Residual Tokens Enhance Masked Autoencoders for Speech Modeling
par: Sadok, Samir, et autres
Publié: (2026)
par: Sadok, Samir, et autres
Publié: (2026)
MATPAC++: Enhanced Masked Latent Prediction for Self-Supervised Audio Representation Learning
par: Quelennec, Aurian, et autres
Publié: (2025)
par: Quelennec, Aurian, et autres
Publié: (2025)
Masked Latent Prediction and Classification for Self-Supervised Audio Representation Learning
par: Quelennec, Aurian, et autres
Publié: (2025)
par: Quelennec, Aurian, et autres
Publié: (2025)
IS${}^3$ : Generic Impulsive--Stationary Sound Separation in Acoustic Scenes using Deep Filtering
par: Berger, Clémentine, et autres
Publié: (2025)
par: Berger, Clémentine, et autres
Publié: (2025)
Knowledge Distillation of Black-Box Large Language Models
par: Chen, Hongzhan, et autres
Publié: (2024)
par: Chen, Hongzhan, et autres
Publié: (2024)
Black-Box On-Policy Distillation of Large Language Models
par: Ye, Tianzhu, et autres
Publié: (2025)
par: Ye, Tianzhu, et autres
Publié: (2025)
SF20K Competition 2025: Summary and findings
par: Ghermi, Ridouane, et autres
Publié: (2026)
par: Ghermi, Ridouane, et autres
Publié: (2026)
Around the World in 80 Timesteps: A Generative Approach to Global Visual Geolocation
par: Dufour, Nicolas, et autres
Publié: (2024)
par: Dufour, Nicolas, et autres
Publié: (2024)
T-REGS: Minimum Spanning Tree Regularization for Self-Supervised Learning
par: Mordacq, Julie, et autres
Publié: (2025)
par: Mordacq, Julie, et autres
Publié: (2025)
Don't drop your samples! Coherence-aware training benefits Conditional diffusion
par: Dufour, Nicolas, et autres
Publié: (2024)
par: Dufour, Nicolas, et autres
Publié: (2024)
AKiRa: Augmentation Kit on Rays for optical video generation
par: Wang, Xi, et autres
Publié: (2024)
par: Wang, Xi, et autres
Publié: (2024)
Documents similaires
-
Collaborating Foundation Models for Domain Generalized Semantic Segmentation
par: Benigmim, Yasser, et autres
Publié: (2023) -
Weighted Ensemble Models Are Strong Continual Learners
par: Marouf, Imad Eddine, et autres
Publié: (2023) -
Enhancing Plasticity for First Session Adaptation Continual Learning
par: Marouf, Imad Eddine, et autres
Publié: (2023) -
Di$\mathtt{[M]}$O: Distilling Masked Diffusion Models into One-step Generator
par: Zhu, Yuanzhi, et autres
Publié: (2025) -
Diffusion Reinforcement Learning via Centered Reward Distillation
par: Zhu, Yuanzhi, et autres
Publié: (2026)