Decoupled Audio-Visual Dataset Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Wenyuan, Li, Guang, Maeda, Keisuke, Ogawa, Takahiro, Haseyama, Miki |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
par: Gan, Yaozong, et autres
Publié: (2024)
par: Gan, Yaozong, et autres
Publié: (2024)
Cross-domain Few-shot In-context Learning for Enhancing Traffic Sign Recognition
par: Gan, Yaozong, et autres
Publié: (2024)
par: Gan, Yaozong, et autres
Publié: (2024)
Hyperbolic Dataset Distillation
par: Li, Wenyuan, et autres
Publié: (2025)
par: Li, Wenyuan, et autres
Publié: (2025)
Reinforcing Pre-trained Models Using Counterfactual Images
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Foreground-Aware Dataset Distillation via Dynamic Patch Selection
par: Li, Longzhen, et autres
Publié: (2026)
par: Li, Longzhen, et autres
Publié: (2026)
Generative Dataset Distillation Based on Self-knowledge Distillation
par: Li, Longzhen, et autres
Publié: (2025)
par: Li, Longzhen, et autres
Publié: (2025)
Predictive but Not Plannable: RC-aux for Latent World Models
par: Li, Wenyuan, et autres
Publié: (2026)
par: Li, Wenyuan, et autres
Publié: (2026)
Generative Dataset Distillation: Balancing Global Structure and Local Details
par: Li, Longzhen, et autres
Publié: (2024)
par: Li, Longzhen, et autres
Publié: (2024)
Importance-Aware Adaptive Dataset Distillation
par: Li, Guang, et autres
Publié: (2024)
par: Li, Guang, et autres
Publié: (2024)
Diversity-Driven Generative Dataset Distillation Based on Diffusion Model with Self-Adaptive Memory
par: Li, Mingzhuo, et autres
Publié: (2025)
par: Li, Mingzhuo, et autres
Publié: (2025)
Closed-Form Linear-Probe Dataset Distillation for Pre-trained Vision Models
par: Peng, Bincheng, et autres
Publié: (2026)
par: Peng, Bincheng, et autres
Publié: (2026)
Task-Specific Generative Dataset Distillation with Difficulty-Guided Sampling
par: Li, Mingzhuo, et autres
Publié: (2025)
par: Li, Mingzhuo, et autres
Publié: (2025)
Enhancing Generative Class Incremental Learning Performance with Model Forgetting Approach
par: Togo, Taro, et autres
Publié: (2024)
par: Togo, Taro, et autres
Publié: (2024)
Difficulty-guided Sampling: Bridging the Target Gap between Dataset Distillation and Downstream Tasks
par: Li, Mingzhuo, et autres
Publié: (2026)
par: Li, Mingzhuo, et autres
Publié: (2026)
Generative Dataset Distillation Based on Diffusion Model
par: Su, Duo, et autres
Publié: (2024)
par: Su, Duo, et autres
Publié: (2024)
Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation
par: Uchida, Yuiko, et autres
Publié: (2025)
par: Uchida, Yuiko, et autres
Publié: (2025)
FD$^2$: A Dedicated Framework for Fine-Grained Dataset Distillation
par: Ma, Hongxu, et autres
Publié: (2026)
par: Ma, Hongxu, et autres
Publié: (2026)
SAS: Semantic-aware Sampling for Generative Dataset Distillation
par: Li, Mingzhuo, et autres
Publié: (2026)
par: Li, Mingzhuo, et autres
Publié: (2026)
Information-Guided Diffusion Sampling for Dataset Distillation
par: Ye, Linfeng, et autres
Publié: (2025)
par: Ye, Linfeng, et autres
Publié: (2025)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
par: Li, Guangyao, et autres
Publié: (2024)
par: Li, Guangyao, et autres
Publié: (2024)
Dual-Model Weight Selection and Self-Knowledge Distillation for Medical Image Classification
par: Tsutsumi, Ayaka, et autres
Publié: (2025)
par: Tsutsumi, Ayaka, et autres
Publié: (2025)
Audio-Guided Visual Perception for Audio-Visual Navigation
par: Wang, Yi, et autres
Publié: (2025)
par: Wang, Yi, et autres
Publié: (2025)
Audio Visual Segmentation Through Text Embeddings
par: Lee, Kyungbok, et autres
Publié: (2025)
par: Lee, Kyungbok, et autres
Publié: (2025)
Crab$^{+}$: A Scalable and Unified Audio-Visual Scene Understanding Model with Explicit Cooperation
par: Cai, Dongnuan, et autres
Publié: (2026)
par: Cai, Dongnuan, et autres
Publié: (2026)
Taming Modality Entanglement in Continual Audio-Visual Segmentation
par: Hong, Yuyang, et autres
Publié: (2025)
par: Hong, Yuyang, et autres
Publié: (2025)
Label-anticipated Event Disentanglement for Audio-Visual Video Parsing
par: Zhou, Jinxing, et autres
Publié: (2024)
par: Zhou, Jinxing, et autres
Publié: (2024)
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
par: Marinoni, Christian, et autres
Publié: (2025)
par: Marinoni, Christian, et autres
Publié: (2025)
Learning Trimodal Relation for Audio-Visual Question Answering with Missing Modality
par: Park, Kyu Ri, et autres
Publié: (2024)
par: Park, Kyu Ri, et autres
Publié: (2024)
Adaptive Shared Experts with LoRA-Based Mixture of Experts for Multi-Task Learning
par: Yang, Minghao, et autres
Publié: (2025)
par: Yang, Minghao, et autres
Publié: (2025)
Style-Preserving Lip Sync via Audio-Aware Style Reference
par: Zhong, Weizhi, et autres
Publié: (2024)
par: Zhong, Weizhi, et autres
Publié: (2024)
Efficient Low-Resolution Face Recognition via Bridge Distillation
par: Ge, Shiming, et autres
Publié: (2024)
par: Ge, Shiming, et autres
Publié: (2024)
Graph-Based Cross-Domain Knowledge Distillation for Cross-Dataset Text-to-Image Person Retrieval
par: Luo, Bingjun, et autres
Publié: (2025)
par: Luo, Bingjun, et autres
Publié: (2025)
CrypticBio: A Large Multimodal Dataset for Visually Confusing Biodiversity
par: Manolache, Georgiana, et autres
Publié: (2025)
par: Manolache, Georgiana, et autres
Publié: (2025)
JPEG AI Image Compression Visual Artifacts: Detection Methods and Dataset
par: Tsereh, Daria, et autres
Publié: (2024)
par: Tsereh, Daria, et autres
Publié: (2024)
PAND: Prompt-Aware Neighborhood Distillation for Lightweight Fine-Grained Visual Classification
par: Luo, Qiuming, et autres
Publié: (2026)
par: Luo, Qiuming, et autres
Publié: (2026)
SeeingSounds: Learning Audio-to-Visual Alignment via Text
par: Carnemolla, Simone, et autres
Publié: (2025)
par: Carnemolla, Simone, et autres
Publié: (2025)
CLASP: Cross-modal Salient Anchor-based Semantic Propagation for Weakly-supervised Dense Audio-Visual Event Localization
par: Zhou, Jinxing, et autres
Publié: (2025)
par: Zhou, Jinxing, et autres
Publié: (2025)
Distilling Generative-Discriminative Representations for Very Low-Resolution Face Recognition
par: Zhang, Junzheng, et autres
Publié: (2024)
par: Zhang, Junzheng, et autres
Publié: (2024)
Personalized Federated Learning for Egocentric Video Gaze Estimation with Comprehensive Parameter Frezzing
par: Feng, Yuhu, et autres
Publié: (2025)
par: Feng, Yuhu, et autres
Publié: (2025)
EmotionGesture: Audio-Driven Diverse Emotional Co-Speech 3D Gesture Generation
par: Qi, Xingqun, et autres
Publié: (2023)
par: Qi, Xingqun, et autres
Publié: (2023)
Documents similaires
-
Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
par: Gan, Yaozong, et autres
Publié: (2024) -
Cross-domain Few-shot In-context Learning for Enhancing Traffic Sign Recognition
par: Gan, Yaozong, et autres
Publié: (2024) -
Hyperbolic Dataset Distillation
par: Li, Wenyuan, et autres
Publié: (2025) -
Reinforcing Pre-trained Models Using Counterfactual Images
par: Li, Xiang, et autres
Publié: (2024) -
Foreground-Aware Dataset Distillation via Dynamic Patch Selection
par: Li, Longzhen, et autres
Publié: (2026)