AIM: Adaptive Intra-Network Modulation for Balanced Multimodal Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Shu, Chen, C. L. Philip, Zhang, Tong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reliable Multimodal Learning Via Multi-Level Adaptive DeConfusion
di: Zhang, Tong, et al.
Pubblicazione: (2025)
di: Zhang, Tong, et al.
Pubblicazione: (2025)
Test-time Adaptive Hierarchical Co-enhanced Denoising Network for Reliable Multimodal Classification
di: Shen, Shu, et al.
Pubblicazione: (2026)
di: Shen, Shu, et al.
Pubblicazione: (2026)
Multi-QuAD: Multi-Level Quality-Adaptive Dynamic Network for Reliable Multimodal Classification
di: Shen, Shu, et al.
Pubblicazione: (2024)
di: Shen, Shu, et al.
Pubblicazione: (2024)
AIM-CoT: Active Information-driven Multimodal Chain-of-Thought for Vision-Language Reasoning
di: Li, Xiping, et al.
Pubblicazione: (2025)
di: Li, Xiping, et al.
Pubblicazione: (2025)
Balancing Multimodal Domain Generalization via Gradient Modulation and Projection
di: Li, Hongzhao, et al.
Pubblicazione: (2026)
di: Li, Hongzhao, et al.
Pubblicazione: (2026)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
di: Zhang, Runmin, et al.
Pubblicazione: (2024)
di: Zhang, Runmin, et al.
Pubblicazione: (2024)
AIM: Asymmetric Information Masking for Visual Question Answering Continual Learning
di: Zhang, Peifeng, et al.
Pubblicazione: (2026)
di: Zhang, Peifeng, et al.
Pubblicazione: (2026)
AIM: Adversarial Information Masking for Faithfulness Evaluation of Saliency Maps
di: Hsieh, Chia-Ying, et al.
Pubblicazione: (2026)
di: Hsieh, Chia-Ying, et al.
Pubblicazione: (2026)
PAKAN: Pixel Adaptive Kolmogorov-Arnold Network Modules for Pansharpening
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
On-the-fly Modulation for Balanced Multimodal Learning
di: Wei, Yake, et al.
Pubblicazione: (2024)
di: Wei, Yake, et al.
Pubblicazione: (2024)
Balanced Learning for Domain Adaptive Semantic Segmentation
di: Li, Wangkai, et al.
Pubblicazione: (2025)
di: Li, Wangkai, et al.
Pubblicazione: (2025)
AIM 2025 Challenge on High FPS Motion Deblurring: Methods and Results
di: Ciubotariu, George, et al.
Pubblicazione: (2025)
di: Ciubotariu, George, et al.
Pubblicazione: (2025)
AIM 2024 Sparse Neural Rendering Challenge: Methods and Results
di: Nazarczuk, Michal, et al.
Pubblicazione: (2024)
di: Nazarczuk, Michal, et al.
Pubblicazione: (2024)
AIM: Amending Inherent Interpretability via Self-Supervised Masking
di: Alshami, Eyad, et al.
Pubblicazione: (2025)
di: Alshami, Eyad, et al.
Pubblicazione: (2025)
AIM 2025 Challenge on Real-World RAW Image Denoising
di: Li, Feiran, et al.
Pubblicazione: (2025)
di: Li, Feiran, et al.
Pubblicazione: (2025)
AIM 2024 Challenge on UHD Blind Photo Quality Assessment
di: Hosu, Vlad, et al.
Pubblicazione: (2024)
di: Hosu, Vlad, et al.
Pubblicazione: (2024)
AIM 2024 Sparse Neural Rendering Challenge: Dataset and Benchmark
di: Nazarczuk, Michal, et al.
Pubblicazione: (2024)
di: Nazarczuk, Michal, et al.
Pubblicazione: (2024)
Towards Accurate Binary Spiking Neural Networks: Learning with Adaptive Gradient Modulation Mechanism
di: Liang, Yu, et al.
Pubblicazione: (2025)
di: Liang, Yu, et al.
Pubblicazione: (2025)
AIM: Adaptive Inference of Multi-Modal LLMs via Token Merging and Pruning
di: Zhong, Yiwu, et al.
Pubblicazione: (2024)
di: Zhong, Yiwu, et al.
Pubblicazione: (2024)
Adaptive Intra-Class Variation Contrastive Learning for Unsupervised Person Re-Identification
di: Liu, Lingzhi, et al.
Pubblicazione: (2024)
di: Liu, Lingzhi, et al.
Pubblicazione: (2024)
Spectral-Adaptive Modulation Networks for Visual Perception
di: Yun, Guhnoo, et al.
Pubblicazione: (2025)
di: Yun, Guhnoo, et al.
Pubblicazione: (2025)
Efficient Perceptual Image Super Resolution: AIM 2025 Study and Benchmark
di: Longarela, Bruno, et al.
Pubblicazione: (2025)
di: Longarela, Bruno, et al.
Pubblicazione: (2025)
Adaptive and Balanced Re-initialization for Long-timescale Continual Test-time Domain Adaptation
di: Wang, Yanshuo, et al.
Pubblicazione: (2026)
di: Wang, Yanshuo, et al.
Pubblicazione: (2026)
Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies
di: Tian, Mulin, et al.
Pubblicazione: (2023)
di: Tian, Mulin, et al.
Pubblicazione: (2023)
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
di: Li, Yanshu, et al.
Pubblicazione: (2025)
di: Li, Yanshu, et al.
Pubblicazione: (2025)
AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control
di: Chen, Shi, et al.
Pubblicazione: (2026)
di: Chen, Shi, et al.
Pubblicazione: (2026)
Windsock is Dancing: Adaptive Multimodal Retrieval-Augmented Generation
di: Zhao, Shu, et al.
Pubblicazione: (2025)
di: Zhao, Shu, et al.
Pubblicazione: (2025)
Multi-Expert Adaptive Selection: Task-Balancing for All-in-One Image Restoration
di: Yu, Xiaoyan, et al.
Pubblicazione: (2024)
di: Yu, Xiaoyan, et al.
Pubblicazione: (2024)
Foster Adaptivity and Balance in Learning with Noisy Labels
di: Sheng, Mengmeng, et al.
Pubblicazione: (2024)
di: Sheng, Mengmeng, et al.
Pubblicazione: (2024)
AIM2PC: Aerial Image to 3D Building Point Cloud Reconstruction
di: Turki, Soulaimene, et al.
Pubblicazione: (2025)
di: Turki, Soulaimene, et al.
Pubblicazione: (2025)
Efficient Real-World Deblurring using Single Images: AIM 2025 Challenge Report
di: Feijoo, Daniel, et al.
Pubblicazione: (2025)
di: Feijoo, Daniel, et al.
Pubblicazione: (2025)
Generator-Refiner-Examiner: A Tri-Module Data Augmentation Framework for 3D Human Avatar Learning from Monocular Videos
di: Zhang, Gangjian, et al.
Pubblicazione: (2026)
di: Zhang, Gangjian, et al.
Pubblicazione: (2026)
Robust Saliency-Aware Distillation for Few-shot Fine-grained Visual Recognition
di: Liu, Haiqi, et al.
Pubblicazione: (2023)
di: Liu, Haiqi, et al.
Pubblicazione: (2023)
Unsupervised Multimodal 3D Medical Image Registration with Multilevel Correlation Balanced Optimization
di: Wang, Jiazheng, et al.
Pubblicazione: (2024)
di: Wang, Jiazheng, et al.
Pubblicazione: (2024)
I2CR: Intra- and Inter-modal Collaborative Reflections for Multimodal Entity Linking
di: Liu, Ziyan, et al.
Pubblicazione: (2025)
di: Liu, Ziyan, et al.
Pubblicazione: (2025)
A Dual-Modulation Framework for RGB-T Crowd Counting via Spatially Modulated Attention and Adaptive Fusion
di: Feng, Yuhong, et al.
Pubblicazione: (2025)
di: Feng, Yuhong, et al.
Pubblicazione: (2025)
Adaptive Multi-step Refinement Network for Robust Point Cloud Registration
di: Chen, Zhi, et al.
Pubblicazione: (2023)
di: Chen, Zhi, et al.
Pubblicazione: (2023)
ICG-MVSNet: Learning Intra-view and Cross-view Relationships for Guidance in Multi-View Stereo
di: Hu, Yuxi, et al.
Pubblicazione: (2025)
di: Hu, Yuxi, et al.
Pubblicazione: (2025)
Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
di: Ren, Junlong, et al.
Pubblicazione: (2025)
di: Ren, Junlong, et al.
Pubblicazione: (2025)
Modality-Balanced Learning for Multimedia Recommendation
di: Zhang, Jinghao, et al.
Pubblicazione: (2024)
di: Zhang, Jinghao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Reliable Multimodal Learning Via Multi-Level Adaptive DeConfusion
di: Zhang, Tong, et al.
Pubblicazione: (2025) -
Test-time Adaptive Hierarchical Co-enhanced Denoising Network for Reliable Multimodal Classification
di: Shen, Shu, et al.
Pubblicazione: (2026) -
Multi-QuAD: Multi-Level Quality-Adaptive Dynamic Network for Reliable Multimodal Classification
di: Shen, Shu, et al.
Pubblicazione: (2024) -
AIM-CoT: Active Information-driven Multimodal Chain-of-Thought for Vision-Language Reasoning
di: Li, Xiping, et al.
Pubblicazione: (2025) -
Balancing Multimodal Domain Generalization via Gradient Modulation and Projection
di: Li, Hongzhao, et al.
Pubblicazione: (2026)