Guardado en:
| Autores principales: | Shen, Shu, Chen, C. L. Philip, Zhang, Tong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2508.19769 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reliable Multimodal Learning Via Multi-Level Adaptive DeConfusion
por: Zhang, Tong, et al.
Publicado: (2025)
por: Zhang, Tong, et al.
Publicado: (2025)
Test-time Adaptive Hierarchical Co-enhanced Denoising Network for Reliable Multimodal Classification
por: Shen, Shu, et al.
Publicado: (2026)
por: Shen, Shu, et al.
Publicado: (2026)
Multi-QuAD: Multi-Level Quality-Adaptive Dynamic Network for Reliable Multimodal Classification
por: Shen, Shu, et al.
Publicado: (2024)
por: Shen, Shu, et al.
Publicado: (2024)
Balancing Multimodal Domain Generalization via Gradient Modulation and Projection
por: Li, Hongzhao, et al.
Publicado: (2026)
por: Li, Hongzhao, et al.
Publicado: (2026)
AIM-CoT: Active Information-driven Multimodal Chain-of-Thought for Vision-Language Reasoning
por: Li, Xiping, et al.
Publicado: (2025)
por: Li, Xiping, et al.
Publicado: (2025)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
por: Zhang, Runmin, et al.
Publicado: (2024)
por: Zhang, Runmin, et al.
Publicado: (2024)
AIM: Adversarial Information Masking for Faithfulness Evaluation of Saliency Maps
por: Hsieh, Chia-Ying, et al.
Publicado: (2026)
por: Hsieh, Chia-Ying, et al.
Publicado: (2026)
On-the-fly Modulation for Balanced Multimodal Learning
por: Wei, Yake, et al.
Publicado: (2024)
por: Wei, Yake, et al.
Publicado: (2024)
AIM: Asymmetric Information Masking for Visual Question Answering Continual Learning
por: Zhang, Peifeng, et al.
Publicado: (2026)
por: Zhang, Peifeng, et al.
Publicado: (2026)
PAKAN: Pixel Adaptive Kolmogorov-Arnold Network Modules for Pansharpening
por: Zhang, Haoyu, et al.
Publicado: (2026)
por: Zhang, Haoyu, et al.
Publicado: (2026)
AIM 2025 Challenge on High FPS Motion Deblurring: Methods and Results
por: Ciubotariu, George, et al.
Publicado: (2025)
por: Ciubotariu, George, et al.
Publicado: (2025)
Balanced Learning for Domain Adaptive Semantic Segmentation
por: Li, Wangkai, et al.
Publicado: (2025)
por: Li, Wangkai, et al.
Publicado: (2025)
AIM: Adaptive Inference of Multi-Modal LLMs via Token Merging and Pruning
por: Zhong, Yiwu, et al.
Publicado: (2024)
por: Zhong, Yiwu, et al.
Publicado: (2024)
AIM 2024 Sparse Neural Rendering Challenge: Methods and Results
por: Nazarczuk, Michal, et al.
Publicado: (2024)
por: Nazarczuk, Michal, et al.
Publicado: (2024)
Adaptive Intra-Class Variation Contrastive Learning for Unsupervised Person Re-Identification
por: Liu, Lingzhi, et al.
Publicado: (2024)
por: Liu, Lingzhi, et al.
Publicado: (2024)
AIM: Amending Inherent Interpretability via Self-Supervised Masking
por: Alshami, Eyad, et al.
Publicado: (2025)
por: Alshami, Eyad, et al.
Publicado: (2025)
AIM 2025 Challenge on Real-World RAW Image Denoising
por: Li, Feiran, et al.
Publicado: (2025)
por: Li, Feiran, et al.
Publicado: (2025)
AIM 2024 Challenge on UHD Blind Photo Quality Assessment
por: Hosu, Vlad, et al.
Publicado: (2024)
por: Hosu, Vlad, et al.
Publicado: (2024)
AIM 2024 Sparse Neural Rendering Challenge: Dataset and Benchmark
por: Nazarczuk, Michal, et al.
Publicado: (2024)
por: Nazarczuk, Michal, et al.
Publicado: (2024)
Towards Accurate Binary Spiking Neural Networks: Learning with Adaptive Gradient Modulation Mechanism
por: Liang, Yu, et al.
Publicado: (2025)
por: Liang, Yu, et al.
Publicado: (2025)
Efficient Perceptual Image Super Resolution: AIM 2025 Study and Benchmark
por: Longarela, Bruno, et al.
Publicado: (2025)
por: Longarela, Bruno, et al.
Publicado: (2025)
Windsock is Dancing: Adaptive Multimodal Retrieval-Augmented Generation
por: Zhao, Shu, et al.
Publicado: (2025)
por: Zhao, Shu, et al.
Publicado: (2025)
Adaptive and Balanced Re-initialization for Long-timescale Continual Test-time Domain Adaptation
por: Wang, Yanshuo, et al.
Publicado: (2026)
por: Wang, Yanshuo, et al.
Publicado: (2026)
Spectral-Adaptive Modulation Networks for Visual Perception
por: Yun, Guhnoo, et al.
Publicado: (2025)
por: Yun, Guhnoo, et al.
Publicado: (2025)
Foster Adaptivity and Balance in Learning with Noisy Labels
por: Sheng, Mengmeng, et al.
Publicado: (2024)
por: Sheng, Mengmeng, et al.
Publicado: (2024)
AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control
por: Chen, Shi, et al.
Publicado: (2026)
por: Chen, Shi, et al.
Publicado: (2026)
Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies
por: Tian, Mulin, et al.
Publicado: (2023)
por: Tian, Mulin, et al.
Publicado: (2023)
I2CR: Intra- and Inter-modal Collaborative Reflections for Multimodal Entity Linking
por: Liu, Ziyan, et al.
Publicado: (2025)
por: Liu, Ziyan, et al.
Publicado: (2025)
Multi-Expert Adaptive Selection: Task-Balancing for All-in-One Image Restoration
por: Yu, Xiaoyan, et al.
Publicado: (2024)
por: Yu, Xiaoyan, et al.
Publicado: (2024)
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
por: Li, Yanshu, et al.
Publicado: (2025)
por: Li, Yanshu, et al.
Publicado: (2025)
Robust Saliency-Aware Distillation for Few-shot Fine-grained Visual Recognition
por: Liu, Haiqi, et al.
Publicado: (2023)
por: Liu, Haiqi, et al.
Publicado: (2023)
AIM2PC: Aerial Image to 3D Building Point Cloud Reconstruction
por: Turki, Soulaimene, et al.
Publicado: (2025)
por: Turki, Soulaimene, et al.
Publicado: (2025)
Efficient Real-World Deblurring using Single Images: AIM 2025 Challenge Report
por: Feijoo, Daniel, et al.
Publicado: (2025)
por: Feijoo, Daniel, et al.
Publicado: (2025)
Modality-Balanced Learning for Multimedia Recommendation
por: Zhang, Jinghao, et al.
Publicado: (2024)
por: Zhang, Jinghao, et al.
Publicado: (2024)
Generator-Refiner-Examiner: A Tri-Module Data Augmentation Framework for 3D Human Avatar Learning from Monocular Videos
por: Zhang, Gangjian, et al.
Publicado: (2026)
por: Zhang, Gangjian, et al.
Publicado: (2026)
Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
por: Ren, Junlong, et al.
Publicado: (2025)
por: Ren, Junlong, et al.
Publicado: (2025)
AIM: Additional Image Guided Generation of Transferable Adversarial Attacks
por: Li, Teng, et al.
Publicado: (2025)
por: Li, Teng, et al.
Publicado: (2025)
Unsupervised Multimodal 3D Medical Image Registration with Multilevel Correlation Balanced Optimization
por: Wang, Jiazheng, et al.
Publicado: (2024)
por: Wang, Jiazheng, et al.
Publicado: (2024)
Adaptive Multi-step Refinement Network for Robust Point Cloud Registration
por: Chen, Zhi, et al.
Publicado: (2023)
por: Chen, Zhi, et al.
Publicado: (2023)
ICG-MVSNet: Learning Intra-view and Cross-view Relationships for Guidance in Multi-View Stereo
por: Hu, Yuxi, et al.
Publicado: (2025)
por: Hu, Yuxi, et al.
Publicado: (2025)
Ejemplares similares
-
Reliable Multimodal Learning Via Multi-Level Adaptive DeConfusion
por: Zhang, Tong, et al.
Publicado: (2025) -
Test-time Adaptive Hierarchical Co-enhanced Denoising Network for Reliable Multimodal Classification
por: Shen, Shu, et al.
Publicado: (2026) -
Multi-QuAD: Multi-Level Quality-Adaptive Dynamic Network for Reliable Multimodal Classification
por: Shen, Shu, et al.
Publicado: (2024) -
Balancing Multimodal Domain Generalization via Gradient Modulation and Projection
por: Li, Hongzhao, et al.
Publicado: (2026) -
AIM-CoT: Active Information-driven Multimodal Chain-of-Thought for Vision-Language Reasoning
por: Li, Xiping, et al.
Publicado: (2025)