ADMN: A Layer-Wise Adaptive Multimodal Network for Dynamic Input Noise and Compute Resources
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Jason, Yuan, Yuyang, Yang, Kang, Kaplan, Lance, Srivastava, Mani |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FlexLoc: Conditional Neural Networks for Zero-Shot Sensor Perspective Invariance in Object Localization with Distributed Multimodal Sensors
por: Wu, Jason, et al.
Publicado: (2024)
por: Wu, Jason, et al.
Publicado: (2024)
Input-Adaptive Generative Dynamics in Diffusion Models
por: Xing, Yucheng, et al.
Publicado: (2024)
por: Xing, Yucheng, et al.
Publicado: (2024)
OmniVec2 -- A Novel Transformer based Network for Large Scale Multimodal and Multitask Learning
por: Srivastava, Siddharth, et al.
Publicado: (2025)
por: Srivastava, Siddharth, et al.
Publicado: (2025)
Layer-Wise Feature Metric of Semantic-Pixel Matching for Few-Shot Learning
por: Tang, Hao, et al.
Publicado: (2024)
por: Tang, Hao, et al.
Publicado: (2024)
CLASP: Class-Adaptive Layer Fusion and Dual-Stage Pruning for Multimodal Large Language Models
por: Dang, Yunkai, et al.
Publicado: (2026)
por: Dang, Yunkai, et al.
Publicado: (2026)
Layer-Wise Modality Decomposition for Interpretable Multimodal Sensor Fusion
por: Park, Jaehyun, et al.
Publicado: (2025)
por: Park, Jaehyun, et al.
Publicado: (2025)
NoiseBoost: Alleviating Hallucination with Noise Perturbation for Multimodal Large Language Models
por: Wu, Kai, et al.
Publicado: (2024)
por: Wu, Kai, et al.
Publicado: (2024)
DiffDecompose: Layer-Wise Decomposition of Alpha-Composited Images via Diffusion Transformers
por: Wang, Zitong, et al.
Publicado: (2025)
por: Wang, Zitong, et al.
Publicado: (2025)
Act Wisely: Cultivating Meta-Cognitive Tool Use in Agentic Multimodal Models
por: Yan, Shilin, et al.
Publicado: (2026)
por: Yan, Shilin, et al.
Publicado: (2026)
Winsor-CAM: Human-Tunable Visual Explanations from Deep Networks via Layer-Wise Winsorization
por: Wall, Casey, et al.
Publicado: (2025)
por: Wall, Casey, et al.
Publicado: (2025)
Adaptive Depth Networks with Skippable Sub-Paths
por: Kang, Woochul, et al.
Publicado: (2023)
por: Kang, Woochul, et al.
Publicado: (2023)
AVAM: Universal Training-free Adaptive Visual Anchoring Embedded into Multimodal Large Language Model for Multi-image Question Answering
por: Zeng, Kang, et al.
Publicado: (2025)
por: Zeng, Kang, et al.
Publicado: (2025)
Mitigating the Reasoning Tax in Vision-Language Fine-Tuning with Input-Adaptive Depth Aggregation
por: Ren, Yiming, et al.
Publicado: (2026)
por: Ren, Yiming, et al.
Publicado: (2026)
ReSpinQuant: Efficient Layer-Wise LLM Quantization via Subspace Residual Rotation Approximation
por: Kim, Suyoung, et al.
Publicado: (2026)
por: Kim, Suyoung, et al.
Publicado: (2026)
Revealing Temporal Label Noise in Multimodal Hateful Video Classification
por: Yang, Shuonan, et al.
Publicado: (2025)
por: Yang, Shuonan, et al.
Publicado: (2025)
HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention
por: Zheng, Xuzhe, et al.
Publicado: (2026)
por: Zheng, Xuzhe, et al.
Publicado: (2026)
Visual Document Understanding and Reasoning: A Multi-Agent Collaboration Framework with Agent-Wise Adaptive Test-Time Scaling
por: Yu, Xinlei, et al.
Publicado: (2025)
por: Yu, Xinlei, et al.
Publicado: (2025)
APLe: Token-Wise Adaptive for Multi-Modal Prompt Learning
por: Cao, Guiming, et al.
Publicado: (2024)
por: Cao, Guiming, et al.
Publicado: (2024)
Biological Plausibility and Representational Alignment of Feedback Alignment in Convolutional Networks
por: Lance, Jake, et al.
Publicado: (2026)
por: Lance, Jake, et al.
Publicado: (2026)
Editable Noise Map Inversion: Encoding Target-image into Noise For High-Fidelity Image Manipulation
por: Kang, Mingyu, et al.
Publicado: (2025)
por: Kang, Mingyu, et al.
Publicado: (2025)
Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability
por: Yang, Haiqi, et al.
Publicado: (2025)
por: Yang, Haiqi, et al.
Publicado: (2025)
Visual-Noise Guided In-Context Distillation for Multimodal Large Language Model Unlearning
por: Chen, Junkai, et al.
Publicado: (2026)
por: Chen, Junkai, et al.
Publicado: (2026)
DeepInsert: Early Layer Bypass for Efficient and Performant Multimodal Understanding
por: Choraria, Moulik, et al.
Publicado: (2025)
por: Choraria, Moulik, et al.
Publicado: (2025)
QNCD: Quantization Noise Correction for Diffusion Models
por: Chu, Huanpeng, et al.
Publicado: (2024)
por: Chu, Huanpeng, et al.
Publicado: (2024)
Brain Inspired Adaptive Memory Dual-Net for Few-Shot Image Classification
por: Di, Kexin, et al.
Publicado: (2025)
por: Di, Kexin, et al.
Publicado: (2025)
AT-SNN: Adaptive Tokens for Vision Transformer on Spiking Neural Network
por: Kang, Donghwa, et al.
Publicado: (2024)
por: Kang, Donghwa, et al.
Publicado: (2024)
Knowledge-based Visual Question Answer with Multimodal Processing, Retrieval and Filtering
por: Hong, Yuyang, et al.
Publicado: (2025)
por: Hong, Yuyang, et al.
Publicado: (2025)
LookWise: Knowing When and Where to Look for Fine-Grained Visual Reasoning in Multimodal Large Language Models
por: Shen, Yuxiang, et al.
Publicado: (2026)
por: Shen, Yuxiang, et al.
Publicado: (2026)
Scene Structure Guidance Network: Unfolding Graph Partitioning into Pixel-Wise Feature Learning
por: Shin, Jisu, et al.
Publicado: (2023)
por: Shin, Jisu, et al.
Publicado: (2023)
Revisiting Cross-Attention Mechanisms: Leveraging Beneficial Noise for Domain-Adaptive Learning
por: Zang, Zelin, et al.
Publicado: (2026)
por: Zang, Zelin, et al.
Publicado: (2026)
GateFuseNet: An Adaptive 3D Multimodal Neuroimaging Fusion Network for Parkinson's Disease Diagnosis
por: Jin, Rui, et al.
Publicado: (2025)
por: Jin, Rui, et al.
Publicado: (2025)
Dynamic Feedback Engines: Layer-Wise Control for Self-Regulating Continual Learning
por: Wu, Hengyi, et al.
Publicado: (2025)
por: Wu, Hengyi, et al.
Publicado: (2025)
Preserving Cross-Modal Stability for Visual Unlearning in Multimodal Scenarios
por: Li, Jinghan Xu Yuyang Zhang Qixuan Cai Jiancheng Chen Keqiu
Publicado: (2025)
por: Li, Jinghan Xu Yuyang Zhang Qixuan Cai Jiancheng Chen Keqiu
Publicado: (2025)
An Evolutionary Network Architecture Search Framework with Adaptive Multimodal Fusion for Hand Gesture Recognition
por: Xia, Yizhang, et al.
Publicado: (2024)
por: Xia, Yizhang, et al.
Publicado: (2024)
Sketch Input Method Editor: A Comprehensive Dataset and Methodology for Systematic Input Recognition
por: Zhu, Guangming, et al.
Publicado: (2023)
por: Zhu, Guangming, et al.
Publicado: (2023)
Tracing Representation Progression: Analyzing and Enhancing Layer-Wise Similarity
por: Jiang, Jiachen, et al.
Publicado: (2024)
por: Jiang, Jiachen, et al.
Publicado: (2024)
AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation
por: Tang, Shengkun, et al.
Publicado: (2023)
por: Tang, Shengkun, et al.
Publicado: (2023)
TACFN: Transformer-based Adaptive Cross-modal Fusion Network for Multimodal Emotion Recognition
por: Liu, Feng, et al.
Publicado: (2025)
por: Liu, Feng, et al.
Publicado: (2025)
Hybrid Layer-Wise ANN-SNN With Surrogate Spike Encoding-Decoding Structure
por: Luu, Nhan T., et al.
Publicado: (2025)
por: Luu, Nhan T., et al.
Publicado: (2025)
CorrDiff: Adaptive Delay-aware Detector with Temporal Cue Inputs for Real-time Object Detection
por: Zhang, Xiang, et al.
Publicado: (2025)
por: Zhang, Xiang, et al.
Publicado: (2025)
Ejemplares similares
-
FlexLoc: Conditional Neural Networks for Zero-Shot Sensor Perspective Invariance in Object Localization with Distributed Multimodal Sensors
por: Wu, Jason, et al.
Publicado: (2024) -
Input-Adaptive Generative Dynamics in Diffusion Models
por: Xing, Yucheng, et al.
Publicado: (2024) -
OmniVec2 -- A Novel Transformer based Network for Large Scale Multimodal and Multitask Learning
por: Srivastava, Siddharth, et al.
Publicado: (2025) -
Layer-Wise Feature Metric of Semantic-Pixel Matching for Few-Shot Learning
por: Tang, Hao, et al.
Publicado: (2024) -
CLASP: Class-Adaptive Layer Fusion and Dual-Stage Pruning for Multimodal Large Language Models
por: Dang, Yunkai, et al.
Publicado: (2026)