MultiMax: Sparse and Multi-Modal Attention Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Yuxuan, Fritz, Mario, Keuper, Margret |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MaxSup: Overcoming Representation Collapse in Label Smoothing
par: Zhou, Yuxuan, et autres
Publié: (2025)
par: Zhou, Yuxuan, et autres
Publié: (2025)
Balancing Diversity and Risk in LLM Sampling: How to Select Your Method and Parameter for Open-Ended Text Generation
par: Zhou, Yuxuan, et autres
Publié: (2024)
par: Zhou, Yuxuan, et autres
Publié: (2024)
How Do Training Methods Influence the Utilization of Vision Models?
par: Gavrikov, Paul, et autres
Publié: (2024)
par: Gavrikov, Paul, et autres
Publié: (2024)
Orion-MSP: Multi-Scale Sparse Attention for Tabular In-Context Learning
par: Bouadi, Mohamed, et autres
Publié: (2025)
par: Bouadi, Mohamed, et autres
Publié: (2025)
Divide & Bind Your Attention for Improved Generative Semantic Nursing
par: Li, Yumeng, et autres
Publié: (2023)
par: Li, Yumeng, et autres
Publié: (2023)
A Multi-Modal CNN-LSTM Framework with Multi-Head Attention and Focal Loss for Real-Time Elderly Fall Detection
par: Zhou, Lijie, et autres
Publié: (2026)
par: Zhou, Lijie, et autres
Publié: (2026)
Emotion and Intention Guided Multi-Modal Learning for Sticker Response Selection
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
Multi-Modal Molecular Representation Learning via Structure Awareness
par: Yin, Rong, et autres
Publié: (2025)
par: Yin, Rong, et autres
Publié: (2025)
Self-Tuning Sparse Attention: Multi-Fidelity Hyperparameter Optimization for Transformer Acceleration
par: Dev, Arundhathi, et autres
Publié: (2026)
par: Dev, Arundhathi, et autres
Publié: (2026)
SparseBalance: Load-Balanced Long Context Training with Dynamic Sparse Attention
par: Xu, Hongtao, et autres
Publié: (2026)
par: Xu, Hongtao, et autres
Publié: (2026)
Adversarial Supervision Makes Layout-to-Image Diffusion Models Thrive
par: Li, Yumeng, et autres
Publié: (2024)
par: Li, Yumeng, et autres
Publié: (2024)
HISA: Efficient Hierarchical Indexing for Fine-Grained Sparse Attention
par: Xu, Yufei, et autres
Publié: (2026)
par: Xu, Yufei, et autres
Publié: (2026)
Learning Multi-Level Features with Matryoshka Sparse Autoencoders
par: Bussmann, Bart, et autres
Publié: (2025)
par: Bussmann, Bart, et autres
Publié: (2025)
A Concept-Centric Approach to Multi-Modality Learning
par: Geng, Yuchong, et autres
Publié: (2024)
par: Geng, Yuchong, et autres
Publié: (2024)
Generalized Neighborhood Attention: Multi-dimensional Sparse Attention at the Speed of Light
par: Hassani, Ali, et autres
Publié: (2025)
par: Hassani, Ali, et autres
Publié: (2025)
Detecting Scarce and Sparse Anomalous: Solving Dual Imbalance in Multi-Instance Learning
par: Jia, Lin-Han, et autres
Publié: (2025)
par: Jia, Lin-Han, et autres
Publié: (2025)
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
par: Byeon, Woohyeon, et autres
Publié: (2025)
par: Byeon, Woohyeon, et autres
Publié: (2025)
ProtCLIP: Function-Informed Protein Multi-Modal Learning
par: Zhou, Hanjing, et autres
Publié: (2024)
par: Zhou, Hanjing, et autres
Publié: (2024)
Representation Learning with Mutual Influence of Modalities for Node Classification in Multi-Modal Heterogeneous Networks
par: Li, Jiafan, et autres
Publié: (2025)
par: Li, Jiafan, et autres
Publié: (2025)
Multi-Modal Manipulation via Multi-Modal Policy Consensus
par: Chen, Haonan, et autres
Publié: (2025)
par: Chen, Haonan, et autres
Publié: (2025)
Generative Modeling of Class Probability for Multi-Modal Representation Learning
par: Shin, Jungkyoo, et autres
Publié: (2025)
par: Shin, Jungkyoo, et autres
Publié: (2025)
GraphT5: Unified Molecular Graph-Language Modeling via Multi-Modal Cross-Token Attention
par: Kim, Sangyeup, et autres
Publié: (2025)
par: Kim, Sangyeup, et autres
Publié: (2025)
vAttention: Verified Sparse Attention
par: Desai, Aditya, et autres
Publié: (2025)
par: Desai, Aditya, et autres
Publié: (2025)
Multi-Modal Federated Learning for Cancer Staging over Non-IID Datasets with Unbalanced Modalities
par: Borazjani, Kasra, et autres
Publié: (2024)
par: Borazjani, Kasra, et autres
Publié: (2024)
Multi-Granular Attention based Heterogeneous Hypergraph Neural Network
par: Jin, Hong, et autres
Publié: (2025)
par: Jin, Hong, et autres
Publié: (2025)
Multi-Objective Optimization for Sparse Deep Multi-Task Learning
par: Hotegni, S. S., et autres
Publié: (2023)
par: Hotegni, S. S., et autres
Publié: (2023)
Attention Mechanism, Max-Affine Partition, and Universal Approximation
par: Liu, Hude, et autres
Publié: (2025)
par: Liu, Hude, et autres
Publié: (2025)
Progressive Sparse Attention: Algorithm and System Co-design for Efficient Attention in LLM Serving
par: Zhou, Qihui, et autres
Publié: (2025)
par: Zhou, Qihui, et autres
Publié: (2025)
TAP: Two-Stage Adaptive Personalization of Multi-Task and Multi-Modal Foundation Models in Federated Learning
par: Lee, Seohyun, et autres
Publié: (2025)
par: Lee, Seohyun, et autres
Publié: (2025)
The Max-Min Formulation of Multi-Objective Reinforcement Learning: From Theory to a Model-Free Algorithm
par: Park, Giseung, et autres
Publié: (2024)
par: Park, Giseung, et autres
Publié: (2024)
Stem: Rethinking Causal Information Flow in Sparse Attention
par: Niu, Lin, et autres
Publié: (2026)
par: Niu, Lin, et autres
Publié: (2026)
Natively Trainable Sparse Attention for Hierarchical Point Cloud Datasets
par: Lapautre, Nicolas, et autres
Publié: (2025)
par: Lapautre, Nicolas, et autres
Publié: (2025)
Multi-Modality Collaborative Learning for Sentiment Analysis
par: Wang, Shanmin, et autres
Publié: (2025)
par: Wang, Shanmin, et autres
Publié: (2025)
Learning Cell-Aware Hierarchical Multi-Modal Representations for Robust Molecular Modeling
par: Li, Mengran, et autres
Publié: (2025)
par: Li, Mengran, et autres
Publié: (2025)
CAML: Collaborative Auxiliary Modality Learning for Multi-Agent Systems
par: Liu, Rui, et autres
Publié: (2025)
par: Liu, Rui, et autres
Publié: (2025)
Discrete Diffusion for Complex and Congested Multi-Agent Path Finding with Sparse Social Attention
par: Wang, Yuanzhe, et autres
Publié: (2026)
par: Wang, Yuanzhe, et autres
Publié: (2026)
Multi-Modal AI for Remote Patient Monitoring in Cancer Care
par: Liu, Yansong, et autres
Publié: (2025)
par: Liu, Yansong, et autres
Publié: (2025)
Multi-head Temporal Latent Attention
par: Deng, Keqi, et autres
Publié: (2025)
par: Deng, Keqi, et autres
Publié: (2025)
SeerAttention-R: Sparse Attention Adaptation for Long Reasoning
par: Gao, Yizhao, et autres
Publié: (2025)
par: Gao, Yizhao, et autres
Publié: (2025)
A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models
par: Lin, Zihao, et autres
Publié: (2025)
par: Lin, Zihao, et autres
Publié: (2025)
Documents similaires
-
MaxSup: Overcoming Representation Collapse in Label Smoothing
par: Zhou, Yuxuan, et autres
Publié: (2025) -
Balancing Diversity and Risk in LLM Sampling: How to Select Your Method and Parameter for Open-Ended Text Generation
par: Zhou, Yuxuan, et autres
Publié: (2024) -
How Do Training Methods Influence the Utilization of Vision Models?
par: Gavrikov, Paul, et autres
Publié: (2024) -
Orion-MSP: Multi-Scale Sparse Attention for Tabular In-Context Learning
par: Bouadi, Mohamed, et autres
Publié: (2025) -
Divide & Bind Your Attention for Improved Generative Semantic Nursing
par: Li, Yumeng, et autres
Publié: (2023)