Identifying Multi-modal Knowledge Neurons in Pretrained Transformers via Two-stage Filtering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sato, Yugen, Takagi, Tomohiro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unleashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph Completion
par: Zhang, Yichi, et autres
Publié: (2024)
par: Zhang, Yichi, et autres
Publié: (2024)
Explore the Limits of Omni-modal Pretraining at Scale
par: Zhang, Yiyuan, et autres
Publié: (2024)
par: Zhang, Yiyuan, et autres
Publié: (2024)
FedNano: Toward Lightweight Federated Tuning for Pretrained Multimodal Large Language Models
par: Zhang, Yao, et autres
Publié: (2025)
par: Zhang, Yao, et autres
Publié: (2025)
Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts
par: Liu, Yi, et autres
Publié: (2024)
par: Liu, Yi, et autres
Publié: (2024)
HeLo: Heterogeneous Multi-Modal Fusion with Label Correlation for Emotion Distribution Learning
par: Zheng, Chuhang, et autres
Publié: (2025)
par: Zheng, Chuhang, et autres
Publié: (2025)
MAVEN: Multi-modal Attention for Valence-Arousal Emotion Network
par: Ahire, Vrushank, et autres
Publié: (2025)
par: Ahire, Vrushank, et autres
Publié: (2025)
MultiMedEdit: A Scenario-Aware Benchmark for Evaluating Knowledge Editing in Medical VQA
par: Wen, Shengtao, et autres
Publié: (2025)
par: Wen, Shengtao, et autres
Publié: (2025)
AI-Integrated Decision Support System for Real-Time Market Growth Forecasting and Multi-Source Content Diffusion Analytics
par: Yin, Ziqing, et autres
Publié: (2025)
par: Yin, Ziqing, et autres
Publié: (2025)
Copycat vs. Original: Multi-modal Pretraining and Variable Importance in Box-office Prediction
par: Chao, Qin, et autres
Publié: (2025)
par: Chao, Qin, et autres
Publié: (2025)
Enhancing multimodal cooperation via sample-level modality valuation
par: Wei, Yake, et autres
Publié: (2023)
par: Wei, Yake, et autres
Publié: (2023)
Unveiling Covert Toxicity in Multimodal Data via Toxicity Association Graphs: A Graph-Based Metric and Interpretable Detection Framework
par: Wu, Guanzong, et autres
Publié: (2026)
par: Wu, Guanzong, et autres
Publié: (2026)
Sample then Identify: A General Framework for Risk Control and Assessment in Multimodal Large Language Models
par: Wang, Qingni, et autres
Publié: (2024)
par: Wang, Qingni, et autres
Publié: (2024)
A Split-Window Transformer for Multi-Model Sequence Spammer Detection using Multi-Model Variational Autoencoder
par: Yang, Zhou, et autres
Publié: (2025)
par: Yang, Zhou, et autres
Publié: (2025)
MultiWay-Adapater: Adapting large-scale multi-modal models for scalable image-text retrieval
par: Long, Zijun, et autres
Publié: (2023)
par: Long, Zijun, et autres
Publié: (2023)
FISHER: A Foundation Model for Multi-Modal Industrial Signal Comprehensive Representation
par: Fan, Pingyi, et autres
Publié: (2025)
par: Fan, Pingyi, et autres
Publié: (2025)
SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning
par: Luo, Pengcheng, et autres
Publié: (2025)
par: Luo, Pengcheng, et autres
Publié: (2025)
Adaptive Prototype Knowledge Transfer for Federated Learning with Mixed Modalities and Heterogeneous Tasks
par: Gai, Keke, et autres
Publié: (2025)
par: Gai, Keke, et autres
Publié: (2025)
How Do Images Align and Complement LiDAR? Towards a Harmonized Multi-modal 3D Panoptic Segmentation
par: Pan, Yining, et autres
Publié: (2025)
par: Pan, Yining, et autres
Publié: (2025)
Harmony: A Unified Framework for Modality Incremental Learning
par: Song, Yaguang, et autres
Publié: (2025)
par: Song, Yaguang, et autres
Publié: (2025)
GRAFT: GRaPH and Table Reasoning for Textual Alignment -- A Benchmark for Structured Instruction Following and Visual Reasoning
par: Verma, Abhigya, et autres
Publié: (2025)
par: Verma, Abhigya, et autres
Publié: (2025)
Time-RA: Towards Time Series Reasoning for Anomaly Diagnosis with LLM Feedback
par: Yang, Yiyuan, et autres
Publié: (2025)
par: Yang, Yiyuan, et autres
Publié: (2025)
OmniMER: Auxiliary-Enhanced LLM Adaptation for Indonesian Multimodal Emotion Recognition
par: Yan, Xueming, et autres
Publié: (2025)
par: Yan, Xueming, et autres
Publié: (2025)
Comparing Contrastive and Triplet Loss: Variance Analysis and Optimization Behavior
par: Zeng, Donghuo
Publié: (2025)
par: Zeng, Donghuo
Publié: (2025)
Detecting Multimedia Generated by Large AI Models: A Survey
par: Lin, Li, et autres
Publié: (2024)
par: Lin, Li, et autres
Publié: (2024)
MixEval-X: Any-to-Any Evaluations from Real-World Data Mixtures
par: Ni, Jinjie, et autres
Publié: (2024)
par: Ni, Jinjie, et autres
Publié: (2024)
Predicting Outcomes in Video Games with Long Short Term Memory Networks
par: Chulajata, Kittimate, et autres
Publié: (2024)
par: Chulajata, Kittimate, et autres
Publié: (2024)
A review on Machine Learning based User-Centric Multimedia Streaming Techniques
par: Ghosh, Monalisa, et autres
Publié: (2024)
par: Ghosh, Monalisa, et autres
Publié: (2024)
Enhancing Modality Representation and Alignment for Multimodal Cold-start Active Learning
par: Shen, Meng, et autres
Publié: (2024)
par: Shen, Meng, et autres
Publié: (2024)
EquiAV: Leveraging Equivariance for Audio-Visual Contrastive Learning
par: Kim, Jongsuk, et autres
Publié: (2024)
par: Kim, Jongsuk, et autres
Publié: (2024)
BI-MDRG: Bridging Image History in Multimodal Dialogue Response Generation
par: Yoon, Hee Suk, et autres
Publié: (2024)
par: Yoon, Hee Suk, et autres
Publié: (2024)
Harmful Visual Content Manipulation Matters in Misinformation Detection Under Multimedia Scenarios
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Art2Music: Generating Music for Art Images with Multi-modal Feeling Alignment
par: Hong, Jiaying, et autres
Publié: (2025)
par: Hong, Jiaying, et autres
Publié: (2025)
Moving Pictures of Thought: Extracting Visual Knowledge in Charles S. Peirce's Manuscripts with Vision-Language Models
par: Pedretti, Carlo Teo, et autres
Publié: (2025)
par: Pedretti, Carlo Teo, et autres
Publié: (2025)
Neuron Abandoning Attention Flow: Visual Explanation of Dynamics inside CNN Models
par: Liao, Yi, et autres
Publié: (2024)
par: Liao, Yi, et autres
Publié: (2024)
Continual Multimodal Knowledge Graph Construction
par: Chen, Xiang, et autres
Publié: (2023)
par: Chen, Xiang, et autres
Publié: (2023)
Lightning Fast Video Anomaly Detection via Adversarial Knowledge Distillation
par: Croitoru, Florinel-Alin, et autres
Publié: (2022)
par: Croitoru, Florinel-Alin, et autres
Publié: (2022)
Multimodal Multi-loss Fusion Network for Sentiment Analysis
par: Wu, Zehui, et autres
Publié: (2023)
par: Wu, Zehui, et autres
Publié: (2023)
Multi-Modal Multi-Task Federated Foundation Models for Next-Generation Extended Reality Systems: Towards Privacy-Preserving Distributed Intelligence in AR/VR/MR
par: Nadimi, Fardis, et autres
Publié: (2025)
par: Nadimi, Fardis, et autres
Publié: (2025)
FastAST: Accelerating Audio Spectrogram Transformer via Token Merging and Cross-Model Knowledge Distillation
par: Behera, Swarup Ranjan, et autres
Publié: (2024)
par: Behera, Swarup Ranjan, et autres
Publié: (2024)
MultiScript30k: Leveraging Multilingual Embeddings to Extend Cross Script Parallel Data
par: Driggers-Ellis, Christopher, et autres
Publié: (2025)
par: Driggers-Ellis, Christopher, et autres
Publié: (2025)
Documents similaires
-
Unleashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph Completion
par: Zhang, Yichi, et autres
Publié: (2024) -
Explore the Limits of Omni-modal Pretraining at Scale
par: Zhang, Yiyuan, et autres
Publié: (2024) -
FedNano: Toward Lightweight Federated Tuning for Pretrained Multimodal Large Language Models
par: Zhang, Yao, et autres
Publié: (2025) -
Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts
par: Liu, Yi, et autres
Publié: (2024) -
HeLo: Heterogeneous Multi-Modal Fusion with Label Correlation for Emotion Distribution Learning
par: Zheng, Chuhang, et autres
Publié: (2025)