MINED: Probing and Updating with Multimodal Time-Sensitive Knowledge for Large Multimodal Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Kailin, Jiang, Ning, Du, Yuntao, Ren, Yuchen, Li, Yuchen, Gao, Yifan, Bi, Jinhe, Ma, Yunpu, Li, Bin, Liu, Lei, Li, Qing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
di: Jiang, Kailin, et al.
Pubblicazione: (2025)
di: Jiang, Kailin, et al.
Pubblicazione: (2025)
When Large Multimodal Models Confront Evolving Knowledge: Challenges and Explorations
di: Jiang, Kailin, et al.
Pubblicazione: (2025)
di: Jiang, Kailin, et al.
Pubblicazione: (2025)
MV-Debate: Multi-view Agent Debate with Dynamic Reflection Gating for Multimodal Harmful Content Detection in Social Media
di: Lu, Rui, et al.
Pubblicazione: (2025)
di: Lu, Rui, et al.
Pubblicazione: (2025)
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
di: Du, Yuntao, et al.
Pubblicazione: (2025)
di: Du, Yuntao, et al.
Pubblicazione: (2025)
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
di: Peng, Tianfan, et al.
Pubblicazione: (2025)
di: Peng, Tianfan, et al.
Pubblicazione: (2025)
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
di: Jia, Yifan, et al.
Pubblicazione: (2025)
di: Jia, Yifan, et al.
Pubblicazione: (2025)
ASCD: Attention-Steerable Contrastive Decoding for Reducing Hallucination in MLLM
di: Wang, Yujun, et al.
Pubblicazione: (2025)
di: Wang, Yujun, et al.
Pubblicazione: (2025)
VideoAgent: A Memory-augmented Multimodal Agent for Video Understanding
di: Fan, Yue, et al.
Pubblicazione: (2024)
di: Fan, Yue, et al.
Pubblicazione: (2024)
FedNano: Toward Lightweight Federated Tuning for Pretrained Multimodal Large Language Models
di: Zhang, Yao, et al.
Pubblicazione: (2025)
di: Zhang, Yao, et al.
Pubblicazione: (2025)
Chem3DLLM: 3D Multimodal Large Language Models for Chemistry
di: Jiang, Lei, et al.
Pubblicazione: (2025)
di: Jiang, Lei, et al.
Pubblicazione: (2025)
MMKU-Bench: A Multimodal Update Benchmark for Diverse Visual Knowledge
di: Fu, Baochen, et al.
Pubblicazione: (2026)
di: Fu, Baochen, et al.
Pubblicazione: (2026)
AutoCoder: Enhancing Code Large Language Model with \textsc{AIEV-Instruct}
di: Lei, Bin, et al.
Pubblicazione: (2024)
di: Lei, Bin, et al.
Pubblicazione: (2024)
PRISM: Self-Pruning Intrinsic Selection Method for Training-Free Multimodal Data Selection
di: Bi, Jinhe, et al.
Pubblicazione: (2025)
di: Bi, Jinhe, et al.
Pubblicazione: (2025)
Instinct vs. Reflection: Unifying Token and Verbalized Confidence in Multimodal Large Models
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning
di: Yan, Sikuan, et al.
Pubblicazione: (2026)
di: Yan, Sikuan, et al.
Pubblicazione: (2026)
MM-CRITIC: A Holistic Evaluation of Large Multimodal Models as Multimodal Critique
di: Zeng, Gailun, et al.
Pubblicazione: (2025)
di: Zeng, Gailun, et al.
Pubblicazione: (2025)
Multimodal Large Language Models Meet Multimodal Emotion Recognition and Reasoning: A Survey
di: Shou, Yuntao, et al.
Pubblicazione: (2025)
di: Shou, Yuntao, et al.
Pubblicazione: (2025)
MK-SGN: A Spiking Graph Convolutional Network with Multimodal Fusion and Knowledge Distillation for Skeleton-based Action Recognition
di: Zheng, Naichuan, et al.
Pubblicazione: (2024)
di: Zheng, Naichuan, et al.
Pubblicazione: (2024)
MMCode: Benchmarking Multimodal Large Language Models for Code Generation with Visually Rich Programming Problems
di: Li, Kaixin, et al.
Pubblicazione: (2024)
di: Li, Kaixin, et al.
Pubblicazione: (2024)
CLOVA: A Closed-Loop Visual Assistant with Tool Usage and Update
di: Gao, Zhi, et al.
Pubblicazione: (2023)
di: Gao, Zhi, et al.
Pubblicazione: (2023)
CLASP: Class-Adaptive Layer Fusion and Dual-Stage Pruning for Multimodal Large Language Models
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models
di: Xu, Qinwu, et al.
Pubblicazione: (2026)
di: Xu, Qinwu, et al.
Pubblicazione: (2026)
Edit Once, Update Everywhere: A Simple Framework for Cross-Lingual Knowledge Synchronization in LLMs
di: Wu, Yuchen, et al.
Pubblicazione: (2025)
di: Wu, Yuchen, et al.
Pubblicazione: (2025)
Blocks as Probes: Dissecting Categorization Ability of Large Multimodal Models
di: Fu, Bin, et al.
Pubblicazione: (2024)
di: Fu, Bin, et al.
Pubblicazione: (2024)
Graph is a Substrate Across Data Modalities
di: Li, Ziming, et al.
Pubblicazione: (2026)
di: Li, Ziming, et al.
Pubblicazione: (2026)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
di: Li, Mingxin, et al.
Pubblicazione: (2025)
di: Li, Mingxin, et al.
Pubblicazione: (2025)
LLaVA Steering: Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
di: Bi, Jinhe, et al.
Pubblicazione: (2024)
di: Bi, Jinhe, et al.
Pubblicazione: (2024)
InverTune: Removing Backdoors from Multimodal Contrastive Learning Models via Trigger Inversion and Activation Tuning
di: Sun, Mengyuan, et al.
Pubblicazione: (2025)
di: Sun, Mengyuan, et al.
Pubblicazione: (2025)
OddGridBench: Exposing the Lack of Fine-Grained Visual Discrepancy Sensitivity in Multimodal Large Language Models
di: Weng, Tengjin, et al.
Pubblicazione: (2026)
di: Weng, Tengjin, et al.
Pubblicazione: (2026)
GenTKG: Generative Forecasting on Temporal Knowledge Graph with Large Language Models
di: Liao, Ruotong, et al.
Pubblicazione: (2023)
di: Liao, Ruotong, et al.
Pubblicazione: (2023)
mKG-RAG: Leveraging Multimodal Knowledge Graphs in Retrieval-Augmented Generation for Knowledge-intensive VQA
di: Yuan, Xu, et al.
Pubblicazione: (2025)
di: Yuan, Xu, et al.
Pubblicazione: (2025)
Auxetic‐Assisted Decoupling Strategy for High‐Sensitivity Multimodal Sensing of Temperature and Strain
di: Hao Yin, et al.
Pubblicazione: (2025)
di: Hao Yin, et al.
Pubblicazione: (2025)
MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection
di: Jiang, Xi, et al.
Pubblicazione: (2024)
di: Jiang, Xi, et al.
Pubblicazione: (2024)
MaxMind: A Memory Loop Network to Enhance Software Productivity based on Large Language Models
di: Dong, Yuchen, et al.
Pubblicazione: (2024)
di: Dong, Yuchen, et al.
Pubblicazione: (2024)
Mirage-1: Augmenting and Updating GUI Agent with Hierarchical Multimodal Skills
di: Xie, Yuquan, et al.
Pubblicazione: (2025)
di: Xie, Yuquan, et al.
Pubblicazione: (2025)
Investigating Traffic Accident Detection Using Multimodal Large Language Models
di: Skender, Ilhan, et al.
Pubblicazione: (2025)
di: Skender, Ilhan, et al.
Pubblicazione: (2025)
Rethinking Early-Fusion Strategies for Improved Multimodal Image Segmentation
di: Shen, Zhengwen, et al.
Pubblicazione: (2025)
di: Shen, Zhengwen, et al.
Pubblicazione: (2025)
MMBERT: Scaled Mixture-of-Experts Multimodal BERT for Robust Chinese Hate Speech Detection under Cloaking Perturbations
di: Xue, Qiyao, et al.
Pubblicazione: (2025)
di: Xue, Qiyao, et al.
Pubblicazione: (2025)
AffordBot: 3D Fine-grained Embodied Reasoning via Multimodal Large Language Models
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
SNN-Driven Multimodal Human Action Recognition via Sparse Spatial-Temporal Data Fusion
di: Zheng, Naichuan, et al.
Pubblicazione: (2025)
di: Zheng, Naichuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
di: Jiang, Kailin, et al.
Pubblicazione: (2025) -
When Large Multimodal Models Confront Evolving Knowledge: Challenges and Explorations
di: Jiang, Kailin, et al.
Pubblicazione: (2025) -
MV-Debate: Multi-view Agent Debate with Dynamic Reflection Gating for Multimodal Harmful Content Detection in Social Media
di: Lu, Rui, et al.
Pubblicazione: (2025) -
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
di: Du, Yuntao, et al.
Pubblicazione: (2025) -
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
di: Peng, Tianfan, et al.
Pubblicazione: (2025)