When Large Multimodal Models Confront Evolving Knowledge: Challenges and Explorations
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Kailin, Du, Yuntao, Ding, Yukai, Ren, Yuchen, Jiang, Ning, Gao, Zhi, Zheng, Zilong, Liu, Lei, Li, Bin, Li, Qing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
por: Jiang, Kailin, et al.
Publicado: (2025)
por: Jiang, Kailin, et al.
Publicado: (2025)
MINED: Probing and Updating with Multimodal Time-Sensitive Knowledge for Large Multimodal Models
por: Jiang, Kailin, et al.
Publicado: (2025)
por: Jiang, Kailin, et al.
Publicado: (2025)
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
por: Du, Yuntao, et al.
Publicado: (2025)
por: Du, Yuntao, et al.
Publicado: (2025)
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
por: Jia, Yifan, et al.
Publicado: (2025)
por: Jia, Yifan, et al.
Publicado: (2025)
When Search Engine Services meet Large Language Models: Visions and Challenges
por: Xiong, Haoyi, et al.
Publicado: (2024)
por: Xiong, Haoyi, et al.
Publicado: (2024)
In-Context Editing: Learning Knowledge from Self-Induced Distributions
por: Qi, Siyuan, et al.
Publicado: (2024)
por: Qi, Siyuan, et al.
Publicado: (2024)
VideoAgent: A Memory-augmented Multimodal Agent for Video Understanding
por: Fan, Yue, et al.
Publicado: (2024)
por: Fan, Yue, et al.
Publicado: (2024)
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
por: Peng, Tianfan, et al.
Publicado: (2025)
por: Peng, Tianfan, et al.
Publicado: (2025)
Beyond Data Privacy: New Privacy Risks for Large Language Models
por: Du, Yuntao, et al.
Publicado: (2025)
por: Du, Yuntao, et al.
Publicado: (2025)
Unity in Diversity: Multi-expert Knowledge Confrontation and Collaboration for Generalizable Vehicle Re-identification
por: Kuang, Zhenyu, et al.
Publicado: (2024)
por: Kuang, Zhenyu, et al.
Publicado: (2024)
When Language Overrules: Revealing Text Dominance in Multimodal Large Language Models
por: Wu, Huyu, et al.
Publicado: (2025)
por: Wu, Huyu, et al.
Publicado: (2025)
Knowledge Fusion By Evolving Weights of Language Models
por: Du, Guodong, et al.
Publicado: (2024)
por: Du, Guodong, et al.
Publicado: (2024)
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
por: Li, Yibo, et al.
Publicado: (2026)
por: Li, Yibo, et al.
Publicado: (2026)
Large Model Empowered Metaverse: State-of-the-Art, Challenges and Opportunities
por: Wang, Yuntao, et al.
Publicado: (2025)
por: Wang, Yuntao, et al.
Publicado: (2025)
Delineating Knowledge Boundaries for Honest Large Vision-Language Models
por: Song, Junru, et al.
Publicado: (2026)
por: Song, Junru, et al.
Publicado: (2026)
MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection
por: Jiang, Xi, et al.
Publicado: (2024)
por: Jiang, Xi, et al.
Publicado: (2024)
AutoCoder: Enhancing Code Large Language Model with \textsc{AIEV-Instruct}
por: Lei, Bin, et al.
Publicado: (2024)
por: Lei, Bin, et al.
Publicado: (2024)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
por: Dong, Xiangyu, et al.
Publicado: (2025)
por: Dong, Xiangyu, et al.
Publicado: (2025)
Multimodal Large Language Models Meet Multimodal Emotion Recognition and Reasoning: A Survey
por: Shou, Yuntao, et al.
Publicado: (2025)
por: Shou, Yuntao, et al.
Publicado: (2025)
When Modalities Remember: Continual Learning for Multimodal Knowledge Graphs
por: Li, Linyu, et al.
Publicado: (2026)
por: Li, Linyu, et al.
Publicado: (2026)
Evolving Without Ending: Unifying Multimodal Incremental Learning for Continual Panoptic Perception
por: Yuan, Bo, et al.
Publicado: (2026)
por: Yuan, Bo, et al.
Publicado: (2026)
Rule-Based Conflict-Free Decision Framework in Swarm Confrontation
por: Dong, Zhaoqi, et al.
Publicado: (2025)
por: Dong, Zhaoqi, et al.
Publicado: (2025)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
por: Cheng, Zifeng, et al.
Publicado: (2025)
por: Cheng, Zifeng, et al.
Publicado: (2025)
Confronting the Challenges of Participatory Culture
por: Jenkins, Henry
Publicado: (2019)
por: Jenkins, Henry
Publicado: (2019)
Evolving Knowledge Distillation with Large Language Models and Active Learning
por: Liu, Chengyuan, et al.
Publicado: (2024)
por: Liu, Chengyuan, et al.
Publicado: (2024)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
por: Chen, Jin, et al.
Publicado: (2023)
por: Chen, Jin, et al.
Publicado: (2023)
A Spectral Projected Gradient Method for Computational Protein Design problem
por: Zheng, Yukai, et al.
Publicado: (2025)
por: Zheng, Yukai, et al.
Publicado: (2025)
FrontierCS: Evolving Challenges for Evolving Intelligence
por: Mang, Qiuyang, et al.
Publicado: (2025)
por: Mang, Qiuyang, et al.
Publicado: (2025)
When Large Language Models Confront Repository-Level Automatic Program Repair: How Well They Done?
por: Chen, Yuxiao, et al.
Publicado: (2024)
por: Chen, Yuxiao, et al.
Publicado: (2024)
MK-SGN: A Spiking Graph Convolutional Network with Multimodal Fusion and Knowledge Distillation for Skeleton-based Action Recognition
por: Zheng, Naichuan, et al.
Publicado: (2024)
por: Zheng, Naichuan, et al.
Publicado: (2024)
Systematic Assessment of Tabular Data Synthesis
por: Du, Yuntao, et al.
Publicado: (2024)
por: Du, Yuntao, et al.
Publicado: (2024)
mKG-RAG: Leveraging Multimodal Knowledge Graphs in Retrieval-Augmented Generation for Knowledge-intensive VQA
por: Yuan, Xu, et al.
Publicado: (2025)
por: Yuan, Xu, et al.
Publicado: (2025)
Chem3DLLM: 3D Multimodal Large Language Models for Chemistry
por: Jiang, Lei, et al.
Publicado: (2025)
por: Jiang, Lei, et al.
Publicado: (2025)
CLOVA: A Closed-Loop Visual Assistant with Tool Usage and Update
por: Gao, Zhi, et al.
Publicado: (2023)
por: Gao, Zhi, et al.
Publicado: (2023)
Multimodal LLM Guided Exploration and Active Mapping using Fisher Information
por: Jiang, Wen, et al.
Publicado: (2024)
por: Jiang, Wen, et al.
Publicado: (2024)
Investigating Traffic Accident Detection Using Multimodal Large Language Models
por: Skender, Ilhan, et al.
Publicado: (2025)
por: Skender, Ilhan, et al.
Publicado: (2025)
Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory
por: Li, Sijia, et al.
Publicado: (2025)
por: Li, Sijia, et al.
Publicado: (2025)
Nanoparticles Designed Based on the Blood‐Brain Barrier for the Treatment of Cerebral Ischemia‐Reperfusion Injury
por: Zhi‐Wei Du, et al.
Publicado: (2025)
por: Zhi‐Wei Du, et al.
Publicado: (2025)
ExoViP: Step-by-step Verification and Exploration with Exoskeleton Modules for Compositional Visual Reasoning
por: Wang, Yuxuan, et al.
Publicado: (2024)
por: Wang, Yuxuan, et al.
Publicado: (2024)
GraphScout: Empowering Large Language Models with Intrinsic Exploration Ability for Agentic Graph Reasoning
por: Ying, Yuchen, et al.
Publicado: (2026)
por: Ying, Yuchen, et al.
Publicado: (2026)
Ejemplares similares
-
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
por: Jiang, Kailin, et al.
Publicado: (2025) -
MINED: Probing and Updating with Multimodal Time-Sensitive Knowledge for Large Multimodal Models
por: Jiang, Kailin, et al.
Publicado: (2025) -
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
por: Du, Yuntao, et al.
Publicado: (2025) -
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
por: Jia, Yifan, et al.
Publicado: (2025) -
When Search Engine Services meet Large Language Models: Visions and Challenges
por: Xiong, Haoyi, et al.
Publicado: (2024)