DWE+: Dual-Way Matching Enhanced Framework for Multimodal Entity Linking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Shezheng, Li, Shasha, Zhao, Shan, Li, Xiaopeng, Wang, Chengyu, Yu, Jie, Ma, Jun, Yan, Tianwei, Ji, Bin, Mao, Xiaoguang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Dual-way Enhanced Framework from Text Matching Point of View for Multimodal Entity Linking
par: Song, Shezheng, et autres
Publié: (2023)
par: Song, Shezheng, et autres
Publié: (2023)
DIM: Dynamic Integration of Multimodal Entity Linking with Large Language Model
par: Song, Shezheng, et autres
Publié: (2024)
par: Song, Shezheng, et autres
Publié: (2024)
PTA: Enhancing Multimodal Sentiment Analysis through Pipelined Prediction and Translation-based Alignment
par: Song, Shezheng, et autres
Publié: (2024)
par: Song, Shezheng, et autres
Publié: (2024)
How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model
par: Song, Shezheng, et autres
Publié: (2023)
par: Song, Shezheng, et autres
Publié: (2023)
Rethinking Residual Distribution in Locate-then-Edit Model Editing
par: Li, Xiaopeng, et autres
Publié: (2025)
par: Li, Xiaopeng, et autres
Publié: (2025)
Where Does Vision Meet Language? Understanding and Refining Visual Fusion in MLLMs via Contrastive Attention
par: Song, Shezheng, et autres
Publié: (2026)
par: Song, Shezheng, et autres
Publié: (2026)
Seeing Right but Saying Wrong: Inter- and Intra-Layer Refinement in MLLMs without Training
par: Song, Shezheng, et autres
Publié: (2026)
par: Song, Shezheng, et autres
Publié: (2026)
Identifying Knowledge Editing Types in Large Language Models
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
PMET: Precise Model Editing in a Transformer
par: Li, Xiaopeng, et autres
Publié: (2023)
par: Li, Xiaopeng, et autres
Publié: (2023)
MOSABench: Multi-Object Sentiment Analysis Benchmark for Evaluating Multimodal Large Language Models Understanding of Complex Image
par: Song, Shezheng, et autres
Publié: (2024)
par: Song, Shezheng, et autres
Publié: (2024)
DcMatch: Unsupervised Multi-Shape Matching with Dual-Level Consistency
par: Ye, Tianwei, et autres
Publié: (2025)
par: Ye, Tianwei, et autres
Publié: (2025)
Exploring Large Language Models for Multimodal Sentiment Analysis: Challenges, Benchmarks, and Future Directions
par: Song, Shezheng
Publié: (2024)
par: Song, Shezheng
Publié: (2024)
EMSEdit: Efficient Multi-Step Meta-Learning-based Model Editing
par: Li, Xiaopeng, et autres
Publié: (2025)
par: Li, Xiaopeng, et autres
Publié: (2025)
DeepMEL: A Multi-Agent Collaboration Framework for Multimodal Entity Linking
par: Wang, Fang, et autres
Publié: (2025)
par: Wang, Fang, et autres
Publié: (2025)
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
Multi-level Matching Network for Multimodal Entity Linking
par: Hu, Zhiwei, et autres
Publié: (2024)
par: Hu, Zhiwei, et autres
Publié: (2024)
How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization
par: Song, Shezheng, et autres
Publié: (2025)
par: Song, Shezheng, et autres
Publié: (2025)
MERLIN: A Testbed for Multilingual Multimodal Entity Recognition and Linking
par: Ramamoorthy, Sathyanarayanan, et autres
Publié: (2025)
par: Ramamoorthy, Sathyanarayanan, et autres
Publié: (2025)
Generative Multimodal Entity Linking
par: Shi, Senbao, et autres
Publié: (2023)
par: Shi, Senbao, et autres
Publié: (2023)
Camel: Energy-Aware LLM Inference on Resource-Constrained Devices
par: Xu, Hao, et autres
Publié: (2025)
par: Xu, Hao, et autres
Publié: (2025)
SGMatch: Semantic-Guided Non-Rigid Shape Matching with Flow Regularization
par: Ye, Tianwei, et autres
Publié: (2026)
par: Ye, Tianwei, et autres
Publié: (2026)
VP-MEL: Visual Prompts Guided Multimodal Entity Linking
par: Mi, Hongze, et autres
Publié: (2024)
par: Mi, Hongze, et autres
Publié: (2024)
Model Editing for LLMs4Code: How Far are We?
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
Knowledge Completes the Vision: A Multimodal Entity-aware Retrieval-Augmented Generation Framework for News Image Captioning
par: You, Xiaoxing, et autres
Publié: (2025)
par: You, Xiaoxing, et autres
Publié: (2025)
Multi-level Mixture of Experts for Multimodal Entity Linking
par: Hu, Zhiwei, et autres
Publié: (2025)
par: Hu, Zhiwei, et autres
Publié: (2025)
KGMEL: Knowledge Graph-Enhanced Multimodal Entity Linking
par: Kim, Juyeon, et autres
Publié: (2025)
par: Kim, Juyeon, et autres
Publié: (2025)
$M^3EL$: A Multi-task Multi-topic Dataset for Multi-modal Entity Linking
par: Wang, Fang, et autres
Publié: (2024)
par: Wang, Fang, et autres
Publié: (2024)
LSAQ: Layer-Specific Adaptive Quantization for Large Language Model Deployment
par: Zeng, Binrui, et autres
Publié: (2024)
par: Zeng, Binrui, et autres
Publié: (2024)
AMELI: Enhancing Multimodal Entity Linking with Fine-Grained Attributes
par: Yao, Barry Menglong, et autres
Publié: (2023)
par: Yao, Barry Menglong, et autres
Publié: (2023)
UniMEL: A Unified Framework for Multimodal Entity Linking with Large Language Models
par: Qi, Liu, et autres
Publié: (2024)
par: Qi, Liu, et autres
Publié: (2024)
Optimal Transport Guided Correlation Assignment for Multimodal Entity Linking
par: Zhang, Zefeng, et autres
Publié: (2024)
par: Zhang, Zefeng, et autres
Publié: (2024)
APrompt4EM: Augmented Prompt Tuning for Generalized Entity Matching
par: Xia, Yikuan, et autres
Publié: (2024)
par: Xia, Yikuan, et autres
Publié: (2024)
Reverse Region-to-Entity Annotation for Pixel-Level Visual Entity Linking
par: Xu, Zhengfei, et autres
Publié: (2024)
par: Xu, Zhengfei, et autres
Publié: (2024)
EntityCLIP: Entity-Centric Image-Text Matching via Multimodal Attentive Contrastive Learning
par: Wang, Yaxiong, et autres
Publié: (2024)
par: Wang, Yaxiong, et autres
Publié: (2024)
REMM:Rotation-Equivariant Framework for End-to-End Multimodal Image Matching
par: Nie, Han, et autres
Publié: (2024)
par: Nie, Han, et autres
Publié: (2024)
Investigating Self-regulated Learning Sequences within a Generative AI-based Intelligent Tutoring System
par: Gao, Jie, et autres
Publié: (2026)
par: Gao, Jie, et autres
Publié: (2026)
Enhancing Multimodal Entity and Relation Extraction with Variational Information Bottleneck
par: Cui, Shiyao, et autres
Publié: (2023)
par: Cui, Shiyao, et autres
Publié: (2023)
Multi-Perspective Evidence Synthesis and Reasoning for Unsupervised Multimodal Entity Linking
par: Zhou, Mo, et autres
Publié: (2026)
par: Zhou, Mo, et autres
Publié: (2026)
LLMAEL: Large Language Models are Good Context Augmenters for Entity Linking
par: Xin, Amy, et autres
Publié: (2024)
par: Xin, Amy, et autres
Publié: (2024)
An Entity Linking Agent for Question Answering
par: Luo, Yajie, et autres
Publié: (2025)
par: Luo, Yajie, et autres
Publié: (2025)
Documents similaires
-
A Dual-way Enhanced Framework from Text Matching Point of View for Multimodal Entity Linking
par: Song, Shezheng, et autres
Publié: (2023) -
DIM: Dynamic Integration of Multimodal Entity Linking with Large Language Model
par: Song, Shezheng, et autres
Publié: (2024) -
PTA: Enhancing Multimodal Sentiment Analysis through Pipelined Prediction and Translation-based Alignment
par: Song, Shezheng, et autres
Publié: (2024) -
How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model
par: Song, Shezheng, et autres
Publié: (2023) -
Rethinking Residual Distribution in Locate-then-Edit Model Editing
par: Li, Xiaopeng, et autres
Publié: (2025)