Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Jinlong, Zhang, Yu, Bai, Xuefeng, Chen, Kehai, Wang, Yuwei, Liu, Zeming, Yu, Jun, Zhang, Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
Character-R1: Enhancing Role-Aware Reasoning in Role-Playing Agents via RLVR
por: Tang, Yihong, et al.
Publicado: (2026)
por: Tang, Yihong, et al.
Publicado: (2026)
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
por: Tang, Yihong, et al.
Publicado: (2026)
por: Tang, Yihong, et al.
Publicado: (2026)
Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration
por: Zhang, Yu, et al.
Publicado: (2026)
por: Zhang, Yu, et al.
Publicado: (2026)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
por: Zhu, Yingjie, et al.
Publicado: (2024)
por: Zhu, Yingjie, et al.
Publicado: (2024)
Federated Incremental Named Entity Recognition
por: Zhang, Duzhen, et al.
Publicado: (2024)
por: Zhang, Duzhen, et al.
Publicado: (2024)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
por: Xu, Mufan, et al.
Publicado: (2026)
por: Xu, Mufan, et al.
Publicado: (2026)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
por: Zhang, Hongbin, et al.
Publicado: (2024)
por: Zhang, Hongbin, et al.
Publicado: (2024)
Cross-domain Named Entity Recognition via Graph Matching
por: Zheng, Junhao, et al.
Publicado: (2024)
por: Zheng, Junhao, et al.
Publicado: (2024)
A Reasoning Paradigm for Named Entity Recognition
por: Huang, Hui, et al.
Publicado: (2025)
por: Huang, Hui, et al.
Publicado: (2025)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
por: Xu, Mufan, et al.
Publicado: (2024)
por: Xu, Mufan, et al.
Publicado: (2024)
Question-guided Knowledge Graph Re-scoring and Injection for Knowledge Graph Question Answering
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
In-Context Learning for Few-Shot Nested Named Entity Recognition
por: Zhang, Meishan, et al.
Publicado: (2024)
por: Zhang, Meishan, et al.
Publicado: (2024)
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
por: Wei, Xuchen, et al.
Publicado: (2025)
por: Wei, Xuchen, et al.
Publicado: (2025)
Exploring Stability-Plasticity Trade-offs for Continual Named Entity Recognition
por: Zhang, Duzhen, et al.
Publicado: (2025)
por: Zhang, Duzhen, et al.
Publicado: (2025)
SAKE: Self-aware Knowledge Exploitation-Exploration for Grounded Multimodal Named Entity Recognition
por: Tang, Jielong, et al.
Publicado: (2026)
por: Tang, Jielong, et al.
Publicado: (2026)
Named Entity Recognition in COVID-19 tweets with Entity Knowledge Augmentation
por: Zhang, Xuankang, et al.
Publicado: (2025)
por: Zhang, Xuankang, et al.
Publicado: (2025)
LLMs as Bridges: Reformulating Grounded Multimodal Named Entity Recognition
por: Li, Jinyuan, et al.
Publicado: (2024)
por: Li, Jinyuan, et al.
Publicado: (2024)
Rethinking Negative Instances for Generative Named Entity Recognition
por: Ding, Yuyang, et al.
Publicado: (2024)
por: Ding, Yuyang, et al.
Publicado: (2024)
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
por: Zhang, Hongbin, et al.
Publicado: (2025)
por: Zhang, Hongbin, et al.
Publicado: (2025)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
por: Zhang, Hongbin, et al.
Publicado: (2024)
por: Zhang, Hongbin, et al.
Publicado: (2024)
Mitigating Multimodal Hallucination via Phase-wise Self-reward
por: Zhang, Yu, et al.
Publicado: (2026)
por: Zhang, Yu, et al.
Publicado: (2026)
Progressively Modality Freezing for Multi-Modal Entity Alignment
por: Huang, Yani, et al.
Publicado: (2024)
por: Huang, Yani, et al.
Publicado: (2024)
Agentic Tool Use in Large Language Models
por: Hu, Jinchao, et al.
Publicado: (2026)
por: Hu, Jinchao, et al.
Publicado: (2026)
SAT: Balancing Reasoning Accuracy and Efficiency with Stepwise Adaptive Thinking
por: Huang, Weiyang, et al.
Publicado: (2026)
por: Huang, Weiyang, et al.
Publicado: (2026)
LTNER: Large Language Model Tagging for Named Entity Recognition with Contextualized Entity Marking
por: Yan, Faren, et al.
Publicado: (2024)
por: Yan, Faren, et al.
Publicado: (2024)
Constraint Multi-class Positive and Unlabeled Learning for Distantly Supervised Named Entity Recognition
por: Zhang, Yuzhe, et al.
Publicado: (2025)
por: Zhang, Yuzhe, et al.
Publicado: (2025)
"I've Heard of You!": Generate Spoken Named Entity Recognition Data for Unseen Entities
por: Yu, Jiawei, et al.
Publicado: (2024)
por: Yu, Jiawei, et al.
Publicado: (2024)
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
por: Zhu, Yingjie, et al.
Publicado: (2025)
por: Zhu, Yingjie, et al.
Publicado: (2025)
Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity Recognition
por: Yang, Yuming, et al.
Publicado: (2024)
por: Yang, Yuming, et al.
Publicado: (2024)
Named Entity Recognition in Context
por: Brisson, Colin, et al.
Publicado: (2025)
por: Brisson, Colin, et al.
Publicado: (2025)
Exploring the Translation Mechanism of Large Language Models
por: Zhang, Hongbin, et al.
Publicado: (2025)
por: Zhang, Hongbin, et al.
Publicado: (2025)
UniversalNER: Targeted Distillation from Large Language Models for Open Named Entity Recognition
por: Zhou, Wenxuan, et al.
Publicado: (2023)
por: Zhou, Wenxuan, et al.
Publicado: (2023)
E2E-GMNER: End-to-End Generative Grounded Multimodal Named Entity Recognition
por: Zhang, Meng, et al.
Publicado: (2026)
por: Zhang, Meng, et al.
Publicado: (2026)
Augmenting Biomedical Named Entity Recognition with General-domain Resources
por: Yin, Yu, et al.
Publicado: (2024)
por: Yin, Yu, et al.
Publicado: (2024)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
por: Deng, Qiyuan, et al.
Publicado: (2025)
por: Deng, Qiyuan, et al.
Publicado: (2025)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
por: Li, Xingzuo, et al.
Publicado: (2025)
por: Li, Xingzuo, et al.
Publicado: (2025)
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
por: Duan, Yifan, et al.
Publicado: (2025)
por: Duan, Yifan, et al.
Publicado: (2025)
CopyNE: Better Contextual ASR by Copying Named Entities
por: Zhou, Shilin, et al.
Publicado: (2023)
por: Zhou, Shilin, et al.
Publicado: (2023)
BANER: Boundary-Aware LLMs for Few-Shot Named Entity Recognition
por: Guo, Quanjiang, et al.
Publicado: (2024)
por: Guo, Quanjiang, et al.
Publicado: (2024)
Ejemplares similares
-
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
por: Zhang, Yu, et al.
Publicado: (2025) -
Character-R1: Enhancing Role-Aware Reasoning in Role-Playing Agents via RLVR
por: Tang, Yihong, et al.
Publicado: (2026) -
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
por: Tang, Yihong, et al.
Publicado: (2026) -
Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration
por: Zhang, Yu, et al.
Publicado: (2026) -
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
por: Zhu, Yingjie, et al.
Publicado: (2024)