M$^{3}$D: A Multimodal, Multilingual and Multitask Dataset for Grounded Document-level Information Extraction
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Jiang, Li, Bobo, Yang, Xinran, Yang, Na, Fei, Hao, Zhang, Mingyao, Li, Fei, Ji, Donghong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CMNER: A Chinese Multimodal NER Dataset based on Social Media
por: Ji, Yuanze, et al.
Publicado: (2024)
por: Ji, Yuanze, et al.
Publicado: (2024)
LASQ: A Low-resource Aspect-based Sentiment Quadruple Extraction Dataset
por: Yusufu, Aizihaierjiang, et al.
Publicado: (2026)
por: Yusufu, Aizihaierjiang, et al.
Publicado: (2026)
Code-MIE: A Code-style Model for Multimodal Information Extraction with Scene Graph and Entity Attribute Knowledge Enhancement
por: Liu, Jiang, et al.
Publicado: (2026)
por: Liu, Jiang, et al.
Publicado: (2026)
Harvesting Events from Multiple Sources: Towards a Cross-Document Event Extraction Paradigm
por: Gao, Qiang, et al.
Publicado: (2024)
por: Gao, Qiang, et al.
Publicado: (2024)
Revisiting Structured Sentiment Analysis as Latent Dependency Graph Parsing
por: Zhou, Chengjie, et al.
Publicado: (2024)
por: Zhou, Chengjie, et al.
Publicado: (2024)
Enhancing Cross-Document Event Coreference Resolution by Discourse Structure and Semantic Information
por: Gao, Qiang, et al.
Publicado: (2024)
por: Gao, Qiang, et al.
Publicado: (2024)
Zero-Shot Conversational Stance Detection: Dataset and Approaches
por: Ding, Yuzhe, et al.
Publicado: (2025)
por: Ding, Yuzhe, et al.
Publicado: (2025)
Multi-Granular Multimodal Clue Fusion for Meme Understanding
por: Zheng, Li, et al.
Publicado: (2025)
por: Zheng, Li, et al.
Publicado: (2025)
Dynamic Emotion and Personality Profiling for Multimodal Deception Detection
por: Zheng, Li, et al.
Publicado: (2026)
por: Zheng, Li, et al.
Publicado: (2026)
DALR: Dual-level Alignment Learning for Multimodal Sentence Representation Learning
por: He, Kang, et al.
Publicado: (2025)
por: He, Kang, et al.
Publicado: (2025)
M3TQA: Massively Multilingual Multitask Table Question Answering
por: Shu, Daixin, et al.
Publicado: (2025)
por: Shu, Daixin, et al.
Publicado: (2025)
FormFactory: An Interactive Benchmarking Suite for Multimodal Form-Filling Agents
por: Li, Bobo, et al.
Publicado: (2025)
por: Li, Bobo, et al.
Publicado: (2025)
P-MMEval: A Parallel Multilingual Multitask Benchmark for Consistent Evaluation of LLMs
por: Zhang, Yidan, et al.
Publicado: (2024)
por: Zhang, Yidan, et al.
Publicado: (2024)
Enhance-then-Balance Modality Collaboration for Robust Multimodal Sentiment Analysis
por: He, Kang, et al.
Publicado: (2026)
por: He, Kang, et al.
Publicado: (2026)
M4FC: a Multimodal, Multilingual, Multicultural, Multitask Real-World Fact-Checking Dataset
por: Geng, Jiahui, et al.
Publicado: (2025)
por: Geng, Jiahui, et al.
Publicado: (2025)
PanoSent: A Panoptic Sextuple Extraction Benchmark for Multimodal Conversational Aspect-based Sentiment Analysis
por: Luo, Meng, et al.
Publicado: (2024)
por: Luo, Meng, et al.
Publicado: (2024)
NUS-Emo at SemEval-2024 Task 3: Instruction-Tuning LLM for Multimodal Emotion-Cause Analysis in Conversations
por: Luo, Meng, et al.
Publicado: (2024)
por: Luo, Meng, et al.
Publicado: (2024)
Event Extraction in Large Language Model
por: Li, Bobo, et al.
Publicado: (2025)
por: Li, Bobo, et al.
Publicado: (2025)
Modeling Unified Semantic Discourse Structure for High-quality Headline Generation
por: Xu, Minghui, et al.
Publicado: (2024)
por: Xu, Minghui, et al.
Publicado: (2024)
Enhancing Hyperbole and Metaphor Detection with Their Bidirectional Dynamic Interaction and Emotion Knowledge
por: Zheng, Li, et al.
Publicado: (2025)
por: Zheng, Li, et al.
Publicado: (2025)
Automatic Extraction of Relationships among Motivations, Emotions and Actions from Natural Language Texts
por: Yang, Fei
Publicado: (2024)
por: Yang, Fei
Publicado: (2024)
DiscoSG: Towards Discourse-Level Text Scene Graph Parsing through Iterative Graph Refinement
por: Lin, Shaoqing, et al.
Publicado: (2025)
por: Lin, Shaoqing, et al.
Publicado: (2025)
Are Emotion and Rhetoric Neurons in LLM? Neuron Recognition and Adaptive Masking for Emotion-Rhetoric Prediction Steering
por: Zheng, Li, et al.
Publicado: (2026)
por: Zheng, Li, et al.
Publicado: (2026)
Cross-Document Cross-Lingual NLI via RST-Enhanced Graph Fusion and Interpretability Prediction
por: Yuan, Mengying, et al.
Publicado: (2025)
por: Yuan, Mengying, et al.
Publicado: (2025)
Benchmarking Multimodal Retrieval Augmented Generation with Dynamic VQA Dataset and Self-adaptive Planning Agent
por: Li, Yangning, et al.
Publicado: (2024)
por: Li, Yangning, et al.
Publicado: (2024)
XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form Parser
por: Cheng, Xianfu, et al.
Publicado: (2024)
por: Cheng, Xianfu, et al.
Publicado: (2024)
Kestrel: 3D Multimodal LLM for Part-Aware Grounded Description
por: Ahmed, Mahmoud, et al.
Publicado: (2024)
por: Ahmed, Mahmoud, et al.
Publicado: (2024)
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
por: Ji, Yifan, et al.
Publicado: (2026)
por: Ji, Yifan, et al.
Publicado: (2026)
m3P: Towards Multimodal Multilingual Translation with Multimodal Prompt
por: Yang, Jian, et al.
Publicado: (2024)
por: Yang, Jian, et al.
Publicado: (2024)
TRIDENT: Enhancing Large Language Model Safety with Tri-Dimensional Diversified Red-Teaming Data Synthesis
por: Wu, Xiaorui, et al.
Publicado: (2025)
por: Wu, Xiaorui, et al.
Publicado: (2025)
A Multilingual Dataset and Empirical Validation for the Mutual Reinforcement Effect in Information Extraction
por: Gan, Chengguang, et al.
Publicado: (2024)
por: Gan, Chengguang, et al.
Publicado: (2024)
CreoleVal: Multilingual Multitask Benchmarks for Creoles
por: Lent, Heather, et al.
Publicado: (2023)
por: Lent, Heather, et al.
Publicado: (2023)
"What is the value of {templates}?" Rethinking Document Information Extraction Datasets for LLMs
por: Zmigrod, Ran, et al.
Publicado: (2024)
por: Zmigrod, Ran, et al.
Publicado: (2024)
Cross-lingual Embedding Clustering for Hierarchical Softmax in Low-Resource Multilingual Speech Recognition
por: Yang, Zhengdong, et al.
Publicado: (2025)
por: Yang, Zhengdong, et al.
Publicado: (2025)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
por: Zhang, Meishan, et al.
Publicado: (2024)
por: Zhang, Meishan, et al.
Publicado: (2024)
Generative Sentiment Analysis via Latent Category Distribution and Constrained Decoding
por: Zhou, Jun, et al.
Publicado: (2024)
por: Zhou, Jun, et al.
Publicado: (2024)
Grounding Multilingual Multimodal LLMs With Cultural Knowledge
por: Nyandwi, Jean de Dieu, et al.
Publicado: (2025)
por: Nyandwi, Jean de Dieu, et al.
Publicado: (2025)
KnowCoder-X: Boosting Multilingual Information Extraction via Code
por: Zuo, Yuxin, et al.
Publicado: (2024)
por: Zuo, Yuxin, et al.
Publicado: (2024)
Relation Extraction Using Large Language Models: A Case Study on Acupuncture Point Locations
por: Li, Yiming, et al.
Publicado: (2024)
por: Li, Yiming, et al.
Publicado: (2024)
Multilingual Datasets for Custom Input Extraction and Explanation Requests Parsing in Conversational XAI Systems
por: Wang, Qianli, et al.
Publicado: (2025)
por: Wang, Qianli, et al.
Publicado: (2025)
Ejemplares similares
-
CMNER: A Chinese Multimodal NER Dataset based on Social Media
por: Ji, Yuanze, et al.
Publicado: (2024) -
LASQ: A Low-resource Aspect-based Sentiment Quadruple Extraction Dataset
por: Yusufu, Aizihaierjiang, et al.
Publicado: (2026) -
Code-MIE: A Code-style Model for Multimodal Information Extraction with Scene Graph and Entity Attribute Knowledge Enhancement
por: Liu, Jiang, et al.
Publicado: (2026) -
Harvesting Events from Multiple Sources: Towards a Cross-Document Event Extraction Paradigm
por: Gao, Qiang, et al.
Publicado: (2024) -
Revisiting Structured Sentiment Analysis as Latent Dependency Graph Parsing
por: Zhou, Chengjie, et al.
Publicado: (2024)