3M: Multi-modal Multi-task Multi-teacher Learning for Game Event Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ng, Thye Shan, Cao, Feiqi, Han, Soyeon Caren |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
In-game Toxic Language Detection: Shared Task and Attention Residuals
par: Jia, Yuanzhe, et autres
Publié: (2022)
par: Jia, Yuanzhe, et autres
Publié: (2022)
ChuLo: Chunk-Level Key Information Representation for Long Document Understanding
par: Li, Yan, et autres
Publié: (2024)
par: Li, Yan, et autres
Publié: (2024)
Multimodal Large Language Models and Tunings: Vision, Language, Sensors, Audio, and Beyond
par: Han, Soyeon Caren, et autres
Publié: (2024)
par: Han, Soyeon Caren, et autres
Publié: (2024)
3M-Health: Multimodal Multi-Teacher Knowledge Distillation for Mental Health Detection
par: Cabral, Rina Carines, et autres
Publié: (2024)
par: Cabral, Rina Carines, et autres
Publié: (2024)
PEACH: Pretrained-embedding Explanation Across Contextual and Hierarchical Structure
par: Cao, Feiqi, et autres
Publié: (2024)
par: Cao, Feiqi, et autres
Publié: (2024)
3MVRD: Multimodal Multi-task Multi-teacher Visually-Rich Form Document Understanding
par: Ding, Yihao, et autres
Publié: (2024)
par: Ding, Yihao, et autres
Publié: (2024)
Game-MUG: Multimodal Oriented Game Situation Understanding and Commentary Generation Dataset
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
MIDAS: Multi-level Intent, Domain, And Slot Knowledge Distillation for Multi-turn NLU
par: Li, Yan, et autres
Publié: (2024)
par: Li, Yan, et autres
Publié: (2024)
When More Is Less: A Systematic Analysis of Spatial and Commonsense Information for Visual Spatial Reasoning
par: Akasaka, Muku, et autres
Publié: (2026)
par: Akasaka, Muku, et autres
Publié: (2026)
Graph-Based Multimodal Contrastive Learning for Chart Question Answering
par: Dai, Yue, et autres
Publié: (2025)
par: Dai, Yue, et autres
Publié: (2025)
SPANER: Shared Prompt Aligner for Multimodal Semantic Representation
par: Ng, Thye Shan, et autres
Publié: (2025)
par: Ng, Thye Shan, et autres
Publié: (2025)
DocHop-QA: Towards Multi-Hop Reasoning over Multimodal Document Collections
par: Park, Jiwon, et autres
Publié: (2025)
par: Park, Jiwon, et autres
Publié: (2025)
$M^3EL$: A Multi-task Multi-topic Dataset for Multi-modal Entity Linking
par: Wang, Fang, et autres
Publié: (2024)
par: Wang, Fang, et autres
Publié: (2024)
Graph Neural Networks for Text Classification: A Survey
par: Wang, Kunze, et autres
Publié: (2023)
par: Wang, Kunze, et autres
Publié: (2023)
BRIDGE: Benchmark for multi-hop Reasoning In long multimodal Documents with Grounded Evidence
par: Xiang, Biao, et autres
Publié: (2026)
par: Xiang, Biao, et autres
Publié: (2026)
M3TCM: Multi-modal Multi-task Context Model for Utterance Classification in Motivational Interviews
par: Hossain, Sayed Muddashir, et autres
Publié: (2024)
par: Hossain, Sayed Muddashir, et autres
Publié: (2024)
SPADE: Structured Prompting Augmentation for Dialogue Enhancement in Machine-Generated Text Detection
par: Li, Haoyi, et autres
Publié: (2025)
par: Li, Haoyi, et autres
Publié: (2025)
EMMM, Explain Me My Model! Explainable Machine Generated Text Detection in Dialogues
par: Yuan, Angela Yifei, et autres
Publié: (2025)
par: Yuan, Angela Yifei, et autres
Publié: (2025)
MSG-Chart: Multimodal Scene Graph for ChartQA
par: Dai, Yue, et autres
Publié: (2024)
par: Dai, Yue, et autres
Publié: (2024)
MAP4TS: A Multi-Aspect Prompting Framework for Time-Series Forecasting with Large Language Models
par: Lee, Suchan, et autres
Publié: (2025)
par: Lee, Suchan, et autres
Publié: (2025)
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
par: Ohi, Masanari, et autres
Publié: (2024)
par: Ohi, Masanari, et autres
Publié: (2024)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
UnifiedMLLM: Enabling Unified Representation for Multi-modal Multi-tasks With Large Language Model
par: Li, Zhaowei, et autres
Publié: (2024)
par: Li, Zhaowei, et autres
Publié: (2024)
Deep Learning based Visually Rich Document Content Understanding: A Survey
par: Ding, Yihao, et autres
Publié: (2024)
par: Ding, Yihao, et autres
Publié: (2024)
MAGIC-VQA: Multimodal And Grounded Inference with Commonsense Knowledge for Visual Question Answering
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
Multi-task Learning with Active Learning for Arabic Offensive Speech Detection
par: Alansari, Aisha, et autres
Publié: (2025)
par: Alansari, Aisha, et autres
Publié: (2025)
Zero-Shot Multi-task Hallucination Detection
par: Bhamidipati, Patanjali, et autres
Publié: (2024)
par: Bhamidipati, Patanjali, et autres
Publié: (2024)
Task Selection and Assignment for Multi-modal Multi-task Dialogue Act Classification with Non-stationary Multi-armed Bandits
par: He, Xiangheng, et autres
Publié: (2023)
par: He, Xiangheng, et autres
Publié: (2023)
M4CXR: Exploring Multi-task Potentials of Multi-modal Large Language Models for Chest X-ray Interpretation
par: Park, Jonggwon, et autres
Publié: (2024)
par: Park, Jonggwon, et autres
Publié: (2024)
A Survey of Large Language Models in Finance (FinLLMs)
par: Lee, Jean, et autres
Publié: (2024)
par: Lee, Jean, et autres
Publié: (2024)
A Training-Free Length Extrapolation Approach for LLMs: Greedy Attention Logit Interpolation (GALI)
par: Li, Yan, et autres
Publié: (2025)
par: Li, Yan, et autres
Publié: (2025)
AM$^3$Safety: Towards Data Efficient Alignment of Multi-modal Multi-turn Safety for MLLMs
par: Zhu, Han, et autres
Publié: (2026)
par: Zhu, Han, et autres
Publié: (2026)
Two eyes, Two views, and finally, One summary! Towards Multi-modal Multi-tasking Knowledge-Infused Medical Dialogue Summarization
par: Saha, Anisha, et autres
Publié: (2024)
par: Saha, Anisha, et autres
Publié: (2024)
Multi-modal Stance Detection: New Datasets and Model
par: Liang, Bin, et autres
Publié: (2024)
par: Liang, Bin, et autres
Publié: (2024)
Multi-modal Data Spectrum: Multi-modal Datasets are Multi-dimensional
par: Madaan, Divyam, et autres
Publié: (2025)
par: Madaan, Divyam, et autres
Publié: (2025)
Rumor Detection by Multi-task Suffix Learning based on Time-series Dual Sentiments
par: Liu, Zhiwei, et autres
Publié: (2025)
par: Liu, Zhiwei, et autres
Publié: (2025)
Customizing Visual-Language Foundation Models for Multi-modal Anomaly Detection and Reasoning
par: Xu, Xiaohao, et autres
Publié: (2024)
par: Xu, Xiaohao, et autres
Publié: (2024)
M$^3$CoT: A Novel Benchmark for Multi-Domain Multi-step Multi-modal Chain-of-Thought
par: Chen, Qiguang, et autres
Publié: (2024)
par: Chen, Qiguang, et autres
Publié: (2024)
RMPL: Relation-aware Multi-task Progressive Learning with Stage-wise Training for Multimedia Event Extraction
par: Jin, Yongkang, et autres
Publié: (2026)
par: Jin, Yongkang, et autres
Publié: (2026)
PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering
par: Ding, Yihao, et autres
Publié: (2024)
par: Ding, Yihao, et autres
Publié: (2024)
Documents similaires
-
In-game Toxic Language Detection: Shared Task and Attention Residuals
par: Jia, Yuanzhe, et autres
Publié: (2022) -
ChuLo: Chunk-Level Key Information Representation for Long Document Understanding
par: Li, Yan, et autres
Publié: (2024) -
Multimodal Large Language Models and Tunings: Vision, Language, Sensors, Audio, and Beyond
par: Han, Soyeon Caren, et autres
Publié: (2024) -
3M-Health: Multimodal Multi-Teacher Knowledge Distillation for Mental Health Detection
par: Cabral, Rina Carines, et autres
Publié: (2024) -
PEACH: Pretrained-embedding Explanation Across Contextual and Hierarchical Structure
par: Cao, Feiqi, et autres
Publié: (2024)