Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luo, Miaosen, Long, Jiesen, Li, Zequn, Yang, Yunying, Jiang, Yuncheng, Mai, Sijie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Explainable Fusion and Balanced Learning in Multimodal Sentiment Analysis
par: Luo, Miaosen, et autres
Publié: (2025)
par: Luo, Miaosen, et autres
Publié: (2025)
End-to-end Semantic-centric Video-based Multimodal Affective Computing
par: Lin, Ronghao, et autres
Publié: (2024)
par: Lin, Ronghao, et autres
Publié: (2024)
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
par: Luo, Miaosen, et autres
Publié: (2026)
par: Luo, Miaosen, et autres
Publié: (2026)
MissMAC-Bench: Building Solid Benchmark for Missing Modality Issue in Robust Multimodal Affective Computing
par: Lin, Ronghao, et autres
Publié: (2026)
par: Lin, Ronghao, et autres
Publié: (2026)
SpatialText: A Pure-Text Cognitive Benchmark for Spatial Understanding in Large Language Models
par: Jiang, Peiyao, et autres
Publié: (2026)
par: Jiang, Peiyao, et autres
Publié: (2026)
SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models
par: Yin, Han, et autres
Publié: (2025)
par: Yin, Han, et autres
Publié: (2025)
Finetuning Generative Large Language Models with Discrimination Instructions for Knowledge Graph Completion
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
E2Edev: Benchmarking Large Language Models in End-to-End Software Development Task
par: Liu, Jingyao, et autres
Publié: (2025)
par: Liu, Jingyao, et autres
Publié: (2025)
AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models
par: Zhang, Wentao, et autres
Publié: (2026)
par: Zhang, Wentao, et autres
Publié: (2026)
Using Large Language Model for End-to-End Chinese ASR and NER
par: Li, Yuang, et autres
Publié: (2024)
par: Li, Yuang, et autres
Publié: (2024)
WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models
par: He, Hongliang, et autres
Publié: (2024)
par: He, Hongliang, et autres
Publié: (2024)
End-to-End Graph Flattening Method for Large Language Models
par: Hong, Bin, et autres
Publié: (2024)
par: Hong, Bin, et autres
Publié: (2024)
End-To-End Clinical Trial Matching with Large Language Models
par: Ferber, Dyke, et autres
Publié: (2024)
par: Ferber, Dyke, et autres
Publié: (2024)
Large Language Models as End-to-end Combinatorial Optimization Solvers
par: Jiang, Xia, et autres
Publié: (2025)
par: Jiang, Xia, et autres
Publié: (2025)
MiCU: End-to-End Smart Home Command Understanding with Large Language Model
par: Han, Haowei, et autres
Publié: (2026)
par: Han, Haowei, et autres
Publié: (2026)
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
par: Mozaffari, Mohammad, et autres
Publié: (2026)
par: Mozaffari, Mohammad, et autres
Publié: (2026)
LightEMMA: Lightweight End-to-End Multimodal Model for Autonomous Driving
par: Qiao, Zhijie, et autres
Publié: (2025)
par: Qiao, Zhijie, et autres
Publié: (2025)
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
par: Jia, Yifan, et autres
Publié: (2025)
par: Jia, Yifan, et autres
Publié: (2025)
LMGenDrive: Bridging Multimodal Understanding and Generative World Modeling for End-to-End Driving
par: Shao, Hao, et autres
Publié: (2026)
par: Shao, Hao, et autres
Publié: (2026)
A Prompt-Based Knowledge Graph Foundation Model for Universal In-Context Reasoning
par: Cui, Yuanning, et autres
Publié: (2024)
par: Cui, Yuanning, et autres
Publié: (2024)
The End of Manual Decoding: Towards Truly End-to-End Language Models
par: Wang, Zhichao, et autres
Publié: (2025)
par: Wang, Zhichao, et autres
Publié: (2025)
AutoRD: An Automatic and End-to-End System for Rare Disease Knowledge Graph Construction Based on Ontologies-enhanced Large Language Models
par: Cao, Lang, et autres
Publié: (2024)
par: Cao, Lang, et autres
Publié: (2024)
SENTINEL: A Fully End-to-End Language-Action Model for Humanoid Whole Body Control
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
Language Model Inversion through End-to-End Differentiation
par: Denamganaï, Kevin Yandoka, et autres
Publié: (2026)
par: Denamganaï, Kevin Yandoka, et autres
Publié: (2026)
Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
par: Tang, Qiaoyu, et autres
Publié: (2024)
par: Tang, Qiaoyu, et autres
Publié: (2024)
Reinforced Reasoning for End-to-End Retrosynthetic Planning
par: Zuo, Chenyang, et autres
Publié: (2026)
par: Zuo, Chenyang, et autres
Publié: (2026)
End-to-End Neuro-Symbolic Reinforcement Learning with Textual Explanations
par: Luo, Lirui, et autres
Publié: (2024)
par: Luo, Lirui, et autres
Publié: (2024)
Leveraging Graph Structures and Large Language Models for End-to-End Synthetic Task-Oriented Dialogues
par: Medjad, Maya, et autres
Publié: (2025)
par: Medjad, Maya, et autres
Publié: (2025)
In-Context Autonomous Network Incident Response: An End-to-End Large Language Model Agent Approach
par: Gao, Yiran, et autres
Publié: (2026)
par: Gao, Yiran, et autres
Publié: (2026)
ProjDevBench: Benchmarking AI Coding Agents on End-to-End Project Development
par: Lu, Pengrui, et autres
Publié: (2026)
par: Lu, Pengrui, et autres
Publié: (2026)
MEMERAG: A Multilingual End-to-End Meta-Evaluation Benchmark for Retrieval Augmented Generation
par: Blandón, María Andrea Cruz, et autres
Publié: (2025)
par: Blandón, María Andrea Cruz, et autres
Publié: (2025)
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
par: Lai, Hanyu, et autres
Publié: (2025)
par: Lai, Hanyu, et autres
Publié: (2025)
First Ask Then Answer: A Framework Design for AI Dialogue Based on Supplementary Questioning with Large Language Models
par: Fu, Chuanruo, et autres
Publié: (2025)
par: Fu, Chuanruo, et autres
Publié: (2025)
Graphy'our Data: Towards End-to-End Modeling, Exploring and Generating Report from Raw Data
par: Lai, Longbin, et autres
Publié: (2025)
par: Lai, Longbin, et autres
Publié: (2025)
E2ETune: End-to-End Knob Tuning via Fine-tuned Generative Language Model
par: Huang, Xinmei, et autres
Publié: (2024)
par: Huang, Xinmei, et autres
Publié: (2024)
A Modular End-to-End Multimodal Learning Method for Structured and Unstructured Data
par: Alessandro, Marco D, et autres
Publié: (2024)
par: Alessandro, Marco D, et autres
Publié: (2024)
E2E-AFG: An End-to-End Model with Adaptive Filtering for Retrieval-Augmented Generation
par: Jiang, Yun, et autres
Publié: (2024)
par: Jiang, Yun, et autres
Publié: (2024)
GSQA: An End-to-End Model for Generative Spoken Question Answering
par: Shih, Min-Han, et autres
Publié: (2023)
par: Shih, Min-Han, et autres
Publié: (2023)
A Conflict-Aware Penalty and Statistical Loss Framework for Balancing Modalities and Enhancing Stability in Multimodal Sentiment Analysis
par: Dai, Jianheng, et autres
Publié: (2026)
par: Dai, Jianheng, et autres
Publié: (2026)
Let Relations Speak: An End-to-End LLM-GNN Soft Prompt Framework for Fraud Detection
par: Zuo, Zhixing, et autres
Publié: (2026)
par: Zuo, Zhixing, et autres
Publié: (2026)
Documents similaires
-
Towards Explainable Fusion and Balanced Learning in Multimodal Sentiment Analysis
par: Luo, Miaosen, et autres
Publié: (2025) -
End-to-end Semantic-centric Video-based Multimodal Affective Computing
par: Lin, Ronghao, et autres
Publié: (2024) -
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
par: Luo, Miaosen, et autres
Publié: (2026) -
MissMAC-Bench: Building Solid Benchmark for Missing Modality Issue in Robust Multimodal Affective Computing
par: Lin, Ronghao, et autres
Publié: (2026) -
SpatialText: A Pure-Text Cognitive Benchmark for Spatial Understanding in Large Language Models
par: Jiang, Peiyao, et autres
Publié: (2026)