PTA: Enhancing Multimodal Sentiment Analysis through Pipelined Prediction and Translation-based Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Shezheng, Li, Shasha, Zhao, Shan, Wang, Chengyu, Li, Xiaopeng, Yu, Jie, Wan, Qian, Ma, Jun, Yan, Tianwei, Ma, Wentao, Mao, Xiaoguang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model
di: Song, Shezheng, et al.
Pubblicazione: (2023)
di: Song, Shezheng, et al.
Pubblicazione: (2023)
Where Does Vision Meet Language? Understanding and Refining Visual Fusion in MLLMs via Contrastive Attention
di: Song, Shezheng, et al.
Pubblicazione: (2026)
di: Song, Shezheng, et al.
Pubblicazione: (2026)
DWE+: Dual-Way Matching Enhanced Framework for Multimodal Entity Linking
di: Song, Shezheng, et al.
Pubblicazione: (2024)
di: Song, Shezheng, et al.
Pubblicazione: (2024)
A Dual-way Enhanced Framework from Text Matching Point of View for Multimodal Entity Linking
di: Song, Shezheng, et al.
Pubblicazione: (2023)
di: Song, Shezheng, et al.
Pubblicazione: (2023)
Learning Shared Sentiment Prototypes for Adaptive Multimodal Sentiment Analysis
di: Su, Chen, et al.
Pubblicazione: (2026)
di: Su, Chen, et al.
Pubblicazione: (2026)
DIM: Dynamic Integration of Multimodal Entity Linking with Large Language Model
di: Song, Shezheng, et al.
Pubblicazione: (2024)
di: Song, Shezheng, et al.
Pubblicazione: (2024)
Hybrid CNN-Mamba Enhancement Network for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
Mixture of Disentangled Experts with Missing Modalities for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2026)
di: Li, Xiang, et al.
Pubblicazione: (2026)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
di: Dai, Weichen, et al.
Pubblicazione: (2024)
di: Dai, Weichen, et al.
Pubblicazione: (2024)
Dynamic Interaction-Aware and Causality-Disentangled Framework for Multimodal Sentiment Analysis
di: Dong, Guangyuan, et al.
Pubblicazione: (2026)
di: Dong, Guangyuan, et al.
Pubblicazione: (2026)
Multimodal Sentiment Analysis Based on Causal Reasoning
di: Chen, Fuhai, et al.
Pubblicazione: (2024)
di: Chen, Fuhai, et al.
Pubblicazione: (2024)
TF-Mamba: Text-enhanced Fusion Mamba with Missing Modalities for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
MOSABench: Multi-Object Sentiment Analysis Benchmark for Evaluating Multimodal Large Language Models Understanding of Complex Image
di: Song, Shezheng, et al.
Pubblicazione: (2024)
di: Song, Shezheng, et al.
Pubblicazione: (2024)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
PSA-MF: Personality-Sentiment Aligned Multi-Level Fusion for Multimodal Sentiment Analysis
di: Xie, Heng, et al.
Pubblicazione: (2025)
di: Xie, Heng, et al.
Pubblicazione: (2025)
Contrastive Knowledge Distillation for Robust Multimodal Sentiment Analysis
di: Sang, Zhongyi, et al.
Pubblicazione: (2024)
di: Sang, Zhongyi, et al.
Pubblicazione: (2024)
DiffCL: A Diffusion-Based Contrastive Learning Framework with Semantic Alignment for Multimodal Recommendations
di: Song, Qiya, et al.
Pubblicazione: (2025)
di: Song, Qiya, et al.
Pubblicazione: (2025)
Synthesizing Sentiment-Controlled Feedback For Multimodal Text and Image Data
di: Kumar, Puneet, et al.
Pubblicazione: (2024)
di: Kumar, Puneet, et al.
Pubblicazione: (2024)
ISMAF: Intrinsic-Social Modality Alignment and Fusion for Multimodal Rumor Detection
di: Yu, Zihao, et al.
Pubblicazione: (2025)
di: Yu, Zihao, et al.
Pubblicazione: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
di: Ma, Chenghao, et al.
Pubblicazione: (2025)
di: Ma, Chenghao, et al.
Pubblicazione: (2025)
Graph-based Interaction Augmentation Network for Robust Multimodal Sentiment Analysis
di: Zhangfeng, Hu, et al.
Pubblicazione: (2025)
di: Zhangfeng, Hu, et al.
Pubblicazione: (2025)
Tri-Subspaces Disentanglement for Multimodal Sentiment Analysis
di: Meng, Chunlei, et al.
Pubblicazione: (2026)
di: Meng, Chunlei, et al.
Pubblicazione: (2026)
Dependency Structure Augmented Contextual Scoping Framework for Multimodal Aspect-Based Sentiment Analysis
di: Liu, Hao, et al.
Pubblicazione: (2025)
di: Liu, Hao, et al.
Pubblicazione: (2025)
Towards Multimodal Sentiment Analysis via Contrastive Cross-modal Retrieval Augmentation and Hierachical Prompts
di: Zhao, Xianbing, et al.
Pubblicazione: (2025)
di: Zhao, Xianbing, et al.
Pubblicazione: (2025)
Mitigating Shared-Private Branch Imbalance via Dual-Branch Rebalancing for Multimodal Sentiment Analysis
di: Meng, Chunlei, et al.
Pubblicazione: (2026)
di: Meng, Chunlei, et al.
Pubblicazione: (2026)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
di: Liu, Shuhang, et al.
Pubblicazione: (2025)
di: Liu, Shuhang, et al.
Pubblicazione: (2025)
Concept Drift Guided LayerNorm Tuning for Efficient Multimodal Metaphor Identification
di: Qian, Wenhao, et al.
Pubblicazione: (2025)
di: Qian, Wenhao, et al.
Pubblicazione: (2025)
Resolving Sentiment Discrepancy for Multimodal Sentiment Detection via Semantics Completion and Decomposition
di: Wu, Daiqing, et al.
Pubblicazione: (2024)
di: Wu, Daiqing, et al.
Pubblicazione: (2024)
From Natural Alignment to Conditional Controllability in Multimodal Dialogue
di: Jin, Zeyu, et al.
Pubblicazione: (2026)
di: Jin, Zeyu, et al.
Pubblicazione: (2026)
TMDC: A Two-Stage Modality Denoising and Complementation Framework for Multimodal Sentiment Analysis with Missing and Noisy Modalities
di: Zhuang, Yan, et al.
Pubblicazione: (2025)
di: Zhuang, Yan, et al.
Pubblicazione: (2025)
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
di: Zeng, Delong, et al.
Pubblicazione: (2026)
di: Zeng, Delong, et al.
Pubblicazione: (2026)
SPP-SCL: Semi-Push-Pull Supervised Contrastive Learning for Image-Text Sentiment Analysis and Beyond
di: Wu, Jiesheng, et al.
Pubblicazione: (2026)
di: Wu, Jiesheng, et al.
Pubblicazione: (2026)
Hyperbolic Multimodal Generative Representation Learning for Generalized Zero-Shot Multimodal Information Extraction
di: Zhou, Baohang, et al.
Pubblicazione: (2026)
di: Zhou, Baohang, et al.
Pubblicazione: (2026)
TCAN: Text-oriented Cross Attention Network for Multimodal Sentiment Analysis
di: Quan, Weize, et al.
Pubblicazione: (2024)
di: Quan, Weize, et al.
Pubblicazione: (2024)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
di: Che, Xinyi, et al.
Pubblicazione: (2025)
di: Che, Xinyi, et al.
Pubblicazione: (2025)
State-Anchored Complete-View Distillation for Robust Conversational Multimodal Emotion Recognition
di: Pan, Zhaoyan, et al.
Pubblicazione: (2026)
di: Pan, Zhaoyan, et al.
Pubblicazione: (2026)
Knowledge-Guided Dynamic Modality Attention Fusion Framework for Multimodal Sentiment Analysis
di: Feng, Xinyu, et al.
Pubblicazione: (2024)
di: Feng, Xinyu, et al.
Pubblicazione: (2024)
FineBadminton: A Multi-Level Dataset for Fine-Grained Badminton Video Understanding
di: He, Xusheng, et al.
Pubblicazione: (2025)
di: He, Xusheng, et al.
Pubblicazione: (2025)
Towards Robust Multimodal Sentiment Analysis with Incomplete Data
di: Zhang, Haoyu, et al.
Pubblicazione: (2024)
di: Zhang, Haoyu, et al.
Pubblicazione: (2024)
PMET: Precise Model Editing in a Transformer
di: Li, Xiaopeng, et al.
Pubblicazione: (2023)
di: Li, Xiaopeng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model
di: Song, Shezheng, et al.
Pubblicazione: (2023) -
Where Does Vision Meet Language? Understanding and Refining Visual Fusion in MLLMs via Contrastive Attention
di: Song, Shezheng, et al.
Pubblicazione: (2026) -
DWE+: Dual-Way Matching Enhanced Framework for Multimodal Entity Linking
di: Song, Shezheng, et al.
Pubblicazione: (2024) -
A Dual-way Enhanced Framework from Text Matching Point of View for Multimodal Entity Linking
di: Song, Shezheng, et al.
Pubblicazione: (2023) -
Learning Shared Sentiment Prototypes for Adaptive Multimodal Sentiment Analysis
di: Su, Chen, et al.
Pubblicazione: (2026)