FINE: Factorized multimodal sentiment analysis via mutual INformation Estimation
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Yadong, Wang, Shangfei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DIVA: Harnessing the Representation Divergence in Unified Multimodal Models for Mutual Reinforcement
por: Lu, Renjie, et al.
Publicado: (2026)
por: Lu, Renjie, et al.
Publicado: (2026)
A Novel FACS-Aligned Anatomical Text Description Paradigm for Fine-Grained Facial Behavior Synthesis
por: Wang, Jiahe, et al.
Publicado: (2026)
por: Wang, Jiahe, et al.
Publicado: (2026)
Text-controlled Motion Mamba: Text-Instructed Temporal Grounding of Human Motion
por: Wang, Xinghan, et al.
Publicado: (2024)
por: Wang, Xinghan, et al.
Publicado: (2024)
An Emotion Recognition Framework via Cross-modal Alignment of EEG and Eye Movement Data
por: Wang, Jianlu, et al.
Publicado: (2025)
por: Wang, Jianlu, et al.
Publicado: (2025)
A multimodal stress detection dataset with facial expressions and physiological signals
por: Hosseini, Majid, et al.
Publicado: (2022)
por: Hosseini, Majid, et al.
Publicado: (2022)
CAFE: Channel-Autoregressive Factorized Encoding for Robust Biosignal Spatial Super-Resolution
por: Liu, Hongjun, et al.
Publicado: (2026)
por: Liu, Hongjun, et al.
Publicado: (2026)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
por: Liu, Shuhang, et al.
Publicado: (2025)
por: Liu, Shuhang, et al.
Publicado: (2025)
MultiMediate'24: Multi-Domain Engagement Estimation
por: Müller, Philipp, et al.
Publicado: (2024)
por: Müller, Philipp, et al.
Publicado: (2024)
Enhancing multimodal cooperation via sample-level modality valuation
por: Wei, Yake, et al.
Publicado: (2023)
por: Wei, Yake, et al.
Publicado: (2023)
High-Fidelity 3D Gaussian Human Reconstruction via Region-Aware Initialization and Geometric Priors
por: Liu, Yang, et al.
Publicado: (2026)
por: Liu, Yang, et al.
Publicado: (2026)
Mitigating Multimodal Inconsistency via Cognitive Dual-Pathway Reasoning for Intent Recognition
por: Wang, Yifan, et al.
Publicado: (2026)
por: Wang, Yifan, et al.
Publicado: (2026)
Semantic Compensation via Adversarial Removal for Robust Zero-Shot ECG Diagnosis
por: Liu, Hongjun, et al.
Publicado: (2026)
por: Liu, Hongjun, et al.
Publicado: (2026)
Self-Training Boosted Multi-Factor Matching Network for Composed Image Retrieval
por: Wen, Haokun, et al.
Publicado: (2023)
por: Wen, Haokun, et al.
Publicado: (2023)
FakeSV-VLM: Taming VLM for Detecting Fake Short-Video News via Progressive Mixture-Of-Experts Adapter
por: Wang, Junxi, et al.
Publicado: (2025)
por: Wang, Junxi, et al.
Publicado: (2025)
AcoustEmo: Open-Vocabulary Emotion Reasoning via Utterance-Aware Acoustic Q-Former
por: Zhang, Liyun, et al.
Publicado: (2026)
por: Zhang, Liyun, et al.
Publicado: (2026)
Leveraging multimodal explanatory annotations for video interpretation with Modality Specific Dataset
por: Ancarani, Elisa, et al.
Publicado: (2025)
por: Ancarani, Elisa, et al.
Publicado: (2025)
Generating Attribute-Aware Human Motions from Textual Prompt
por: Wang, Xinghan, et al.
Publicado: (2025)
por: Wang, Xinghan, et al.
Publicado: (2025)
ConCLVD: Controllable Chinese Landscape Video Generation via Diffusion Model
por: Liu, Dingming, et al.
Publicado: (2024)
por: Liu, Dingming, et al.
Publicado: (2024)
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2026)
por: Zhou, Qianrui, et al.
Publicado: (2026)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
por: Li, Mingxin, et al.
Publicado: (2025)
por: Li, Mingxin, et al.
Publicado: (2025)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
por: Dai, Weichen, et al.
Publicado: (2024)
por: Dai, Weichen, et al.
Publicado: (2024)
Music2Palette: Emotion-aligned Color Palette Generation via Cross-Modal Representation Learning
por: Hu, Jiayun, et al.
Publicado: (2025)
por: Hu, Jiayun, et al.
Publicado: (2025)
Unsupervised Ego- and Exo-centric Dense Procedural Activity Captioning via Gaze Consensus Adaptation
por: Shi, Zhaofeng, et al.
Publicado: (2025)
por: Shi, Zhaofeng, et al.
Publicado: (2025)
3DMambaIPF: A State Space Model for Iterative Point Cloud Filtering via Differentiable Rendering
por: Zhou, Qingyuan, et al.
Publicado: (2024)
por: Zhou, Qingyuan, et al.
Publicado: (2024)
Similarity over Factuality: Are we making progress on multimodal out-of-context misinformation detection?
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2024)
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2024)
VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement Learning
por: Chen, Siran, et al.
Publicado: (2025)
por: Chen, Siran, et al.
Publicado: (2025)
AVID: A Benchmark for Omni-Modal Audio-Visual Inconsistency Understanding via Agent-Driven Construction
por: Chen, Zixuan, et al.
Publicado: (2026)
por: Chen, Zixuan, et al.
Publicado: (2026)
PopSim: Social Network Simulation for Social Media Popularity Prediction
por: Liu, Yijun, et al.
Publicado: (2025)
por: Liu, Yijun, et al.
Publicado: (2025)
Towards Alleviating Text-to-Image Retrieval Hallucination for CLIP in Zero-shot Learning
por: Wang, Hanyao, et al.
Publicado: (2024)
por: Wang, Hanyao, et al.
Publicado: (2024)
Voxel-GS: Quantized Scaffold Gaussian Splatting Compression with Run-Length Coding
por: Fu, Chunyang, et al.
Publicado: (2025)
por: Fu, Chunyang, et al.
Publicado: (2025)
HeadsetOff: Enabling Photorealistic Video Conferencing on Economical VR Headsets
por: Jin, Yili, et al.
Publicado: (2024)
por: Jin, Yili, et al.
Publicado: (2024)
Muse: A Multimodal Conversational Recommendation Dataset with Scenario-Grounded User Profiles
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
Index-MSR: A high-efficiency multimodal fusion framework for speech recognition
por: Chen, Jinming, et al.
Publicado: (2025)
por: Chen, Jinming, et al.
Publicado: (2025)
StreamOptix: A Cross-layer Adaptive Video Delivery Scheme
por: Liu, Mufan, et al.
Publicado: (2024)
por: Liu, Mufan, et al.
Publicado: (2024)
TAGF: Time-aware Gated Fusion for Multimodal Valence-Arousal Estimation
por: Lee, Yubeen, et al.
Publicado: (2025)
por: Lee, Yubeen, et al.
Publicado: (2025)
GestureHYDRA: Semantic Co-speech Gesture Synthesis via Hybrid Modality Diffusion Transformer and Cascaded-Synchronized Retrieval-Augmented Generation
por: Yang, Quanwei, et al.
Publicado: (2025)
por: Yang, Quanwei, et al.
Publicado: (2025)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
Identity-Driven Multimedia Forgery Detection via Reference Assistance
por: Xu, Junhao, et al.
Publicado: (2024)
por: Xu, Junhao, et al.
Publicado: (2024)
Block Erasure-Aware Semantic Multimedia Compression via JSCC Autoencoder
por: Esfahanizadeh, Homa, et al.
Publicado: (2026)
por: Esfahanizadeh, Homa, et al.
Publicado: (2026)
Multimodal Fusion via Hypergraph Autoencoder and Contrastive Learning for Emotion Recognition in Conversation
por: Yi, Zijian, et al.
Publicado: (2024)
por: Yi, Zijian, et al.
Publicado: (2024)
Ejemplares similares
-
DIVA: Harnessing the Representation Divergence in Unified Multimodal Models for Mutual Reinforcement
por: Lu, Renjie, et al.
Publicado: (2026) -
A Novel FACS-Aligned Anatomical Text Description Paradigm for Fine-Grained Facial Behavior Synthesis
por: Wang, Jiahe, et al.
Publicado: (2026) -
Text-controlled Motion Mamba: Text-Instructed Temporal Grounding of Human Motion
por: Wang, Xinghan, et al.
Publicado: (2024) -
An Emotion Recognition Framework via Cross-modal Alignment of EEG and Eye Movement Data
por: Wang, Jianlu, et al.
Publicado: (2025) -
A multimodal stress detection dataset with facial expressions and physiological signals
por: Hosseini, Majid, et al.
Publicado: (2022)